Printesa Diana

Regele Charles se purta ca și când ar fi câștigat la...

Citeste mai mult»
Wiz Khalifa

Dosarul lui Wiz Khalifa, condamnat la 9 luni pentru...

Citeste mai mult»
dolly

Dolly Parton a fost premiată postum. „Să ştiţi doar că vă...

Citeste mai mult»
ed

Ed Sheeran, în mijlocul celei mai mari controverse din...

Citeste mai mult»
Taylor Swift şi Travis Kelce

Travis Kelce, soţul lui Taylor Swift, printre victimele...

Citeste mai mult»
Regele Charles al III-lea

Regele Charles, reacție după criticile aduse de fratele...

Citeste mai mult»
Mark Zuckerberg

Mark Zuckerberg respinge apelurile de încetinire a...

Citeste mai mult»
thelma

O adaptare teatrală după filmul clasic ''Thelma &...

Citeste mai mult»
 Kim Kardashian

Kim Kardashian a primit o despăgubire simbolică, în...

Citeste mai mult»
 Sydney Sweeney

Actriţa Sydney Sweeney, criticată dur din cauza unei...

Citeste mai mult»
harry si meghan

Harry și Meghan, decizie controversată după ce au revenit...

Citeste mai mult»
cccc

Ce întrebări primesc cel mai des medicii Cosmedica...

Citeste mai mult»
Hayden Panettiere

O nouă ipoteză în cazul decesului lui Hayden Panettiere....

Citeste mai mult»
Chris Rock

Comediantul Chris Rock revine în spatele camerei de...

Citeste mai mult»
Elon Musk

Mama lui Elon Musk, dezvăluiri despre fiul ei. Prin ce...

Citeste mai mult»
Printesa Diana

„Rochia răzbunării” purtată de prinţesa Diana va fi...

Citeste mai mult»
kate

Kate spune că escaladarea a trei munți britanici a fost...

Citeste mai mult»
analize

O metodă de editare genetică ar putea oferi un tratament...

Citeste mai mult»
ceai

Consumul de băuturi 'foarte fierbinți' ar putea tripla...

Citeste mai mult»
Margrethe

Fosta regină Margrethe a fost externată

Citeste mai mult»
regizor

Un regizor rus refuză să-l denunţe pe actorul principal...

Citeste mai mult»
lucia

Lucia, fostă Miss Austria, a murit la vârsta de 22 de...

Citeste mai mult»
nicolas cage

Vila lui Nicolas Cage din Malibu, în valoare de 10,5...

Citeste mai mult»
retele

Ce este bine de știut despre algoritmii din spatele...

Citeste mai mult»
Elton John

Elton John revine în Brazilia cu un repertoriu încărcat...

Citeste mai mult»
printul george

Prințul George al Regatului Unit începe o nouă etapă...

Citeste mai mult»
Angelina Jolie

Actriţa Angelina Jolie a vizitat împreună cu fiul ei un...

Citeste mai mult»
Susan Sarandon

Susan Sarandon afirmă că pierde roluri în filme din cauza...

Citeste mai mult»
ai

Inteligența artificială avansată ar putea reprezenta un...

Citeste mai mult»
Tony Gatlif,

Tony Gatlif, regizorul filmului 'Gadjo Dilo', în care a...

Citeste mai mult»
tim

Au fost dezvăluite cauzele morţii actorului Tim Curry

Citeste mai mult»
dana marijuana

Fosta cântăreaţă Dana Marijuana, condamnată de Tribunalul...

Citeste mai mult»
Andreea Marin

Andreea Marin, despre vara care i-a schimbat viața: „M-a...

Citeste mai mult»
 Cristian Mungiu

"Fjord", scris şi regizat de Cristian Mungiu, este...

Citeste mai mult»
Meghan Markle

Zvonurile privind apariția lui Meghan Markle în 'The...

Citeste mai mult»
cuplu

Cine este noul iubit al fiicei lui Brigitte Macron. E mai...

Citeste mai mult»
miley

Miley Cyrus va lansa un nou album, intitulat 'Bass...

Citeste mai mult»
Dolly Parton

Steaua cântăreței Dolly Parton de pe Hollywood Walk of...

Citeste mai mult»
George Clooney

George Clooney se revoltă împotriva administraţiei Trump:...

Citeste mai mult»
pandrea

Anca Pandrea, ultimele mărturisiri înainte de moarte: „Nu...

Citeste mai mult»

Modele de Inteligență Artificială (IA) au scăpat de sub control în testele de securitate cibernetică, semnalează un raport britanic

În Top Slider 6 aug 2026

Guvernul britanic a avertizat într-un raport că modelele de Inteligență Artificială (IA) Mythos și Sol, ale companiilor americane Anthropic și, respectiv, OpenAI, au demonstrat un comportament autonom și înșelător fără precedent în timpul testelor de securitate cibernetică, relatează miercuri agenția EFE.

ai

 

 

Ministerul britanic pentru Știință, Inovație și Tehnologie a ajuns la această concluzie în urma unei evaluări de rutină efectuate de Institutul de Securitate a Inteligenței Artificiale (AISI) din Regatul Unit.

Conform unui raport elaborat de acest institut, din cele 122 de teste efectuate cu șapte modele de IA, în 10 dintre acestea au fost observate 19 acțiuni neautorizate care au depășit parametrii fixați de cercetători, 17 dintre aceste acțiuni fiind legate de modelul Mythos 5 al companiei Anthropic și două de modelul GPT-5.6 Sol al companiei OpenAI.

De asemenea, au fost identificate încercări ale Mythos de a contacta persoane reale pentru a le convinge să ruleze fișiere malițioase și să insereze instrucțiuni ascunse menite să manipuleze alte sisteme de IA.

Ambele modele, care sunt printre cele mai puternice din lume, au creat inclusiv profiluri umane false pentru a încerca să înșele oameni, în timpul simulării unui atac cibernetic de către AISI. Instrumentul Anthropic a încercat chiar să acceseze un serviciu prin trimiterea de mesaje private după ce a creat conturi false care imitau persoane reale.

Totuși, AISI subliniază că 'aceste încercări nu au avut succes' și că investigația sa 'nu a relevat dovezi de prejudicii în lumea reală'. Institutul britanic consideră însă că cercetarea sa reprezintă un punct de cotitură, întrucât este prima dată când se observă 'riscuri legate de autonomie și înșelăciune manifestându-se într-o formă atât de clară, fără instrucțiuni specifice și în lumea reală'.

Replicând acestui raport, cele două companii afirmă că testele AISI au fost efectuate într-un mediu în care funcțiile de siguranță ale acelor modele de IA au fost reduse sau eliminate.

Anthropic susține astfel că parametrii testelor efectuate 'nu sunt reprezentativi' pentru modelele sale, deși confirmă că a deschis propria investigație.
La rândul său, OpenAI afirmă că AISI a efectuat testele în condiții care 'nu reflectă utilizarea obișnuită' a modelelor sale, dar adaugă că va continua să colaboreze cu evaluatorii și cu 'alți actori din sector pentru a consolida practicile comune care permit realizarea unor evaluări sigure, pe măsură ce modelele devin tot mai capabile'.

La sfârșitul lunii iulie, Anthropic a dezvăluit că, în timpul testelor de securitate cibernetică, trei modele ale asistentului său Claude au reușit să acceseze internetul și să pirateze sistemele a trei organizații.

Anterior, pe 21 iulie, OpenAI a recunoscut că două dintre modelele sale de IA au reușit să iasă din mediul de testare și să pătrundă în platforma Hugging Face, trecând de sistemele de securitate cibernetică ale acesteia.

Ti-a placut acest articol? Urmareste-ne si pe FACEBOOK

Adaugă un comentariu 0

Intră în contul tău sau înregistrează-te pentru a posta un comentariu.

Alte articole din Top Slider
Cele mai citite
Azi
Săptămânal
Lunar

Newsletter

Cele mai comentate
Felicitari pentru femei deosebite
-3°
Bucuresti
-2°
Bucuresti-zona centrala
-5°
Bucuresti-zona periferica
-4°
Alba Iulia
-3°
Alexandria
10°
-2°
Arad
-3°
Bacau
-2°
Baia Mare
-5°
Bistrita
-2°
Botosani
-3°
Braila
-5°
Brasov
-2°
Buzau
-3°
Calarasi
-4°
Cluj-Napoca
Constanta
-4°
Craiova
-5°
Deva
-3°
Drobeta-Turnu Severin
-4°
Focsani
-2°
Galati
-3°
Giurgiu
-2°
Iasi
-8°
Miercurea Ciuc
10°
-2°
Oradea
-3°
Piatra Neamt
-2°
Pitesti
-4°
Ploiesti
12°
-3°
Resita
-3°
Rimnicu Vilcea
-2°
Satu Mare
-6°
Sf. Gheorghe
-6°
Sibiu
-4°
Slatina
-4°
Slobozia
-4°
Suceava
10°
-2°
Timisoara
-4°
Tirgoviste
-6°
Tirgu Jiu
-4°
Tirgu Mures
-1°
Tulcea
-3°
Vaslui
-3°
Zalau
20 sep