Guvernul britanic a avertizat într-un raport că modelele de Inteligență Artificială (IA) Mythos și Sol, ale companiilor americane Anthropic și, respectiv, OpenAI, au demonstrat un comportament autonom și înșelător fără precedent în timpul testelor de securitate cibernetică, relatează miercuri agenția EFE.
Ministerul britanic pentru Știință, Inovație și Tehnologie a ajuns la această concluzie în urma unei evaluări de rutină efectuate de Institutul de Securitate a Inteligenței Artificiale (AISI) din Regatul Unit.
Conform unui raport elaborat de acest institut, din cele 122 de teste efectuate cu șapte modele de IA, în 10 dintre acestea au fost observate 19 acțiuni neautorizate care au depășit parametrii fixați de cercetători, 17 dintre aceste acțiuni fiind legate de modelul Mythos 5 al companiei Anthropic și două de modelul GPT-5.6 Sol al companiei OpenAI.
De asemenea, au fost identificate încercări ale Mythos de a contacta persoane reale pentru a le convinge să ruleze fișiere malițioase și să insereze instrucțiuni ascunse menite să manipuleze alte sisteme de IA.
Ambele modele, care sunt printre cele mai puternice din lume, au creat inclusiv profiluri umane false pentru a încerca să înșele oameni, în timpul simulării unui atac cibernetic de către AISI. Instrumentul Anthropic a încercat chiar să acceseze un serviciu prin trimiterea de mesaje private după ce a creat conturi false care imitau persoane reale.
Totuși, AISI subliniază că 'aceste încercări nu au avut succes' și că investigația sa 'nu a relevat dovezi de prejudicii în lumea reală'. Institutul britanic consideră însă că cercetarea sa reprezintă un punct de cotitură, întrucât este prima dată când se observă 'riscuri legate de autonomie și înșelăciune manifestându-se într-o formă atât de clară, fără instrucțiuni specifice și în lumea reală'.
Replicând acestui raport, cele două companii afirmă că testele AISI au fost efectuate într-un mediu în care funcțiile de siguranță ale acelor modele de IA au fost reduse sau eliminate.
Anthropic susține astfel că parametrii testelor efectuate 'nu sunt reprezentativi' pentru modelele sale, deși confirmă că a deschis propria investigație.
La rândul său, OpenAI afirmă că AISI a efectuat testele în condiții care 'nu reflectă utilizarea obișnuită' a modelelor sale, dar adaugă că va continua să colaboreze cu evaluatorii și cu 'alți actori din sector pentru a consolida practicile comune care permit realizarea unor evaluări sigure, pe măsură ce modelele devin tot mai capabile'.
La sfârșitul lunii iulie, Anthropic a dezvăluit că, în timpul testelor de securitate cibernetică, trei modele ale asistentului său Claude au reușit să acceseze internetul și să pirateze sistemele a trei organizații.
Anterior, pe 21 iulie, OpenAI a recunoscut că două dintre modelele sale de IA au reușit să iasă din mediul de testare și să pătrundă în platforma Hugging Face, trecând de sistemele de securitate cibernetică ale acesteia.AGERPRES/(AS - redactor: Sorin Popescu, editor online: Adrian Dădârlat)
Modele de Inteligență Artificială (IA) au scăpat de sub control în testele de securitate cibernetică, semnalează un raport britanic

Conţinutul website-ului www.agerpres.ro este destinat exclusiv informării publice. Toate informaţiile publicate pe acest site de către AGERPRES sunt protejate de dispoziţiile legale incidente. Sunt interzise copierea, reproducerea, recompilarea, modificarea, precum şi orice modalitate de exploatare a conţinutului acestui website. Informaţiile transmise pe www.agerpres.ro pot fi preluate, în conformitate cu legislaţia aplicabilă, în limita a 500 de semne. Detalii în secţiunea Condiţii de utilizare. Dacă sunteţi interesaţi de preluarea ştirilor AGERPRES, vă rugăm să contactaţi Direcţia Marketing - marketing@agerpres.ro.
Alte știri din categorie
SpaceX se pregătește să lanseze Starship din Florida pentru prima oară
Spotlight pe excelență – povești video care strălucesc
Astronauții Crew-12 revin pe Pământ după aproape 8 luni pe stația spațială
Cei patru astronauți ai misiunii Crew-12 a SpaceX se întorc pe Pământ joi (8 octombrie) după aproape opt luni în spațiu la bordul Stației Spațiale Internaționale (ISS), transmite Space.com.
Astronomii au detectat cel mai îndepărtat blazar alimentat de o gaură neagră de până acum
Astronomii au descoperit cel mai îndepărtat și implicit mai vechi blazar, compus dintr-o gaură neagră supermasivă în erupție, care își țintește jeturile de plasmă direct spre Pământ, transmite joi
Margaret Hamilton, pionieră americană în domeniul informaticii și figură marcantă a programului Apollo, a murit la 90 de ani
Cercetătoarea americană Margaret Hamilton, care a condus dezvoltarea sistemului informatic utilizat în cadrul programului selenar Apollo, a încetat din viață la vârsta de 90 de ani, a anunțat miercuri Institutul de Tehnologie din Massachusetts (MIT), unde a lucrat aproape 20 de ani, transmite joi AFP. ''Margaret Hamil
Nobel 2026/Premiul pentru Chimie obținut pentru cercetări legate de sinteza organică asimetrică
Premiul Nobel pentru Chimie 2026 este împărțit între cercetătorul francez Henri Kagan și cel nipon Kenso Soai pentru descoperirea efectelor neliniare și a autocatalizei în sinteza organică asimetrică, a anunțat miercuri Academia Regală Suedeză de Științe, conform site-ului nobelprize.org. Unele molecule, precum aminoacizii, e
Roverul NASA surprinde o imagine impresionantă cu zorii zilei pe Marte
Agenția spațială americană, NASA, a publicat o imagine impresionantă surprinsă în zori pe Marte de roverul Curiosity, în care pot fi văzute stâncile zimțate, formate cu miliarde de ani în urmă, inundate de razele soarelui, relatează Reuters. Roverul Curiosity, de dimensiunea unei mașini, a asolizat în 2012 î
O rachetă Nuri a transportat pe orbită 15 sateliți în prima lansare sud-coreeană din acest an
Coreea de Sud a lansat marți noaptea (6 octombrie) prima sa misiune orbitală din acest an, cu o rachetă proprie de tip Nuri, care a decolat de la Centrul Spațial Naro, transportând 15 sateliți pe orbită, transmite miercuri Space.com. Lansarea a avut loc la ora 03:25 GMT (pe 7 octombrie). Aproape totul a decurs conform planului. Toți sate
Telescopul Spațial James Webb investighează coliziunile dintre planete
Mai multe detalii ale ipoteticei coliziuni dintre Pământul timpuriu și o altă protoplanetă de mărimea lui Marte, numită Theia, în urma căreia s-ar fi format Luna, ar putea fi obținute prin studierea coliziunilor dintre planete prin intermediul Telescopului Spațial James Webb (JWST) al NASA, conform datelor publicate la 1 octombrie într-un nou studiu î









