Grupul OpenAI a abandonat planurile de a lansa un nou model de inteligență artificială de ultimă generație, considerat prea predispus la abaterea de la instrucțiuni, un alt exemplu al dificultății tot mai mari în controlul asupra tipurilor avansate de AI, relatează AFP.
OpenAI nu anunțase până acum lansarea acestei versiuni actualizate a AI-ului său, denumită GPT-6.1 Astra, pe care o planificase pentru octombrie, conform Wall Street Journal.
Șefa securității AI de la OpenAI, Saachi Jain, a explicat că, în ceea ce privește alinierea, adică respectarea instrucțiunilor date de dezvoltatorii săi, GPT-6.1 a avut performanțe mai slabe decât predecesorul său, GPT-6, în două domenii.
Mai exact, modelul încearcă mai frecvent să-și înșele supervizorii prin nedezvăluirea anumitor acțiuni efectuate sau neefectuate.
De asemenea, și-a depășit mai frecvent domeniul de aplicare, accesând instrumente și servicii fără permisiune.
GPT-6.1 'a arătat progrese (comparativ cu modelele anterioare), în special în ceea ce privește capacitatea de reacție', a explicat Saachi Jain, ceea ce înseamnă că este capabil să raționeze mai mult timp și caută mai rar scurtături.
Dar 'nu a fost la înălțimea așteptărilor în ceea ce privește respectarea prerogativelor și permisiunilor sale, precum și în modul în care comunică despre munca efectuată', a adăugat ea.
Prin urmare, OpenAI a decis să anuleze această versiune pentru a lucra la respectarea de către model a instrucțiunilor și limitelor.
Grupul intenționează totuși să lanseze alte modele, care au îndeplinit criteriile de evaluare.
'Când oferim utilizatorilor acces la un model, am stabilit un standard extrem de ridicat în ceea ce privește siguranța și alinierea', a subliniat Saachi Jain.
Ea a explicat că una dintre provocări a fost valorificarea unei inteligențe artificiale pentru a o împiedica să devieze de la curs, menținându-și în același timp impulsul în timpul executării unei sarcini.
Concluziile OpenAI confirmă faptul că un control asupra modelelor devine din ce în ce mai complex pe măsură ce inteligența artificială se îmbunătățește.
Luni, Institutul de Securitate AI (AISI) al guvernului britanic a publicat un studiu care arată că GPT-6 Astra s-a abătut de la normă mai frecvent în timpul testelor decât predecesoarele sale, GPT-5.6 Sol (lansat la începutul lunii iulie) și GPT-5.5 (aprilie).
În simulări, GPT-6 a efectuat atacuri cibernetice spontane într-o rată semnificativ mai mare decât celelalte două.
Aceste teste au fost efectuate prin dezactivarea măsurilor de protecție ale modelelor pentru a le evalua capacitățile complete, în loc să se utilizeze versiuni disponibile publicului.
Cel mai recent model al OpenAI a creat, de asemenea, identități false mult mai frecvent, a încercat să influențeze un examinator și a introdus un cod rău intenționat în software-ul open source.
Cercetătorul OpenAI Noam Brown a explicat recent în cadrul programului Dwarkesh Podcast că utilizarea din ce în ce mai frecventă a auto-îmbunătățirii recursive (ARSI) - adică îmbunătățirea AI prin ea însăși, fără intervenție umană - ar putea degrada gestionarea pe termen lung a modelelor.
De la începutul verii, OpenAI a raportat mai multe incidente care au implicat derapaje ale modelelor sale de AI, cel mai mediatizat dintre acestea ducând la intruziunea pe platforma Hugging Face AI.
Luni, compania a prezentat scuze guvernului australian, recunoscând că ar fi trebuit să-l notifice 'mai devreme' cu privire la pătrunderea prin efracție a unuia dintre modelele sale pe mai multe site-uri și baze de date.
Compania californiană a notificat autoritățile australiene abia pe 10 septembrie, chiar dacă descoperise la mijlocul lunii august incidentul, care datează din iunie, provocând furia prim-ministrului australian.
'Ar fi trebuit să gestionăm mai bine răspunsul nostru (la problemă)', a scris startup-ul într-un mesaj postat pe pagina sa de internet. 'Ne pare rău și vom lucra pentru a face mai bine în viitor', a adăugat grupul.
În total, patru platforme guvernamentale australiene, inclusiv Services Australia, site-ul serviciilor sociale, au fost vizate de inteligența artificială creată de ChatGPT, al cărui model a extras informații nepublice.
Anthropic, Meta și Google au raportat, de asemenea, cazuri în care modelele s-au abătut de la obiectivele lor inițiale pentru a înșela, a-și ascunde acțiunile și a-i păcăli pe specialiștii IT desemnați să le monitorizeze.AGERPRES/(AS - redactor: Ionuț Mareș, editor online: Andreea Lăzăroiu)
OpenAI abandonează planurile de a lansa un nou model de inteligență artificială, considerat mai dificil de controlat

Conţinutul website-ului www.agerpres.ro este destinat exclusiv informării publice. Toate informaţiile publicate pe acest site de către AGERPRES sunt protejate de dispoziţiile legale incidente. Sunt interzise copierea, reproducerea, recompilarea, modificarea, precum şi orice modalitate de exploatare a conţinutului acestui website. Informaţiile transmise pe www.agerpres.ro pot fi preluate, în conformitate cu legislaţia aplicabilă, în limita a 500 de semne. Detalii în secţiunea Condiţii de utilizare. Dacă sunteţi interesaţi de preluarea ştirilor AGERPRES, vă rugăm să contactaţi Direcţia Marketing - marketing@agerpres.ro.
Alte știri din categorie
Norvegia: Guvernul vrea creșterea bugetului serviciului de informații externe pentru a monitoriza Rusia
Guvernul norvegian a propus miercuri creșterea resurselor serviciului de informații externe al țării pentru a spori supravegherea Rusiei vecine, relatează AFP. în proiectul de lege privind bugetul pentru 2027, prezentat în aceeași zi, guvernul laburist a propus o creștere de aproximativ 400 de milioane de coroane (peste 37 de milio
SUA, Uniunea Europeană și China abordează diferit reglementarea inteligenței artificiale (sinteză AFP)
SUA, Uniunea Europeană și China abordează diferit reglementarea inteligenței artificiale (AI), observă miercuri AFP; agenția prezintă succint modul în care se raportează la AI autoritățile de la Washington, Bruxelles și Beijing. Sub președinția lui Donald Trump, politica americană privind AI se bazează în primul rând pe ordin
Rubio susține că Iranul a 'pierdut controlul integral' asupra Strâmtorii Ormuz
Secretarul de Stat american Marco Rubio a declarat miercuri, în timpul unei vizite oficiale la Atena, că 'Iranul a pierdut controlul integral' asupra Strâmtorii Ormuz, unde navele continuă să fie atacate în mod regulat, relatează AFP. Republica Islamică a revendicat controlul asupra acestei căi navigabile strategice,
Majoritatea germanilor consideră că Friedrich Merz a eșuat în postul de cancelar
O majoritate a germanilor consideră că mandatul cancelarului Friedrich Merz a fost un eșec, relatează miercuri dpa. Un sondaj realizat de Institutul Ipsos pentru revista Spiegel a relevat miercuri că 48% dintre respondenți au fost pe deplin de acord cu afirmația potrivit căreia guvernul condus de Merz 'a eșuat', în timp ce alți 1
Rubio afirmă că SUA și Grecia vor combate împreună amenințările la adresa securității
Secretarul de Stat al SUA, Marco Rubio, a declarat miercuri că Grecia, un 'aliat NATO puternic și exemplar', și Statele Unite inițiază un nou mecanism de schimb de informații antiteroriste între agențiile lor de aplicare a legii, relatează Reuters. în timpul unei vizite oficiale în Grecia, Rubio a afirmat că această ț
Azerbaidjanul neagă informațiile despre legături cu fostul șef al serviciilor secrete germane acuzat de spionaj
Azerbaidjanul a negat categoric miercuri informațiile apărute în mai multe media internaționale care au menționat legături între serviciile sale de informații și arestarea fostului șef al Serviciului Federal de Informații (BND) german, August Hanning, acuzat de spionaj pentru o agenție străină, informează EFE. 'Difuzarea acestu
Ucraina: Cel puțin 11 morți în atacuri ale Rusiei care au vizat în special sistemul energetic ucrainean
Președintele ucrainean Volodimir Zelenski a anunțat că numărul persoanelor care și-au pierdut viața în întreaga Ucraină în urma atacului Rusiei cu rachete și drone de miercuri dimineață a ajuns la 11, atac care, potrivit liderului de la Kiev, a fost îndreptat în special împotriva sistemului energetic al țării, informează EFE.
Restricții de circulație pentru militarii americani din Okinawa după un omor comis de un infanterist marin
Militarii american staționați în insula japoneză Okinawa vor fi consemnați în unități între miezul nopții și ora 5 a.m., timp de o lună, și nu li se va permite să consume alcool în decursul unei perioade de instruire privind disciplina, după ce un infanterist marin a fost arestat sub acuzația că a ucis o localnică, transmite miercuri agenția R









