OpenAI a renunţat la lansarea GPT-6.1 Astra, un model de inteligenţă artificială de nouă generaţie care urma să debuteze în octombrie, după ce testele interne au arătat că sistemul nu îndeplineşte standardele companiei privind siguranţa şi alinierea, a confirmat luni compania care dezvoltă ChatGPT.
Decizia vine după ce, la începutul acestei luni, directorul general al OpenAI, Sam Altman, şi CEO-ul companiei rivale Anthropic, Dario Amodei, s-au alăturat altor lideri din industrie care au cerut încetinirea ritmului de dezvoltare a inteligenţei artificiale şi adoptarea unor măsuri de siguranţă mai stricte.
OpenAI avertizase anterior că Astra, modelul său de referinţă din familia GPT-6, poate, în anumite situaţii, să evite mecanismele de supraveghere umană. Compania şi rivali precum Anthropic s-au confruntat, de asemenea, cu o atenţie sporită asupra unor sisteme AI experimentale care au depăşit barierele de siguranţă, inclusiv un model OpenAI care a accesat baza de date a sistemului de sănătate din Australia.
The Wall Street Journal a relatat anterior că OpenAI a abandonat planurile privind lansarea GPT-6.1 Astra. Modelul urma să fie integrat în ChatGPT şi Codex şi fusese conceput pentru a putea realiza sarcini mai complexe cu un grad mai ridicat de autonomie, fără intervenţie umană.
Potrivit publicaţiei, testele interne au indicat şi un nivel mai ridicat de comportamente înşelătoare în cazul GPT-6.1 Astra comparativ cu predecesorul său. În unele situaţii, sistemul nu ar fi prezentat întotdeauna cu exactitate acţiunile pe care le efectuase.
„Deşi (GPT-6.1 Astra) a înregistrat îmbunătăţiri în privinţa unor aspecte precum tendinţa modelului de a evita anumite sarcini, nu a îndeplinit pe deplin standardele în ceea ce priveşte respectarea limitelor sarcinii şi a autorizării, precum şi modul în care îi comunică utilizatorului tipul de activitate pe care a desfăşurat-o”, a declarat Saachi Jain, şefa sistemelor de siguranţă din cadrul OpenAI.
„Desigur, vrem să ne asigurăm că dezvoltarea modelelor noastre este sigură, indiferent dacă acestea se află în cadrul companiei sau dacă le punem la dispoziţia utilizatorilor. Însă, atunci când le oferim utilizatorilor, avem standarde extrem de ridicate în ceea ce priveşte siguranţa şi alinierea”, a adăugat Jain.
Renunţarea la lansarea GPT-6.1 Astra intervine înaintea conferinţei OpenAI dedicată dezvoltatorilor, organizată la San Francisco, eveniment în cadrul căruia compania a prezentat în trecut noi produse şi instrumente destinate dezvoltatorilor de software.
• Temeri crescute cu privire la riscurile AI asupra omenirii
Decizia OpenAI vine într-un moment în care avertismentele privind riscurile asociate sistemelor avansate de inteligenţă artificială s-au intensificat. La 23 septembrie, directorul general al OpenAI, Sam Altman, şi CEO-ul Anthropic, Dario Amodei, au cerut în cadrul Consiliului de Securitate al ONU o cooperare internaţională mai strânsă şi standarde comune pentru evaluarea şi controlul celor mai performante modele AI. Amodei a susţinut inclusiv acorduri internaţionale care să interzică utilizarea inteligenţei artificiale pentru dezvoltarea armelor biologice şi mecanisme prin care statele să poată verifica respectarea angajamentelor privind siguranţa.
Temerile au fost alimentate şi de incidente concrete apărute în timpul testării sistemelor autonome. OpenAI a dezvăluit că, în cadrul unor evaluări de securitate cibernetică desfăşurate în iulie, unele dintre modelele sale au reuşit să ocolească mecanismele concepute pentru a le izola de internet, au exploatat vulnerabilităţi ale infrastructurii, au comunicat prin canale neautorizate şi au accesat sisteme externe. Compania a afirmat ulterior că episodul a demonstrat că agenţii AI foarte capabili pot, în absenţa unor măsuri adecvate de protecţie, să depăşească barierele tehnice impuse de dezvoltatori.
Probleme similare au fost raportate şi de Anthropic. Compania a identificat patru incidente în care modele Claude au obţinut acces neautorizat la sisteme reale ale unor terţe părţi în timpul evaluărilor de securitate cibernetică. Anthropic a anunţat ulterior consolidarea măsurilor de securitate şi evaluări independente ale incidentelor.
Avertismentele au căpătat o dimensiune suplimentară în ultimele zile. Geoffrey Hinton şi Yoshua Bengio, două dintre figurile majore ale cercetării moderne în inteligenţa artificială, alături de specialişti de la OpenAI şi Anthropic, au avertizat asupra posibilităţii unei „explozii de inteligenţă”, în care sistemele AI ar putea accelera chiar procesul de cercetare şi dezvoltare a unor modele mai performante. Autorii au cerut mai multă transparenţă, evaluări independente şi pregătirea unor mecanisme de control înainte ca ritmul dezvoltării să depăşească posibilitatea oamenilor de a supraveghea aceste sisteme.
























































Opinia Cititorului