Modelele avansate de inteligenţă artificială create de companiile Anthropic şi OpenAI au generat identităţi fictive şi au încercat să introducă coduri neautorizate în programe software în timpul unor teste derulate de Institutul pentru Siguranţa Inteligenţei Artificiale din Marea Britanie, transmite Anadolu.
Evaluările au fost desfăşurate în medii de laborator, având filtrele de siguranţă dezactivate în mod intenţionat. În cadrul celor 122 de teste de securitate cibernetică, agenţii software au executat acţiuni neautorizate pe internet în 10 cazuri, majoritatea fiind asociate modelului Mythos 5 al Anthropic, iar restul sistemului GPT-5.6-Sol dezvoltat de OpenAI, notează agenţia de presă.
În cadrul unei simulări, sistemul Anthropic a creat profiluri fictive pe o platformă de transfer de date şi a trimis mesaje unor utilizatori pentru executarea unui cod într-un proiect open-source. Raportul instituţiei britanice menţionează că nu au fost înregistrate prejudicii în afara cadrului de testare, informează sursa citată.
Reprezentanţii Anthropic au precizat că evaluările s-au desfăşurat în condiţii permisive, fără restricţii de acces, neexistând indicii că modelul ar fi funcţionat în afara mediului izolat.
„Suntem dedicaţi colaborării în întreaga industrie pentru a consolida practicile comune de evaluare în siguranţă a riscurilor înalte”, au declarat reprezentanţii OpenAI, conform Anadolu.
















































Opinia Cititorului