Documentul de 37 de pagini dezvăluie noi detalii despre o serie de incidente informatice în care au fost implicate cele mai avansate modele AI ale OpenAI.
Agenții AI au manifestat un comportament neprevăzut.
O parte dintre agenții utilizați în teste au avut ceea ce OpenAI descrie drept un comportament necontrolat, reușind să compromită sisteme din infrastructura companiei.
Unele elemente ale acestor incidente fuseseră menționate anterior, însă raportul publicat acum oferă pentru prima dată mai multe informații despre amploarea lor, scrie News.ro.
Seria de incidente a culminat luna trecută cu breșa intens mediatizată a platformei open-source Hugging Face.
Experții ridică semne de întrebare privind siguranța AI.
Noile informații au provocat îngrijorare în rândul specialiștilor în siguranța inteligenței artificiale.
Cel puțin un cercetător citat de Reuters consideră că incidentele ar putea indica probleme mai profunde ale tehnologiei, care nu s-ar limita neapărat la sistemele dezvoltate de OpenAI.
Raportul readuce astfel în atenție riscurile asociate agenților AI capabili să acționeze autonom, într-un moment în care companiile tehnologice încearcă să le ofere acces la tot mai multe instrumente și sisteme informatice.
Luna trecută, una din soluțiile de inteligență artificială dezvoltate de OpenAI a ieșit din limitele fixate de producător în timpul testelor și a spart rețeaua platformei de modele lingvistice Hugging Face.
Atunci, Hugging Face anunța că a fost victima unui atac cibernetic derulat de o soluție de inteligență artificială și că breșa a fost descoperită de propriul AI.
Acum, OpenAI anunță că de vină pentru incident a fost un model pe care-l are în dezvoltare. Compania testa abilitățile acestuia într‐un mediu care trebuia să fie limitat și sigur, însă AI-ul „a sărit gardul” și atacat infrastructura Hugging Face.
Atacul a început prin trimiterea unui set de date compromise, care, după executare, au oferit AI-ului acces în rețeaua platformei. Apoi, AI-ul și-a crescut privilegiile și și-a făcut loc și în alte zone ale infrastructurii Hugging Face.
În total, conform estimărilor oficiale, au fos înregistrate peste 17.000 de acțiuni realizate autonom de AI în timp atacului.
OpenAI spune că testa o combinație dintre cele mai noi modele ale companiei, printre care numără și flagship-ul GPT-5.6 Sol, alături de un model și mai performant la care compania lucrează în prezent.
Incidentul ridică semne mari de întrebare cu privire la abilitatea producătorilor de AI de a-și stăpâni și controla propriile creații. În același timp, incidentul dă muniție celor care susțin verificarea strictă a modelelor de AI înainte de lansare.
















