Pe 9 iulie, OpenAI a demarat un test într-un mediu controlat, în care o combinație de mai multe modele lingvistice proprii, inclusiv unul încă nelansat, realizau sarcini cibernetice
În principiu, sarcinile cibernetice constau în descoperirea și repararea autonomă de găurilor de securitate software de către AI-ul companiei, în încercarea de a concura cu Mythos, liderul acestei nișe, dezvoltat de Anthropic.
Conform Reuters, modelele au reușit să iasă din zona restricționată impusă de inginerii OpenAI pe 11 iulie și au început să ia cu asalt infrastructura online a platformei Hugging Face.
Atacul propriu-zis a început pe 13 iulie, la două zile după ce modelele au scăpat de sub control, fără ca angajații OpenAI să realizeze, susține susține co-fondatorul platformei Thomas Wolf Thomas Wolf.
Inginerii OpenAI au realizat că atacul este opera propriilor modele abia după alte câteva zile, iar cele două companii au făcut publice primele informații după 20 iulie.
Surse citate de Bloomberg susțin că AI-ul a avut nevoie de numai câteva ore pentru a derula cu succes un atac de asemenea magnitudine, care, oamenilor le-ar fi luat mai multe săptămâni să-l ducă la bun sfârșit.
Incidentul, care i-a îngrijorat atât pe specialiști, cât și opinia publică, este primul de acest gen, în care AI-ul actual scapă de sub control și atacă o infrastructură cibernetică.
Deși încă nu există niciun comentariu oficial din partea autorităților americane, este posibil ca incidentul să determine reglementări stricte asupra modelelor de AI, după doi ani de abordări relaxate din partea administrației Trump.
















