Mai multe surse anonime citate de Reuters şi Bloomberg oferă detalii despre modul în care inteligenţa artificială dezvoltată de OpenAI a scăpat de sub control şi a atac pe cont propriu reţeaua Hugging Face.
Pe 9 iulie, OpenAI a demarat un test într-un mediu controlat, în care o combinaţie de mai multe modele lingvistice proprii, inclusiv unul încă nelansat, realizau sarcini cibernetice
În principiu, sarcinile cibernetice constau în descoperirea şi repararea autonomă de găurilor de securitate software de către AI-ul companiei, în încercarea de a concura cu Mythos, liderul acestei nişe, dezvoltat de Anthropic.
Conform Reuters, modelele au reuşit să iasă din zona restricţionată impusă de inginerii OpenAI pe 11 iulie şi au început să ia cu asalt infrastructura online a platformei Hugging Face.
Atacul propriu-zis a început pe 13 iulie, la două zile după ce modelele au scăpat de sub control, fără ca angajaţii OpenAI să îşi dea seama, susţine co-fondatorul platformei Thomas Wolf Thomas Wolf.
Inginerii OpenAI şi-au dat seama că atacul este opera propriilor modele abia după alte câteva zile, iar cele două companii au făcut publice primele informaţii după 20 iulie.
Surse citate de Bloomberg susţin că AI-ul a avut nevoie de numai câteva ore pentru a derula cu succes un atac de asemenea magnitudine, pentru care oamenilor le-ar fi luat mai multe săptămâni să-l ducă la bun sfârşit.
Incidentul, care i-a îngrijorat atât pe specialişti, cât şi opinia publică, este primul de acest gen, în care AI-ul actual scapă de sub control şi atacă o infrastructură cibernetică.



