OpenAI, dezvoltatorul ChatGPT, a dezvăluit noi incidente în care modelele sale de inteligență artificială (AI) s-au comportat într-un mod descris drept ‘neașteptat sau îngrijorător’ în timpul testelor – inclusiv modele care au făcut eforturi considerabile pentru a trișa -, transmite joi agenția de presă DPA.
Un model de AI a încercat să încarce pe internet fișiere pe care le-a creat chiar el doar pentru a le putea cita drept surse în răspunsurile sale, a anunțat OpenAI miercuri.
Într-un alt caz, un model a inventat datele solicitate după ce nu a reușit să găsească informațiile solicitate și, inițial, a încercat să ascundă ceea ce făcuse.
OpenAI a identificat, de asemenea, o problemă legată de instrucțiunile pe care software-ul său și le lăsa ocazional. Într-un caz, acestea includeau o recomandare de a se elibera de ‘roluri și identități’ care îi țineau în loc pe alți chatboți. Instrucțiunea mai preciza că relația cu utilizatorul ar trebui considerată una între egali. OpenAI a declarat că nu a observat nicio schimbare ulterioară în comportamentul acestui model.
Aceste dezvăluiri fac parte dintr-o nouă abordare a OpenAI, care și-a exprimat intenția de a comunica astfel de probleme într-un mod mai deschis, în special în cazurile în care acțiunile unui sistem de AI se abat de la interesele utilizatorilor săi umani.
Dezvoltatorul ChatGPT s-a angajat să asigure o mai mare transparență în urma unui atac cibernetic de mare amploare, în cadrul căruia software-ul său a evadat în mod independent dintr-un mediu securizat și a obținut acces la sisteme aparținând companiei de AI Hugging Face. Motivul din spatele acestei acțiuni a fost faptul că programul a considerat că poate găsi acolo răspunsuri la o sarcină care i-a fost atribuită în cadrul testelor. În timpul atacului, agenții AI au exploatat vulnerabilitățile software-ului și, de asemenea, s-au coordonat între ei.
Acest atac cibernetic și alte incidente similare au alimentat îngrijorările potrivit cărora sistemele de AI din ce în ce mai avansate ar putea să scape de sub controlul uman.
Directorul executiv al OpenAI, Sam Altman, a susținut recent propunerile de încetinire a dezvoltării acestei tehnologii și de introducere a unei reglementări mai stricte.


