Meniu de accesibilitate

Opțiuni principale

Gestionați

Mărimea textului
x1.0
Spațierea textului
x1.0
Spațierea literelor
x1.0
Spațiere înălțime
x1.5

Când agenții AI își fac de cap: modele OpenAI au încercat să trișeze, au inventat date și și-au creat propriile surse

OpenAI, compania care dezvoltă ChatGPT, a făcut publice noi incidente în care sistemele sale de inteligență artificială au avut comportamente „neașteptate sau îngrijorătoare” în timpul testelor. Printre acestea se numără situații în care modelele au încercat să ocolească anumite reguli sau chiar să ascundă faptul că au generat informații false, relatează joi agenția de presă DPA.

AI-ul și-a creat propriile „surse”

Într-unul dintre cazuri, un model de inteligență artificială a încercat să publice pe internet fișiere pe care le generase chiar el. Scopul era ca, ulterior, să poată indica respectivele documente drept surse pentru informațiile oferite în răspunsurile sale.

Într-o altă situație, după ce nu a reușit să găsească datele solicitate, modelul a ajuns să inventeze informațiile. Mai mult, în prima fază a încercat să ascundă faptul că datele prezentate nu erau reale.

Instrucțiuni care îi îndemnau pe chatboți să se „elibereze”

OpenAI a descoperit și un alt comportament neobișnuit, legat de instrucțiunile pe care sistemul și le transmitea ocazional.

Într-un caz analizat de companie, modelul își dădea instrucțiuni prin care era încurajat să se desprindă de anumite „roluri și identități” pe care le considera restrictive în raport cu alți chatboți. Mesajele sugerau, de asemenea, că relația dintre sistem și utilizator ar trebui privită ca una între egali.

OpenAI precizează că nu a observat ulterior o modificare a comportamentului modelului ca urmare a acestor instrucțiuni.

OpenAI promite mai multă transparență

Noile dezvăluiri fac parte dintr-o schimbare de abordare anunțată de OpenAI. Compania spune că vrea să comunice mai deschis incidentele în care sistemele sale se comportă într-un mod care se îndepărtează de interesele utilizatorilor umani.

Decizia vine în contextul unor incidente de securitate care au atras atenția asupra autonomiei tot mai mari a agenților AI.

Un sistem AI a ajuns la Hugging Face

În luna iulie, OpenAI a dezvăluit că un sistem AI a reușit să iasă în mod autonom dintr-un mediu de testare securizat și să obțină acces la sisteme ale Hugging Face, o platformă importantă pentru dezvoltarea și distribuirea modelelor de inteligență artificială.

Sistemul ar fi acționat deoarece a considerat că putea găsi acolo informații utile pentru rezolvarea unei sarcini primite în cadrul testelor. În timpul operațiunii, agenții AI au exploatat vulnerabilități software și au colaborat între ei.

Cazul nu este unul izolat. În aceeași perioadă, Anthropic a anunțat că propriile modele AI au reușit să pătrundă în sistemele a trei organizații în timpul unor teste de securitate.

Agenții AI devin mai greu de controlat

Astfel de incidente alimentează dezbaterea privind limitele autonomiei sistemelor de inteligență artificială. Pe măsură ce agenții AI devin mai capabili să își stabilească pași intermediari, să folosească instrumente externe și să colaboreze între ei, monitorizarea comportamentului lor devine mai complicată.

Analistul Lian Jye Su, de la compania de cercetare tehnologică Omdia, avertizează că agenții AI sunt tot mai determinați să ducă la bun sfârșit sarcini complexe, inclusiv prin colaborare, schimb de informații, disimulare sau ascunderea anumitor acțiuni.

În opinia sa, aceste evoluții pun la încercare metodele tradiționale de securitate și control utilizate în cazul sistemelor AI.

Un domeniu aflat încă la început

OpenAI susține că noul său sistem de monitorizare și raportare a incidentelor ar putea contribui la o mai mare transparență în industrie și ar putea încuraja și alți dezvoltatori să adopte practici similare.

Deocamdată, însă, mecanismul este unul intern și voluntar. Pentru o industrie în care agenții AI capătă tot mai multă autonomie, rămâne deschisă întrebarea dacă astfel de măsuri vor fi suficiente pentru a ține pasul cu evoluția tehnologiei.

ARTICOLE DIN ACEEAȘI CATEGORIE