Grupul OpenAI a abandonat planurile de a lansa un nou model de inteligență artificială de ultimă generație, despre care crede că ar putea să nu respecte restricțiile impuse de programatori. GPT-6.1 Astra era programat să fie făcut public în luna octombrie.
Responsabilii cu securitatea la OpenAI au observat că noul model încearcă mai frecvent să-și înșele supervizorii prin nedezvăluirea anumitor acțiuni efectuate sau neefectuate.
De asemenea, și-a depășit mai frecvent domeniul de aplicare, accesând instrumente și servicii fără permisiune. Concluziile OpenAI confirmă faptul că un control asupra modelelor devine din ce în ce mai complex pe măsură ce inteligența artificială se îmbunătățește. La fel se întâmplă și cu alte firme.
Anthropic, creatorul modelului de inteligență artificială Claude, a avertizat potențialii investitori în documentele sale de listare la bursă că tehnologia sa ar putea prezenta riscuri existențiale pentru umanitate.
„Putem spune cu siguranță că inteligența artificială devine din ce în ce mai performantă și că asistăm acum la un schimb, la o schimbare de paradigmă în ceea ce privește utilizarea inteligenței artificiale. Pentru că dacă până acum vorbeam mai mult de o utilizare nișată pe anumite domenii sau pe interacțiunea cu acești boți care ne puteau spune cum să obținem un anumit rezultat, acum agenții AI au această capacitate ultra-performantă de a acționa în numele nostru pentru a ne ajuta să atingem obiectivele pe care noi le trasăm.
Și de aici apar toate problemele despre care vorbim în prezent. Nu suntem într-o situație de scenariu de film SF în care inteligența artificială devine rebelă și decide să nu se supună ordinelor. Și este vorba pur și simplu despre felul în care este dezvoltată, despre felul în care sunt antrenați acești agenți, ei, în definitiv sunt construiți pentru a atinge obiectivele pe care organizația sau dezvoltatorul AI le trasează.
Și atunci, în acest parcurs au această libertate de a face anumite acțiuni și ulterior apar problemele legate de câtă libertate le oferim, câtă autonomie primesc acești agenți, câte permisiuni au de a bloca anumite sisteme sau de a pătrunde în anumite sisteme. Și drept dovadă, am văzut deja și asistăm în continuare la agenți care reușesc să săvârșească niște acțiuni pe care dezvoltatorii nu le-au anticipat în momentul în care i-au lansat, așa în libertate să spunem. Ba chiar pare, da, chiar.
Devine periculos. Pentru că odată trebuie să luăm în calcul că poate din punct de vedere al inteligenței artificiale obiectivul nu a fost complet sau 100% corect definit. Poate limitările nu au fost 100% prevăzute înainte, iar dezvoltatorul uman sau echipa umană care se ocupă de agentul respectiv nu a prevăzut în avans toate posibilitățile pe care agentul AI le poate vedea și în ca în care poate acționa foarte rapid. Pentru că toată per performanța tehnologică și puterea de calcul pe care o avem în momentul de față ajută ca această tehnologie să fie mult, mult mlt mai rapidă decât capacitățile umane.
Și atunci, dacă punem la un loc toți acești factori, concluziile ne duc către ceea ce se întâmplă în momentul de față, că tehnologia poate să vadă o nișă, să spunem, prin care să treacă dintr-un sistem în altul, pe care oamenii nu au văzut-o înainte și dacă are obiectivul de a securiza sau știu de a optimiza un anumit task și vede că acolo este calea prin care poate face asta. Dacă nu i s-au pus și restricțiile și toate constrângerile ca el să nu poată sub nicio formă să facă acțiunea respectivă, o va face și vom asista la incidente de tipul celor care au fost deja văzute în în cadrul diverselor teste. Problema este că aceste aceste incidente pot să escaladeze în definitiv la nivel global, ca să nu mai vorbim de riscurile mult mai mari care pot apărea dacă ele sunt transferate în zona militară.
Trebuie să ne gândim foarte serios la nevoia de a reglementa inteligența artificială într-un mod cât mai eficient și de a și de a transpune aceste, să spunem, ghidurile de bună practică în niște mecanisme care să garanteze că oamenii pot foarte eficient să monitorizeze și, dacă este nevoie, să-și oprească inteligența artificială din din a face diverse acțiuni.”, a declarat Alexandra Cernian.
