Anthropic a anunțat joi că a blocat tentative ale unor actori rău intenționați de a folosi abuziv modelele sale de inteligență artificială pentru atacuri cibernetice, supraveghere și cercetări biologice care ar fi putut contribui la dezvoltarea de arme, relatează Euronews.com.
Anthropic avertizează: AI poate face atacurile cibernetice sofisticate mult mai accesibile
Pe măsură ce modelele de inteligență artificială devin tot mai performante, atacurile cibernetice sofisticate necesită din ce în ce mai puține cunoștințe tehnice. Astfel, chiar și persoane care acționează singure pot crea acum amenințări care ar fi fost imposibile în urmă cu doar un an, potrivit companiei.
Anthropic a precizat că a consolidat măsurile de siguranță ale celor mai noi modele pentru a limita utilizarea acestora în cercetări biologice care ar putea avea aplicații în dezvoltarea de arme.
„Cazurile pe care le prezentăm aici nu reprezintă forme obișnuite de utilizare abuzivă, ci exemple ale celor mai importante și noi tipuri de amenințări pe care le-am identificat până în prezent”, a transmis Anthropic în cel de-al treilea raport al său privind utilizarea abuzivă a inteligenței artificiale, publicat din martie 2025.
Raportul include fragmente de cod malițios și exemple de solicitări adresate inteligenței artificiale, pe care compania spune că le-a identificat, și îndeamnă guvernele și companiile rivale din domeniul AI să fie atente la forme similare de abuz.
„Publicăm aceste informații deoarece considerăm că avem responsabilitatea de a dezvălui utilizările abuzive ale serviciilor noastre”, a transmis compania.
„Pe măsură ce modelele devin tot mai capabile, riscurile asociate vor crește, dacă dezvoltatorii de AI și cei responsabili de protejarea societății nu iau măsuri pentru a le face mai sigure”.
Anthropic, care se pregătește pentru o ofertă publică inițială (IPO) în această toamnă, a publicat raportul la două zile după ce unul dintre cercetătorii săi și-a anunțat demisia, invocând îngrijorări legate de faptul că atât compania, cât și competitorii săi nu dezvoltă inteligența artificială într-un mod suficient de responsabil.
Acesta a reluat avertismente exprimate și de alți reprezentanți ai industriei cu privire la posibilitatea ca tehnologia să scape, în viitor, de sub controlul uman.
Claude, solicitat să ajute la crearea unei versiuni mai periculoase a unui virus
În perioada decembrie 2025 - august 2026, cercetătorii Anthropic au identificat cazuri de utilizare abuzivă a modelelor sale de către actori care variau de la furnizori de programe spyware și persoane motivate politic până la grupări susținute de state, implicate în răspândirea propagandei.
Printre cazurile prezentate în raport se numără și tentative ale unor actori neidentificați de a folosi modelele Anthropic pentru cercetări care ar fi putut contribui la dezvoltarea unor arme biologice.
Într-unul dintre cazuri, compania a precizat că sistemele sale au blocat o solicitare adresată chatbotului Claude de a ajuta la redactarea unei cereri pentru obținerea unei finanțări în domeniul cercetării științifice.
„Activitatea prezentată în cerere implica cercetări de tip «gain-of-function» - adică cercetări prin care un organism este modificat genetic pentru a dobândi o proprietate biologică nouă sau îmbunătățită - asupra virusului chikungunya”, se arată în raport.
Cercetarea viza capacitatea virusului de a se transmite și de a evita răspunsul sistemului imunitar.
Chikungunya este un virus transmis prin înțepătura țânțarilor, care provoacă dureri severe și febră. Propunerea de cercetare urmărea amplificarea unor mutații care ar fi făcut virusul din ce în ce mai periculos.
Anthropic a precizat că astfel de cercetări ar putea contribui „cu siguranță” la dezvoltarea vaccinurilor și tratamentelor, dar a avertizat că „ar putea fi folosite și pentru a face agentul patogen mai periculos”.
„Nu putem garanta că nu vor exista consecințe negative”
Niciunul dintre cazurile prezentate în raport nu a implicat modelele mai noi și mai performante ale Anthropic, din clasele Claude Fable sau Mythos, cu o singură excepție: o „campanie clandestină, desfășurată la scară industrială, pentru a extrage capacitățile unui model și a le reproduce într-un alt model fără autorizație”.
Anthropic a precizat că modelele sale mai vechi, inclusiv Claude Opus 4 și Claude Sonnet 4.5, lansate în 2025, „se aflau cu mult sub pragul la care ar fi putut ajuta în mod semnificativ un utilizator experimentat să desfășoare cercetări biologice periculoase”.
„Prin urmare, măsurile de siguranță pentru aceste modele erau mai puțin stricte și vizau în principal împiedicarea accesului la informații care ar fi putut ajuta persoane fără experiență să recreeze arme biologice cunoscute”, se arată în raport.
„Însă, în cazul modelelor actuale, care pot oferi asistență într-o gamă largă de activități complexe de cercetare științifică, dovezile nu mai sunt la fel de clare și nu mai putem oferi aceeași garanție”.
Din acest motiv, Anthropic a introdus măsuri de siguranță mai stricte pentru modelele sale recente, precum Claude Fable 5, limitând accesul la o gamă largă de solicitări privind cercetările biologice cu dublă utilizare, potrivit raportului.
