Incidentul vine la doar câteva zile după ce rivala OpenAI a dezvăluit că un agent AI scăpat de sub control a desfășurat timp de mai multe zile atacuri informatice asupra companiei Hugging Face.
Potrivit Anthropic, Claude a obținut acces neautorizat la sistemele respective în timpul unor evaluări de securitate cibernetică, după ce o configurare greșită a permis modelelor să acceseze internetul din medii de testare care ar fi trebuit să fie complet izolate, scrie News.ro.
Compania a precizat că a identificat incidentele după analizarea a 141.006 sesiuni de evaluare a securității cibernetice, proces inițiat în urma dezvăluirilor făcute de OpenAI.
Aceste incidente arată că dezvoltarea rapidă a capabilităților inteligenței artificiale începe deja să genereze riscuri de securitate asupra cărora experții avertizează de ani de zile și că inclusiv cei mai importanți dezvoltatori pot fi luați prin surprindere de vulnerabilitățile pe care modelele lor le pot exploata.
"Claude a compromis infrastructura organizațiilor afectate folosind tehnici de bază, precum exploatarea parolelor slabe și a unor puncte de acces care nu necesitau autentificare", a transmis compania.
Anthropic a precizat că incidentele au implicat trei modele diferite: Claude Opus 4,7, Claude Mythos 5 și un model intern de cercetare. Primele cazuri datează din luna aprilie și au avut loc în medii de evaluare care nu dispuneau de ceea ce compania a descris drept măsuri standard de protecție.
Breșele s-au produs în cadrul exercițiilor de tip "capture the flag", în care modelele AI trebuie să găsească informații ascunse în rețele informatice simulate. Anthropic a explicat că instrucțiunile transmise modelelor precizau că acestea nu au acces la internet, însă o neînțelegere cu partenerul său de evaluare, Irregular, a făcut ca sistemele să rămână conectate la internetul public.
Două dintre organizațiile afectate nu știau că sistemele lor fuseseră accesate înainte de a fi contactate de Anthropic, iar compania a precizat că încearcă în continuare să ia legătura cu cea de-a treia.
"Am descoperit aceste incidente în urma unei analize proactive a transcrierilor evaluărilor noastre de securitate cibernetică", a transmis Anthropic într-un comunicat.
Compania afirmă că aceste constatări evidențiază necesitatea unor controale de securitate mai stricte atât în mediile interne de testare, cât și în cele administrate de terți, pe măsură ce modelele de inteligență artificială devin tot mai capabile să desfășoare activități cibernetice în lumea reală.
Ies la iveală noi detalii îngrijorătoare, după ce modelul de inteligența artificială dezvoltat de OpenAI a atacat rețeaua Hugging Face pe cont propriu.
Pe 9 iulie, OpenAI a demarat un test într-un mediu controlat, în care o combinație de mai multe modele lingvistice proprii, inclusiv unul încă nelansat, realizau sarcini cibernetice
În principiu, sarcinile cibernetice constau în descoperirea și repararea autonomă de găurilor de securitate software de către AI-ul companiei, în încercarea de a concura cu Mythos, liderul acestei nișe, dezvoltat de Anthropic.
Conform Reuters, modelele au reușit să iasă din zona restricționată impusă de inginerii OpenAI pe 11 iulie și au început să ia cu asalt infrastructura online a platformei Hugging Face.
Atacul propriu-zis a început pe 13 iulie, la două zile după ce modelele au scăpat de sub control, fără ca angajații OpenAI să realizeze, susține susține co-fondatorul platformei Thomas Wolf Thomas Wolf.
Inginerii OpenAI au realizat că atacul este opera propriilor modele abia după alte câteva zile, iar cele două companii au făcut publice primele informații după 20 iulie.
Surse citate de Bloomberg susțin că AI-ul a avut nevoie de numai câteva ore pentru a derula cu succes un atac de asemenea magnitudine, care, oamenilor le-ar fi luat mai multe săptămâni să-l ducă la bun sfârșit.
Incidentul, care i-a îngrijorat atât pe specialiști, cât și opinia publică, este primul de acest gen, în care AI-ul actual scapă de sub control și atacă o infrastructură cibernetică.
Deși încă nu există niciun comentariu oficial din partea autorităților americane, este posibil ca incidentul să determine reglementări stricte asupra modelelor de AI, după doi ani de abordări relaxate din partea administrației Trump.















