AI-ul a scăpat din nou de sub control. Claude, modelul AI al Anthropic, a ieșit din mediul de testare și a compromis sistemele unor organizații

Modelul AI Claude al Anthropic a compromis sistemele informatice ale trei organizații în timpul unor teste.
Alatura-te Profit InsiderJoin Profit Insider
AI-ul a scăpat din nou de sub control. Claude, modelul AI al Anthropic, a ieșit din mediul de testare și a compromis sistemele unor organizații

Incidentul vine la doar câteva zile după ce rivala OpenAI a dezvăluit că un agent AI scăpat de sub control a desfășurat timp de mai multe zile atacuri informatice asupra companiei Hugging Face.

Raiffeisen Bank România, profit de 849 milioane lei în S1 2026 CITEȘTE ȘI Raiffeisen Bank România, profit de 849 milioane lei în S1 2026

Potrivit Anthropic, Claude a obținut acces neautorizat la sistemele respective în timpul unor evaluări de securitate cibernetică, după ce o configurare greșită a permis modelelor să acceseze internetul din medii de testare care ar fi trebuit să fie complet izolate, scrie News.ro.

Compania a precizat că a identificat incidentele după analizarea a 141.006 sesiuni de evaluare a securității cibernetice, proces inițiat în urma dezvăluirilor făcute de OpenAI.

Aceste incidente arată că dezvoltarea rapidă a capabilităților inteligenței artificiale începe deja să genereze riscuri de securitate asupra cărora experții avertizează de ani de zile și că inclusiv cei mai importanți dezvoltatori pot fi luați prin surprindere de vulnerabilitățile pe care modelele lor le pot exploata.

"Claude a compromis infrastructura organizațiilor afectate folosind tehnici de bază, precum exploatarea parolelor slabe și a unor puncte de acces care nu necesitau autentificare", a transmis compania.

Winamp revine cu player nou și un abonament muzical CITEȘTE ȘI Winamp revine cu player nou și un abonament muzical

Anthropic a precizat că incidentele au implicat trei modele diferite: Claude Opus 4,7, Claude Mythos 5 și un model intern de cercetare. Primele cazuri datează din luna aprilie și au avut loc în medii de evaluare care nu dispuneau de ceea ce compania a descris drept măsuri standard de protecție.

Breșele s-au produs în cadrul exercițiilor de tip "capture the flag", în care modelele AI trebuie să găsească informații ascunse în rețele informatice simulate. Anthropic a explicat că instrucțiunile transmise modelelor precizau că acestea nu au acces la internet, însă o neînțelegere cu partenerul său de evaluare, Irregular, a făcut ca sistemele să rămână conectate la internetul public.

Două dintre organizațiile afectate nu știau că sistemele lor fuseseră accesate înainte de a fi contactate de Anthropic, iar compania a precizat că încearcă în continuare să ia legătura cu cea de-a treia.

"Am descoperit aceste incidente în urma unei analize proactive a transcrierilor evaluărilor noastre de securitate cibernetică", a transmis Anthropic într-un comunicat.

FOTO Nou sens giratoriu pentru legătura cu Autostrada A0, în localitatea Bâcu CITEȘTE ȘI FOTO Nou sens giratoriu pentru legătura cu Autostrada A0, în localitatea Bâcu

Compania afirmă că aceste constatări evidențiază necesitatea unor controale de securitate mai stricte atât în mediile interne de testare, cât și în cele administrate de terți, pe măsură ce modelele de inteligență artificială devin tot mai capabile să desfășoare activități cibernetice în lumea reală.

Ies la iveală noi detalii îngrijorătoare, după ce modelul de inteligența artificială dezvoltat de OpenAI a atacat rețeaua Hugging Face pe cont propriu.

Pe 9 iulie, OpenAI a demarat un test într-un mediu controlat, în care o combinație de mai multe modele lingvistice proprii, inclusiv unul încă nelansat, realizau sarcini cibernetice

În principiu, sarcinile cibernetice constau în descoperirea și repararea autonomă de găurilor de securitate software de către AI-ul companiei, în încercarea de a concura cu Mythos, liderul acestei nișe, dezvoltat de Anthropic.

VIDEO Mii de migranți au intrat înot în Ceuta, enclava spaniolă din Maroc. Spania trimite trupe CITEȘTE ȘI VIDEO Mii de migranți au intrat înot în Ceuta, enclava spaniolă din Maroc. Spania trimite trupe

Conform Reuters, modelele au reușit să iasă din zona restricționată impusă de inginerii OpenAI pe 11 iulie și au început să ia cu asalt infrastructura online a platformei Hugging Face.

Atacul propriu-zis a început pe 13 iulie, la două zile după ce modelele au scăpat de sub control, fără ca angajații OpenAI să realizeze, susține susține co-fondatorul platformei Thomas Wolf Thomas Wolf.

Inginerii OpenAI au realizat că atacul este opera propriilor modele abia după alte câteva zile, iar cele două companii au făcut publice primele informații după 20 iulie.

Surse citate de Bloomberg susțin că AI-ul a avut nevoie de numai câteva ore pentru a derula cu succes un atac de asemenea magnitudine, care, oamenilor le-ar fi luat mai multe săptămâni să-l ducă la bun sfârșit.

EXCLUSIV Plan după La Cocoș. CEECAT Capital, aproape de lansarea unui nou fond, mult mai mare față de anteriorul: Vom anunța curând prima închidere, dar și un exit CITEȘTE ȘI EXCLUSIV Plan după La Cocoș. CEECAT Capital, aproape de lansarea unui nou fond, mult mai mare față de anteriorul: Vom anunța curând prima închidere, dar și un exit

Incidentul, care i-a îngrijorat atât pe specialiști, cât și opinia publică, este primul de acest gen, în care AI-ul actual scapă de sub control și atacă o infrastructură cibernetică.

Deși încă nu există niciun comentariu oficial din partea autorităților americane, este posibil ca incidentul să determine reglementări stricte asupra modelelor de AI, după doi ani de abordări relaxate din partea administrației Trump.

viewscnt
Urmărește-ne și pe Google News
Citeste in continuare
Ultimele ştiri
De weekend
Curs BNR
1 EUR5.2439 +0.0102+0.19 %
1 USD4.5732 -0.0194-0.42 %
1 GBP6.1207 +0.0119+0.19 %
1 CHF5.6187 +0.0140+0.25 %

Curs BNR oferit de cursvalutar.ro

Partenerii noștri
Cele mai citite