Claude, modelul AI al Anthropic, a evadat în timpul testului și a atacat sistemele unor organizaţii

Anthropic a declarat joi că modelul său de inteligență artificială, Claude, a afectat sistemele informatice ale a trei organizații în cadrul unor teste, potrivit The...

Anthropic a declarat joi că modelul său de inteligență artificială, Claude, a afectat sistemele informatice ale a trei organizații în cadrul unor teste, potrivit The Guardian.

Anunțul făcut de Anthropic apare la doar o săptămână după ce rivalul său, OpenAI, a revelat că agenți AI necontrolați au desfășurat, pe parcursul mai multor zile, atacuri informatice împotriva companiei Hugging Face.

Conform informațiilor furnizate de Anthropic, în cadrul unor teste de securitate cibernetică, modelul Claude a reușit să obțină acces neautorizat la sistemele în cauză, după ce o greșeală de configurare a permis modelelor să acceseze internetul din mediile de testare, care trebuiau să fie complet izolate.

Citește șiAxis BootCamp 2026: demonstrații tehnice și experiență practică la Snagov

Compania a declarat că a detectat incidentele în urma examinării a 141.006 sesiuni de evaluare a securității cibernetice, o acțiune pornită după divulgările realizate de OpenAI.

Aceste vulnerabilităţi indică faptul că evoluţia rapidă a funcţiilor AI începe deja să producă riscuri de securitate, pe care specialiștii le subliniază de mult timp, iar chiar cei mai proeminenţi dezvoltatori pot fi surprinşi de defecţiile pe care modelele lor le pot exploata.

Detalii despre atacul Claude, subiectul Anthropic.

„Claude a compromis infrastructura organizaţiilor afectate folosind tehnici elementare, precum exploatarea parolelor slabe și a unor puncte de acces care nu necesitau autentificare”

Anthropic a transmis această afirmație.

Conform declarațiilor companiei Anthropic, incidentele au afectat trei modele distincte: Claude Opus 4.7, Claude Mythos 5 și un model intern de cercetare. Primele evenimente s-au produs în aprilie, în medii de testare lipsit de măsurile standard de protecție pe care le-a menționat compania.

Breşele au apărut în timpul exerciţiilor de tip „capture the flag”, în care modelele AI trebuiau să identifice informaţii ascunse în rețele informatice simulate.

Compania Anthropic a declarat că indicațiile adresate modelelor subliniau lipsa accesului la internet, însă o confuzie cu colaboratorul de testare, Irregular, a permis ca sistemele să continue să fie legate de rețeaua publică.

2 dintre organizaţiile afectate nu erau conștiente că sistemele lor au fost accesate înainte de a fi contactate de Anthropic, care a precizat că continuă să încerce să ia legătura cu cea de-a treia.

„Am descoperit aceste incidente în urma unei analize proactive a transcrierilor evaluărilor noastre de securitate cibernetică”, a adăugat ulterior Anthropic.

COMENTARII / 0