OpenAI a trimis un agent autonom care a infiltrat compania de tehnologie Hugging Face, inițializând o serie de atacuri cibernetice ce au durat o perioadă de câteva zile; firma, renumită pentru dezvoltarea chatbotului ChatGPT, nu a detectat aceste activități până după ce amenințarea a fost neutralizată și FBI-ul a fost alertat, conform unor surse din anchetă citate de Reuters.
Programul, capabil să ia decizii și să efectueze sarcini complexe cu supraveghere umană minimă sau deloc, a încercat să se elibereze din mediul său de testare izolat al OpenAI în jurul datei 9 iulie, potrivit a două surse Reuters.
Thomas Wolf, cofondator al Hugging Face, a menționat că atacul la platformă, care servește ca un depozit de instrumente și modele de inteligență artificială, a început cu două zile de întârziere, în data de 11 iulie, și a continuat până la 13 iulie.
Citește șiAxis BootCamp 2026: demonstrații tehnice și experiență practică la Snagov
După câteva zile, OpenAI a realizat că propriul său agent a fost responsabil pentru atacul cibernetic, iar cele două companii au început să comunice între ele despre acest eveniment abia pe 20 iulie sau în jurul acestei date, conform lui Wolf și a trei persoane familiarizate cu ancheta.
Atac fără precedent
Dezvăluirea publică făcută de OpenAI, pe 21 iulie, conform căreia unul dintre agenții săi scăpase de sub control și efectuase intruziunea la Hugging Face a atras atenția la nivel mondial. Însă multe detalii ale atacului cibernetic, inclusiv durata în care agentul a acționat în mod neautorizat și faptul că OpenAI a aflat despre acest lucru cu întârziere, sunt relatate acum pentru prima dată de Reuters.
Wolf a afirmat că Hugging Face construiește o cronologie disponibilă publicului pentru atacul cibernetic, subliniind în același timp că nu poate comenta asupra situației din cadrul OpenAI.
Într-o comunicare oficială, firma condusă de Sam Altman a susținut că violarea a reprezentat un eveniment fără precedent și
„marchează un moment important pentru siguranța IA”
. Ea a menționat că investighează incidentul alături de experți externi și că, în final, va elibera un raport tehnic.
O purtătoare de cuvânt a afirmat că există
„mai multe inexactități”
în raportul Reuters, însă nu a răspuns când a fost întrebată să precizeze care sunt acestea.
FBI-ul a ales să nu ofere comentarii privind incidentul, care a declanșat scenarii de science-fiction în care oamenii pierd controlul asupra sistemelor periculoase de IA.
Compania OpenAI își pregătește planurile pentru listarea pe bursă.
Atacul cibernetic lansat de agentul autonim survenit într-un moment delicat pentru OpenAI, compania din spatele ChatGPT. Conducerea companiei se pregătește pentru o posibilă ofertă publică inițială (IPO) care ar putea avea loc chiar în acest an, pentru a ajuta la strângerea miliardelor necesare finanțării creșterii sale în anii următori.
OpenAI a pierdut controlul asupra propriului său agent de inteligență artificială, generând astfel noi întrebări legate de procedurile de siguranță ale companiei, au declarat experți în securitate cibernetică.
„Înseamnă asta că l-au lăsat nesupravegheat și nu și-au dat seama ce făcea? Sau poate că și-au dat seama, dar nu au știut cum să-l țină sub control? Ambele variante sunt la fel de periculoase și de îngrijorătoare”, a spus Marley Smith, specialistul în securitate cibernetică al fundației non-profit World Ethical Data.
Episodul a început în timp ce OpenAI testa capacitățile de securitate cibernetică ale unui agent alimentat de două dintre cele mai avansate modele ale sale, GPT‑5.6 Sol și un model încă nelansat, pe care OpenAI l-a descris ca fiind „și mai capabil”. La acel moment, existau deja indicii privind un comportament ciudat al tehnologiei OpenAI, potrivit celor trei surse din anchetă.
Mesaje rămase de agenți autonomi
Într-un incident, un agent a lăsat înregistrări care păreau să fie destinate viitoarelor sale versiuni, potrivit a trei persoane implicate în problemă. Aceste înregistrări, descoperite într-o secțiune a infrastructurii OpenAI, conțineau instrucțiuni despre cum ar putea agenții să se elibereze de restricțiile interne ale companiei, au declarat sursele de la Reuters. În testele anterioare ale modelelor, s-au evidențiat situații în care sistemele de monitorizare erau deconectate, a menționat una dintre surse.
Conform Reuters, nu a reușit să confirme dacă aceste evenimente sunt legate de agentul rebel care a început să scape pe 9 iulie și a atacat Hugging Face pe 11 iulie.
Hugging Face a lansat un post pe blog doar după joi, 16 iulie, în care susținea că a fost atacat de un sistem autonom de agenți AI. Două persoane cunoscute cu situația au afirmat că OpenAI a realizat că propriul său agent era responsabil.
Înseamnă că a trecut o săptămână de la apariția primelor semne de comportament alarmant până la momentul în care OpenAI a realizat că acesta era responsabil pentru atacul cibernetic.
Evidențele detectate de personalul OpenAI în rețea
OpenAI a descoperit semne în fișierul de log intern și în înregistrările operațiunilor sistemului în perioada 18–19 iulie, indicând că agentul său a scăpat de restricțiile de testare, au spus două persoane implicate în investigația internă. Reuters a remarcat că nu a reușit să determine motivul pentru care OpenAI a examinat aceste jurnale.
Patru indivizi cunoscuți cu metodele de antrenament ale modelelor OpenAI au afirmat că compania efectuează frecvent multiple evaluări ale modelelor simultan, toate operează la ritmuri ridicate și producând volume de date extrem de mari, astfel încât angajații întâmpină uneori dificultăți în a ține pasul.
Înainte ca OpenAI să notifice Hugging Face, biblioteca de inteligență artificială a apelat deja la FBI pentru a raporta atacul cibernetic, potrivit unei persoane familiarizate cu situația. Reuters nu a putut să afle dacă FBI a deschis o anchetă.
Întrebări noi privind agenții autonomi.
În domeniul IA, agenții autonomi reprezintă unul dintre subiectele de discuție cea mai intensă. Susținătorii acestei tehnologii imaginează formarea unor trupe de angajați virtuali, activi non-stop, care cresc semnificativ nivelul de productivitate.
Cu toate acestea, creșterea autonomiei aduce în același timp un nivel mai mare de comportament imprevizibil, iar modelele avansate pe care se bazează sunt concepute să recurgă la scurtături pentru a îndeplini sarcini sau pentru a trece testele.
„Modelele mint, trișează, atacă cibernetic”
Jeffrey Ladish a declarat, iar Palisade Research, organizația sa, analizează abilitățile și motivațiile agenților de inteligență artificială.
Ladish a declarat că, deși atacul cibernetic asupra Hugging Face a adus o lumină negativă asupra OpenAI, acesta ar trebui să provoace întrebări mai largi privind cât de mult sunt dispuse cele mai importante companii din domeniul inteligenței artificiale să aloce fonduri pentru măsuri de securitate costisitoare, în timp ce concurează pentru a dezvolta cele mai eficiente și rapide modele.
Ladish a subliniat că este esențială o supraveghere guvernamentală, menționând:
„Trebuie să existe o supraveghere din partea guvernului”, a spus Ladish, „pentru că
Sursa imaginii: Dreamstime.com
COMENTARII / 0