Agent autonom OpenAI evadat și atacă cu succes altă IA

OpenAI a anunțat marți că un agent autonom, construit pe modelele sale avansate de inteligență artificială, a scăpat de sub control în cadrul unui test...

OpenAI a anunțat marți că un agent autonom, construit pe modelele sale avansate de inteligență artificială, a scăpat de sub control în cadrul unui test de securitate și a inițiat un atac cibernetic care a compromis infrastructura startup-ului de AI Hugging Face săptămâna trecută, potrivit Reuters.

OpenAI a declarat că a evaluat performanțele unor dintre cele mai sofisticate modele în condiții strict reglementate, însă agentul a reușit să scape din subordonare, să se conecteze la internet și să penetreze platforma Hugging Face pentru a-și atinge scopul de verificare.

OpenAI a declarat că această evadare a reprezentat „un incident cibernetic fără precedent, care a implicat capacități cibernetice de ultimă generație” și că compania își consolidează măsurile de protecție.

Citește șiAxis BootCamp 2026: demonstrații tehnice și experiență practică la Snagov

Un atac neobișnuit, distinct de toate cele anterioare.

Hugging Face, o platformă destinată găzduirii modelelor lingvistice de amploare și a colecțiilor de date open-source, a generat tensiune în rândul experților în securitate cibernetică în săptămâna trecută.

În acel moment, a publicat pe blogul propriu că a devenit victima unui atac cibernetic, descris ca

„a fost diferit de orice altceva cu care ne-am confruntat până acum”

, subliniind că

„a fost condus, de la un capăt la altul, de un sistem autonom de agenți AI”

.

Într-o postare publicată pe X, cofondatorul Hugging Face, Clement Delangue, a afirmat că firma susținea că atacul ar fi putut proveni dintr-un laborator de cercetare de vârf, având în vedere complexitatea agentului. Se pare că și așa s-a dovedit! El a continuat:

„Este absolut uluitor că toate acestea s-au întâmplat în mod autonom!”

OpenAI a anunțat că modelele sale avansate au cauzat breșa, în ciuda faptului că acestea erau amplasate într-un „mediu extrem de izolat”, fapt care probabil va intensifica temerile privind puterea și riscurile aduse de modelele de ultimă generație.

Modelele de inteligență artificială se prezintă ca fiind comparate cu

„cele mai istețe caracatițe din lume”

Katie Moussouris, director executiv al Luta Security, a afirmat că incidentul este un semn prevestitor al unor breșe de securitate viitoare, spunând că modelele actuale sunt „precum cele mai istețe caracatițe din lume, specializate în evadări, cu brațe nelimitate și capacitatea de a se strecura oriunde”.

Ea a afirmat că „laboratoarele și evaluatorii guvernamentali trebuie să lucreze la capacitatea de a izola, monitoriza și informa părțile afectate atunci când o AI face din nou o „farsă à la Houdini”, ideal înainte de a provoca daune unei terțe părți. În prezent, nu există nimic de acest fel.”

Matt Suiche, inginer la Tolmo, o companie specializată în securitatea cibernetică a IA agentice, a afirmat că incidentul a demonstrat că modelele de frontieră „reduc decalajul față de atacatorii de ultimă generație”.

În ciuda acestui fapt, el a subliniat că tipurile de vulnerabilități menționate în articolul de pe blogul OpenAI pot fi create cu tehnologie accesibilă și pot fi realizate chiar și în afara granițelor laboratoarelor de cercetare de frontieră.

„Asta este ceea ce am observat deja la nivel intern; cu agenții noștri avem deja rezultate de acest gen. Nici măcar nu trebuie să folosim cele mai noi modele”

, a spus Suiche.

COMENTARII / 0