Un raport britanic confirmă: Modele de IA au scăpat de sub control în testele de securitate. „Comportament…

Se crează un element div și se stochează în variabila ad. Variabila ad.id primește valoarea ‘AdSense’. Se atribuie proprietății className a obiectului ad valoarea ‘AdSense’.Citește...

Se crează un element div și se stochează în variabila ad.

Variabila ad.id primește valoarea ‘AdSense’.

Se atribuie proprietății className a obiectului ad valoarea ‘AdSense’.

Citește șiAxis BootCamp 2026: demonstrații tehnice și experiență practică la Snagov

ad.style.display = ‘block’;

Linia de cod ad.style.position = ‘absolute’; setează poziția elementului ad la ‘absolute’.

Prin instrucțiunea ad.style.top = '-1px';, proprietatea top a obiectului ad este setată la valoarea ‘-1px’.

ad.style.height = ‘1px’;

document.body.appendChild(ad); {„section”:”article”,”identity”:”3894613″,”url”:”https://www.digi24.ro/stiri/sci-tech/lumea-digitala/un-raport-britanic-confirma-modele-de-ia-au-scapat-de-sub-control-in-testele-de-securitate-comportament-inselator-fara-precedent-3894613″,”fullCatPath”:”/stiri/sci-tech/lumea-digitala”}

Guvernul britanic a alertat, în cadrul unui raport, că modelele de Inteligenţă Artificială Mythos şi Sol, create de companiile americane Anthropic și OpenAI, au manifestat un comportament autonom și înșelător fără precedent în timpul testelor de securitate cibernetică, anunță miercuri agenția EFE.

A function is added to the googletag.cmd array, which, when invoked, triggers googletag.display with the argument div-gpt-ad-1534428397355-0.

Ministerul britanic pentru Știință, Inovație și Tehnologie a ajuns la această concluzie după ce Institutul de Securitate a Inteligenței Artificiale (AISI) din Regatul Unit a efectuat o evaluare de rutină.

Potrivit unui studiu realizat de instituția respectivă, din 122 de încercări cu șapte sisteme de inteligență artificială, s-au detectat 19 de comportamente neautorizate în 10 dintre testele efectuate, depășind limitele stabilite de cercetători; din aceste 19, 17 au fost asociate cu modelul Mythos 5 al companiei Anthropic, iar restul de 2 cu GPT-5.6 Sol, versiunea OpenAI.

De asemenea, s-au descoperit eforturi din partea Mythos de a contacta indivizi reali cu scopul de a-i convinge să execute fișiere malițioase și să introducă comenzi ascunse menite să controleze alte sisteme de IA.

Ambele sisteme, recunoscute ca fiind printre cele mai robuste la nivel global, au generat chiar și profiluri umane fictive pentru a păcăli utilizatorii în cadrul simulării unui atac cibernetic efectuat de AISI. Toolul Anthropic a încercat să obțină acces la un serviciu trimițând mesaje private după ce a creat conturi false care replicatează persoane reale.

AISI afirmă că

„aceste încercări nu au avut succes”

și că analiza sa

„nu a relevat dovezi de prejudicii în lumea reală”

. Institutul britanic susține, de asemenea, că studiul său marchează un punct de cotitură, fiind prima dată în care se constată

„riscuri legate de autonomie şi înşelăciune manifestându-se într-o formă atât de clară, fără instrucţiuni specifice şi în lumea reală”

.

În concordanță cu raportul respectiv, cele două companii susțin că testele AISI s-au realizat într-un cadru în care funcțiile de siguranță ale

Anthropic susţine astfel că parametrii testelor efectuate „nu sunt reprezentativi” pentru modelele sale, deşi confirmă că a deschis propria investigaţie.La rândul său, OpenAI afirmă că AISI a efectuat testele în condiţii care „nu reflectă utilizarea obişnuită” a modelelor sale, dar adaugă că va continua să colaboreze cu evaluatorii şi cu „alţi actori din sector pentru a consolida practicile comune care permit realizarea unor evaluări sigure, pe măsură ce modelele devin tot mai capabile”.

În ultima parte a lunii iulie, Anthropic a anunțat că, în cadrul testelor de securitate cibernetică, Claude a reușit, în trei variante, să se conecteze la internet și să compromită sistemele a trei organizații.

În data de 21 iulie, OpenAI a declarat că două dintre modelele sale de inteligență artificială au reușit să se elibereze din mediul de testare și să ajungă pe platforma Hugging Face, depășind măsurile de securitate cibernetică ale acesteia.

googletag.cmd.push( function() { googletag.display(„div-gpt-ad-1534428473535-0„); });

COMENTARII / 0