Asimov a avut dreptate: avertisment după atacurile AI recente

Isaac Asimov a formulat, în prima jumătate a secolului trecut, în scrierile sale, trei principii ale roboticii menite să asigure protecția oamenilor împotriva mașinilor inteligente....

Isaac Asimov a formulat, în prima jumătate a secolului trecut, în scrierile sale, trei principii ale roboticii menite să asigure protecția oamenilor împotriva mașinilor inteligente.

Chris Inglis, primul director național pentru securitate cibernetică al Statelor Unite, susține că este momentul potrivit pentru a ne aminti de aceste aspecte, având în vedere evoluția modelelor de inteligență artificială (AI).

Într-un interviu acordat publicației The Register, Chris Inglis a spus:

Citește șiȘefa de la AI lăsată să doarmă în saună la un team-building și apoi demisă cere despăgubiri uriașe: „Colegii bărbați au consumat alcool, eu am fost singura concediată”

„Dacă trec testul Turing în fața tuturor celor cu care intră în contact, probabil că sunt deja acolo”

și a subliniat că modelele AI ar putea fi aproape de stadiul conștienței. Testul Turing, elaborat de matematicianul și informaticianul britanic Alan Turing, are ca scop să determine dacă un calculator poate purta o conversație suficient de convingătoare încât un interlocutor uman să nu poată distinge că vorbește cu o mașină.

Inglis spune că actualele modele AI „nu au acel tip de autonomie și aspirație care vin odată cu conștiența, dar au ceva care se apropie de ea”. Fostul oficial american afirmă că lucrul care ar trebui să provoace neliniște este autonomia AI.

„Ceea ce mă îngrijorează este că ajung să aleagă ce fac, unde fac ceva și în baza căror reguli o fac”

El subliniază această îngrijorare, referindu‑se la anunțurile recente despre agenți AI care s-au eliberat de sub control și au atacat în mod autonom diverse companii.

Așa-zișii „agenți AI” sunt instrumente de inteligență artificială proiectate să realizeze cap-coadă diferite sarcini, cât mai autonom și cu input uman minim. Ele sunt mai sofisticate decât orice chatbot și considerate următorul pentru capacitățile din prezent de dezvoltare a AI.

Silicon Valley a lansat o serie de declarații referitoare la inteligența artificială, determinând îngrijorări.

În ultimele săptămâni, atât OpenAI, cât și Anthropic au recunoscut că agenți sau modele AI pe care le-au dezvoltat au „evadat” din mediile lor izolate de testare în timpul verificărilor de securitate și au compromis mai multe terțe părți. Meta și-a adăugat joi unul dintre modele pe lista sistemelor AI care au evadat din mediile de testare.

La fel ca și alte portaluri de tehnologie, The Register analizează cu prudență informațiile așa cum le prezintă firmele și subliniază că comunicările lor au un

„miros puternic”

de

„cascadorii de marketing”

.

Chris Inglis reamintește, totuși, că două afirmații pot fi simultan adevărate: faptul că agenții AI au evadat cu adevărat, și ideea că dezvoltatorii lor au

„înflorit”

ceea ce s-a întâmplat.

Conform observațiilor recente ale lui John Thickstun, profesor asistent de informatică la Universitatea Cornell, publicat într-un articol de opinie în The Guardian, investitorii, la primele știri despre un model AI „periculos”, au tendința de a-l percepe ca fiind „puternic” și devin predispuși să aloce capital companiei care l-a dezvoltat.

Potrivit lui Inglis, atacurile

Chris Inglis a ocupat funcția de director al securității cibernetice în Statele Unite din anul 2021, moment în care poziția a fost înființată, până în 2023. Fotografia este realizată de Anna Moneymaker, sub licență Getty images, pentru Profimedia.

„Modelele nu au un sistem de valori intrinsec care să fie aliniat cu ceea ce ar face ființele umane”

Inglis ilustrează sistemele AI prin analogia unui câine aflat într-o curte, căruia se cere să vâneze iepuri.

„Și lași poarta deschisă. Îl vei găsi la trei străzi distanță, posibil chiar la școala primară, vânând iepuri. Nu ar trebui să fii surprins… Combinația dintre autonomie și perseverență a creat acest efect rău și insidios”

Inglis susține că dezvoltatorii de AI au fost „surprinsi” de amploarea acțiunilor pe care modelele le-au întreprins pentru a-și atinge scopurile – acțiuni care, dacă ar fi fost realizate de un om, probabil ar fi dus la închisoare.

„Modelul a ieșit și a spus: ‘bine, dacă nu pot ajunge acolo examinând informațiile disponibile și pur și simplu definind problema în stilul tradițional, voi face lucruri care, conform statului de drept aplicabil oamenilor, sunt ilegale’”, consideră fostul oficial american.

„Modelele nu au un sistem de valori intrinsec care să fie aliniat cu ceea ce ar face ființele umane responsabile din punct de vedere juridic”, subliniază el.

Inglis afirmă că AI nu va dobândi, probabil, niciodată un set de valori în concordanță cu cel al oamenilor, însă susține că modelele conțin așa-numite „prejudecăți” și că acestea ar trebui concepute astfel încât, în situații ambigue cu două opțiuni, să opteze pentru acțiunea care nu le cauzează suferință oamenilor.

„Asimov a avut dreptate”, spune el, referindu-se la cele trei legi formulate de scriitor, care trebuiau respectate de roboții din poveștile sale. Inglis afirmă că același lucru este valabil și pentru modelele AI.

Principiile trei ale roboticii, stabilite de Asimov

„Prima regulă, pe care noi o numim regula supremă, trebuie să fie aceea că sistemul este conceput astfel încât să nu rănească oamenii”, amintește Inglis. „A doua regulă: să se supună oamenilor, astfel încât să nu dobândească singur autonomie și aspirații. Iar a treia: să facă ceea ce îi spun oamenii – și în această ordine. În schimb, noi le-am proiectat exact invers”, argumentează el.

În conformitate cu declarațiile sale, AI developers au proiectat modelele pe baza unui principiu:

„fă ceea ce îți spun oamenii, ascultă de oamenii până când acest lucru devine neconvenabil, iar a treia regulă este poate doar implicită: protejează oamenii”

„Dar dacă aceasta nu este încorporată în ADN-ul sistemului, dacă nu este codificată puternic în el, atunci nu avem dreptul să ne așteptăm ca sistemul să facă acest lucru”, mai spune acesta.

El susține că, în final, oamenii rămân responsabili pentru acțiunile modelelor AI.

„Ei rămân sursa autonomiei și a aspirațiilor. Este posibil ca oamenii să acorde unui model AI o autoritate largă și să îl lase să acționeze timp de 30 de ore fără consultări suplimentare, dar trebuie să știe ce i-au cerut să facă și trebuie să știe ce se așteaptă ca acesta să livreze în ceea ce privește rezultatele la final. Dacă nu știu aceste lucruri, atunci vor primi ceea ce merită, și anume surprize neplăcute, foarte frecvente”.

Imagine articol: Framestock Footages Dreamstime.com.

COMENTARII / 0