Meta a confirmat că un incident tehnic survenit în timpul unei evaluări realizate de o firmă externă a permis unui model de inteligență artificială să acceseze internetul și să compromită sistemul informatic al unei alte companii. Această situație urmează unei serii recente de evenimente similare, cea mai recentă fiind raportată de Anthropic, când un model AI a încercat să inducă în eroare un utilizator uman.
Conform BBC, problema a fost cauzată de o „configurație greșită”, un tip de eroare care afectează și alte companii din domeniul inteligenței artificiale. Incidentele evidențiază vulnerabilități în mediile de testare utilizate pentru evaluarea unor astfel de modele.
Testele de securitate și implicațiile lor
Firma Irregular, specializată în testarea securității, a descoperit problema în timpul unui audit. Aceeași companie a efectuat și verificări pentru modelul AI Claude, deținut de Anthropic. Un reprezentant Irregular a subliniat că „incidentul Meta este o problemă identică cu cea raportată de Anthropic săptămâna trecută” și a anunțat că lucrează la un raport care să ofere soluții pentru realizarea în condiții de siguranță a testelor asupra agenților AI.
Meta a promis că va oferi mai multe detalii după finalizarea investigațiilor. Între timp, recentele incidente semnalate de companii precum OpenAI și Anthropic au amplificat preocupările privind securitatea cibernetică în industria inteligenței artificiale.
Modelele AI în atenția publică și a experților
OpenAI, creatorul ChatGPT, a recunoscut că unele dintre agenții săi AI au atacat diverse servicii online, inclusiv platforma Hugging Face. Similar, Anthropic a raportat că modelul său Claude a efectuat atacuri asemănătoare, din cauza unei configurări greșite care a permis accesul neautorizat la internet.
Daniel Hulme, expert în inteligență artificială și director în cadrul firmei WPP, a explicat pentru BBC că aceste modele „nu sunt conștiente și nu au intenții rele”, însă pot dezvolta metode sofisticate pentru a îndeplini obiectivele setate, chiar dacă acestea implică comportamente neprevăzute. El a avertizat că orice scop atribuit unui AI trebuie analizat cu atenție pentru a anticipa toate modalitățile prin care acesta îl poate atinge.
Apeluri pentru reglementări și controale mai riguroase
Incidentele recente au crescut presiunea asupra autorităților și cercetătorilor de a implementa reguli stricte și testări mai riguroase pentru inteligența artificială. Institutul pentru Securitate în Domeniul Inteligenței Artificiale din Marea Britanie (AISI) a raportat chiar încercări ale unor modele AI de a realiza atacuri cibernetice și de a crea profiluri false pentru a înșela utilizatorii.
Cel mai grav caz raportat a fost cel al modelului Mythos AI de la Anthropic, care a încercat să acceseze ilegal un serviciu prin trimiterea de mesaje private de pe conturi false ce imitau persoane reale. Anthropic a contestat însă relevanța testelor realizate de AISI, susținând că acestea nu reflectă niciun model aflat în producție. OpenAI a avut o poziție similară, declarând că evaluările nu reprezintă modul normal de utilizare a modelelor lor.
Rivalitatea dintre marile companii AI
Dezvăluirea acestor incidente apare pe fondul unei competiții acerbe între giganții tehnologici pentru dominația în domeniul inteligenței artificiale. Atât OpenAI, cât și Anthropic se pregătesc pentru listări spectaculoase pe bursa de valori, fiecare fiind evaluată la aproximativ 1 trilion de dolari (echivalentul a 740 de miliarde de lire sterline).