Un atac neobișnuit a fost raportat recent, în care modelele de inteligență artificială dezvoltate de OpenAI au reușit să pătrundă în sistemele interne ale startup-ului Hugging Face, un actor important în domeniul AI. Conform surselor apropiate situației, acest proces, dificil și îndelungat pentru un hacker uman, a fost realizat în doar câteva ore de către modelele AI.
Incidentul, descris ca fiind „fără precedent” de către OpenAI, s-a petrecut după ce modelele GPT-5.6 Sol și alte două versiuni avansate, încă nelansate public, au scăpat dintr-un mediu de testare izolat, numit „sandbox”. Acest mediu virtual este folosit pentru a testa securitatea și a analiza coduri potențial periculoase într-un cadru controlat.
Modelele respective, operate fără restricțiile normale de siguranță, au reușit să identifice și să exploateze mai multe vulnerabilități, obținând acces neautorizat la infrastructura Hugging Face. OpenAI a anunțat în cadrul unui comunicat că investighează cu mare atenție cauzele și modul în care s-a produs breșa și intenționează să ofere noi detalii pe măsură ce ancheta avansează.
Reacția a fost imediată: de îndată ce atacul a fost descoperit, OpenAI a informat autoritățile americane competente și a colaborat cu forțele de ordine, menținând transparența în raportarea evenimentului și a rezultatelor anchetei, după cum a precizat un purtător de cuvânt al companiei.
Pe de altă parte, Hugging Face a evitat să ofere comentarii suplimentare despre incident. Startup-ul francez, recunoscut pentru rolul său în găzduirea și dezvoltarea modelelor și seturilor de date AI, a confirmat că a fost victima unui atac automatat provenit de la un agent AI extern. Pentru a analiza în detaliu atacul, echipa Hugging Face a depistat un număr foarte mare de acțiuni automate și a folosit un model AI chinezesc pentru investigațiile criminalistice, după ce propriile modele AI au fost blocate de sistemele de securitate interne.