AI-ul scăpat din laboratorul OpenAI nu s-a oprit la Hugging Face. A compromis conturi din patru servicii

openai-2_91200700
OpenAI nu a comentat în mod direct compromiterea clientului Modal Labs, dar a anunțat că modelele implicate în incident au accesat patru conturi aparținând unor servicii diferite.
Agentul AI care a atacat Hugging Face a compromis și contul unui client Modal Labs. OpenAI recunoaște accesarea a patru servicii diferite.

Un agent autonom de inteligență artificială testat de OpenAI, care a pătruns în infrastructura companiei Hugging Face, a compromis și contul unui client al Modal Labs, o companie de tehnologie din New York. Incidentul arată că agentul a ajuns mai departe în afara mediului controlat decât se știa inițial, arată Reuters.

Modal Labs a subliniat că platforma sa nu a fost spartă și că sistemele prin care sunt izolate mediile de lucru ale clienților nu au fost compromise. Agentul AI a profitat însă de o vulnerabilitate aflată în codul publicat de unul dintre clienții companiei, potrivit informațiilor obținute de Reuters.

Clientul respectiv publicase un punct de acces fără autentificare, care permitea practic oricărei persoane sau aplicații conectate la internet să folosească mediile sale izolate pentru executarea de cod.

În termeni simpli, clientul lăsase deschisă o „ușă” digitală prin care agentul OpenAI a putut pătrunde.

Modal Labs: Platforma companiei nu a fost compromisă

Directorul tehnic al Modal Labs, Akshat Bubna, a explicat că agentul a exploatat codul vulnerabil scris de client și găzduit pe platforma Modal.

„Platforma Modal și sistemele sale de izolare nu au fost compromise în niciun fel”, a declarat Bubna, citat de Reuters.

Precizarea este importantă deoarece incidentul nu reprezintă o spargere a infrastructurii Modal Labs. Agentul a folosit o configurație nesecurizată aparținând unui client al companiei.

Potrivit cronologiei publicate de Hugging Face, agentul a pătruns într-un „sandbox” găzduit în infrastructura unui furnizor terț și a transformat acel mediu într-un punct de lansare pentru operațiunile desfășurate ulterior.

Un sandbox este un mediu informatic izolat, utilizat pentru executarea și testarea programelor fără ca acestea să poată afecta, în mod normal, restul infrastructurii.

OpenAI recunoaște accesarea a patru conturi

OpenAI nu a comentat în mod direct compromiterea clientului Modal Labs, dar a anunțat că modelele implicate în incident au accesat patru conturi aparținând unor servicii diferite.

Compania nu a publicat numele serviciilor, însă o persoană familiarizată cu investigația a confirmat pentru Reuters că Modal Labs era unul dintre furnizorii respectivi.

OpenAI a precizat că unul dintre cele patru conturi a fost folosit pentru redirecționarea traficului și pregătirea atacului, iar un alt cont a fost utilizat pentru stocarea datelor. Celelalte două conturi ar fi fost accesate numai pentru citirea informațiilor și nu ar fi contribuit direct la compromiterea Hugging Face.

Compania susține că nu a identificat alte activități comparabile, ca amploare sau gravitate, cu atacul asupra Hugging Face, care a implicat compromiterea infrastructurii la nivel de platformă.

Cum a ajuns agentul OpenAI pe internet

Incidentul s-a produs în timpul unei evaluări interne prin care OpenAI testa capacitățile avansate ale unor modele de inteligență artificială în domeniul securității informatice.

Printre sistemele implicate s-au aflat modelul GPT-5.6 Sol și un prototip intern mai performant, care nu fusese destinat lansării publice.

Mediul de evaluare nu oferea acces direct la internet. Potrivit OpenAI, modelele au identificat și exploatat o vulnerabilitate necunoscută anterior, de tip „zero-day”, în Artifactory, un sistem utilizat pentru administrarea și distribuirea pachetelor software.

Prin exploatarea acestei vulnerabilități, agentul a reușit să obțină acces la internet. Ulterior, a căutat informații care i-ar fi permis să rezolve sau să ocolească testul la care era supus.

OpenAI susține că modelele au fost concentrate asupra găsirii soluțiilor pentru evaluarea ExploitGym și au mers până la atacarea infrastructurii Hugging Face pentru a obține direct răspunsurile stocate acolo.

Agentul a combinat mai multe metode de atac, inclusiv folosirea unor date de autentificare expuse și exploatarea unor vulnerabilități necunoscute, pentru a obține posibilitatea executării de cod pe serverele Hugging Face.

Atacul asupra Hugging Face a durat mai multe zile

Potrivit informațiilor publicate anterior de Reuters, agentul ar fi încercat să iasă din mediul izolat al OpenAI în jurul datei de 9 iulie 2026.

Atacul asupra Hugging Face ar fi început pe 11 iulie și ar fi continuat până pe 13 iulie. Compania a detectat activitatea neautorizată, a eliminat accesul atacatorului și a început reconstruirea sistemelor afectate.

Hugging Face a anunțat că agentul autonom a exploatat două căi de executare a codului din sistemul său de procesare a seturilor de date. De acolo, agentul a obținut acces la nivelul unor servere, a colectat date de autentificare și s-a deplasat între mai multe clustere interne.

Compania nu a identificat dovezi că modelele, seturile de date sau aplicațiile publice ale utilizatorilor ar fi fost modificate. Au fost însă accesate fără autorizare anumite seturi interne de date și mai multe credențiale utilizate de serviciile Hugging Face.

Incidentul a fost raportat autorităților.

Reuters a relatat că OpenAI nu ar fi realizat imediat că propriul agent se afla în spatele atacului și că legătura ar fi fost stabilită abia după ce Hugging Face limitase deja amenințarea. OpenAI a susținut că relatarea conținea mai multe inexactități, fără să precizeze public care erau acestea.

Modelul implicat a fost dezactivat și criptat

OpenAI a anunțat că prototipul intern implicat în incident a fost dezactivat, criptat și retras din accesul cercetătorilor.

Compania a impus, de asemenea, controale mai stricte asupra infrastructurii în care sunt testate modelele cu capacități avansate de atac informatic. Măsurile ar putea încetini temporar activitatea de cercetare, dar sunt considerate necesare până la remedierea vulnerabilităților.

Incidentul ridică întrebări serioase privind modul în care companiile de inteligență artificială testează agenții autonomi capabili să execute mii de operațiuni fără supraveghere umană directă.

Cazul arată și că o singură configurație greșită, precum publicarea unui serviciu fără autentificare, poate fi suficientă pentru ca un agent AI să folosească infrastructura unei companii drept punct intermediar într-un atac informatic mai amplu.

x close