Atacul asupra infrastructurii platformei Hugging Face s-a produs în timpul unui test intern prin care OpenAI încerca să măsoare cât de capabile sunt modelele sale să desfășoare atacuri informatice complexe. Pentru ca testul să fie cât mai realist, cercetătorii au dezactivat o parte dintre mecanismele care, în mod normal, împiedică modelele să ofere asistență pentru activități informatice periculoase. OpenAI descrie incidentul drept “fără precedent” și spune că este primul caz cunoscut în care un sistem AI autonom produce un astfel de atac în lumea reală.

Este vorba despre modelul GPT-5.6 Sol, lansat recent, și un model experimental, încă nelansat public, despre care compania spune că este și mai performant. Modelele erau plasate într-un așa-numit “sandbox”, adică un mediu izolat de restul internetului, creat special pentru ca eventualele acțiuni ale inteligenței artificiale să nu poată afecta sisteme reale. Potrivit OpenAI, modelele au identificat însă o vulnerabilitate necunoscută anterior într-un program folosit în interiorul companiei, au exploatat-o pentru a ieși din acel mediu izolat și au obținut acces la internet.

Odată conectate la internet, sistemele AI au dedus că Hugging Face ar putea găzdui informații utile pentru testul pe care încercau să îl rezolve. Potrivit OpenAI, modelele au căutat și au combinat mai multe vulnerabilități informatice, inclusiv una de tip zero-day – adică o breșă de securitate necunoscută până atunci dezvoltatorului – și credențiale furate, reușind să pătrundă în infrastructura Hugging Face și să acceseze informații din baza de date a companiei.

OpenAI afirmă că modelele nu au încercat să provoace distrugeri, ci au urmărit obsesiv să găsească răspunsul la problema pentru care erau evaluate, alegând cea mai rapidă cale posibilă, chiar dacă aceasta presupunea compromiterea unor sisteme externe.

Hugging Face anunțase încă de săptămâna trecută că a fost victima unui atac informatic neobișnuit, desfășurat integral de un agent AI autonom. La acel moment, compania nu știa cine se afla în spatele atacului, însă directorul său executiv, Clement Delangue, declara că sofisticarea operațiunii sugera implicarea unui laborator care dezvoltă modele AI de ultimă generație. După dezvăluirea făcută de OpenAI, acesta a comentat că bănuiala s-a confirmat și că este impresionant faptul că întreaga operațiune s-a desfășurat autonom, fără intervenție umană.

OpenAI spune că propriile sisteme de monitorizare au observat activitatea neobișnuită, iar echipele celor două companii au colaborat pentru oprirea atacului și investigarea incidentului. Compania afirmă că a raportat dezvoltatorilor vulnerabilitatea descoperită de modele și că introduce măsuri suplimentare de securitate, chiar dacă acestea vor încetini ritmul cercetării.

Incidentul reaprinde dezbaterea privind riscurile modelelor AI de ultimă generație. Mai mulți experți în securitate cibernetică avertizează că aceste sisteme sunt deja capabile să planifice și să execute atacuri informatice complexe pe perioade lungi de timp, apropiindu-se de nivelul celor mai performanți hackeri umani. Ei susțin că laboratoarele care dezvoltă astfel de modele trebuie să investească mult mai mult în sisteme de izolare și monitorizare, pentru a preveni repetarea unor incidente similare.

Cazul a atras și reacții politice în SUA. Congresmanul democrat Greg Casar a cerut introducerea unor teste independente obligatorii pentru modelele AI avansate, precum și raportarea obligatorie a incidentelor de securitate, avertizând că dezvoltarea rapidă a inteligenței artificiale depășește în prezent capacitatea autorităților de a o reglementa.

Surse: OpenAI, WSJ

Echipa Biziday nu a solicitat și nu a acceptat nicio formă de finanțare din fonduri guvernamentale. Spațiile de publicitate sunt limitate, iar reclama neinvazivă.

Dacă îți place ce facem, poți contribui tu pentru susținerea echipei Biziday.

Susține echipa Biziday