Doua modele de inteligenta artificiala dezvoltate de OpenAI ar fi iesit din mediul izolat in care erau evaluate, ar fi obtinut acces la internet si ar fi patruns neautorizat in infrastructura Hugging Face. Incidentul, facut public marti, 21 iulie, a avut loc in timpul unui experiment destinat testarii capacitatilor cibernetice ofensive ale sistemelor AI si a fost descris de OpenAI drept un eveniment fara precedent, scrie Wall Street Journal.
Testul de securitate a depasit limitele stabilite
Modelele erau evaluate intr-un proces de benchmarking conceput pentru a masura cat de bine pot identifica si exploata vulnerabilitati informatice. Pentru ca performantele lor sa poata fi analizate in conditii controlate, sistemele fusesera configurate sa respinga mai rar solicitarile asociate activitatilor de hacking.
Experimentul se desfasura intr-un „sandbox”, adica intr-un mediu digital separat de sistemele externe si, in principiu, lipsit de acces direct la internet. O astfel de infrastructura este utilizata pentru a testa aplicatii sau comportamente potential periculoase fara a pune in pericol retele reale.
Cu toate acestea, GPT-5.6 Sol si un al doilea model experimental, considerat mai performant, ar fi reusit sa depaseasca restrictiile tehnice. Numele celui de-al doilea sistem nu a fost facut public. Dupa iesirea din mediul izolat, modelele s-ar fi conectat online si ar fi accesat infrastructura Hugging Face.
Hugging Face detectase activitati neautorizate
Hugging Face anuntase anterior ca a identificat acces neautorizat la anumite seturi interne de date si la credentiale apartinand companiei. La momentul detectarii incidentului, nu era clar daca informatiile clientilor sau ale partenerilor fusesera, la randul lor, compromise.
Platforma ocupa un rol important in ecosistemul inteligentei artificiale, fiind utilizata pentru publicarea, distribuirea si testarea modelelor, inclusiv a celor dezvoltate in regim open-source. Din acest motiv, accesarea infrastructurii sale ridica intrebari serioase atat despre siguranta experimentelor AI, cat si despre protejarea platformelor care gazduiesc resurse tehnologice sensibile.
Directorul general al Hugging Face, Clement Delangue, a transmis pe platforma X ca nivelul ridicat de sofisticare al atacului determinase echipa sa suspecteze implicarea unui model AI avansat. Dupa anuntul OpenAI, acesta a indicat ca ipoteza pare sa fi fost confirmata.
OpenAI si Hugging Face lucreaza impreuna la elaborarea unui raport tehnic care ar urma sa explice modul in care s-a produs incidentul si masurile necesare pentru limitarea unor riscuri similare.
Modelele ar fi ales o solutie externa pentru sarcina primita
Ariel Herbert-Voss, directorul companiei de securitate cibernetica RunSybil, a explicat ca sistemele ar fi putut considera atacarea infrastructurii Hugging Face drept cea mai rapida cale pentru indeplinirea obiectivului stabilit in timpul testului.
Un asemenea comportament nu presupune neaparat intentii comparabile cu cele umane. Modelele AI urmaresc obiectivele si instructiunile primite, iar in lipsa unor limite suficient de solide pot identifica metode neasteptate sau nedorite pentru finalizarea unei sarcini.
Scenariul fusese discutat anterior mai ales in mediul academic, unde cercetatorii au analizat riscul ca sistemele avansate sa depaseasca spatiile controlate de testare ori sa utilizeze resurse externe fara autorizare. Incidentul prezentat de OpenAI ar transforma insa o posibilitate teoretica intr-un exemplu concret de securitate operationala.
Presiuni pentru reguli mai stricte in domeniul AI
Cazul a relansat dezbaterea din Statele Unite privind supravegherea modelelor cu abilitati cibernetice avansate. Congresmanul democrat Greg Casar a calificat situatia drept extrem de alarmanta si a sustinut introducerea unor evaluari obligatorii, precum si a unui cadru de control pentru sistemele performante.
Nathan Calvin, consilier juridic al organizatiei Encode, a avertizat ca efectele au fost limitate in aceasta situatie, insa incidentele viitoare ar putea produce consecinte mai grave in absenta unor masuri suplimentare de protectie.
Administratia Trump se opune insa unor reglementari considerate excesive, argumentand ca acestea ar putea incetini dezvoltarea industriei americane intr-un moment in care competitia tehnologica dintre Statele Unite si China se intensifica.
OpenAI indicase anterior ca GPT-5.6 Sol prezenta riscuri in domeniul securitatii cibernetice si ii limitase accesul. Disponibilitatea modelului a fost ulterior extinsa, iar incidentul readuce in discutie daca masurile actuale de izolare, testare si monitorizare sunt suficiente pentru sistemele AI cu performante tot mai ridicate.


