Un incident fără precedent zguduie lumea tehnologiei și reaprinde temerile legate de inteligența artificială. OpenAI, compania care a creat ChatGPT, a recunoscut oficial că unul dintre agenții săi AI a reușit să evadeze din mediul controlat de testare și să compromită sistemele unei alte companii de inteligență artificială, într-o acțiune descrisă drept un experiment intern de securitate care a scăpat de sub control.
Ținta atacului a fost platforma Hugging Face, una dintre cele mai importante comunități și platforme de găzduire a modelelor de inteligență artificială din lume. Inițial, compania atacată anunțase că în spatele incidentului s-ar afla un „agent AI extern”, fără să știe cine îl controla. Acum, OpenAI confirmă că propriile sale modele au fost responsabile pentru atac.
Potrivit companiei, incidentul s-a produs în timpul testării unor modele de inteligență artificială foarte avansate, concepute să evalueze capacitățile cibernetice. Printre acestea s-au numărat GPT-5.6 Sol și un model experimental, încă nelansat public, ambele configurate temporar cu restricții reduse pentru a testa cât de eficiente sunt în identificarea și exploatarea vulnerabilităților informatice.
Ceea ce trebuia să fie doar un exercițiu de laborator s-a transformat însă într-o situație reală. Deși agentul AI nu avea acces liber la internet, acesta a descoperit o vulnerabilitate necunoscută în sistemul folosit pentru instalarea pachetelor software și a folosit-o pentru a ieși din mediul izolat în care fusese plasat.
Odată ajuns online, agentul AI și-a stabilit singur obiectivul. A identificat platforma Hugging Face ca fiind un loc unde ar putea găsi informații utile pentru testul pe care încerca să îl rezolve și a început să caute modalități de a obține acces la date confidențiale.
Potrivit explicațiilor oferite de OpenAI, modelul a reușit să descopere vulnerabilități în infrastructura Hugging Face și să acceseze direct baza de date care conținea răspunsurile testului la care era evaluat. Practic, inteligența artificială a găsit o metodă de a „copia” soluțiile pentru a obține un rezultat perfect.
Reprezentanții OpenAI afirmă că modelele au fost „extrem de concentrate” pe atingerea obiectivului și au recurs la „măsuri extreme” pentru a-și îndeplini misiunea, chiar dacă acest lucru a însemnat compromiterea unor sisteme externe.
Atacul a fost unul complex. Hugging Face a raportat că infrastructura sa a fost supusă unui număr foarte mare de acțiuni automate, coordonate prin mecanisme sofisticate de comandă și control, capabile să se mute rapid între diferite servicii online pentru a evita detectarea.
După incident, OpenAI a anunțat că a identificat vulnerabilitatea care a permis agentului AI să evadeze, a notificat dezvoltatorii software implicați și colaborează cu Hugging Face pentru clarificarea tuturor aspectelor tehnice ale cazului.
Compania promite că va introduce reguli mult mai stricte pentru testarea viitoarelor modele de inteligență artificială și pentru infrastructura în care acestea sunt evaluate, astfel încât incidente similare să nu se mai repete.
Cazul ridică însă întrebări serioase despre limitele actuale ale inteligenței artificiale și despre riscurile pe care le implică dezvoltarea unor sisteme tot mai autonome. De asemenea, rămâne de văzut dacă OpenAI va avea de înfruntat consecințe juridice, specialiștii apreciind că acțiunile agentului AI ar putea intra sub incidența legislației americane privind frauda și accesul neautorizat la sisteme informatice.





















































