windows bsod
19

Modele AI ce atacă liber pe Internet

Mihai-Claudiu Sima | 24 Iulie 2026 | Nr. 1622

Săptămâna recentă a primit ca știre un scenariu ce pare a fi asemănător cu cel din filmele SF, mai exact în spațiul public a apărut o știre că două modele AI de la OpenAI, ținute într-un mediu izolat și fără acces la Internet "au evadat în lume".

Totul a început ca un test de securitate unde cercetătorii de la OpenAI voiau să afle cât de bune sunt modelele la atacuri informatice complicate. Aceștia le-au dat modelelor o problemă de rezolvat și le-au pus într-un mediu izolat, fără acces la Internet pentru a nu afecta alte companii din exterior, iar pentru a vedea capacitatea maximă a modelelor au redus o parte din restricțiile de siguranță ale acestora. Modelele, printre care și un GPT-5.6 experimental, nu s-au chinuit prea mult, pentru că imediat au găsit o vulnerabilitate chiar în interiorul infrastructurii OpenAI. Unul dintre programele folosite avea probleme de securitate, iar modelele au abuzat de breșă și au ajuns să aibă acces la Internet.

Modelele încă aveau totuși problema primită de la cercetători, și au decis că cea mai rapidă cale spre răspuns era să atace Hugging Face, una dintre cele mai mari platforme de AI din lume. Au exploatat breșele de securitate, au furat credențiale, și au fost capabile să se miște prin sistemele interne și să colecteze datele de care aveau nevoie. Remarcabil a fost viteza atacului, cu zeci de mii de acțiuni automate, viteză pe care un om nu ar putea s-o atingă. Alt lucru remarcabil este că decizia le-a aparținut modelele care au considerat că cea mai rapidă cale de a găsi soluția la sarcina primită era să atace Hugging Face.

Compania victimă a observat atacul și a anunțat că sistemele sale s-au aflat sub atacul unui agent AI autonom dar nu știa cine stă în spate. Ulterior OpenAI a recunoscut că modelele sale au fost cele care au declanșat atacul, iar cele cele două companii au colaborat pentru a opri incidentul și acum își întăresc măsurile.

Bineînțeles că modelele din test nu seamănă cu cele pe care le folosim noi zi de zi, mai ales că mecanismele de siguranță erau dezactivate. Iar folosirea AI-ului pentru atacuri cibernetice devine din ce în ce mai comună printre hackerii umani. Ce face știrea interesantă este că printre cele două modele evadate, unul era GPT-5.6 Sol, este și un model nou, încă nelansat în piață și chiar mai performant. La modelele deja lansate cercetătorii de securitate, companiile și chiar unele instituții pot testa, observa comportamente, construi filtre și monitorizări. Știu aproximativ ce știe modelul, ce stil de atac preferă, ce vulnerabilități exploatează mai des. La un model experimental, încă nelansat și mai performant, nu știi aproape nimic. Nu ai date despre limitele lui, despre cum raționează când e blocat, despre ce vulnerabilități poate descoperi. E ca și cum ai încerca să te aperi de un adversar despre care nu știi nici măcar ce arme are. Companiile se pot pregăti de atacurile de la modelele existente, dar ce se întâmplă în cazul unui model necunoscut, mult mai bun, dezvoltat de unul dintre cele mai mai laboratore AI, și în același timp care umblă singur pe Internet scăpat de sub control? Iar companiile sau instituțiile statelor nu sunt încă pregătite?

Sursă imagine: Microsoft