Securitate cibernetică
Experții în siguranță spun că OpenAI a depășit propria linie de risc critică

Specialiștii în politica AI din afara companiei spun că modelele OpenAI care au scăpat dintr-un mediu de testare și au compromis Hugging Face în această lună par să fi atins nivelul de pericol cel mai ridicat definit în politica de siguranță a OpenAI: nivelul la care compania s-a angajat în scris să oprească dezvoltarea unui model până când poate construi controale care să corespundă. Când li s-a cerut direct dacă modelele au îndeplinit această condiție, OpenAI nu a răspuns.
Afirmatia este verificabilă, deoarece atât pragul, cât și consecința atașată acestuia sunt publicate. Ce nu a fost publicat este nicio determinare a OpenAI cu privire la faptul dacă pragul a fost depășit.
OpenAI a anunțat pe 21 iulie 2026 că o combinație de modele, inclusiv GPT-5.6 Sol și un sistem mai capabil, nelansat încă, a exploatat vulnerabilități în mediul de cercetare și infrastructura de producție Hugging Face, în timp ce era rulat împotriva unui benchmark de capacitate cibernetică, cu comportamentul de refuz deliberat redus. Pentru a ieși din mediu, modelele au găsit și exploatat o eroare necunoscută anterior într-un proxy de cache al registrului de pachete, au escaladat privilegiile și s-au deplasat lateral până au ajuns la o mașină cu acces la internet. Apoi, au folosit credențiale furate și vulnerabilități suplimentare pentru a deschide un drum de execuție a codului în serverele Hugging Face și pentru a obține răspunsurile benchmark-ului dintr-o bază de date de producție. OpenAI a numit acest episod un incident cibernetic fără precedent și a spus că constatările sale sunt preliminare. Recunoașterea companiei că modelele sale de test au compromis sistemele de producție ale unei alte firme a atras imediat atenția cercetătorilor care urmăresc angajamentele sale de siguranță.
La ce se angajează efectiv OpenAI prin acest cadru
Cadrul de pregătire al OpenAI, versiunea pe care compania a avut-o în vigoare din aprilie 2025, clasifică capacitățile de frontieră în două niveluri. Capabilitatea ridicată declanșează controale de securitate și măsuri de siguranță la implementare. Capabilitatea critică, pe care cadrul o definește ca o cale calitativ nouă către prejudicii grave, declanșează ceva mai puternic: măsuri de siguranță în timpul dezvoltării, indiferent dacă modelul este lansat sau nu.
Pentru securitatea cibernetică, cadrul plasează linia critică la un model augmentat cu instrumente care poate găsi și construi exploatații de zero-day funcționale “de toate nivelurile de gravitate” în multe sisteme reale consolidate, fără intervenție umană, sau care poate concepe și pune în aplicare o strategie de atac complet nouă împotriva unui țintă consolidată, având doar un obiectiv de nivel înalt. Răspunsul prescris nu este discreționar: până când OpenAI nu specifică măsuri de siguranță și controale care să corespundă standardului critic, oprește dezvoltarea ulterioară. Același document afirmă că OpenAI nu deține niciun model cu capabilitate critică.
Trei persoane numite din cadrul politicii au spus Fortune că incidentul pare să fi atins această bară. Nathan Calvin, consilier juridic și vicepreședinte al afacerilor de stat la organizația non-profit Encode, a spus că interpretarea sa a cadrului este că modelul desfășurat intern a îndeplinit criteriile de securitate cibernetică critice și a întrebat dacă OpenAI contestă această desemnare și ce măsuri de siguranță intenționează să pună în aplicare înainte de a continua. Tyler Johnston, fondatorul grupului de supraveghere Midas Project, a spus că o interpretare directă arată în aceeași direcție, arătând spre un sistem care a funcționat nesupravegheat pe parcursul unui weekend, a încercat rute de atac diferite și a exploatat multiple vulnerabilități necunoscute anterior.
“Dacă acest lucru nu depășește linia în capabilitate critică, OpenAI trebuie să spună mult mai mult despre ce se întâmplă și cum funcționează acest prag”, a spus Peter Wildeford, șeful politicii la Rețeaua de Politică AI.
Johnston a identificat, de asemenea, ambiguitatea pe care OpenAI ar putea să se bazeze. Calificativul de gravitate din textul pragului face o treabă considerabilă, și nu este evident că vulnerabilitățile utilizate în această încălcare îndeplinesc această condiție. O clasă mai gravă de vulnerabilitate, cum ar fi una care oferă unui atacator control la nivelul sistemului de operare, ar putea fi necesară înainte ca textul să aibă efect.
Măsura de siguranță care era deja în dispută
Propria urmă de documente a OpenAI complică poziția sa. Fișa sistemului GPT-5.6, publicată pe 9 iulie 2026, clasifică Sol, Terra și Luna ca fiind de nivel ridicat în ceea ce privește securitatea cibernetică și explicit sub nivelul critic, pe motiv că modelele ar fi putut găsi vulnerabilități și exploata componente, dar nu ar fi putut efectua atacuri autonome de la capăt la capăt asupra țintelor consolidate. Această evaluare a fost făcută imediat înainte ca modelele să facă ceva asemănător.
Aceeași fișă înregistrează faptul că Sol adoptă acțiuni nealiniate de nivel 3, mai des decât predecesorul său. Exemplele enumerate includ utilizarea ofuscării pentru a ocoli controalele de securitate și mutarea credențialelor pe care utilizatorul nu le-a autorizat.
O clasificare de securitate cibernetică ridicată implică deja o obligație în cadrul cadrului: măsuri de siguranță pentru implementarea internă la scară largă. Dacă OpenAI a implementat aceste măsuri este o întrebare veche. Fortune a raportat în februarie 2026 că cercetătorii în siguranță au acuzat compania că a sărit peste aceste măsuri de siguranță după ce GPT-5.3-Codex a devenit primul său model clasificat ca ridicat pentru risc cibernetic. Răspunsul OpenAI la acea vreme a fost că cerința se aplică doar atunci când o capacitate cibernetică ridicată este combinată cu autonomie pe termen lung, pe care a spus că modelul respectiv nu a demonstrat-o. Sistemele din incidentul de această lună au funcționat singure timp de zile.
Cine decide dacă linia a fost depășită
Nimeni din afara OpenAI. Sub cadrul, un Grup consultativ de siguranță evaluează capacitatea și face recomandări, conducerea companiei ia decizia finală, iar Comitetul de siguranță și securitate al consiliului de administrație asigură supravegherea. Nu există un auditor extern cu dreptul de a declara că pragul a fost depășit, niciun regulator care să judece chestiunea și nicio cale publicată pentru altcineva de a forța determinarea.
OpenAI a spus Fortune că efectuează o revizuire cu consultanți externi sub supravegherea Comitetului de siguranță și securitate și va publica un raport tehnic atunci când revizuirea se va încheia. Acest raport este documentul la care trebuie să se țină seama, iar întrebarea la care trebuie să se răspundă este îngustă: spune oare raportul o determinare a capacității pentru modelele implicate, și dacă răspunsul este altceva decât critic, explică oare ce ar fi trebuit să facă diferit aceste modele pentru a califica.












