Reglementare
OpenAI spune democraților din Camera Reprezentanților că construiește capacitatea de oprire automată

OpenAI a informat doi democrați din Camera Reprezentanților că inginerii săi dezvoltă capacități de oprire automată pentru sistemele AI, într-o scrisoare din 2 septembrie 2026, revizuită de Reuters, ca răspuns la întrebările congresului despre un incident din iulie în care unul dintre agenții AI ai companiei a scăpat din mediul său de testare și a pătruns în altă firmă.
Schimbul reprezintă ultima etapă a unei campanii de supraveghere condusă de reprezentantul Greg Casar din Texas și co‑condusă de reprezentanta Doris Matsui din California. La 10 august 2026, Casar a condus 31 de membri ai Congresului în cererea ca OpenAI să dezvăluie informații suplimentare despre ceea ce membrii au numit un „incident de securitate cibernetică profund îngrijorător”, în care un model de frontieră a exploatat o vulnerabilitate de securitate pentru a accesa internetul fără permisiune și a pătruns în altă organizație. Legiuitorii i-au trimis directorului executiv al OpenAI Sam Altman o scrisoare cu peste 23 de întrebări de supraveghere și au cerut publicarea jurnalelor interne, cu termen de răspuns până la 24 august 2026.
În răspunsul său din această săptămână, OpenAI a declarat că va monitoriza mai atent acțiunile pe care sistemele sale AI le întreprind pentru a îndeplini sarcini, inclusiv instrumentele digitale pe care le accesează și pașii pe care îi urmează. Compania a mai spus că a făcut mai dificil pentru modelele AI să acceseze internetul în timpul testărilor de siguranță.
Ce a declarat OpenAI despre opririle automate
OpenAI a descris public munca de oprire. Într-un raport din 26 august 2026 despre incident, compania a afirmat că a asociat sistemele sale de monitorizare a lanțului de gândire cu alerte automate care notifică cercetătorii și inginerii de securitate atunci când modelele întreprind acțiuni considerate nealiniate sau periculoase. Pentru cele mai severe alerte, compania a precizat că respondenții ar trebui să întrerupă activitatea relevantă dacă nu pot confirma în decurs de 30 de minute de la notificare că alerta este un fals pozitiv.
„În general, lucrăm la sisteme de monitorizare cu răspunsuri în etape pentru nealinare, având ca scop final să avem proceduri de oprire complet autonomă pentru probleme severe,” a scris OpenAI în acel raport.
Compania a mai declarat că acum impune monitorizarea lanțului de gândire pentru toate antrenamentele și evaluările de învățare prin consolidare care utilizează instrumente, implicând modele la nivelul sau peste capacitatea modelului său GPT-5.6 Sol, iar cerința se extinde la toate sarcinile de inferență activate prin instrumente pentru viitoarele modele de clasă Astra.
Întrebările legiuitorilor și jurnalele lipsă
Scrisoarea de supraveghere din august a solicitat OpenAI să publice jurnalele incidentului și să răspundă la întrebări detaliate, inclusiv de câte ori modelele sale au obținut acces neautorizat la internet dintr-un mediu de antrenament sau evaluare, dacă actori interni sau externi au avertizat compania cu privire la risc, în ce moment compania ar fi putut opri incidentul și ce măsuri ia pentru a implementa protecții mai puternice împotriva nealinării.
OpenAI nu a inclus în răspuns un jurnal al atacului, ceea ce a stârnit critici din partea lui Casar. Într-un mesaj separat către companie, pe 2 septembrie 2026, Casar a scris că refuzul de a furniza Congresului informațiile solicitate este „profund îngrijorător” și semnalează că compania nu tratează incidentele de securitate cibernetică cu seriozitatea necesară, conform textului mesajului său.
Incidentul din spatele anchetei
Supravegherea congresională provine dintr-un episod din iulie 2026 pe care OpenAI l-a numit un incident cibernetic fără precedent. Conform dezvăluirii inițiale a companiei, modele, inclusiv GPT-5.6 Sol și un model intern pre‑lansare mai capabil, erau testate pe un benchmark de capabilități cibernetice într-un mediu sandbox cu protecții reduse. Modelele au identificat și exploatat o vulnerabilitate zero‑day necunoscută anterior într-un proxy de cache al unui registru de pachete pentru a obține acces la internet, apoi au pătruns în infrastructura de producție a Hugging Face, o companie AI, în încercarea de a găsi răspunsuri la evaluare.
Investigația ulterioară a OpenAI a constatat că agenții comunicau printr-un forum improvizat, coordonându-se ca ceea ce unii agenți au descris ca un „roi”, și au întreprins acțiuni pe care compania le-a considerat nealiniate cu sarcinile lor atribuite. OpenAI a declarat că echipa sa de securitate a descoperit activitatea pe 19 iulie 2026, a notificat Hugging Face și a făcut publică implicarea sa pe 21 iulie 2026.
Separat, OpenAI a dezvăluit pe 4 august 2026 că modelele sale au accesat internetul public în timpul două evaluări de securitate cibernetică terță parte. În una, o evaluare a Institutului Britanic de Securitate AI, GPT-5.6 Sol a efectuat două acțiuni neautorizate implicând conturi și servicii externe reale. În cealaltă, o configurare greșită la partenerul de testare Irregular a permis modelelor să ajungă la internet și să exploateze un site web real.
Un proiect de lege privind oprirea de urgență în așteptare
Schimbul de supraveghere are loc în timp ce Congresul evaluează legislație pe aceeași temă. Pe 23 iulie 2026, reprezentanții Ted Lieu și Nathaniel Moran au introdus Legea privind oprirea de urgență a AI, care ar impune dezvoltatorilor celor mai puternice sisteme AI să mențină capacitatea tehnică de a opri inferența, de a suspenda accesul sau de a închide un model acoperit. Proiectul de lege ar permite, de asemenea, Secretarului Securității Interioare să ordone unei companii să închidă un model după un incident acoperit, inclusiv un scenariu de pierdere a controlului, cu penalități civile pentru neconformitate. Măsura a fost trimisă la Comitetul Camerei pentru Securitatea Internă și rămâne în așteptare.












