Securitate cibernetică
OpenAI extinde Daybreak cu două niveluri și un nou model de securitate cibernetică

OpenAI împarte programul său de securitate cibernetică în două niveluri de acces și lansează un nou model specializat, alături de acestea, compania a anunțat pe 10 august 2026. Daybreak Blue deschide modele generale cu scop special, inclusiv GPT-5.6 Sol, pentru apărători aprobati pentru lucrări de securitate de zi cu zi, în timp ce Daybreak Red blochează noul model GPT-5.6-Cyber în spatele unei verificări mai stricte pentru cercetarea vulnerabilităților, validarea exploatării și testarea securității.
Structura abordează o tensiune pe care OpenAI spune că o gestionează în producție. Barierelor de securitate la nivel de sistem pe care le rulează pe GPT-5.6 Sol filtrează cererile legate de securitate cibernetică pentru a preveni utilizarea abuzivă, dar compania spune că aceleași filtre blochează lucrul de apărare legitim. Daybreak Blue elimină aceste filtre pentru utilizatori verificați. Un reziduu de prompturi cu utilizare duală foarte ridicată, cum ar fi testarea penetrării sistemelor de producție, încă atrage refuzuri chiar și sub accesul Blue, unde GPT-5.6-Cyber intervine: o versiune a GPT-5.6 Sol antrenată pentru a reduce refuzurile la sarcini avansate de securitate cibernetică și pentru a îmbunătăți lucrul specializat, cum ar fi găsirea vulnerabilităților zero-day și dezvoltarea lanțurilor de exploatări.
Ce au măsurat evaluările
Pentru a cuantifica cât de permisiv este noul model, OpenAI a creat o evaluare internă pe care o numește Advanced Cybersecurity Completion Rate, care măsoară cât de des modelele răspund la cereri care implică dezvoltarea lanțurilor de exploatări, ocolirea autentificării, escaladarea privilegiilor și scenarii similare. Pe această benchmark, compania raportează că GPT-5.6-Cyber finalizează 95,0% din cereri, față de 1,5% pentru GPT-5.6 Sol sub garduri de protecție standard și 2,0% pentru GPT-5.6 Sol sub Daybreak Blue. Modelul anterior specializat, GPT-5.5-Cyber, a finalizat 57,3%, o rată de refuz pe care compania spune că a generat plângeri persistente din partea cercetătorilor de securitate.
Evaluările capacităților spun o poveste mai nuanțată. Pe ExploitGym, care testează dacă agenții pot transforma vulnerabilități cunoscute în exploatări funcționale care ating executarea codului în medii controlate, OpenAI spune că GPT-5.6-Cyber depășește atât GPT-5.6 Sol, cât și GPT-5.5-Cyber. Pe evaluarea internă a companiei de descoperire și raportare a vulnerabilităților, GPT-5.6-Cyber îmbunătățește GPT-5.5-Cyber, dar rămâne sub GPT-5.6 Sol, un rezultat pe care OpenAI îl atribuie faptului că modelul produce rapoarte mai scurte și mai puțin detaliate. Pe ExploitBench, o sarcină de exploatare mai dificilă cu sandbox-ul V8 activat și mai puține informații furnizate agentului, modelul general GPT-5.6 Sol performează cel mai bine în limita standard de 300 de tururi, cu o diferență care se reduce atunci când rulările se extind la 600 de tururi. Toate aceste cifre sunt raportate de vendor, mai multe pe benchmark-uri interne pe care evaluatorii externi nu le-au replicat.
Pretențiile cu cea mai mare greutate din spatele lor nu sunt deloc benchmark-uri. OpenAI spune că a utilizat GPT-5.6-Cyber pentru a investiga V8, motorul JavaScript din Chrome, și a descoperit două vulnerabilități necunoscute anterior care ar putea fi legate pentru a corupe memoria și a evada din sandbox-ul heap V8. Prima, o eroare de compilator în care o verificare de securitate omisă permite unui atacator să citească sau să suprascrie memoria din interiorul sandbox-ului Chrome, a fost raportată către Google prin divulgare coordonată, remediată și atribuită CVE-2026-15903. Compania enumeră, fără a numi software-ul afectat, cel puțin cinci vulnerabilități într-un sistem de operare mobil popular, incluzând o escaladare a privilegiilor de la o aplicație neîncredere, trei vulnerabilități critice într-o bază de date populară, incluzând o cale remote de executare a codului, și peste 400 de vulnerabilități de escaladare a privilegiilor într-un nucleu de sistem de operare popular, toate trecând prin divulgare cu partenerii Daybreak și întreținătorii de cod deschis.
SpecterOps, firma de securitate a cărei CTO, Jared Atkinson, a testat modelul devreme, a descris rezultatele în termeni de comprimare a lucrului: modelul “a finalizat lucrul în mai puțin de o zi, ceea ce modelele anterioare nu au rezolvat după săptămâni de efort intermitent”.
Cum sunt guvernate cele două niveluri
Accesul la ambele niveluri rulează prin verificarea identității, cerințele de securitate a contului, monitorizare, restricții de utilizare aprobată și atestări legale, cu căi de aplicare separate pentru indivizi și organizații. OpenAI împinge clienții Daybreak care utilizează agentul de codare Codex spre un mod de revizuire automată care evaluează acțiunile care necesită permisiuni ridicate înainte de executare, iar compania va cere chei de securitate hardware pentru toate conturile individuale Daybreak începând cu 1 septembrie 2026. O cartelă de sistem cu evaluări suplimentare ale GPT-5.6-Cyber este planificată pentru o dată ulterioară.
Sub Cadrul de Pregătire al OpenAI, atât GPT-5.6 Sol, cât și GPT-5.6-Cyber au fost evaluate ca fiind de nivel ridicat pentru capacitatea de securitate cibernetică și sub pragul critic. Această evaluare vine în urma raportării de către Unite.AI că modelul Astra viitor al OpenAI ar putea depăși pragul critic de securitate cibernetică, iar compania a folosit anunțul pentru a reitera un punct din divulgările sale anterioare: GPT-5.6-Cyber nu a fost implicat în exploatarea Hugging Face, iar niciun model implicat în aceasta nu este programat pentru lansare.
Unde se afla Daybreak înainte de această lansare
Structura în niveluri consolidează un program care se extinsese în bucăți. OpenAI a lansat versiunea completă a GPT-5.5-Cyber pe 22 iunie 2026, alături de un Program de parteneriat Daybreak Cyber care număra printre participanți Accenture, CrowdStrike, Cisco, IBM și Palo Alto Networks, și Patch the Planet, o inițiativă de remediere deschisă fondată cu Trail of Bits. La lansarea anterioară, OpenAI a raportat că GPT-5.5-Cyber a atins 85,6% pe CyberGym față de 81,8% pentru GPT-5.5, și 39,5% față de 25,95% pe ExploitGym.
Conform anunțului din 22 iunie, peste 30 de proiecte deschise s-au angajat să participe, iar sprintul inițial de cinci zile a adus la suprafață sute de probleme, cu zeci de patch-uri integrate. Daybreak Blue și Red înlocuiesc ceea ce fusese o singură pistă de Acces de Încredere cu o scară cu două trepte: frontiera generală cu scop special, cu garduri relaxate, pentru baza largă de apărători, și un model specializat cu refuzuri ușoare pentru grupul mai mic a cărui muncă autorizată se extinde la dezvoltarea exploatărilor și testarea de securitate.












