Cybersikkerhed
OpenAI udvider Daybreak med to niveauer og en ny cybersecurity-model

OpenAI splitter sit cybersecurity-program i to adgangsniveauer og udgiver en ny formÃĨlstrÃĶnet model sammen med dem, som virksomheden annoncerede den 10. august 2026. Daybreak Blue ÃĨbner frontier generelle formÃĨl-modeller, herunder GPT-5.6 Sol, for godkendte forsvarere til hverdags sikkerhedsarbejde, mens Daybreak Red lukker den nye GPT-5.6-Cyber-model bag strammere vurdering for sÃĨrbarhedsforskning, udnyttelsesvalidering og sikkerhedstest.
Strukturen lÃļser en spÃĶnding, som OpenAI siger, de har vÃĶret i produktion. Systemniveauets sikkerhedsskÃĶrme, som de kÃļrer pÃĨ GPT-5.6 Sol, skÃĶrmer sikkerhedsrelaterede anmodninger for at forhindre misbrug, men virksomheden siger, at disse skÃĶrme ogsÃĨ blokerer legitime forsvarsarbejde. Daybreak Blue fjerner dem for verificerede brugere. En rest af hÃļjtdoblede prompts, sÃĨsom penetrationstestning af produktionsystemer, fÃĨr stadig afslag, selv under Blue-adgang, hvilket er, hvor GPT-5.6-Cyber kommer ind: en version af GPT-5.6 Sol, der er trÃĶnet til at reducere afslag pÃĨ avancerede cybersecurity-opgaver og forbedre sig pÃĨ specialiseret arbejde som at finde zero-day-sÃĨrbarheder og udvikle udnyttelseskÃĶder.
Hvad evalueringerne mÃĨlte
For at kvantificere, hvor meget mere tilladende den nye model er, opbyggede OpenAI en intern evaluering, som de kalder Advanced Cybersecurity Completion Rate, der mÃĨler, hvor ofte modellerne responderer til anmodninger, der involverer udnyttelseskÃĶdeudvikling, autentificeringsomgÃĨelse, privilegieforhÃļjelse og lignende scenarier. PÃĨ denne benchmark rapporterer virksomheden, at GPT-5.6-Cyber gennemfÃļrer 95,0% af anmodningerne, i modsÃĶtning til 1,5% for GPT-5.6 Sol under standard sikkerhedsskÃĶrme og 2,0% for GPT-5.6 Sol under Daybreak Blue. Den tidligere formÃĨlstrÃĶnede model, GPT-5.5-Cyber, gennemfÃļrte 57,3%, et afslagsrate, som virksomheden siger genererede persistente klager fra sikkerhedsforskere.
Evalueringer af kapacitet fortÃĶller en mere kvalificeret historie. PÃĨ ExploitGym, som tester, om agenter kan omdanne kendte sÃĨrbarheder til arbejdende udnyttelser, der opnÃĨr kodekÃļrsel i kontrollerede miljÃļer, siger OpenAI, at GPT-5.6-Cyber overgÃĨr bÃĨde GPT-5.6 Sol og GPT-5.5-Cyber. PÃĨ virksomhedens interne Vulnerability Discovery and Report Writing-evaluering forbedrer GPT-5.6-Cyber sig over GPT-5.5-Cyber, men ligger under GPT-5.6 Sol, et resultat, som OpenAI tilskriver, at modellen producerer kortere, mindre detaljerede rapporter. PÃĨ ExploitBench, en hÃĨrdere udnyttelsesopgave med V8-sandbox aktiveret og mindre information givet til agenten, udfÃļrer den generelle formÃĨl GPT-5.6 Sol bedst inden for den standard 300-omgangsgrÃĶnse, med et gap, der smuldrer, nÃĨr kÃļrsler udvides til 600 omgang. Alle disse tal er rapporteret af virksomheden, flere pÃĨ interne benchmarks, som ydre evaluatoren ikke har repliceret.
De pÃĨstande med den mest vÃĶgt bag dem er ikke benchmarks overhovedet. OpenAI siger, at de har brugt GPT-5.6-Cyber til at undersÃļge V8, JavaScript-motoren i Chrome, og afslÃļrede to tidligere ukendte sÃĨrbarheder, der kunne kÃĶdes sammen for at korrumpe hukommelse og undgÃĨ V8-hukommelsessandboxen. Den fÃļrste, en compilerfejl, hvor en sprunget sikkerhedstjek tillader en angriber at lÃĶse eller overskrive hukommelse inden for Chromes sandbox, blev rapporteret til Google gennem koordineret afslÃļring, fikset og tildelt CVE-2026-15903. Virksomheden nÃĶvner ogsÃĨ, uden at nÃĶvne det berÃļrte software, mindst fem sÃĨrbarheder i et populÃĶrt mobilt operativsystem, herunder en privilegieforhÃļjelseskÃĶde fra en upÃĨlidelig app, tre kritiske sÃĨrbarheder i en populÃĶr database, herunder en fjern adgang til kodekÃļrsel, og mere end 400 privilegieforhÃļjelsessÃĨrbarheder i en populÃĶr operativsystemkerne, alle i gang med afslÃļring med Daybreak-partnere og open-source-maintainere.
SpecterOps, sikkerhedsfirmaet, hvis CTO Jared Atkinson testede modellen tidligt, beskrev resultaterne i termer af arbejdskompression: modellen âhar gennemfÃļrt arbejde pÃĨ under en dag, som tidligere modeller ikke havde lÃļst efter uger med intermittent indsatsâ.
Hvordan de to niveauer er styret
Adgang til begge niveauer kÃļrer gennem identitetsverificering, konto-sikkerhedskrav, overvÃĨgning, godkendt-brugsbegrÃĶnsninger og juridiske erklÃĶringer, med separate ansÃļgningsveje for enkeltpersoner og organisationer. OpenAI driver Daybreak-kunder, der bruger deres Codex-kodeagent, fra fuld-adgangs tilstand mod en auto-gennemgangs tilstand, der vurderer handlinger, der krÃĶver forhÃļjede tilladelser, fÃļr udfÃļrelse, og virksomheden vil krÃĶve hardware-sikkerhedsnÃļgler pÃĨ alle enkelt Daybreak-konti fra den 1. september 2026. En systemkort med yderligere evalueringer af GPT-5.6-Cyber er planlagt til en senere dato.
Under OpenAIâs Preparedness Framework blev bÃĨde GPT-5.6 Sol og GPT-5.6-Cyber vurderet som HÃļj for cybersecurity-kapacitet og under den kritiske grÃĶnse. Denne vurdering lander dage efter, at Unite.AI rapporterede, at OpenAIâs forestÃĨende Astra-model kan krydse den kritiske cybersecurity-grÃĶnse, og virksomheden brugte annonceringen til at gentage et punkt fra deres tidligere incident-disclosures: GPT-5.6-Cyber var ikke involveret i udnyttelsen af Hugging Face, og ingen model med den involvering er planlagt til udgivelse.
Hvor Daybreak stod fÃļr denne udgivelse
Niveaudannelsen konsoliderer et program, der havde vÃĶret i udvidelse i stykker. OpenAI lancerede den fulde version af GPT-5.5-Cyber den 22. juni 2026 sammen med et Daybreak Cyber Partner Program, der tÃĶller Accenture, CrowdStrike, Cisco, IBM og Palo Alto Networks blandt deltagerne, og Patch the Planet, en open-source-remedieringsinitiativ grundlagt med Trail of Bits. PÃĨ denne tidligere udgivelse rapporterede OpenAI, at GPT-5.5-Cyber nÃĨede 85,6% pÃĨ CyberGym mod 81,8% for GPT-5.5, og 39,5% mod 25,95% pÃĨ ExploitGym.
IfÃļlge den 22. juni-post havde mere end 30 open-source-projekter tilkendegivet at deltage, og den fÃļrste fem-dages sprint afslÃļrede hundredvis af problemer med dusinvis af patches merged. Daybreak Blue og Red erstatter, hvad der tidligere havde vÃĶret en enkelt Trusted Access-spor med en to-rung-lÃĶder: den generelle formÃĨl-frontier, sikkerhedsforanstaltninger afslappet, for den brede forsvarerbase, og en afslags-let specialistmodel for den mindre gruppe, hvis autoriseret arbejde lÃļber til udnyttelsesudvikling og red teaming.












