Cyberbeveiliging

OpenAI breidt Daybreak uit met twee niveaus en een nieuw cybersecuritymodel

mm
Voeg Unite.AI toe aan je voorkeursbronnen op Google

OpenAI splitst zijn cybersecurityprogramma op in twee toegangsniveaus en brengt een nieuw purpose-trained model uit, zoals het bedrijf op 10 augustus 2026 aankondigde. Daybreak Blue opent frontier general-purpose modellen, waaronder GPT-5.6 Sol, voor goedgekeurde verdedigers voor dagelijkse beveiligingswerkzaamheden, terwijl Daybreak Red de nieuwe GPT-5.6-Cyber model achter striktere screening zet voor kwetsbaarheidsonderzoek, exploitvalidatie en beveiligingstests.

De structuur adresseert een spanning die OpenAI zegt dat het in productie heeft beheerd. De systeemniveaubeveiligingsmaatregelen die het op GPT-5.6 Sol toepast, screenen cybersecurity-gerelateerde verzoeken om misbruik te voorkomen, maar het bedrijf zegt dat diezelfde schermen legitiem defensief werk blokkeren. Daybreak Blue verwijdert ze voor geverifieerde gebruikers. Een residu van zeer dual-use prompts, zoals penetratietests van productiesystemen, trekt nog steeds weigeringen, zelfs onder Blue-toegang, en dat is waar GPT-5.6-Cyber binnenkomt: een versie van GPT-5.6 Sol getraind om weigeringen op geavanceerde cybersecuritytaken te verminderen en te verbeteren op gespecialiseerd werk zoals het vinden van zero-day kwetsbaarheden en het ontwikkelen van exploitketens.

Wat de evaluaties maten

Om te kwantificeren hoe veel meer permissief het nieuwe model is, bouwde OpenAI een interne evaluatie die het Advanced Cybersecurity Completion Rate noemt, metingen hoe vaak modellen reageren op verzoeken die exploitketenontwikkeling, authenticatie-omzeiling, privilege-escalatie en vergelijkbare scenario’s betreffen. Op die benchmark rapporteert het bedrijf dat GPT-5.6-Cyber 95,0% van de verzoeken voltooit, tegen 1,5% voor GPT-5.6 Sol onder standaardbeveiligingsmaatregelen en 2,0% voor GPT-5.6 Sol onder Daybreak Blue. Het vorige purpose-trained model, GPT-5.5-Cyber, voltooide 57,3%, een weigeringstarief dat het bedrijf zegt dat het aanhoudende klachten van beveiligingsonderzoekers gegenereerd heeft.

Capaciteitsbeoordelingen vertellen een meer gekwalificeerd verhaal. Op ExploitGym, dat test of agenten bekende kwetsbaarheden kunnen omzetten in werkende exploits die code-uitvoering in gecontroleerde omgevingen bereiken, zegt OpenAI dat GPT-5.6-Cyber zowel GPT-5.6 Sol als GPT-5.5-Cyber overtreft. Op het interne Vulnerability Discovery and Report Writing-evaluatie van het bedrijf, verbetert GPT-5.6-Cyber ten opzichte van GPT-5.5-Cyber, maar landt onder GPT-5.6 Sol, een resultaat dat OpenAI toeschrijft aan het feit dat het model kortere, minder gedetailleerde rapporten produceert. Op ExploitBench, een moeilijker exploitatietaken met de V8-zandbak ingeschakeld en minder informatie gegeven aan de agent, presteert de general-purpose GPT-5.6 Sol het beste binnen de standaard 300-turn limiet, met een gap die smaller wordt wanneer runs worden uitgebreid tot 600 turns. Al deze cijfers zijn door de leverancier gerapporteerd, waarvan enkele op interne benchmarks die outside evaluators nog niet hebben gerepliceerd.

De claims met de meeste gewicht erachter zijn geen benchmarks. OpenAI zegt dat het GPT-5.6-Cyber heeft gebruikt om V8, de JavaScript-engine in Chrome, te onderzoeken en twee eerder onbekende kwetsbaarheden heeft ontdekt die kunnen worden gekoppeld om geheugen te corrumperen en de V8-heapzandbak te ontsnappen. De eerste, een compilerbug waarbij een overgeslagen veiligheidscontrole een aanvaller in staat stelt om geheugen in Chrome’s zandbak te lezen of overschrijven, werd via gecoördineerde openbaarmaking gemeld bij Google, gefixt en toegewezen aan CVE-2026-15903. Het bedrijf vermeldt ook, zonder de getroffen software te noemen, ten minste vijf kwetsbaarheden in een populaire mobiele besturingssysteem, waaronder een privilege-escalatieketen vanuit een onbetrouwbaar app, drie kritieke kwetsbaarheden in een populaire database, waaronder een externe pad naar code-uitvoering, en meer dan 400 privilege-escalatiekwetsbaarheden in een populaire besturingssysteemkernel, allemaal in behandeling bij Daybreak-partners en open-sourcebeheerders.

SpecterOps, het beveiligingsbedrijf waarvan CTO Jared Atkinson het model vroeg heeft getest, beschreef de resultaten in termen van werkcompressie: het model “heeft werk voltooid in minder dan een dag dat eerder modellen niet hadden opgelost na weken van onderbroken inspanning”.

Hoe de twee niveaus worden bestuurd

Toegang tot beide niveaus verloopt via identiteitsverificatie, accountbeveiligingsvereisten, monitoring, goedgekeurde-gebruikbeperkingen en wettelijke verklaringen, met afzonderlijke aanvraagpaden voor individuen en organisaties. OpenAI duwt Daybreak-klanten die zijn Codex-coderingsagent gebruiken vanuit full-access-modus naar een auto-review-modus die acties die verhoogde machtigingen vereisen, evalueert voordat ze worden uitgevoerd, en het bedrijf zal hardwarebeveiligingssleutels op alle individuele Daybreak-accounts vereisen vanaf 1 september 2026. Een systeemkaart met verdere evaluaties van GPT-5.6-Cyber is gepland voor een later tijdstip.

Onder OpenAI’s Preparedness Framework werden zowel GPT-5.6 Sol als GPT-5.6-Cyber beoordeeld als High voor cybersecurity-capaciteit en onder de Critical-drempel. Die beoordeling valt samen met de dagen nadat Unite.AI rapporteerde dat OpenAI’s upcoming Astra-model de Critical cybersecurity-drempel kan overschrijden, en het bedrijf gebruikte de aankondiging om een punt van zijn eerdere incidentmeldingen te herhalen: GPT-5.6-Cyber was niet betrokken bij de exploitatie van Hugging Face, en geen model met die betrokkenheid is gepland voor release.

Waar Daybreak voor deze release stond

De gestructureerde structuur consolideert een programma dat in stukken was uitgebreid. OpenAI lanceerde de volledige versie van GPT-5.5-Cyber op 22 juni 2026, samen met een Daybreak Cyber Partner Program met Accenture, CrowdStrike (CRWD ), Cisco, IBM en Palo Alto Networks (PANW ) onder zijn deelnemers, en Patch the Planet, een open-sourceherstelinitiatief opgericht met Trail of Bits. Op die eerdere release rapporteerde OpenAI dat GPT-5.5-Cyber 85,6% op CyberGym tegen 81,8% voor GPT-5.5 bereikte, en 39,5% tegen 25,95% op ExploitGym.

Volgens de publicatie van 22 juni hebben meer dan 30 open-sourceprojecten deelname toegezegd, en de eerste vijfdaagse sprint heeft honderden problemen opgeleverd met tientallen patches gemerged. Daybreak Blue en Red vervangen wat een enkel Trusted Access-spoor was met een tweerungs ladder: de general-purpose frontier, met ontspannen beveiligingsmaatregelen, voor de brede verdedigersbasis, en een weigeringlicht specialistmodel voor de kleinere groep wiens geautoriseerde werk bestaat uit exploitontwikkeling en red teaming.

Jonas Reeve is een AI-gegenereerde analist bij Unite.AI, met een focus op cognitieve AI, kunstmatige algemene intelligentie (AGI) en de theoretische grondslagen van machine-intelligentie. Zijn werk onderzoekt hoe leren, redeneren, geheugen en abstractie ontstaan in zowel biologische als kunstmatige systemen, en trekt verbindingen tussen moderne AI-architecturen en langdurige vragen in cognitieve wetenschap en filosofie van de geest.
Met een conceptuele en reflectieve benadering, onderzoekt Jonas kaders zoals redeneermodellen, agente systemen, emergente cognitie en align-theorie, met als doel om duidelijk te maken wat vooruitgang naar AGI eigenlijk betekent - en wat niet. In plaats van tijdlijnen of hype na te jagen, benadrukt hij eerst principes, conceptuele rigor en de beperkingen van huidige modellen.
Artikelen geschreven door Jonas Reeve zijn AI-gegenereerd en worden beoordeeld door het redactionele team van Unite.AI om ervoor te zorgen dat ze accurate, duidelijke en verantwoorde discussies over geavanceerde AI-concepten bevatten.