Cybersicherheit
OpenAI erweitert Daybreak mit zwei Stufen und einem neuen Cybersicherheitsmodell

OpenAI teilt sein Cybersicherheitsprogramm in zwei Zugriffsebenen auf und veröffentlicht ein neues speziell trainiertes Modell, wie das Unternehmen am 10. August 2026 bekannt gab. Daybreak Blue öffnet die allgemeinen Modelle, einschließlich GPT-5.6 Sol, für zugelassene Verteidiger für den täglichen Sicherheitsarbeitsablauf, während Daybreak Red das neue GPT-5.6-Cyber-Modell hinter eine strengere Überprüfung für die Schwachstellenforschung, die Validierung von Exploits und die Sicherheitstests stellt.
Die Struktur behebt eine Spannung, die OpenAI nach eigenen Angaben in der Produktion gemanagt hat. Die systemweiten Sicherheitsvorkehrungen, die auf GPT-5.6 Sol angewendet werden, um Anfragen im Zusammenhang mit der Cybersicherheit zu filtern und einen Missbrauch zu verhindern, blockieren jedoch nach Angaben des Unternehmens auch legale Verteidigungsarbeiten. Daybreak Blue entfernt diese für verifizierte Benutzer. Ein Rest von hochgradig dualen Anfragen, wie z.B. Penetrationstests in Produktionsumgebungen, wird auch unter Blue-Zugriff abgelehnt, wo GPT-5.6-Cyber zum Einsatz kommt: eine Version von GPT-5.6 Sol, die speziell trainiert wurde, um Ablehnungen bei fortgeschrittenen Cybersicherheitsaufgaben zu reduzieren und bei speziellen Arbeiten wie der Entdeckung von Zero-Day-Schwachstellen und der Entwicklung von Exploit-Ketten zu verbessern.
Was die Bewertungen gemessen haben
Um zu quantifizieren, wie viel zugänglicher das neue Modell ist, hat OpenAI eine interne Bewertung entwickelt, die als Advanced Cybersecurity Completion Rate bezeichnet wird und misst, wie oft Modelle auf Anfragen reagieren, die die Entwicklung von Exploit-Ketten, die Umgehung von Authentifizierung, die Erhöhung von Privilegien und ähnliche Szenarien beinhalten. Laut dem Unternehmen erreicht GPT-5.6-Cyber auf diesem Benchmark 95,0% der Anfragen, im Vergleich zu 1,5% für GPT-5.6 Sol unter Standard-Sicherheitsvorkehrungen und 2,0% für GPT-5.6 Sol unter Daybreak Blue. Das vorherige speziell trainierte Modell, GPT-5.5-Cyber, erreichte 57,3%, eine Ablehnungsrate, die nach Angaben des Unternehmens zu anhaltenden Beschwerden von Sicherheitsforschern führte.
Bewertungen der Fähigkeiten erzählen eine nuanciertere Geschichte. Auf ExploitGym, das testet, ob Agenten bekannte Schwachstellen in funktionierende Exploits umwandeln können, die die Code-Ausführung in kontrollierten Umgebungen erreichen, übertrifft GPT-5.6-Cyber nach Angaben von OpenAI sowohl GPT-5.6 Sol als auch GPT-5.5-Cyber. Auf der internen Bewertung zur Entdeckung und zum Schreiben von Schwachstellenberichten verbessert GPT-5.6-Cyber sich im Vergleich zu GPT-5.5-Cyber, liegt aber unter GPT-5.6 Sol, ein Ergebnis, das OpenAI der Tatsache zuschreibt, dass das Modell kürzere, weniger detaillierte Berichte produziert. Auf ExploitBench, einer schwierigeren Ausbeutungsaufgabe mit aktiviertem V8-Sandbox und weniger Informationen für den Agenten, zeigt das allgemeine Modell GPT-5.6 Sol die beste Leistung innerhalb der Standard-300-Turn-Grenze, wobei die Lücke sich bei verlängerten Läufen von 600 Turns verringert. Alle diese Zahlen sind vom Hersteller gemeldet, mehrere auf internen Benchmarks, die von externen Evaluierern nicht repliziert wurden.
Die Behauptungen mit dem meisten Gewicht sind keine Benchmarks, sondern tatsächliche Ergebnisse. OpenAI gibt an, GPT-5.6-Cyber zur Untersuchung von V8, dem JavaScript-Motor in Chrome, eingesetzt zu haben und zwei zuvor unbekannte Schwachstellen entdeckt zu haben, die zu einem Speicherfehler und einem Ausbruch aus dem V8-Heap-Sandbox führen könnten. Die erste, ein Compiler-Fehler, bei dem ein übersprungenes Sicherheitscheck erlaubt, dass ein Angreifer Speicher innerhalb des Chrome-Sandboxes liest oder überschreibt, wurde über eine koordinierte Offenlegung an Google gemeldet, behoben und mit CVE-2026-15903 versehen. Das Unternehmen listet außerdem, ohne die betroffene Software zu nennen, mindestens fünf Schwachstellen in einem beliebten mobilen Betriebssystem auf, einschließlich einer Privilegien-Eskalationskette von einer nicht vertrauenswürdigen App, drei kritische Schwachstellen in einer beliebten Datenbank, einschließlich eines Remote-Pfads zur Code-Ausführung, und über 400 Privilegien-Eskalations-Schwachstellen in einem beliebten Betriebssystem-Kernel, alle über Daybreak-Partner und Open-Source-Wartungsmitarbeiter offengelegt.
SpecterOps, das Sicherheitsunternehmen, dessen CTO Jared Atkinson das Modell früh getestet hat, beschrieb die Ergebnisse in Bezug auf die Arbeitskomprimierung: das Modell “hat in weniger als einem Tag Arbeit abgeschlossen, die frühere Modelle nicht nach Wochen intermittierender Anstrengung gelöst hatten”.
Wie die beiden Ebenen regiert werden
Der Zugriff auf beide Ebenen läuft über die Identitätsprüfung, Anforderungen an die Kontosicherheit, Überwachung, genehmigte Nutzungseinschränkungen und rechtliche Erklärungen, mit getrennten Antragswegen für Einzelpersonen und Organisationen. OpenAI drängt Daybreak-Kunden, die seinen Codex-Coding-Agenten verwenden, von der Vollzugriffsmodus in eine Auto-Überprüfungsmodus, der Aktionen, die erweiterte Berechtigungen erfordern, vor der Ausführung bewertet, und das Unternehmen wird ab dem 1. September 2026 auf allen individuellen Daybreak-Konten Hardware-Sicherheitsschlüssel erfordern. Eine Systemkarte mit weiteren Bewertungen von GPT-5.6-Cyber ist für einen späteren Zeitpunkt geplant.
Unter OpenAI’s Preparedness Framework wurden sowohl GPT-5.6 Sol als auch GPT-5.6-Cyber als “Hoch” für die Cybersicherheitsfähigkeit und unter der Schwelle “Kritisch” bewertet. Diese Bewertung erfolgt Tage nachdem Unite.AI berichtet hat, dass OpenAI’s kommendes Astra-Modell die kritische Cybersicherheitsschwelle überschreiten könnte, und das Unternehmen nutzt die Ankündigung, um einen Punkt aus seinen früheren Incident-Offenlegungen zu wiederholen: GPT-5.6-Cyber war nicht an der Ausbeutung von Hugging Face beteiligt, und kein Modell mit dieser Beteiligung ist für die Veröffentlichung geplant.
Wo Daybreak vor dieser Veröffentlichung stand
Die gestufte Struktur konsolidiert ein Programm, das in Teilen expandiert war. OpenAI startete die vollständige Version von GPT-5.5-Cyber am 22. Juni 2026 zusammen mit einem Daybreak Cyber Partner Program, an dem Accenture, CrowdStrike (CRWD ), Cisco, IBM und Palo Alto Networks (PANW ) teilnehmen, und Patch the Planet, eine Open-Source-Initiative zur Wartung, die mit Trail of Bits gegründet wurde. In dieser früheren Veröffentlichung gab OpenAI an, dass GPT-5.5-Cyber 85,6% auf CyberGym gegenüber 81,8% für GPT-5.5 und 39,5% gegenüber 25,95% auf ExploitGym erreicht hat.
Laut dem Beitrag vom 22. Juni haben sich über 30 Open-Source-Projekte zur Teilnahme verpflichtet, und der anfängliche fünftägige Sprint hat Hunderte von Problemen mit Dutzenden von Patches aufgedeckt. Daybreak Blue und Red ersetzen das, was zuvor eine einzige Trusted-Access-Spur war, durch eine zweistufige Leiter: die allgemeine, entspannte Grenze für die breite Verteidigerbasis und ein ablehnungsleichtes Spezialmodell für die kleinere Gruppe, deren genehmigte Arbeit Exploit-Entwicklung und Red-Teaming umfasst.
Quellen des Originalartikels: unite.ai [1] · openai.com [2]












