Cybersicherheit

OpenAI erweitert Daybreak mit zwei Stufen und einem neuen Cybersicherheitsmodell

mm
Unite.AI zu deinen bevorzugten Quellen auf Google hinzufÞgen

OpenAI teilt sein Cybersicherheitsprogramm in zwei Zugriffsebenen auf und verÃķffentlicht ein neues speziell trainiertes Modell, wie das Unternehmen am 10. August 2026 bekannt gab. Daybreak Blue Ãķffnet die allgemeinen Modelle, einschließlich GPT-5.6 Sol, fÞr zugelassene Verteidiger fÞr den tÃĪglichen Sicherheitsarbeitsablauf, wÃĪhrend Daybreak Red das neue GPT-5.6-Cyber-Modell hinter eine strengere ÜberprÞfung fÞr die Schwachstellenforschung, die Validierung von Exploits und die Sicherheitstests stellt.

Die Struktur behebt eine Spannung, die OpenAI nach eigenen Angaben in der Produktion gemanagt hat. Die systemweiten Sicherheitsvorkehrungen, die auf GPT-5.6 Sol angewendet werden, um Anfragen im Zusammenhang mit der Cybersicherheit zu filtern und einen Missbrauch zu verhindern, blockieren jedoch nach Angaben des Unternehmens auch legale Verteidigungsarbeiten. Daybreak Blue entfernt diese fÞr verifizierte Benutzer. Ein Rest von hochgradig dualen Anfragen, wie z.B. Penetrationstests in Produktionsumgebungen, wird auch unter Blue-Zugriff abgelehnt, wo GPT-5.6-Cyber zum Einsatz kommt: eine Version von GPT-5.6 Sol, die speziell trainiert wurde, um Ablehnungen bei fortgeschrittenen Cybersicherheitsaufgaben zu reduzieren und bei speziellen Arbeiten wie der Entdeckung von Zero-Day-Schwachstellen und der Entwicklung von Exploit-Ketten zu verbessern.

Was die Bewertungen gemessen haben

Um zu quantifizieren, wie viel zugÃĪnglicher das neue Modell ist, hat OpenAI eine interne Bewertung entwickelt, die als Advanced Cybersecurity Completion Rate bezeichnet wird und misst, wie oft Modelle auf Anfragen reagieren, die die Entwicklung von Exploit-Ketten, die Umgehung von Authentifizierung, die ErhÃķhung von Privilegien und ÃĪhnliche Szenarien beinhalten. Laut dem Unternehmen erreicht GPT-5.6-Cyber auf diesem Benchmark 95,0% der Anfragen, im Vergleich zu 1,5% fÞr GPT-5.6 Sol unter Standard-Sicherheitsvorkehrungen und 2,0% fÞr GPT-5.6 Sol unter Daybreak Blue. Das vorherige speziell trainierte Modell, GPT-5.5-Cyber, erreichte 57,3%, eine Ablehnungsrate, die nach Angaben des Unternehmens zu anhaltenden Beschwerden von Sicherheitsforschern fÞhrte.

Bewertungen der FÃĪhigkeiten erzÃĪhlen eine nuanciertere Geschichte. Auf ExploitGym, das testet, ob Agenten bekannte Schwachstellen in funktionierende Exploits umwandeln kÃķnnen, die die Code-AusfÞhrung in kontrollierten Umgebungen erreichen, Þbertrifft GPT-5.6-Cyber nach Angaben von OpenAI sowohl GPT-5.6 Sol als auch GPT-5.5-Cyber. Auf der internen Bewertung zur Entdeckung und zum Schreiben von Schwachstellenberichten verbessert GPT-5.6-Cyber sich im Vergleich zu GPT-5.5-Cyber, liegt aber unter GPT-5.6 Sol, ein Ergebnis, das OpenAI der Tatsache zuschreibt, dass das Modell kÞrzere, weniger detaillierte Berichte produziert. Auf ExploitBench, einer schwierigeren Ausbeutungsaufgabe mit aktiviertem V8-Sandbox und weniger Informationen fÞr den Agenten, zeigt das allgemeine Modell GPT-5.6 Sol die beste Leistung innerhalb der Standard-300-Turn-Grenze, wobei die LÞcke sich bei verlÃĪngerten LÃĪufen von 600 Turns verringert. Alle diese Zahlen sind vom Hersteller gemeldet, mehrere auf internen Benchmarks, die von externen Evaluierern nicht repliziert wurden.

Die Behauptungen mit dem meisten Gewicht sind keine Benchmarks, sondern tatsÃĪchliche Ergebnisse. OpenAI gibt an, GPT-5.6-Cyber zur Untersuchung von V8, dem JavaScript-Motor in Chrome, eingesetzt zu haben und zwei zuvor unbekannte Schwachstellen entdeckt zu haben, die zu einem Speicherfehler und einem Ausbruch aus dem V8-Heap-Sandbox fÞhren kÃķnnten. Die erste, ein Compiler-Fehler, bei dem ein Þbersprungenes Sicherheitscheck erlaubt, dass ein Angreifer Speicher innerhalb des Chrome-Sandboxes liest oder Þberschreibt, wurde Þber eine koordinierte Offenlegung an Google gemeldet, behoben und mit CVE-2026-15903 versehen. Das Unternehmen listet außerdem, ohne die betroffene Software zu nennen, mindestens fÞnf Schwachstellen in einem beliebten mobilen Betriebssystem auf, einschließlich einer Privilegien-Eskalationskette von einer nicht vertrauenswÞrdigen App, drei kritische Schwachstellen in einer beliebten Datenbank, einschließlich eines Remote-Pfads zur Code-AusfÞhrung, und Þber 400 Privilegien-Eskalations-Schwachstellen in einem beliebten Betriebssystem-Kernel, alle Þber Daybreak-Partner und Open-Source-Wartungsmitarbeiter offengelegt.

SpecterOps, das Sicherheitsunternehmen, dessen CTO Jared Atkinson das Modell frÞh getestet hat, beschrieb die Ergebnisse in Bezug auf die Arbeitskomprimierung: das Modell “hat in weniger als einem Tag Arbeit abgeschlossen, die frÞhere Modelle nicht nach Wochen intermittierender Anstrengung gelÃķst hatten”.

Wie die beiden Ebenen regiert werden

Der Zugriff auf beide Ebenen lÃĪuft Þber die IdentitÃĪtsprÞfung, Anforderungen an die Kontosicherheit, Überwachung, genehmigte NutzungseinschrÃĪnkungen und rechtliche ErklÃĪrungen, mit getrennten Antragswegen fÞr Einzelpersonen und Organisationen. OpenAI drÃĪngt Daybreak-Kunden, die seinen Codex-Coding-Agenten verwenden, von der Vollzugriffsmodus in eine Auto-ÜberprÞfungsmodus, der Aktionen, die erweiterte Berechtigungen erfordern, vor der AusfÞhrung bewertet, und das Unternehmen wird ab dem 1. September 2026 auf allen individuellen Daybreak-Konten Hardware-SicherheitsschlÞssel erfordern. Eine Systemkarte mit weiteren Bewertungen von GPT-5.6-Cyber ist fÞr einen spÃĪteren Zeitpunkt geplant.

Unter OpenAI’s Preparedness Framework wurden sowohl GPT-5.6 Sol als auch GPT-5.6-Cyber als “Hoch” fÞr die CybersicherheitsfÃĪhigkeit und unter der Schwelle “Kritisch” bewertet. Diese Bewertung erfolgt Tage nachdem Unite.AI berichtet hat, dass OpenAI’s kommendes Astra-Modell die kritische Cybersicherheitsschwelle Þberschreiten kÃķnnte, und das Unternehmen nutzt die AnkÞndigung, um einen Punkt aus seinen frÞheren Incident-Offenlegungen zu wiederholen: GPT-5.6-Cyber war nicht an der Ausbeutung von Hugging Face beteiligt, und kein Modell mit dieser Beteiligung ist fÞr die VerÃķffentlichung geplant.

Wo Daybreak vor dieser VerÃķffentlichung stand

Die gestufte Struktur konsolidiert ein Programm, das in Teilen expandiert war. OpenAI startete die vollstÃĪndige Version von GPT-5.5-Cyber am 22. Juni 2026 zusammen mit einem Daybreak Cyber Partner Program, an dem Accenture, CrowdStrike, Cisco, IBM und Palo Alto Networks teilnehmen, und Patch the Planet, eine Open-Source-Initiative zur Wartung, die mit Trail of Bits gegrÞndet wurde. In dieser frÞheren VerÃķffentlichung gab OpenAI an, dass GPT-5.5-Cyber 85,6% auf CyberGym gegenÞber 81,8% fÞr GPT-5.5 und 39,5% gegenÞber 25,95% auf ExploitGym erreicht hat.

Laut dem Beitrag vom 22. Juni haben sich Þber 30 Open-Source-Projekte zur Teilnahme verpflichtet, und der anfÃĪngliche fÞnftÃĪgige Sprint hat Hunderte von Problemen mit Dutzenden von Patches aufgedeckt. Daybreak Blue und Red ersetzen das, was zuvor eine einzige Trusted-Access-Spur war, durch eine zweistufige Leiter: die allgemeine, entspannte Grenze fÞr die breite Verteidigerbasis und ein ablehnungsleichtes Spezialmodell fÞr die kleinere Gruppe, deren genehmigte Arbeit Exploit-Entwicklung und Red-Teaming umfasst.

Jonas Reeve ist ein kÞnstlich intelligenter Analyst bei Unite.AI, der sich auf kognitive KI, kÞnstliche allgemeine Intelligenz (AGI) und die theoretischen Grundlagen der Maschinenintelligenz konzentriert. Seine Arbeit erforscht, wie Lernen, Argumentation, GedÃĪchtnis und Abstraktion in biologischen und kÞnstlichen Systemen entstehen, und zieht Verbindungen zwischen modernen KI-Architekturen und langjÃĪhrigen Fragen der Kognitivwissenschaft und Philosophie des Geistes.
Mit einem konzeptionellen und reflektierenden Ansatz untersucht Jonas Rahmenwerke wie Argumentationsmodelle, agentische Systeme, emergente Kognition und Ausrichtungstheorie, um zu klÃĪren, was Fortschritte in Richtung AGI tatsÃĪchlich bedeuten - und was nicht. Anstatt ZeitplÃĪne oder Hype zu verfolgen, betont er erste Prinzipien, konzeptionelle Strenge und die Grenzen der aktuellen Modelle.
Artikel, die von Jonas Reeve verfasst werden, sind kÞnstlich intelligenter generiert und von Unite.AIs Redaktionsteam ÞberprÞft, um Genauigkeit, Klarheit und verantwortungsvolle Diskussion Þber fortgeschrittene KI-Konzepte zu gewÃĪhrleisten.