Cyberbezpieczeństwo
OpenAI Rozszerza Daybreak Z Dwoma Poziomami Dostępu I Nowym Modelem Cyberbezpieczeństwa

OpenAI dzieli swój program cyberbezpieczeństwa na dwa poziomy dostępu i wydaje nowy model szkoleniowy obok nich, jak ogłosiła firma 10 sierpnia 2026 r. Daybreak Blue otwiera ogólnego użytku modele, w tym GPT-5.6 Sol, dla zatwierdzonych obrońców do codziennej pracy zabezpieczeń, podczas gdy Daybreak Red zamyka nowy model GPT-5.6-Cyber za ścisłymi kontrolami dla badań nad lukami w zabezpieczeniach, walidacji eksploitów i testowania zabezpieczeń.
Struktura ta rozwiązuje napięcie, które OpenAI twierdzi, że zarządza w produkcji. Systemowe zabezpieczenia, które są uruchamiane na GPT-5.6 Sol, filtrowania żądań związanych z cyberbezpieczeństwem w celu zapobiegania nadużyciom, ale firma twierdzi, że te same filtry blokują również uzasadnioną pracę obronną. Daybreak Blue usuwa je dla zweryfikowanych użytkowników. Resztki wysoko dwuznacznych podpowiedzi, takich jak testowanie penetracyjne systemów produkcyjnych, nadal powodują odmowy nawet w trybie dostępu Blue, co jest tym, gdzie GPT-5.6-Cyber wchodzi w grę: wersja GPT-5.6 Sol przeszkolona w celu zmniejszenia odmów w zaawansowanych zadaniach związanych z cyberbezpieczeństwem i poprawy specjalistycznej pracy, takiej jak wykrywanie luk w zabezpieczeniach zero-day i rozwijanie łańcuchów eksploitów.
Co mierzyły oceny
Aby zmierzyć, jak muito bardziej permissive nowy model jest, OpenAI zbudował wewnętrzną ocenę, którą nazywa Advanced Cybersecurity Completion Rate, mierząc, jak często modele odpowiadają na żądania dotyczące rozwoju łańcuchów eksploitów, obejścia uwierzytelniania, eskalacji uprawnień i podobnych scenariuszy. Na tym benchmarku firma raportuje, że GPT-5.6-Cyber kończy 95,0% żądań, w porównaniu z 1,5% dla GPT-5.6 Sol pod standardowymi zabezpieczeniami i 2,0% dla GPT-5.6 Sol pod Daybreak Blue. Poprzedni model szkoleniowy, GPT-5.5-Cyber, kończył 57,3%, co firma twierdzi, że wygenerowało stałe skargi od researcherów zabezpieczeń.
Oceny możliwości opowiadają bardziej zróżnicowaną historię. Na ExploitGym, który testuje, czy agenci mogą przekształcić znane luki w zabezpieczeniach w działające eksploaty, które osiągają wykonanie kodu w kontrolowanych środowiskach, OpenAI twierdzi, że GPT-5.6-Cyber przewyższa zarówno GPT-5.6 Sol, jak i GPT-5.5-Cyber. Na wewnętrznej ocenie Odkrycia luk w zabezpieczeniach i pisania raportów, GPT-5.6-Cyber poprawia się w porównaniu z GPT-5.5-Cyber, ale ląduje poniżej GPT-5.6 Sol, co OpenAI przypisuje temu, że model produkuje krótsze, mniej szczegółowe raporty. Na ExploitBench, trudniejszym zadaniu eksploatacji z włączoną piaskownicą V8 i mniej informacjami dostarczonymi agentowi, ogólny model GPT-5.6 Sol wykonuje się najlepiej w ramach standardowego limitu 300 tur, a przepaść zwęża się, gdy uruchomienia są przedłużone do 600 tur. Wszystkie te liczby są raportowane przez dostawcę, kilka na wewnętrznych benchmarkach, które zewnętrzni ewaluatorzy nie powtórzyli.
Twierdzenia z największym ciężarem dowodów nie są benchmarkami w ogóle. OpenAI twierdzi, że użyło GPT-5.6-Cyber do zbadania V8, silnika JavaScript w Chrome, i odkryło dwie wcześniej nieznane luki, które mogą być połączone w celu skorumpowania pamięci i ucieczki z piaskownicy V8. Pierwsza, błąd kompilatora, w którym pominięta kontrola zabezpieczeń pozwala atakującemu odczytać lub nadpisać pamięć wewnątrz piaskownicy Chrome, została zgłoszona do Google za pośrednictwem skoordynowanego ujawnienia, naprawiona i otrzymała identyfikator CVE-2026-15903. Firma wymienia również, bez podawania nazwy oprogramowania, co najmniej pięć luk w popularnym systemie operacyjnym mobilnym, w tym łańcuch eskalacji uprawnień z niezaufanego aplikacji, trzy krytyczne luki w popularnej bazie danych, w tym zdalną ścieżkę do wykonania kodu, i ponad 400 luk eskalacji uprawnień w popularnym jądrze systemu operacyjnego, wszystkie przechodzące przez ujawnienie z partnerami Daybreak i utrzymującymi oprogramowanie open-source.
SpecterOps, firma bezpieczeństwa, której CTO Jared Atkinson przetestował model wcześnie, opisał wyniki w kategoriach kompresji pracy: model “wykonał pracę w ciągu jednego dnia, którą wcześniejsze modele nie rozwiązały nawet po tygodniach przerywanej pracy”.
Jak są zarządzane dwa poziomy
Dostęp do obu poziomów odbywa się za pośrednictwem weryfikacji tożsamości, wymagań bezpieczeństwa konta, monitorowania, ograniczeń użycia i oświadczeń prawnych, z oddzielnymi ścieżkami aplikacyjnymi dla osób fizycznych i organizacji. OpenAI nakłania klientów Daybreak, którzy używają swojego agenta kodowania Codex, do przejścia z trybu pełnego dostępu do trybu automatycznego przeglądu, który ocenia działania wymagające podniesionych uprawnień przed wykonaniem, a firma będzie wymagać kluczy zabezpieczeń sprzętowych we wszystkich indywidualnych kontach Daybreak od 1 września 2026 r. Planowana jest karta systemu z dalszymi ocenami GPT-5.6-Cyber w późniejszym terminie.
W ramach ram przygotowania OpenAI oba modele, GPT-5.6 Sol i GPT-5.6-Cyber, zostały ocenione jako Wysokie pod względem zdolności cyberbezpieczeństwa i poniżej progu krytycznego. Ta ocena pojawiła się kilka dni po tym, jak Unite.AI poinformował, że nadchodzący model Astra OpenAI może przekroczyć próg krytyczny cyberbezpieczeństwa, a firma użyła ogłoszenia, aby powtórzyć punkt ze swoich wcześniejszych ujawnień incydentów: GPT-5.6-Cyber nie był zaangażowany w eksploatację Hugging Face, a żaden model z tym zaangażowaniem nie jest zaplanowany do wydania.
Gdzie stał Daybreak przed tym wydaniem
Struktura warstwowa konsoliduje program, który był rozszerzany w częściach. OpenAI uruchomił pełną wersję GPT-5.5-Cyber 22 czerwca 2026 r. obok programu partnerskiego Daybreak Cyber, w którym uczestniczą Accenture, CrowdStrike (CRWD ), Cisco, IBM i Palo Alto Networks (PANW ), oraz Patch the Planet, inicjatywy remediacji open-source założonej z Trail of Bits. W tym wcześniejszym wydaniu OpenAI poinformował, że GPT-5.5-Cyber osiągnął 85,6% na CyberGym w porównaniu z 81,8% dla GPT-5.5, i 39,5% w porównaniu z 25,95% na ExploitGym.
Zgodnie z postem z 22 czerwca, ponad 30 projektów open-source zobowiązało się do udziału, a początkowy pięciodniowy sprint ujawnił setki problemów z dziesiątkami łat włączonych. Daybreak Blue i Red zastępują to, co było single śladem dostępu zaufanego, z dwustopniową drabiną: ogólny poziom ogólnego przeznaczenia, zrelaksowane barierki, dla szerokiej bazy obrońców, i model specjalistyczny z lekkimi odmowami dla mniejszej grupy, której autoryzowana praca obejmuje rozwój eksploitów i czerwone zespoły.
Źródła artykułu oryginalnego: unite.ai [1] · unite.ai [2] · openai.com [3]












