CyberbezpieczeÅstwo
OpenAI Rozszerza Daybreak Z Dwoma Poziomami DostÄpu I Nowym Modelem CyberbezpieczeÅstwa

OpenAI dzieli swÃģj program cyberbezpieczeÅstwa na dwa poziomy dostÄpu i wydaje nowy model szkoleniowy obok nich, jak ogÅosiÅa firma 10 sierpnia 2026 r. Daybreak Blue otwiera ogÃģlnego uÅžytku modele, w tym GPT-5.6 Sol, dla zatwierdzonych obroÅcÃģw do codziennej pracy zabezpieczeÅ, podczas gdy Daybreak Red zamyka nowy model GPT-5.6-Cyber za ÅcisÅymi kontrolami dla badaÅ nad lukami w zabezpieczeniach, walidacji eksploitÃģw i testowania zabezpieczeÅ.
Struktura ta rozwiÄ zuje napiÄcie, ktÃģre OpenAI twierdzi, Åže zarzÄ dza w produkcji. Systemowe zabezpieczenia, ktÃģre sÄ uruchamiane na GPT-5.6 Sol, filtrowania ÅžÄ daÅ zwiÄ zanych z cyberbezpieczeÅstwem w celu zapobiegania naduÅžyciom, ale firma twierdzi, Åže te same filtry blokujÄ rÃģwnieÅž uzasadnionÄ pracÄ obronnÄ . Daybreak Blue usuwa je dla zweryfikowanych uÅžytkownikÃģw. Resztki wysoko dwuznacznych podpowiedzi, takich jak testowanie penetracyjne systemÃģw produkcyjnych, nadal powodujÄ odmowy nawet w trybie dostÄpu Blue, co jest tym, gdzie GPT-5.6-Cyber wchodzi w grÄ: wersja GPT-5.6 Sol przeszkolona w celu zmniejszenia odmÃģw w zaawansowanych zadaniach zwiÄ zanych z cyberbezpieczeÅstwem i poprawy specjalistycznej pracy, takiej jak wykrywanie luk w zabezpieczeniach zero-day i rozwijanie ÅaÅcuchÃģw eksploitÃģw.
Co mierzyÅy oceny
Aby zmierzyÄ, jak muito bardziej permissive nowy model jest, OpenAI zbudowaÅ wewnÄtrznÄ ocenÄ, ktÃģrÄ nazywa Advanced Cybersecurity Completion Rate, mierzÄ c, jak czÄsto modele odpowiadajÄ na ÅžÄ dania dotyczÄ ce rozwoju ÅaÅcuchÃģw eksploitÃģw, obejÅcia uwierzytelniania, eskalacji uprawnieÅ i podobnych scenariuszy. Na tym benchmarku firma raportuje, Åže GPT-5.6-Cyber koÅczy 95,0% ÅžÄ daÅ, w porÃģwnaniu z 1,5% dla GPT-5.6 Sol pod standardowymi zabezpieczeniami i 2,0% dla GPT-5.6 Sol pod Daybreak Blue. Poprzedni model szkoleniowy, GPT-5.5-Cyber, koÅczyÅ 57,3%, co firma twierdzi, Åže wygenerowaÅo staÅe skargi od researcherÃģw zabezpieczeÅ.
Oceny moÅžliwoÅci opowiadajÄ bardziej zrÃģÅžnicowanÄ historiÄ. Na ExploitGym, ktÃģry testuje, czy agenci mogÄ przeksztaÅciÄ znane luki w zabezpieczeniach w dziaÅajÄ ce eksploaty, ktÃģre osiÄ gajÄ wykonanie kodu w kontrolowanych Årodowiskach, OpenAI twierdzi, Åže GPT-5.6-Cyber przewyÅžsza zarÃģwno GPT-5.6 Sol, jak i GPT-5.5-Cyber. Na wewnÄtrznej ocenie Odkrycia luk w zabezpieczeniach i pisania raportÃģw, GPT-5.6-Cyber poprawia siÄ w porÃģwnaniu z GPT-5.5-Cyber, ale lÄ duje poniÅžej GPT-5.6 Sol, co OpenAI przypisuje temu, Åže model produkuje krÃģtsze, mniej szczegÃģÅowe raporty. Na ExploitBench, trudniejszym zadaniu eksploatacji z wÅÄ czonÄ piaskownicÄ V8 i mniej informacjami dostarczonymi agentowi, ogÃģlny model GPT-5.6 Sol wykonuje siÄ najlepiej w ramach standardowego limitu 300 tur, a przepaÅÄ zwÄÅža siÄ, gdy uruchomienia sÄ przedÅuÅžone do 600 tur. Wszystkie te liczby sÄ raportowane przez dostawcÄ, kilka na wewnÄtrznych benchmarkach, ktÃģre zewnÄtrzni ewaluatorzy nie powtÃģrzyli.
Twierdzenia z najwiÄkszym ciÄÅžarem dowodÃģw nie sÄ benchmarkami w ogÃģle. OpenAI twierdzi, Åže uÅžyÅo GPT-5.6-Cyber do zbadania V8, silnika JavaScript w Chrome, i odkryÅo dwie wczeÅniej nieznane luki, ktÃģre mogÄ byÄ poÅÄ czone w celu skorumpowania pamiÄci i ucieczki z piaskownicy V8. Pierwsza, bÅÄ d kompilatora, w ktÃģrym pominiÄta kontrola zabezpieczeÅ pozwala atakujÄ cemu odczytaÄ lub nadpisaÄ pamiÄÄ wewnÄ trz piaskownicy Chrome, zostaÅa zgÅoszona do Google za poÅrednictwem skoordynowanego ujawnienia, naprawiona i otrzymaÅa identyfikator CVE-2026-15903. Firma wymienia rÃģwnieÅž, bez podawania nazwy oprogramowania, co najmniej piÄÄ luk w popularnym systemie operacyjnym mobilnym, w tym ÅaÅcuch eskalacji uprawnieÅ z niezaufanego aplikacji, trzy krytyczne luki w popularnej bazie danych, w tym zdalnÄ ÅcieÅžkÄ do wykonania kodu, i ponad 400 luk eskalacji uprawnieÅ w popularnym jÄ drze systemu operacyjnego, wszystkie przechodzÄ ce przez ujawnienie z partnerami Daybreak i utrzymujÄ cymi oprogramowanie open-source.
SpecterOps, firma bezpieczeÅstwa, ktÃģrej CTO Jared Atkinson przetestowaÅ model wczeÅnie, opisaÅ wyniki w kategoriach kompresji pracy: model âwykonaÅ pracÄ w ciÄ gu jednego dnia, ktÃģrÄ wczeÅniejsze modele nie rozwiÄ zaÅy nawet po tygodniach przerywanej pracyâ.
Jak sÄ zarzÄ dzane dwa poziomy
DostÄp do obu poziomÃģw odbywa siÄ za poÅrednictwem weryfikacji toÅžsamoÅci, wymagaÅ bezpieczeÅstwa konta, monitorowania, ograniczeÅ uÅžycia i oÅwiadczeÅ prawnych, z oddzielnymi ÅcieÅžkami aplikacyjnymi dla osÃģb fizycznych i organizacji. OpenAI nakÅania klientÃģw Daybreak, ktÃģrzy uÅžywajÄ swojego agenta kodowania Codex, do przejÅcia z trybu peÅnego dostÄpu do trybu automatycznego przeglÄ du, ktÃģry ocenia dziaÅania wymagajÄ ce podniesionych uprawnieÅ przed wykonaniem, a firma bÄdzie wymagaÄ kluczy zabezpieczeÅ sprzÄtowych we wszystkich indywidualnych kontach Daybreak od 1 wrzeÅnia 2026 r. Planowana jest karta systemu z dalszymi ocenami GPT-5.6-Cyber w pÃģÅšniejszym terminie.
W ramach ram przygotowania OpenAI oba modele, GPT-5.6 Sol i GPT-5.6-Cyber, zostaÅy ocenione jako Wysokie pod wzglÄdem zdolnoÅci cyberbezpieczeÅstwa i poniÅžej progu krytycznego. Ta ocena pojawiÅa siÄ kilka dni po tym, jak Unite.AI poinformowaÅ, Åže nadchodzÄ cy model Astra OpenAI moÅže przekroczyÄ prÃģg krytyczny cyberbezpieczeÅstwa, a firma uÅžyÅa ogÅoszenia, aby powtÃģrzyÄ punkt ze swoich wczeÅniejszych ujawnieÅ incydentÃģw: GPT-5.6-Cyber nie byÅ zaangaÅžowany w eksploatacjÄ Hugging Face, a Åžaden model z tym zaangaÅžowaniem nie jest zaplanowany do wydania.
Gdzie staÅ Daybreak przed tym wydaniem
Struktura warstwowa konsoliduje program, ktÃģry byÅ rozszerzany w czÄÅciach. OpenAI uruchomiÅ peÅnÄ wersjÄ GPT-5.5-Cyber 22 czerwca 2026 r. obok programu partnerskiego Daybreak Cyber, w ktÃģrym uczestniczÄ Accenture, CrowdStrike, Cisco, IBM i Palo Alto Networks, oraz Patch the Planet, inicjatywy remediacji open-source zaÅoÅžonej z Trail of Bits. W tym wczeÅniejszym wydaniu OpenAI poinformowaÅ, Åže GPT-5.5-Cyber osiÄ gnÄ Å 85,6% na CyberGym w porÃģwnaniu z 81,8% dla GPT-5.5, i 39,5% w porÃģwnaniu z 25,95% na ExploitGym.
Zgodnie z postem z 22 czerwca, ponad 30 projektÃģw open-source zobowiÄ zaÅo siÄ do udziaÅu, a poczÄ tkowy piÄciodniowy sprint ujawniÅ setki problemÃģw z dziesiÄ tkami Åat wÅÄ czonych. Daybreak Blue i Red zastÄpujÄ to, co byÅo single Åladem dostÄpu zaufanego, z dwustopniowÄ drabinÄ : ogÃģlny poziom ogÃģlnego przeznaczenia, zrelaksowane barierki, dla szerokiej bazy obroÅcÃģw, i model specjalistyczny z lekkimi odmowami dla mniejszej grupy, ktÃģrej autoryzowana praca obejmuje rozwÃģj eksploitÃģw i czerwone zespoÅy.












