Cyberbezpieczeństwo

OpenAI Rozszerza Daybreak Z Dwoma Poziomami Dostępu I Nowym Modelem Cyberbezpieczeństwa

mm
Dodaj Unite.AI do preferowanych ÅšrÃģdeł w Google

OpenAI dzieli swÃģj program cyberbezpieczeństwa na dwa poziomy dostępu i wydaje nowy model szkoleniowy obok nich, jak ogłosiła firma 10 sierpnia 2026 r. Daybreak Blue otwiera ogÃģlnego uÅžytku modele, w tym GPT-5.6 Sol, dla zatwierdzonych obrońcÃģw do codziennej pracy zabezpieczeń, podczas gdy Daybreak Red zamyka nowy model GPT-5.6-Cyber za ścisłymi kontrolami dla badań nad lukami w zabezpieczeniach, walidacji eksploitÃģw i testowania zabezpieczeń.

Struktura ta rozwiązuje napięcie, ktÃģre OpenAI twierdzi, Åže zarządza w produkcji. Systemowe zabezpieczenia, ktÃģre są uruchamiane na GPT-5.6 Sol, filtrowania Şądań związanych z cyberbezpieczeństwem w celu zapobiegania naduÅžyciom, ale firma twierdzi, Åže te same filtry blokują rÃģwnieÅž uzasadnioną pracę obronną. Daybreak Blue usuwa je dla zweryfikowanych uÅžytkownikÃģw. Resztki wysoko dwuznacznych podpowiedzi, takich jak testowanie penetracyjne systemÃģw produkcyjnych, nadal powodują odmowy nawet w trybie dostępu Blue, co jest tym, gdzie GPT-5.6-Cyber wchodzi w grę: wersja GPT-5.6 Sol przeszkolona w celu zmniejszenia odmÃģw w zaawansowanych zadaniach związanych z cyberbezpieczeństwem i poprawy specjalistycznej pracy, takiej jak wykrywanie luk w zabezpieczeniach zero-day i rozwijanie łańcuchÃģw eksploitÃģw.

Co mierzyły oceny

Aby zmierzyć, jak muito bardziej permissive nowy model jest, OpenAI zbudował wewnętrzną ocenę, ktÃģrą nazywa Advanced Cybersecurity Completion Rate, mierząc, jak często modele odpowiadają na Şądania dotyczące rozwoju łańcuchÃģw eksploitÃģw, obejścia uwierzytelniania, eskalacji uprawnień i podobnych scenariuszy. Na tym benchmarku firma raportuje, Åže GPT-5.6-Cyber kończy 95,0% Şądań, w porÃģwnaniu z 1,5% dla GPT-5.6 Sol pod standardowymi zabezpieczeniami i 2,0% dla GPT-5.6 Sol pod Daybreak Blue. Poprzedni model szkoleniowy, GPT-5.5-Cyber, kończył 57,3%, co firma twierdzi, Åže wygenerowało stałe skargi od researcherÃģw zabezpieczeń.

Oceny moÅžliwości opowiadają bardziej zrÃģÅžnicowaną historię. Na ExploitGym, ktÃģry testuje, czy agenci mogą przekształcić znane luki w zabezpieczeniach w działające eksploaty, ktÃģre osiągają wykonanie kodu w kontrolowanych środowiskach, OpenAI twierdzi, Åže GPT-5.6-Cyber przewyÅžsza zarÃģwno GPT-5.6 Sol, jak i GPT-5.5-Cyber. Na wewnętrznej ocenie Odkrycia luk w zabezpieczeniach i pisania raportÃģw, GPT-5.6-Cyber poprawia się w porÃģwnaniu z GPT-5.5-Cyber, ale ląduje poniÅžej GPT-5.6 Sol, co OpenAI przypisuje temu, Åže model produkuje krÃģtsze, mniej szczegÃģłowe raporty. Na ExploitBench, trudniejszym zadaniu eksploatacji z włączoną piaskownicą V8 i mniej informacjami dostarczonymi agentowi, ogÃģlny model GPT-5.6 Sol wykonuje się najlepiej w ramach standardowego limitu 300 tur, a przepaść zwęŞa się, gdy uruchomienia są przedłuÅžone do 600 tur. Wszystkie te liczby są raportowane przez dostawcę, kilka na wewnętrznych benchmarkach, ktÃģre zewnętrzni ewaluatorzy nie powtÃģrzyli.

Twierdzenia z największym cięŞarem dowodÃģw nie są benchmarkami w ogÃģle. OpenAI twierdzi, Åže uÅžyło GPT-5.6-Cyber do zbadania V8, silnika JavaScript w Chrome, i odkryło dwie wcześniej nieznane luki, ktÃģre mogą być połączone w celu skorumpowania pamięci i ucieczki z piaskownicy V8. Pierwsza, błąd kompilatora, w ktÃģrym pominięta kontrola zabezpieczeń pozwala atakującemu odczytać lub nadpisać pamięć wewnątrz piaskownicy Chrome, została zgłoszona do Google za pośrednictwem skoordynowanego ujawnienia, naprawiona i otrzymała identyfikator CVE-2026-15903. Firma wymienia rÃģwnieÅž, bez podawania nazwy oprogramowania, co najmniej pięć luk w popularnym systemie operacyjnym mobilnym, w tym łańcuch eskalacji uprawnień z niezaufanego aplikacji, trzy krytyczne luki w popularnej bazie danych, w tym zdalną ścieÅžkę do wykonania kodu, i ponad 400 luk eskalacji uprawnień w popularnym jądrze systemu operacyjnego, wszystkie przechodzące przez ujawnienie z partnerami Daybreak i utrzymującymi oprogramowanie open-source.

SpecterOps, firma bezpieczeństwa, ktÃģrej CTO Jared Atkinson przetestował model wcześnie, opisał wyniki w kategoriach kompresji pracy: model “wykonał pracę w ciągu jednego dnia, ktÃģrą wcześniejsze modele nie rozwiązały nawet po tygodniach przerywanej pracy”.

Jak są zarządzane dwa poziomy

Dostęp do obu poziomÃģw odbywa się za pośrednictwem weryfikacji toÅžsamości, wymagań bezpieczeństwa konta, monitorowania, ograniczeń uÅžycia i oświadczeń prawnych, z oddzielnymi ścieÅžkami aplikacyjnymi dla osÃģb fizycznych i organizacji. OpenAI nakłania klientÃģw Daybreak, ktÃģrzy uÅžywają swojego agenta kodowania Codex, do przejścia z trybu pełnego dostępu do trybu automatycznego przeglądu, ktÃģry ocenia działania wymagające podniesionych uprawnień przed wykonaniem, a firma będzie wymagać kluczy zabezpieczeń sprzętowych we wszystkich indywidualnych kontach Daybreak od 1 września 2026 r. Planowana jest karta systemu z dalszymi ocenami GPT-5.6-Cyber w pÃģÅšniejszym terminie.

W ramach ram przygotowania OpenAI oba modele, GPT-5.6 Sol i GPT-5.6-Cyber, zostały ocenione jako Wysokie pod względem zdolności cyberbezpieczeństwa i poniÅžej progu krytycznego. Ta ocena pojawiła się kilka dni po tym, jak Unite.AI poinformował, Åže nadchodzący model Astra OpenAI moÅže przekroczyć prÃģg krytyczny cyberbezpieczeństwa, a firma uÅžyła ogłoszenia, aby powtÃģrzyć punkt ze swoich wcześniejszych ujawnień incydentÃģw: GPT-5.6-Cyber nie był zaangaÅžowany w eksploatację Hugging Face, a Åžaden model z tym zaangaÅžowaniem nie jest zaplanowany do wydania.

Gdzie stał Daybreak przed tym wydaniem

Struktura warstwowa konsoliduje program, ktÃģry był rozszerzany w częściach. OpenAI uruchomił pełną wersję GPT-5.5-Cyber 22 czerwca 2026 r. obok programu partnerskiego Daybreak Cyber, w ktÃģrym uczestniczą Accenture, CrowdStrike, Cisco, IBM i Palo Alto Networks, oraz Patch the Planet, inicjatywy remediacji open-source załoÅžonej z Trail of Bits. W tym wcześniejszym wydaniu OpenAI poinformował, Åže GPT-5.5-Cyber osiągnął 85,6% na CyberGym w porÃģwnaniu z 81,8% dla GPT-5.5, i 39,5% w porÃģwnaniu z 25,95% na ExploitGym.

Zgodnie z postem z 22 czerwca, ponad 30 projektÃģw open-source zobowiązało się do udziału, a początkowy pięciodniowy sprint ujawnił setki problemÃģw z dziesiątkami łat włączonych. Daybreak Blue i Red zastępują to, co było single śladem dostępu zaufanego, z dwustopniową drabiną: ogÃģlny poziom ogÃģlnego przeznaczenia, zrelaksowane barierki, dla szerokiej bazy obrońcÃģw, i model specjalistyczny z lekkimi odmowami dla mniejszej grupy, ktÃģrej autoryzowana praca obejmuje rozwÃģj eksploitÃģw i czerwone zespoły.

Jonas Reeve jest analitykiem wygenerowanym przez AI w Unite.AI, specjalizującym się w sztucznej inteligencji kognitywnej, ogÃģlnej inteligencji sztucznej (AGI) oraz teoretycznych podstawach inteligencji maszynowej. Jego praca bada, jak uczenie się, rozumowanie, pamięć i abstrakcja pojawiają się w systemach biologicznych i sztucznych, nawiązując połączenia między nowoczesnymi architekturami AI a długotrwałymi pytaniami w nauce o poznaniu i filozofii umysłu.
Z konceptualnym i refleksyjnym podejściem, Jonas bada ramy takie jak modele rozumowania, systemy agenty, emergentna percepcja i teoria dopasowania, mając na celu wyjaśnienie, co oznacza postęp w kierunku AGI - i co nie. Zamiast gonienia za harmonogramami lub hiperem, kładzie nacisk na pierwsze zasady, konceptualną surowość i granice obecnych modeli.
Artykuły napisane przez Jonasa Reeve są wygenerowane przez AI i sprawdzane przez zespÃģł redakcyjny Unite.AI, aby zapewnić dokładność, klarowność i odpowiedzialną dyskusję zaawansowanych pojęć AI.