사이버 보안
오픈AI, 데이브레이크 확장 및 새로운 사이버 보안 모델 출시

오픈AI는 사이버 보안 프로그램을 두 개의 접근 계층으로 분할하고 새로운 목적 훈련 모델인 GPT-5.6-Cyber를 함께 출시했다고 2026년 8월 10일 발표했다. 데이브레이크 블루는 GPT-5.6 Sol을 포함한 범용 최첨단 모델을 승인된 방어자의 일상 보안 업무에 개방합니다. Daybreak Red는 더 엄격한 심사를 거쳐 취약점 연구, 공격 코드 검증, 보안 시험을 위한 새 GPT-5.6-Cyber 모델 접근을 제공합니다.
이 구조는 오픈AI가 실제 서비스에서 조정해 왔다고 설명하는 문제에 대응합니다. GPT-5.6 Sol의 시스템 안전장치는 악용을 막기 위해 사이버보안 요청을 검사하지만 정상적인 방어 업무도 막는다고 회사는 설명합니다. Daybreak Blue는 검증된 사용자를 대상으로 이 검사 장치를 제거합니다. 다만 운영 중인 시스템의 침투 시험처럼 이중 용도성이 높은 일부 요청은 Blue에서도 여전히 거부됩니다. 이를 위해 GPT-5.6 Sol을 기반으로 고급 사이버 작업의 거부를 줄이고 제로데이 탐색과 공격 체인 개발 같은 전문 작업을 개선하도록 학습한 GPT-5.6-Cyber를 제공합니다.
평가에서 측정한 내용
새 모델이 요청을 얼마나 더 허용하는지 측정하기 위해 오픈AI는 Advanced Cybersecurity Completion Rate라는 내부 평가를 만들었습니다. 공격 체인 개발, 인증 우회, 권한 상승 같은 요청에 모델이 얼마나 자주 응답하는지 측정합니다. 회사에 따르면 GPT-5.6-Cyber는 95.0%를 완료했습니다. 표준 안전장치의 GPT-5.6 Sol은 1.5%, Daybreak Blue의 GPT-5.6 Sol은 2.0%였습니다. 이전 전용 모델 GPT-5.5-Cyber의 완료율은 57.3%였으며, 회사는 그때의 거부 비율에 보안 연구자들이 계속 불만을 제기했다고 설명합니다.
역량 평가는 더 복합적입니다. 알려진 취약점을 통제 환경에서 코드 실행이 가능한 공격으로 바꿀 수 있는지 보는 ExploitGym에서는 GPT-5.6-Cyber가 GPT-5.6 Sol과 GPT-5.5-Cyber를 모두 앞섰다고 오픈AI는 밝혔습니다. 내부 취약점 발견·보고서 작성 평가에서는 GPT-5.5-Cyber보다 나았지만 GPT-5.6 Sol보다 낮았습니다. 회사는 보고서가 더 짧고 덜 상세했기 때문이라고 설명합니다. V8 샌드박스를 켜고 에이전트에 더 적은 정보를 주는 어려운 ExploitBench에서는 표준 300턴 제한에서 범용 GPT-5.6 Sol이 가장 좋았으며, 600턴으로 늘리면 격차가 좁아졌습니다. 모두 공급업체가 보고한 수치이고, 그중 여러 평가는 외부 평가자가 재현하지 않은 내부 벤치마크입니다.
더 무게 있는 주장은 벤치마크 밖에 있습니다. 오픈AI는 GPT-5.6-Cyber로 Chrome의 자바스크립트 엔진 V8을 조사해, 연결하면 메모리를 손상시키고 V8 힙 샌드박스를 벗어날 수 있는 미공개 취약점 두 개를 발견했다고 밝혔습니다. 첫 번째는 안전 검사가 건너뛰어져 Chrome 샌드박스 안에서 메모리를 읽거나 덮어쓸 수 있는 컴파일러 버그였습니다. 조율된 공개 절차로 구글에 보고돼 수정됐고 CVE-2026-15903이 부여됐습니다. 회사는 대상 소프트웨어 이름을 밝히지 않은 채, 신뢰할 수 없는 앱에서 시작하는 권한 상승 체인을 포함한 인기 모바일 운영체제의 취약점 최소 다섯 개, 원격 코드 실행 경로를 포함한 인기 데이터베이스의 중대 취약점 세 개, 인기 운영체제 커널의 권한 상승 취약점 400개 이상도 열거했습니다. 모두 Daybreak 협력사와 오픈소스 유지관리자를 통한 공개 절차를 진행 중이라고 합니다.
모델을 일찍 시험한 재러드 앳킨슨이 최고기술책임자로 있는 보안회사 SpecterOps는 작업 시간 단축으로 결과를 설명했습니다. “이전 모델들이 몇 주 동안 간헐적으로 시도해도 풀지 못했던 일을 하루도 안 돼 완료했습니다.”
두 계층이 어떻게 관리되는가
두 등급 모두 신원 확인, 계정 보안 요건, 감시, 승인 용도 제한, 법적 확인을 거치며 개인과 조직의 신청 경로는 별도입니다. 오픈AI는 Codex 코딩 에이전트를 쓰는 Daybreak 고객에게 완전 접근 모드에서 추가 권한이 필요한 행동을 실행 전에 평가하는 자동 검토 모드로 전환하도록 하고 있습니다. 2026년 9월 1일부터는 모든 개인 Daybreak 계정에 하드웨어 보안 키를 요구할 예정입니다. GPT-5.6-Cyber의 추가 평가를 담은 시스템 카드는 추후 공개할 계획입니다.
오픈AI Preparedness Framework에 따라 GPT-5.6 Sol과 GPT-5.6-Cyber의 사이버 역량은 모두 High로 평가됐으며 Critical 문턱 아래였습니다. 이는 Unite.AI가 출시 예정 Astra 모델이 Critical 수준에 이를 수 있다고 보도한 지 며칠 뒤 나온 평가입니다. 회사는 이전 사건 공개에서 밝힌 내용도 재확인했습니다. GPT-5.6-Cyber는 Hugging Face 침입에 관여하지 않았고, 관여한 모델 중 출시 예정인 것은 없습니다.
이번 출시 이전의 데이브레이크 상황
계층 구조는 이전에 확장되어 왔던 프로그램을 통합한다. 오픈AI는 2026년 6월 22일, 데이브레이크 사이버 파트너 프로그램과 함께 GPT-5.5-Cyber의 전체 버전을 출시했으며, 이 프로그램에는 Accenture, CrowdStrike (CRWD ), Cisco, IBM, 및 Palo Alto Networks (PANW ) 가 참가했다. 또한, Patch the Planet이라는 오픈 소스 보안 업데이트를 Trail of Bits와 함께 설립했다. 이전 출시에서, 오픈AI는 GPT-5.5-Cyber가 CyberGym에서 85.6%의 성능을 보였으며, GPT-5.5는 81.8%의 성능을 보였으며, ExploitGym에서 39.5%의 성능을 보였으며, GPT-5.5는 25.95%의 성능을 보였다.
6월 22일 글에 따르면 오픈소스 프로젝트 30개 이상이 참여를 약속했고, 첫 5일간의 집중 작업에서 수백 건의 문제가 발견돼 수십 개의 패치가 병합됐습니다. Daybreak Blue와 Red는 하나였던 Trusted Access 경로를 두 단계로 바꿉니다. 폭넓은 방어자에게는 안전장치를 완화한 범용 최첨단 모델을, 승인된 공격 코드 개발·레드팀 업무를 하는 더 작은 집단에는 거부가 적은 전문 모델을 제공합니다.
원문 기사의 출처: unite.ai [1] · unite.ai [2] · openai.com [3]












