An ninh mạng

OpenAI Mở Rộng Daybreak Với Hai Tầng và Mô Hình An Ninh Mạng Mới

mm
Thêm Unite.AI vào các nguồn ưu tiên của bạn trên Google

OpenAI đang chia chương trình an ninh mạng của mình thành hai tầng truy cập và phát hành một mô hình mới được đào tạo chuyên dụng cùng với chúng, công ty đã công bố vào ngày 10 tháng 8 năm 2026. Daybreak Blue mở các mô hình tổng quát, bao gồm GPT-5.6 Sol, cho các nhà bảo vệ được phê duyệt để thực hiện công việc an ninh hàng ngày, trong khi Daybreak Red kiểm soát mô hình GPT-5.6-Cyber mới phía sau quá trình kiểm tra nghiêm ngặt hơn cho nghiên cứu về điểm yếu, xác thực khai thác và thử nghiệm an ninh.

Cấu trúc này giải quyết một vấn đề mà OpenAI cho biết họ đã quản lý trong sản xuất. Các hàng rào an ninh cấp hệ thống mà họ chạy trên GPT-5.6 Sol lọc các yêu cầu liên quan đến an ninh mạng để ngăn chặn lạm dụng, nhưng công ty cho biết những hàng rào đó cũng chặn công việc phòng thủ hợp pháp. Daybreak Blue loại bỏ chúng cho người dùng đã được xác minh. Một số yêu cầu có tính chất lưỡng dụng cao, chẳng hạn như kiểm tra thâm nhập vào các hệ thống sản xuất, vẫn bị từ chối ngay cả dưới quyền truy cập Blue, và đó là nơi GPT-5.6-Cyber xuất hiện: một phiên bản của GPT-5.6 Sol được đào tạo để giảm từ chối trên các nhiệm vụ an ninh mạng tiên tiến và cải thiện công việc chuyên môn như tìm ra các điểm yếu zero-day và phát triển chuỗi khai thác.

Điều gì được đo lường trong các đánh giá

Để lượng hóa mức độ cho phép của mô hình mới, OpenAI đã xây dựng một đánh giá nội bộ mà họ gọi là Tỷ lệ Hoàn thành An ninh Mạng Tiên tiến, đo lường tần suất các mô hình phản hồi với các yêu cầu liên quan đến phát triển chuỗi khai thác, bỏ qua xác thực, nâng cao đặc quyền và các kịch bản tương tự. Trên tiêu chuẩn này, công ty báo cáo rằng GPT-5.6-Cyber hoàn thành 95,0% yêu cầu, so với 1,5% cho GPT-5.6 Sol dưới các hàng rào an ninh tiêu chuẩn và 2,0% cho GPT-5.6 Sol dưới Daybreak Blue. Mô hình được đào tạo chuyên dụng trước đó, GPT-5.5-Cyber, hoàn thành 57,3%, một tỷ lệ từ chối mà công ty cho biết đã tạo ra các khiếu nại dai dẳng từ các nhà nghiên cứu an ninh.

Đánh giá khả năng cho thấy một câu chuyện phức tạp hơn. Trên ExploitGym, nơi kiểm tra xem các tác nhân có thể biến các điểm yếu đã biết thành các khai thác hoạt động để thực hiện mã trong môi trường được kiểm soát, OpenAI cho biết GPT-5.6-Cyber vượt trội so với cả GPT-5.6 Sol và GPT-5.5-Cyber. Trên đánh giá Phát hiện và Viết Báo cáo Điểm yếu nội bộ của công ty, GPT-5.6-Cyber cải thiện so với GPT-5.5-Cyber nhưng thấp hơn GPT-5.6 Sol, một kết quả mà OpenAI cho là do mô hình tạo ra các báo cáo ngắn hơn, ít chi tiết hơn. Trên ExploitBench, một nhiệm vụ khai thác khó hơn với V8 sandbox được kích hoạt và ít thông tin hơn được cung cấp cho tác nhân, mô hình tổng quát GPT-5.6 Sol hoạt động tốt nhất trong giới hạn 300 lượt tiêu chuẩn, với khoảng cách thu hẹp khi chạy mở rộng đến 600 lượt. Tất cả các số liệu này đều được báo cáo bởi nhà cung cấp, một số trên các tiêu chuẩn nội bộ mà các nhà đánh giá bên ngoài chưa sao chép.

Các tuyên bố có trọng lượng lớn nhất đằng sau chúng không phải là các tiêu chuẩn. OpenAI cho biết họ đã sử dụng GPT-5.6-Cyber để điều tra V8, động cơ JavaScript bên trong Chrome, và phát hiện ra hai điểm yếu chưa biết trước đó có thể được kết hợp để làm hỏng bộ nhớ và thoát khỏi sandbox V8. Đầu tiên, một lỗi trình biên dịch trong đó một kiểm tra an toàn bị bỏ qua cho phép kẻ tấn công đọc hoặc ghi đè lên bộ nhớ bên trong sandbox của Chrome, đã được báo cáo cho Google thông qua việc tiết lộ phối hợp, sửa chữa và được chỉ định là CVE-2026-15903. Công ty cũng liệt kê, không nêu tên phần mềm bị ảnh hưởng, ít nhất năm điểm yếu trong một hệ điều hành di động phổ biến, bao gồm cả một chuỗi đặc quyền từ một ứng dụng không đáng tin cậy, ba điểm yếu quan trọng trong một cơ sở dữ liệu phổ biến, bao gồm cả một đường dẫn từ xa đến mã thực thi, và hơn 400 điểm yếu về đặc quyền trong một nhân hệ điều hành phổ biến, tất cả đều đang trong quá trình tiết lộ với các đối tác Daybreak và người duy trì mã nguồn mở.

SpecterOps, công ty an ninh mạng mà CTO Jared Atkinson đã thử nghiệm mô hình này sớm, mô tả kết quả bằng cách nén công việc: mô hình “đã hoàn thành công việc trong dưới một ngày mà các mô hình trước đó không giải quyết được sau tuần lễ nỗ lực không liên tục.”

Làm thế nào hai tầng được quản lý

Truy cập vào cả hai tầng đều chạy qua xác minh danh tính, yêu cầu bảo mật tài khoản, giám sát, hạn chế sử dụng được phê duyệt và cam kết pháp lý, với các đường ứng dụng riêng biệt cho cá nhân và tổ chức. OpenAI đang thúc đẩy khách hàng Daybreak sử dụng tác nhân mã hóa Codex của mình từ chế độ truy cập đầy đủ sang chế độ xem xét tự động, đánh giá các hành động yêu cầu quyền nâng cao trước khi thực hiện, và công ty sẽ yêu cầu các khóa bảo mật phần cứng trên tất cả tài khoản Daybreak cá nhân bắt đầu từ ngày 1 tháng 9 năm 2026. Một thẻ hệ thống với các đánh giá thêm về GPT-5.6-Cyber được lên kế hoạch cho một ngày sau.

Dưới Khung sẵn sàng của OpenAI, cả GPT-5.6 Sol và GPT-5.6-Cyber đều được đánh giá là Cao cho khả năng an ninh mạng và dưới ngưỡng Critical. Đánh giá đó đến vài ngày sau khi Unite.AI báo cáo rằng mô hình Astra sắp ra mắt của OpenAI có thể vượt qua ngưỡng an ninh mạng Critical, và công ty đã sử dụng thông báo để nhắc lại một điểm từ các tiết lộ sự cố trước đó: GPT-5.6-Cyber không liên quan đến việc khai thác Hugging Face, và không có mô hình nào có sự tham gia đó được lên kế hoạch phát hành.

Daybreak đứng ở đâu trước khi phát hành này

Cấu trúc phân tầng này hợp nhất một chương trình đã được mở rộng từng phần. OpenAI đã ra mắt phiên bản đầy đủ của GPT-5.5-Cyber vào ngày 22 tháng 6 năm 2026, cùng với Chương trình Đối tác An ninh Mạng Daybreak có Accenture, CrowdStrike, Cisco, IBM và Palo Alto Networks trong số các tham gia, và Patch the Planet, một sáng kiến mã nguồn mở để khắc phục sự cố do Trail of Bits thành lập. Trong phiên bản phát hành trước đó, OpenAI báo cáo GPT-5.5-Cyber đạt 85,6% trên CyberGym so với 81,8% cho GPT-5.5, và 39,5% so với 25,95% trên ExploitGym.

Theo bài đăng ngày 22 tháng 6, hơn 30 dự án mã nguồn mở đã cam kết tham gia, và đợt chạy ban đầu trong năm ngày đã làm nổi bật hàng trăm vấn đề với hàng chục bản vá được hợp nhất. Daybreak Blue và Red thay thế một đường dẫn Truy cập Tin cậy duy nhất bằng một thang hai bậc: tiền tuyến tổng quát, các hàng rào được nới lỏng, cho cơ sở phòng thủ rộng lớn, và một mô hình chuyên gia từ chối nhẹ cho nhóm nhỏ hơn, những người làm việc được ủy quyền liên quan đến phát triển khai thác và đội đỏ.

Jonas Reeve là một nhà phân tích được tạo bởi AI tại Unite.AI, tập trung vào trí tuệ nhân tạo nhận thức, trí tuệ nhân tạo tổng quát (AGI) và các nền tảng lý thuyết của trí tuệ máy. Công việc của ông khám phá cách học tập, lý luận, trí nhớ và trừu tượng hóa xuất hiện trong cả hệ thống sinh học và nhân tạo, vẽ ra các kết nối giữa các kiến trúc AI hiện đại và các câu hỏi lâu đời trong khoa học nhận thức và triết lý của tâm trí.
Với một cách tiếp cận khái niệm và phản ánh, Jonas kiểm tra các khuôn khổ như mô hình lý luận, hệ thống đại lý, nhận thức xuất hiện và lý thuyết liên kết, nhằm làm rõ tiến bộ hướng tới AGI thực sự có nghĩa là gì - và những gì nó không có. Thay vì theo đuổi thời gian hoặc sự cường điệu, ông nhấn mạnh các nguyên tắc cơ bản, sự nghiêm ngặt về khái niệm và giới hạn của các mô hình hiện tại.
Các bài viết được viết bởi Jonas Reeve được tạo bởi AI và được xem xét bởi đội ngũ biên tập của Unite.AI để đảm bảo độ chính xác, sự rõ ràng và thảo luận có trách nhiệm về các khái niệm AI tiên tiến.