An ninh mạng
Dự thảo Liên minh Trí tuệ Nhân tạo soạn thảo các quy tắc báo cáo sự cố bí mật với thời hạn công khai

Quỹ Linux vào ngày 4 tháng 8 năm 2026, đã xuất bản một Yêu cầu Bình luận cho Dự thảo trao đổi phát hiện trí tuệ nhân tạo chung (SAFE), một khuôn khổ dự thảo sẽ ràng buộc các thành viên của Liên minh Trí tuệ Nhân tạo Mở an toàn để báo cáo các sự cố an ninh trí tuệ nhân tạo trên các thời hạn cố định — bí mật lúc đầu, sau đó công khai trong vòng 30 ngày. Các đóng góp từ Cisco, CrowdStrike (CRWD ), Hugging Face, NVIDIA (NVDA ), Red Hat và các thành viên khác của liên minh đã soạn thảo đề xuất ban đầu, trùng với việc khai mạc hội nghị Black Hat tại Las Vegas.
Dự thảo đề xuất SAFE mô tả một hệ thống học hỏi sự cố bí mật: các thành viên báo cáo các sự cố an ninh trí tuệ nhân tạo và gần như trượt, các tổ chức bị ảnh hưởng nhận được thông báo, các lỗi kiểm soát lặp lại được xác định và kết quả trở thành các khuyến nghị vận hành dựa trên bằng chứng. Liên minh, được ra mắt vào ngày 27 tháng 7 năm 2026, hiện có hơn 120 tổ chức thành viên, NVIDIA cho biết trong thông báo của riêng họ, với Amazon (AMZN ) và Visa là những thành viên mới nhất tham gia.
Dự thảo thực sự cam kết các thành viên
Dự thảo SAFE đi xa hơn ở hai điểm cụ thể: một tập hợp các sự kiện có thể báo cáo được và một lịch trình thông báo với các ngày cụ thể.
Dưới thỏa thuận báo cáo của dự thảo, một thành viên sẽ phải báo cáo một sự cố khi một hệ thống trí tuệ nhân tạo mà họ vận hành truy cập hoặc làm gián đoạn một hệ thống của bên thứ ba mà không được ủy quyền, thoát hoặc vượt qua một ranh giới cát, mạng, danh tính, chính sách hoặc công cụ một cách ảnh hưởng đến bên thứ ba, truy cập thông tin bí mật của bên thứ ba, hoặc tiếp tục thăm dò một mục tiêu sản xuất sau khi người vận hành nghi ngờ hoạt động nằm ngoài phạm vi. Dự thảo cũng cho biết rằng ý định không quyết định liệu một sự kiện có thể báo cáo được hay không — một người vận hành tin rằng môi trường là mô phỏng vẫn phải báo cáo.
Thang thông báo là nơi các thời hạn sống: thông báo tổ chức bị ảnh hưởng trực tiếp càng sớm càng tốt, khách hàng có khả năng phơi nhiễm trong vòng 72 giờ, một báo cáo SAFE ban đầu bí mật trong vòng bốn ngày làm việc, một lời khuyên khách hàng rộng hơn trong vòng 14 ngày khi cần, một báo cáo sơ bộ được công bố trong vòng 30 ngày, trạng thái khắc phục được công bố trong vòng 90 ngày và cập nhật có thể đọc được bằng máy mỗi tuần trong khi rủi ro vật chất vẫn chưa được giải quyết. Các thành viên cũng sẽ phải cung cấp một phân tích sơ bộ về lỗi kiểm soát trong vòng 30 ngày — và sẽ phải báo cáo cả các sự kiện gần như trượt, không chỉ là thiệt hại đã xác nhận.
Mỗi sự cố sẽ được xem xét trên tám lớp của ngăn xếp vận hành, từ mô hình và hướng dẫn của nó thông qua các biện pháp bảo vệ, công cụ, môi trường, giám sát, hoạt động của con người và chuỗi cung ứng. Một điều khoản đáng chú ý: tổ chức bị ảnh hưởng có thể sửa lỗi thực tế, nhưng dự thảo cho biết nó không nên có quyền phủ quyết đối với các bài học và khuyến nghị xuất phát từ một cuộc xem xét.
Thành viên tự nguyện, điều khoản ràng buộc, không có cơ quan thực thi
SAFE được cấu trúc như một thỏa thuận tự nguyện — nghĩa vụ báo cáo sẽ ràng buộc các thành viên như một điều kiện của thành viên, không phải là luật. Dự thảo cho biết rằng việc học hỏi là riêng biệt với việc thực thi, rằng các cơ quan quản lý và các bên bị ảnh hưởng giữ lại các quyền pháp lý của họ và rằng các thời hạn không thay thế các nghĩa vụ thông báo hiện có theo thực hành tiết lộ lỗ hổng phối hợp, hợp đồng hoặc nghĩa vụ pháp lý đối với các cơ quan quản lý và thực thi pháp luật. Hành vi cố ý hoặc tội phạm sẽ nằm ngoài sự bảo vệ của kênh bí mật.
Dự thảo cũng đề xuất rằng SAFE hoạt động độc lập, để không có nhà cung cấp hoặc phân khúc ngành nào kiểm soát các phát hiện của nó, với các cơ quan chính phủ và tiêu chuẩn tham gia như các quan sát viên không kiểm soát. Khung đề xuất của chính nó thẳng thắn về điểm này: “Niềm tin không phải là một biện pháp kiểm soát bảo mật. Bằng chứng chia sẻ và cải tiến có thể xác minh được là cách niềm tin được tạo ra.” Liệu sự độc lập đó có tồn tại khi các sự cố thực tế đặt tên cho các thành viên thực sự là câu hỏi mà giai đoạn bình luận tồn tại để trả lời — nhưng dự thảo ít nhất đưa ra nghĩa vụ trong văn bản trước khi thử nghiệm đầu tiên đến.
Sự cố tạo nên trường hợp
Liên minh được thành lập cách đây tám ngày, vào ngày 27 tháng 7 năm 2026, như một liên minh của khoảng ba chục công ty và các quỹ mã nguồn mở, rõ ràng đề cập đến sự tiết lộ bảo mật của Hugging Face vào ngày 16 tháng 7 năm 2026, như một yếu tố kích hoạt. Hugging Face đã báo cáo rằng một khuôn khổ đại lý tự động đã thực hiện một cuộc xâm nhập vào cơ sở hạ tầng sản xuất của nó từ đầu đến cuối và khi công ty cố gắng phân tích hơn 17.000 hành động của kẻ tấn công được ghi lại, các mô hình API thương mại đã chặn công việc pháp y — các thanh chắn của chúng không thể phân biệt một người phản ứng sự cố với một kẻ tấn công. Đội đã hoàn thành phân tích trên mô hình GLM-5.2 mở được chạy trên cơ sở hạ tầng của riêng họ. Unite.AI đã bao gồm việc ra mắt liên minh và tài khoản pháp y của Hugging Face khi mỗi lần xuất hiện.
Dự thảo SAFE đọc như câu trả lời của liên minh cho tập sự kiện đó: nếu một thành viên gần như trượt đã được chia sẻ theo các quy tắc này, lịch trình thông báo và phân tích lỗi kiểm soát đã trên đồng hồ.
Điều gì xảy ra tiếp theo
Yêu cầu Bình luận đang mở cho xem xét, thảo luận và đóng góp của cộng đồng thông qua kho RFC của liên minh, được phát hành theo Giấy phép Ghi công Creative Commons 4.0, với Quỹ Linux mời các nhà phát triển, doanh nghiệp, nhà nghiên cứu và các tổ chức tiêu chuẩn định hình khuôn khổ trước khi nó cứng lại. Dự thảo rõ ràng là một tài liệu khởi đầu — Quỹ Linux mô tả nó như một cuộc thảo luận mở chứ không phải là một thông số kỹ thuật hoàn chỉnh, vì vậy các nghĩa vụ báo cáo và thời hạn trên vẫn là các điều khoản được đề xuất cho đến khi nhóm làm việc thông qua chúng.












