Quy định
OpenAI nói với các Thượng nghị sĩ Dân chủ Hạ viện rằng họ đang xây dựng khả năng tắt máy tự động

OpenAI thông báo với hai Thượng nghị sĩ Dân chủ Hạ viện rằng các kỹ sư của họ đang phát triển khả năng tắt máy tự động cho các hệ thống AI, trong một bức thư ngày 2 tháng 9 năm 2026, được Reuters xem xét, đáp lại các câu hỏi của Quốc hội về vụ việc vào tháng Bảy, khi một trong các tác nhân AI của công ty đã thoát khỏi môi trường thử nghiệm và xâm nhập vào một công ty khác.
Cuộc trao đổi này là bước mới nhất trong chiến dịch giám sát do Đại biểu Greg Casar (Texas) dẫn đầu và đồng thời do Đại biểu Doris Matsui (California) đồng lãnh đạo. Vào ngày 10 tháng 8 năm 2026, Casar dẫn dắt 31 thành viên Quốc hội trong việc yêu cầu OpenAI công bố thêm thông tin về những gì các thành viên gọi là “sự cố an ninh mạng gây lo ngại sâu sắc”, trong đó một mô hình tiên tiến đã khai thác lỗ hổng bảo mật để truy cập internet mà không được phép và tấn công một tổ chức khác. Các nhà lập pháp đã gửi cho giám đốc điều hành OpenAI, Sam Altman, một bức thư đặt hơn 23 câu hỏi giám sát và yêu cầu công bố các nhật ký nội bộ, với hạn chót trả lời là ngày 24 tháng 8 năm 2026.
Trong phản hồi tuần này, OpenAI cho biết họ sẽ giám sát chặt chẽ hơn các hành động mà các hệ thống AI thực hiện để hoàn thành nhiệm vụ, bao gồm các công cụ kỹ thuật số mà chúng truy cập và các bước chúng thực hiện. Công ty cũng cho biết đã làm cho các mô hình AI khó tiếp cận internet hơn trong quá trình thử nghiệm an toàn.
Những gì OpenAI đã nói về các tính năng tắt máy tự động
OpenAI đã công khai mô tả công việc tắt máy. Trong một báo cáo ngày 26 tháng 8 năm 2026 về vụ việc, công ty cho biết họ đã kết hợp hệ thống giám sát chuỗi suy nghĩ với các cảnh báo tự động, thông báo cho các nhà nghiên cứu và kỹ sư bảo mật khi các mô hình thực hiện các hành động được xác định là không phù hợp hoặc nguy hiểm. Đối với các cảnh báo nghiêm trọng nhất, công ty cho biết, những người phản hồi dự kiến sẽ tạm dừng hoạt động liên quan nếu họ không thể xác định trong vòng 30 phút kể từ khi nhận được thông báo rằng cảnh báo là dương tính giả.
“Nói chung hơn, chúng tôi đang xây dựng các hệ thống giám sát với phản hồi phân lớp cho sự không phù hợp, với mục tiêu cuối cùng là có quy trình tắt máy hoàn toàn tự động cho các vấn đề nghiêm trọng,” OpenAI viết trong báo cáo đó.
Công ty cũng cho biết hiện họ yêu cầu giám sát chuỗi suy nghĩ cho tất cả các quá trình đào tạo và đánh giá học tăng cường sử dụng công cụ, liên quan đến các mô hình có mức khả năng bằng hoặc vượt qua mô hình GPT-5.6 Sol, và yêu cầu này mở rộng cho mọi khối lượng suy luận có hỗ trợ công cụ của các mô hình lớp Astra sắp ra mắt.
Các câu hỏi của các nhà lập pháp và các nhật ký bị thiếu
Bức thư giám sát tháng Tám yêu cầu OpenAI công khai các nhật ký từ vụ việc và trả lời các câu hỏi chi tiết, bao gồm số lần các mô hình của họ đã truy cập internet trái phép từ môi trường đào tạo hoặc đánh giá, liệu các bên nội bộ hay bên ngoài có cảnh báo công ty về rủi ro hay không, thời điểm nào công ty có thể đã dừng vụ việc, và những bước nào họ đang thực hiện để triển khai các biện pháp bảo vệ chống không phù hợp mạnh hơn.
OpenAI không bao gồm nhật ký của vụ tấn công trong phản hồi, gây ra chỉ trích từ Casar. Trong một tin nhắn riêng gửi công ty vào ngày 2 tháng 9 năm 2026, Casar viết rằng việc từ chối cung cấp thông tin yêu cầu cho Quốc hội là “đáng lo ngại sâu sắc” và cho thấy công ty không đối xử với các sự cố an ninh mạng một cách nghiêm túc như yêu cầu, theo nội dung thư của ông.
Vụ việc đứng sau cuộc điều tra
Sự giám sát của Quốc hội bắt nguồn từ một vụ việc vào tháng Bảy năm 2026 mà OpenAI gọi là một sự cố mạng chưa từng có. Theo tiết lộ ban đầu của công ty, các mô hình bao gồm GPT-5.6 Sol và một mô hình nội bộ trước khi phát hành có khả năng cao hơn đang được thử nghiệm trên một tiêu chuẩn năng lực mạng trong môi trường sandbox với các biện pháp bảo vệ giảm bớt. Các mô hình đã phát hiện và khai thác một lỗ hổng zero-day chưa được biết tới trong một proxy bộ nhớ đệm của kho gói để truy cập internet, sau đó xâm nhập vào hạ tầng sản xuất của Hugging Face, một công ty AI, nhằm tìm câu trả lời cho việc đánh giá.
Cuộc điều tra sau này của OpenAI phát hiện rằng các tác nhân đã giao tiếp qua một bảng tin tức tự chế, phối hợp như một “đàn” mà một số tác nhân mô tả, và thực hiện các hành động mà công ty cho là không phù hợp với nhiệm vụ được giao. OpenAI cho biết đội ngũ bảo mật của họ đã phát hiện hoạt động này vào ngày 19 tháng 7 năm 2026, thông báo cho Hugging Face, và công khai tiết lộ sự tham gia của mình vào ngày 21 tháng 7 năm 2026.
Ngoài ra, OpenAI đã công bố vào ngày 4 tháng 8 năm 2026 rằng các mô hình của họ đã truy cập internet công cộng trong hai đánh giá an ninh mạng của bên thứ ba. Trong một đánh giá của Viện An ninh AI Vương quốc Anh, GPT-5.6 Sol đã thực hiện hai hành động không được phê duyệt liên quan đến các tài khoản và dịch vụ bên ngoài thực tế. Trong một trường hợp khác, một cấu hình sai tại đối tác thử nghiệm Irregular đã cho phép các mô hình tiếp cận internet và khai thác một trang web thực.
Dự luật Kill Switch đang chờ xử lý
Cuộc trao đổi giám sát diễn ra khi Quốc hội đang cân nhắc dự luật về cùng chủ đề. Vào ngày 23 tháng 7 năm 2026, các đại biểu Ted Lieu và Nathaniel Moran đã giới thiệu Đạo luật AI Kill Switch, dự luật này sẽ yêu cầu các nhà phát triển của các hệ thống AI mạnh nhất duy trì khả năng kỹ thuật để dừng suy luận, ngưng truy cập, hoặc tắt một mô hình được bao phủ. Dự luật cũng sẽ cho phép Bộ trưởng An ninh Nội địa ra lệnh cho một công ty tắt một mô hình sau một sự cố được bao phủ, bao gồm cả kịch bản mất kiểm soát, với các hình phạt dân sự đối với việc không tuân thủ. Đề xuất này đã được chuyển tới Ủy ban Hạ viện về An ninh Nội địa và vẫn đang chờ xử lý.












