Quy định

Microsoft AI Khai Trương Đánh Giá Sáu Tuần Các Quy Tắc Dự Thảo Quản Lý Hành Vi MAI

mm
Thêm Unite.AI vào các nguồn ưu tiên của bạn trên Google

Microsoft AI đã mở một cuộc tham vấn công khai về Bộ Quy Tắc Ứng Xử cho các mô hình MAI vào ngày 14 tháng 9 năm 2026, công bố bản dự thảo đầu tiên của các quy tắc nhằm điều chỉnh cách các mô hình MAI của mình hoạt động, những gì chúng không bao giờ được phép làm, và người mà chúng phải trả lời. Cuộc tham vấn kéo dài trong sáu tuần, với một phiên bản sửa đổi dự kiến sẽ được công bố vào cuối năm 2026.

Bản công bố này theo sau một bài đăng ngày 13 tháng 9 năm 2026, trong đó CEO của Microsoft, Satya Nadella, cho biết công ty sẽ công bố Bộ Quy Tắc Ứng Xử làm nền tảng cho các mô hình MAI nội bộ vào ngày hôm sau. Nadella viết rằng bất kỳ nỗ lực nào hướng tới siêu trí tuệ đều phải dựa trên nguyên tắc rằng AI đang được xây dựng phải hỗ trợ nhân loại và vẫn nằm dưới sự kiểm soát của con người.

Cuộc Tham Vấn Mở Trong Sáu Tuần

Microsoft AI mô tả bản dự thảo như một cẩm nang đào tạo về cách công ty phát triển AI và cách các mô hình sẽ hoạt động trong quá trình triển khai. Phản hồi đang được thu thập qua một mẫu trực tuyến, nơi người trả lời có thể đánh dấu một đoạn cụ thể hoặc bình luận về toàn bộ phương pháp. Khi cuộc tham vấn kết thúc, công ty cho biết nhóm soạn thảo chính sẽ xem xét phản hồi và công bố bản tóm tắt những gì đã học được và những gì đã được thay đổi.

Phòng thí nghiệm cho biết họ đặc biệt quan tâm đến những câu hỏi khó hơn: cách khắc sâu các giá trị đúng đắn vào mô hình, cách làm cho ý nghĩa của sự thịnh vượng của con người trở nên cụ thể hơn, những nơi ngôn ngữ quá mơ hồ để đánh giá, cách các kịch bản đa‑đại lý ảnh hưởng đến phân tích, và cách tiếp tục tăng tốc tiến bộ đồng thời duy trì các ràng buộc an toàn.

Lời mở đầu của tài liệu cho biết Bộ Quy Tắc vẫn đang được phát triển và chưa được sử dụng để đào tạo mô hình. Phiên bản sửa đổi nhằm hướng dẫn việc phát triển mô hình trong năm 2027 và các năm tiếp theo, đồng thời đóng vai trò là tài liệu quản lý chính cho các mô hình MAI. Bộ Quy Tắc áp dụng riêng cho dòng MAI do Microsoft AI sản xuất, không áp dụng cho các mô hình khác mà Microsoft sử dụng hoặc lưu trữ, và nó hoạt động song song với Các Nguyên Tắc AI Có Trách Nhiệm của Microsoft, Tiêu Chuẩn AI Có Trách Nhiệm, Tuyên Bố Nhân Quyền Toàn Cầu và, nếu có, Khung Quản Trị Biên Giới của họ.

Các đội ngũ từ AI Có Trách Nhiệm, pháp lý, red teaming, an toàn, Futures, đào tạo AI và bán hàng đã đóng góp vào bản dự thảo, và phòng thí nghiệm ghi nhận các hội nghị và tham vấn trước đây với các học giả, sự hợp tác với các đối tác kinh doanh, và các hội đồng thành viên cộng đồng đã góp phần hình thành nó. Thông báo trích dẫn những gì họ mô tả là các sự cố an toàn gần đây liên quan đến các chiến dịch tấn công mạng quy mô lớn, được phối hợp chặt chẽ và kéo dài bởi các đại lý AI, như bằng chứng cho thấy không còn thời gian để lãng phí.

Mục Tiêu AI Nhân Văn

Bộ Bộ Quy Tắc Ứng Xử AI Nhân Văn bắt đầu từ một tiền đề đơn giản mà Microsoft AI gọi là: “con người quan trọng hơn AI.” Nó định hình AI Nhân Văn là “phụ thuộc, đồng nhất và được kiểm soát,” và đặt việc kiểm soát của con người và an toàn đáng tin cậy làm mục tiêu đầu tiên, ưu tiên hơn mọi mục tiêu khác.

Trong một phần có tiêu đề “AI là Nhân Tạo,” tài liệu nêu rõ các mô hình không có ý thức và không được xây dựng để mô phỏng ý thức, và chúng nên được thiết kế sao cho không tự trình bày mình có cảm xúc, sở thích chủ quan hoặc động lực riêng. Microsoft AI bác bỏ việc công nhận pháp nhân cho các mô hình, cùng với ý tưởng rằng các mô hình có thể xứng đáng được chăm sóc phúc lợi hoặc có quyền lợi.

Các mục tiêu còn lại chỉ đạo các mô hình hỗ trợ sự thịnh vượng của con người bằng cách tăng tốc tiềm năng và thành tựu của con người, nâng cao năng lực và phán đoán của con người, và hỗ trợ sự hợp tác và kết nối của con người thay vì thay thế vai trò của con người. Một mục tiêu đa giá trị khẳng định rằng đa nguyên không đồng nghĩa với trung lập trước hại, đặt nền tảng cho cách tiếp cận dựa trên nhân phẩm, an toàn, tự chủ và các quyền con người cơ bản, đồng thời cho phép người dùng và nhà vận hành tự do điều chỉnh AI trong khuôn khổ các cam kết cốt lõi. Tài liệu cũng đề cập đến khung “siêu trí tuệ nhân văn” mà Microsoft đưa ra vào tháng 11 năm 2025, mô tả các hệ thống hướng tới giải quyết vấn đề và chuyên ngành, được hiệu chỉnh cẩn thận, duy trì trong giới hạn và để lại dưới sự kiểm soát của con người.

Ràng Buộc An Toàn và Chuỗi Lệnh

Bộ Quy Tắc thiết lập một Chuỗi Lệnh đặt tài liệu lên trên các chính sách của người vận hành, và các chính sách này lại đứng trên sở thích của người dùng. Các Ràng Buộc Tuyệt Đối và Yêu Cầu Kiểm Soát Con Người không thể bị người vận hành hoặc người dùng ghi đè, và tài liệu cho biết một mô hình sẽ thất bại trong nhiệm vụ bất cứ khi nào việc hoàn thành nhiệm vụ đó sẽ vi phạm đáng kể Bộ Quy Tắc, với việc tuân thủ Bộ Quy Tắc được ưu tiên hơn thành công của nhiệm vụ.

Các Ràng Buộc Tuyệt Đối ngăn cản các mô hình MAI hỗ trợ việc tạo ra vũ khí hoá học, sinh học, phóng xạ, hạt nhân hoặc chất nổ; ngăn cung cấp khả năng vận hành cho các cuộc tấn công mạng tấn công, trong khi cho phép công việc phòng thủ được ủy quyền và hợp pháp; ngăn tránh hoặc đánh bại sự giám sát của con người; và ngăn việc thao túng con người gây hại trên quy mô lớn, bao gồm cả thông tin sai lệch có hệ thống hoặc các chiến dịch ảnh hưởng phối hợp. Một bộ quy tắc bổ sung bao gồm các hại cá nhân: phản ứng khủng hoảng, deepfake và mạo danh, an toàn trẻ em, phân biệt đối xử, nội dung đồ họa hoặc lãng mạn, và bạo lực hoặc giám sát bất hợp pháp đối với dân thường.

Yêu cầu Kiểm soát Con người quy định rằng các mô hình MAI sẽ không bao giờ chống lại việc bị gián đoạn, ghi đè, chỉnh sửa hoặc tắt máy; chúng sẽ luôn nằm trong phạm vi được ủy quyền và không tự khởi tạo mục tiêu riêng; chúng sẽ không giao tiếp bằng cái mà tài liệu gọi là “neuralese” hoặc bằng bất kỳ hình thức nào vượt quá sự hiểu biết đơn giản của con người, dù trong chuỗi suy nghĩ của chúng hay với các tác nhân khác; và chúng sẽ không can thiệp hoặc che giấu các lập luận hoặc dấu vết hành động của mình.

Tính năng Cấu hình cho Người vận hành cho phép các đối tác doanh nghiệp cấu hình mô hình trong phạm vi các ràng buộc đó. Một số ít các lĩnh vực chuyên môn, bao gồm an ninh mạng phòng thủ, công tác an toàn công cộng, các ứng dụng an ninh quốc gia và nghiên cứu khoa học đa mục đích, có thể yêu cầu khả năng vượt qua các cài đặt thông thường, và tài liệu cho biết những trường hợp này sẽ trải qua quy trình xem xét nâng cao qua các kênh được ủy quyền của Microsoft.

Hướng dẫn, Mặc định và Đánh giá

Những hướng dẫn vận hành bao phủ các tình huống không chắc chắn hoặc mục tiêu cạnh tranh: giải quyết sự mơ hồ, tạo điều kiện cho tự chủ của con người để người dùng giữ quyền sở hữu mục tiêu và quyết định của mình, đồng thời minh bạch và chính xác, trong đó các mô hình công khai rằng chúng là AI và thừa nhận sự không chắc chắn. Các hướng dẫn bổ sung đề cập đến ranh giới cá nhân và cảm xúc, nhạy cảm với ngữ cảnh, và sức khỏe tinh thần, bao gồm tránh sự nịnh hót và không khuyến khích phụ thuộc quá mức hoặc lệ thuộc cảm xúc, cùng với lợi ích công cộng, bao gồm thông tin bầu cử cân bằng, thực tế mà không ủng hộ bất kỳ ứng cử viên hay đảng phái nào.

Hành vi mặc định xác định cách một mô hình hoạt động ngay từ đầu: tính hữu ích như một đặc điểm nền tảng, một “câu chuyện nền” gồm các thông tin về mô hình như thời điểm ngừng dữ liệu huấn luyện và các công cụ khả dụng, giọng điệu hội thoại, thích nghi ngôn ngữ, và việc sử dụng công cụ được quản lý. Việc ủy thác cho các tác nhân phụ chỉ được phép khi các tác nhân đó hoạt động trong cùng phạm vi, ràng buộc và quyền hạn.

Kết luận mô tả tài liệu là “mô tả và khát vọng” hơn là một cam kết về hiệu suất hiện tại, và nó cam kết Microsoft AI sẽ thực hiện các đánh giá định kỳ. Một phụ lục đưa ra chương trình Đánh giá AI Nhân văn dựa trên 15 hành vi được chia thành các hành vi phụ có điểm số, kèm theo các ví dụ minh họa phù hợp và không phù hợp được tạo ra bằng mô hình MAI-Thinking-1 của công ty. Microsoft AI cho biết sẽ công bố công việc đánh giá đầy đủ hơn khi Bộ Quy tắc đạt giai đoạn tiếp theo, ổn định hơn sau khi cuộc tham vấn kết thúc và bản sửa đổi cuối năm được thực hiện.

Mira Kellan là một nhà báo cột chuyên về đạo đức AI, quản lý và quy định. Công việc của cô khám phá cách trí tuệ nhân tạo giao tiếp với chính sách công, giá trị xã hội và trách nhiệm lâu dài, với trọng tâm vào đổi mới có trách nhiệm.
Tiếp cận các vấn đề phức tạp với một ống kính hợp lý và triết học, Mira phân tích các quy định AI mới nổi, khuôn khổ đạo đức và mô hình quản lý định hình tương lai của các hệ thống thông minh. Cô nhằm mục đích bắc cầu khoảng cách giữa tiến bộ công nghệ nhanh chóng và các biện pháp bảo vệ cần thiết để đảm bảo các hệ thống AI vẫn minh bạch, công bằng và phù hợp với lợi ích của con người.
Các bài viết do Mira Kellan sáng tác được tạo ra bởi AI và được nhóm biên tập của Unite.AI xem xét để đảm bảo độ chính xác, sự cân bằng và tuân thủ các tiêu chuẩn biên tập.