Hợp tác
Anthropic Huy động Faculty của Accenture cho Đánh giá Mô hình AI Nhúng

Anthropic cho biết vào ngày 18 tháng 9 năm 2026 rằng nó đang hợp tác với Accenture trong việc đánh giá độc lập AI tiên tiến, với mỗi công ty dự kiến đầu tư ít nhất $1 billion để xây dựng năng lực trong lĩnh vực này trong vòng 5 năm tới.
Sự hợp tác sẽ do Faculty, bộ phận AI chuyên môn của Accenture, dẫn đầu và sẽ bao gồm việc đánh giá và thực hiện red‑team các mô hình, tiến hành đánh giá sự phù hợp, và kiểm tra các biện pháp bảo vệ mô hình. Anthropic mô tả công việc này như một bước tiến hướng tới một cam kết, được đưa ra trong một bài tiểu luận của CEO Dario Amodei vào tháng 9 năm 2026, nhằm nhúng các nhà đánh giá độc lập vào trong công ty.
Anthropic cho biết Accenture giúp các doanh nghiệp và chính phủ triển khai AI trên nhiều ngành công nghiệp, và hiểu biết của công ty về cách các doanh nghiệp sử dụng AI trong thực tế định hướng cách tiếp cận an toàn của mình. Quan điểm đó, công ty nói, sẽ được áp dụng vào việc đánh giá các mô hình của mình.
Cách Thức Đánh Giá Nhúng Sẽ Hoạt Động
Đánh giá nhúng là mới, và nhiều chi tiết về cách nó sẽ hoạt động vẫn đang được xác định, theo thông báo. Trong khi các nhà đánh giá bên ngoài hiện có làm việc bên ngoài các công ty mà họ đánh giá, các nhà đánh giá nhúng sẽ làm việc bên trong các công ty AI với quyền truy cập tương đương với nhân viên.
Anthropic cho biết quyền truy cập đó cho phép các nhà đánh giá quan sát mô hình hình thành trong quá trình huấn luyện, theo dõi các quyết định điều khiển cách mô hình được xây dựng và triển khai, và giao tiếp trực tiếp với nhân viên. Từ vị trí đó, các nhà đánh giá có thể đánh giá cách công ty hoạt động, xác minh rằng công ty đang giữ các cam kết an toàn, và xác định các điểm mù. Họ cũng có thể báo cáo các sự cố và cung cấp cho công chúng một bản tóm tắt có thông tin hơn về lợi ích và rủi ro, công ty cho biết.
Anthropic cho biết các nhà đánh giá nhúng độc lập không làm thay đổi trách nhiệm của công ty mà chỉ làm cho trách nhiệm đó dễ kiểm chứng hơn, và an toàn của các mô hình vẫn là trách nhiệm của công ty.
Điều Khoản Truy Cập và Quyền Xuất Bản
Trong bài tiểu luận, có tiêu đề \”Chúng Ta Phải Điều Chỉnh Nhịp Độ Biên Giới\”, Amodei đề xuất một kế hoạch ba bước: các nhà đánh giá nhúng, sự phối hợp giữa các công ty AI tiên tiến ở các quốc gia dân chủ, và sự phối hợp toàn cầu. Ông viết rằng Anthropic đang cam kết một phía với bước đầu tiên và kêu gọi các chính phủ yêu cầu các công ty AI tiên tiến khác cũng làm tương tự. \”Chúng ta phải làm chậm tốc độ mà chúng ta cải thiện khả năng của các mô hình AI,\” ông viết. \”Tiến bộ vẫn sẽ có vẻ nhanh, và chúng ta phải sử dụng thời gian thu được một cách khôn ngoan.\”
Bài tiểu luận cho biết Anthropic dự định mời một nhóm đánh giá bên ngoài nhúng, được trang bị bàn làm việc trong văn phòng, thẻ truy cập và máy tính xách tay của công ty, cùng với quyền truy cập vào không gian làm việc, công cụ và các quyền hạn phần lớn tương đương với những gì các đội đánh giá rủi ro nội bộ có. Các ngoại lệ sẽ được áp dụng trong các trường hợp như luật hoặc hợp đồng yêu cầu, hoặc để bảo vệ thông tin riêng tư của khách hàng và đối tác.
Theo cách tiếp cận hợp đồng được mô tả trong bài tiểu luận, các nhà đánh giá bên ngoài sẽ có quyền công bố các phát hiện quan trọng về mức độ rủi ro, sự cố, thực tiễn và quyền truy cập họ đã nhận hoặc không nhận, mà không bị Anthropic kiểm soát biên tập. Công ty sẽ giữ lại khả năng hạn chế việc xóa bỏ thông tin nhạy cảm về bảo mật, có đặc quyền pháp lý, nhạy cảm thương mại, hoặc bí mật của bên thứ ba, nhưng không thể xóa bỏ các phát hiện chỉ vì chúng không có lợi; các nhà đánh giá có thể công khai nếu một việc xóa bỏ đã loại bỏ điều quan trọng cho kết luận của họ. Bài tiểu luận chỉ ra tiền lệ trong ngành ngân hàng, nơi các cơ quan giám sát quy định đôi khi được nhúng cùng với nhân viên.
Câu Hỏi Về Tài Trợ và Cấu Trúc Không Độc Quyền
Anthropic cho biết hiện vẫn chưa có tiêu chuẩn nào về thông tin mà các nhà đánh giá nhúng nên được truy cập, hoặc cách họ nên báo cáo những gì họ tìm thấy, và chưa có hệ thống ổn định cho việc tài trợ đánh giá độc lập. Về lâu dài, công ty tin rằng nguồn tài trợ nên đến từ các nguồn chung hoặc chính phủ, như đã đề cập trong Khung AI Tiên Tiến của mình vào tháng 6; vì chưa có nguồn nào tồn tại, công ty dự định làm việc với các nhà đánh giá khác nhau dưới các thỏa thuận tài trợ khác nhau.
Anthropic sẽ tài trợ trực tiếp cho công việc của Accenture. Công ty cũng đang đàm phán với METR và các nhà đánh giá phi lợi nhuận khác để thí điểm các yếu tố của đánh giá nhúng bằng nguồn tài trợ của họ, và cho biết tin rằng AI tiên tiến cuối cùng cần một hệ sinh thái các nhà đánh giá hoạt động theo các tiêu chuẩn chung.
Sự hợp tác không độc quyền. Anthropic cho biết sẽ hợp tác với các nhà đánh giá khác mà công ty dự định công bố trong vài tuần tới, dự đoán các phòng thí nghiệm AI tiên tiến sẽ làm việc với nhiều tổ chức đồng thời, và Accenture sẽ làm việc với các nhà phát triển AI khác trong các vai trò tương tự. Công ty cho biết sẽ tiếp tục đào tạo và phát hành các mô hình tiên tiến, đang chia sẻ các nỗ lực ban đầu để mọi người và các nhà phát triển AI khác có thể xem quy trình của mình, dự đoán cách tiếp cận sẽ phát triển khi lĩnh vực này trưởng thành, và sẽ chia sẻ thêm khi công việc bắt đầu và có thêm các nhà đánh giá tham gia.
Quan Hệ Đối Tác Doanh Nghiệp Trước Đó
Công việc đánh giá mở rộng một mối quan hệ rộng hơn mà hai công ty đã công bố vào ngày 9 tháng 12 năm 2025: một đối tác đa năm đã thành lập Nhóm Kinh doanh Accenture Anthropic. Theo thỏa thuận đó, khoảng 30.000 chuyên gia của Accenture sẽ được đào tạo về Claude, Claude Code đang được cung cấp cho hàng chục nghìn nhà phát triển của Accenture, và các công ty đã ra mắt một giải pháp chung nhằm giúp các CIO đo lường giá trị và thúc đẩy việc áp dụng AI trong toàn bộ tổ chức kỹ thuật của họ. Thông báo tháng 12 năm 2025 cũng bao gồm các giải pháp ngành ban đầu cho các lĩnh vực được quản lý, trong đó có dịch vụ tài chính, khoa học đời sống, chăm sóc sức khỏe và khu vực công.












