Lãnh đạo tư tưởng

Washington Có Thể Ngừng Cung Cấp Các Mô Hình Của Anthropic, Nhưng Không Thể Sửa Đổi Kiến Trúc Của Bạn

mm
Thêm Unite.AI vào các nguồn ưu tiên của bạn trên Google

Câu chuyện xoay quanh các mô hình Fable 5 và Mythos 5 của Anthropic đã cung cấp cho ngành CNTT một ví dụ hiếm hoi, thời gian thực về quản trị AI dưới áp lực địa chính trị. Vào tháng 6, Bộ Thương mại Hoa Kỳ đã ra lệnh cho Anthropic ngừng cung cấp quyền truy cập vào cả hai mô hình cho tất cả công dân nước ngoài vì lo ngại an ninh quốc gia. Anthropic không thể xác minh quốc tịch kịp thời, vì vậy đã tắt hoàn toàn quyền truy cập, sau đó khôi phục lại sau vài tuần. Theo đa số nguồn tin, nguyên nhân kích hoạt là một “jailbreak” khiến mô hình hoạt động như một công cụ tấn công mạng có khả năng. Các mô hình tiên tiến ngày càng giỏi hơn trong việc tìm và khai thác lỗ hổng, và xu hướng này sẽ tiếp tục bất kể phòng thí nghiệm nào bị kiểm tra trong tháng này.

Nguy cơ này quan trọng, và các đội an ninh thông tin nên theo dõi chặt chẽ. Các nhà lãnh đạo CNTT có thể rút ra một bài học hữu ích hơn từ sự kiện này: những gì việc ngừng cung cấp tiết lộ về kiến trúc của Anthropic, và những gì nó nói về mỗi tổ chức phải trả lời câu hỏi quản trị theo yêu cầu.

Một Quy Định Không Có Chẩn Đoán

Ngay cả khi nguyên nhân hiện đã được gán cho một phát hiện jailbreak cụ thể, chính phủ vẫn chưa công khai toàn bộ chi tiết kỹ thuật đằng sau quyết định của mình, và việc giải quyết nhanh chóng, một hiệp ước đạt được trong vài tuần, cùng với đề xuất của Anthropic về một khung đánh giá mức độ nghiêm trọng của jailbreak cho toàn ngành, cho thấy đây là kết quả vừa do đàm phán, dựa trên mối quan hệ vừa là kỹ thuật. Dù nguyên nhân chính xác là gì, nó cũng không thay đổi thực tế quan trọng hơn: một đối thủ đã ra mắt mô hình có khả năng tương đương và thoát khỏi cùng một hạn chế, điều này đặt ra những câu hỏi riêng về tính nhất quán.

Điều này quan trọng về mặt vận hành, vì nó có nghĩa là các nhà lãnh đạo CNTT không thể xem đây như một sự cố riêng lẻ, đã giải quyết với nguyên nhân gốc rõ ràng để phòng ngừa. Đó là một sự kiện địa chính trị và quy định, không phải là một lỗi kỹ thuật duy nhất, và áp lực nền tảng mà nó phản hồi không hề biến mất. Việc hạn chế quyền truy cập của một nhà cung cấp trong vài tuần không thay đổi đáng kể hướng đi đó. Thậm chí, nó cho thấy rào cản trong việc tìm và khai thác lỗ hổng đang giảm xuống bất kể mô hình của phòng thí nghiệm nào đứng đầu bảng xếp hạng vào bất kỳ tuần nào.

Tại Sao Các Đội Ngũ Chuẩn Bị Kỹ Lưỡng Hầu Như Không Nhận Thấy

Câu hỏi mang tính chỉ dẫn hơn cho bộ phận CNTT sản xuất là những gì thực sự thay đổi đối với các tổ chức vận hành những hệ thống này hàng ngày. Câu trả lời thẳng thắn là rất ít, và đó chính là điểm mấu chốt. Các đội đã xây dựng quản trị AI dựa trên giả định rằng bất kỳ mô hình, nhà cung cấp, hoặc đường truy cập nào cũng có thể biến mất trong một đêm đã xem sự kiện này như một việc thường lệ. Sự hiện diện hoặc vắng mặt của một mô hình duy nhất không bao giờ bảo vệ họ.

Hệ thống của họ có thể trả lời ngay một câu hỏi quản trị ngay khi ai đó đặt ra: ai có quyền truy cập vào gì, thông qua công cụ nào, và điều gì sẽ xảy ra ngay khi cần thay đổi quyền truy cập. Việc ngừng cung cấp của Anthropic cho thấy những gì xảy ra khi không có khả năng đó. Một lệnh của chính phủ đã được đưa ra. Anthropic không thể xác minh quốc tịch trong thời gian thực trên hàng trăm triệu người dùng, vì vậy phản hồi duy nhất tuân thủ là tắt mọi thứ cho tất cả mọi người. Đó là hình ảnh của một phản ứng ép buộc, thô ráp, toàn diện khi kiến trúc của tổ chức không thể trả lời nhanh một câu hỏi mục tiêu. Khả năng nhìn thấy chi tiết, thời gian thực về quyền truy cập và danh tính tồn tại để ngăn chặn chính xác kết quả đó.

Được đặt trong bối cảnh này, sự kiện Fable 5 dự báo loại sự kiện ép buộc mà bất kỳ tổ chức nào vận hành AI ở quy mô lớn nào cũng sẽ phải đối mặt cuối cùng. Nó có thể xuất hiện dưới dạng một chỉ thị quy định, một đánh giá rủi ro của nhà cung cấp, hoặc một lỗ hổng mới được phát hiện. Các tổ chức vượt qua sự kiện này một cách suôn sẻ sẽ không cần đoán mô hình nào đáng tin cậy. Kiến trúc của họ sẽ đã sẵn sàng trả lời câu hỏi.

Vấn Đề Xác Thực Tại Lớp API

Một luồng ít được chú ý hơn và có thể có hậu quả lớn hơn trong sự kiện này là khoảng trống xác thực thực sự nói gì về kiến trúc nền tảng. Nó chỉ ra một hạn chế cấu trúc: các tổ chức thiết lập niềm tin và danh tính ở lớp API sau khi đã xảy ra, trong khi họ lẽ ra phải kiến trúc sẵn từ đầu.

Đối với các tổ chức vận hành hạ tầng quan trọng, như sản xuất, tiện ích, dịch vụ tài chính, chăm sóc sức khỏe và các hệ thống doanh nghiệp hỗ trợ chúng, bài học này mở rộng vượt ra ngoài việc tuân thủ kiểm soát xuất khẩu. Nếu quyền truy cập, danh tính và luồng dữ liệu không thể được xác minh và quản lý liên tục, thời gian thực, bất kỳ quyết định bên ngoài nào, dù là chỉ thị quy định, đánh giá rủi ro của nhà cung cấp, hay lỗ hổng mới phát hiện, đều có thể buộc phải phản hồi thô ráp, toàn diện. Những tổ chức sẵn sàng hấp thụ cú sốc như vậy là những đơn vị đã có khả năng nhìn thấy chi tiết, thời gian thực về ai và gì đang chạm vào tài sản sản xuất của họ, thay vì dựa vào các cuộc kiểm toán định kỳ hoặc cam kết của nhà cung cấp sau khi xảy ra.

Xây Dựng Quản Trị AI Chủ Động

Quản trị AI chủ động thực tế trông như thế nào, so với trong các tài liệu chính sách? Nó bắt đầu bằng cách coi bất kỳ mô hình, nhà cung cấp, hoặc đường truy cập nào cũng có thể bị rút lại mà không có cảnh báo, và xây dựng quản trị không phụ thuộc vào việc bất kỳ yếu tố nào trong số chúng duy trì.

Nó cũng đồng nghĩa với việc đầu tư vào khả năng quan sát vận hành, cho phép đội ngũ nhìn thấy, thời gian thực, nơi các hệ thống gọi các mô hình ngôn ngữ lớn (LLM). Những đội sẽ vượt lên trong phiên bản tiếp theo của câu chuyện này là những người không bao giờ cần phản hồi khẩn cấp ban đầu, vì khả năng quan sát và các rào cản đã được tích hợp sẵn vào cách tài sản của họ vận hành, dù có hay không có mô hình cụ thể nào đứng sau một cuộc gọi API.

Jan Karstens đã gia nhập Avantra với vị trí Giám đốc Công nghệ vào tháng 9 năm 2025, mang hơn hai thập kỷ kinh nghiệm dẫn dắt công nghệ và đổi mới sản phẩm trong phần mềm doanh nghiệp, AI và nền tảng đám mây. Đặt trụ sở tại Đức, Jan điều hành chiến lược công nghệ, kiến trúc sản phẩm và lộ trình đổi mới của Avantra khi công ty phát triển các giải pháp tự động hoá thông minh cho hoạt động SAP.

Trước khi gia nhập Avantra, Jan đã làm Kiến trúc sư Giải pháp AI tại Aleph Alpha, tập trung vào việc phát triển các giải pháp AI quy mô doanh nghiệp. Trước đó, ông là CTO tại STP – The Legal Tech Company, chịu trách nhiệm hiện đại hoá các dịch vụ SaaS của công ty. Jan đã làm việc hơn một thập kỷ tại Blue Yonder, thăng tiến từ Trưởng bộ phận Phát triển lên vị trí CTO và sau đó là Phó Chủ tịch Cấp cao về Kỹ thuật Nền tảng Đám mây, nơi ông dẫn dắt chuyển đổi sang nền tảng AI và ML bản địa đám mây cho tối ưu hoá bán lẻ và chuỗi cung ứng.

Trong giai đoạn đầu sự nghiệp, Jan đã giữ các vị trí phát triển cấp cao tại SAP và Lufthansa Systems, xây dựng nền tảng vững chắc trong thiết kế và kiến trúc phần mềm doanh nghiệp quy mô lớn. Sự nghiệp của ông phản ánh niềm đam mê liên tục đối với sự xuất sắc công nghệ, đổi mới và xây dựng các tổ chức kỹ thuật hiệu suất cao.