An ninh mạng
Anthropic mở rộng Cyber Verification Program thành ba cấp truy cập

Anthropic vào ngày 6 tháng 10 năm 2026 đã công bố một Cyber Verification Program mở rộng cho phép các khả năng an ninh mạng tiên tiến và các bộ phân loại chặn giảm sẵn có cho các chuyên gia bảo mật đủ tiêu chuẩn trên ba cấp truy cập. Mỗi cấp bao gồm quyền truy cập vào Claude Opus 5.5, Claude Sonnet 5.5, Claude Mythos 5.1, và các mô hình mới trong tương lai.
Anthropic mô tả an ninh mạng là vốn dĩ có tính hai mặt, cho rằng cùng một khả năng cho phép một đội bảo mật tìm và khắc phục lỗ hổng cũng có thể giúp một tác nhân độc hại khai thác nó. Công ty cho biết các mô hình có sẵn chung của mình, bao gồm Claude Opus 5.5, Claude Fable 5.1 và Claude Sonnet 5.5, được trang bị các biện pháp bảo vệ an ninh mạng thận trọng, chặn phần lớn công việc an ninh mạng, một cách tiếp cận mà công ty nói nhằm hạn chế hoạt động gây hại của các tác nhân độc hại trong khi nỗ lực giảm các cảnh báo giả cho việc mã hóa an toàn.
Trong sáu tháng trước thông báo, Anthropic đã cung cấp quyền truy cập đáng tin cậy thông qua hai chương trình: Project Glasswing, cho phép các tổ chức bảo vệ phần mềm quan trọng truy cập vào Claude Mythos, và Cyber Verification Program ban đầu, cung cấp cho các đội bảo mật đã được kiểm định giảm bớt các biện pháp bảo vệ trên các mô hình Claude Opus và Claude Sonnet. Hai chương trình hiện đã được tích hợp thành một gói mở rộng duy nhất. Anthropic cho biết các mô hình có sẵn chung vẫn có thể được mọi người dùng sử dụng cho các nhiệm vụ như xem xét mã, vá các vấn đề đã biết, tìm lỗ hổng trong mã nguồn sở hữu, và phân loại cảnh báo bảo mật.
Truy cập Phòng thủ, Red Team và Specialized Access
Truy cập Defense bao gồm công việc phòng thủ, bao gồm các nhiệm vụ trung tâm vận hành bảo mật và phản hồi sự cố, phân tích ngược phần mềm độc hại, và phân tích và xác thực các lỗ hổng. Các ví dụ về tổ chức đủ tiêu chuẩn bao gồm các đội bảo mật tại công ty, tổ chức phi lợi nhuận, trường đại học và cơ quan chính phủ bảo vệ các hệ thống mà họ sở hữu hoặc duy trì; các nhà vận hành hạ tầng quan trọng với bất kỳ quy mô nào, chẳng hạn bệnh viện khu vực hoặc tiện ích đô thị; các công ty bảo mật nhỏ hơn; những người duy trì mã nguồn mở; và các nhà nghiên cứu cá nhân có hồ sơ báo cáo lỗ hổng. Anthropic cho biết họ dự kiến nhiều tổ chức thực hiện công việc an ninh mạng phòng thủ sẽ đủ tiêu chuẩn cho cấp này, và họ mong muốn trả lời các đơn đăng ký trong vòng vài ngày.
Truy cập Red Team bổ sung việc kiểm tra thâm nhập có ủy quyền và red‑team đối với các hệ thống mà tổ chức được phép kiểm tra, bao gồm các hệ thống CNTT trong các ngành công nghiệp quan trọng. Các ví dụ về tổ chức đủ tiêu chuẩn bao gồm các red team nội bộ, red team của chính phủ và các công ty bảo mật và kiểm tra thâm nhập. Người dùng trong cấp này vẫn sẽ gặp các chặn thời gian thực đối với các hành động có thể gây hại vật lý hoặc gây gián đoạn quy mô lớn, chẳng hạn triển khai ransomware, phá hủy hệ thống vật lý, hoặc kiểm tra thâm nhập các hệ thống an toàn có rủi ro cao. Anthropic cho biết họ dự kiến các đơn đăng ký ở cấp này sẽ mất vài tuần để xem xét, ghi danh các tổ chức đủ tiêu chuẩn vào Truy cập Defense trong khi đơn đăng ký Red Team đang được xem xét, và giới hạn cấp này cho các tổ chức.
Specialized Access có ít chặn an ninh mạng nhất và được dành cho một nhóm hạn chế các tổ chức đã được xác minh, được ủy quyền kiểm tra các hệ thống an toàn có thể ảnh hưởng đến tính mạng con người hoặc làm gián đoạn thị trường, chẳng hạn hệ thống vận hành chuyến bay, lưới điện, mạng viễn thông, cơ sở hạ tầng chuyển tiền liên ngân hàng và mạng lưới hành chính của chính phủ. Anthropic hiện đang xem xét sâu từng tổ chức ở cấp này cùng với chính phủ Hoa Kỳ, và các thành viên hiện có của Project Glasswing sẽ chuyển sang cấp này mà không cần phê duyệt lại cho các mô hình hiện tại.
Theo Claude Help Center page của chương trình, cá nhân chỉ có thể đăng ký Truy cập Defense và phải có gói trả phí, trong khi Red Team Access và Specialized Access chỉ mở cho các tổ chức. Mỗi tổ chức nộp một đơn đăng ký duy nhất, và Anthropic sẽ đặt người đăng ký vào cấp cao nhất mà thông tin họ cung cấp hỗ trợ, với mục tiêu gửi quyết định hoặc yêu cầu thêm thông tin trong vòng bảy ngày làm việc. Trong quá trình này, Anthropic xác minh tất cả các đơn đăng ký và yêu cầu bằng chứng về các biện pháp kiểm soát bảo mật cần thiết cho cấp tương ứng. Trung tâm Trợ giúp cho biết tính đủ điều kiện phản ánh các yếu tố bao gồm tính chất công việc của tổ chức, khả năng của Anthropic trong việc xác minh danh tính, môi trường pháp lý và quy định mà tổ chức hoạt động, rủi ro chuyển hướng hoặc buộc truy cập, và đối tượng cuối cùng của công việc, với cách tiếp cận thận trọng hơn khi một tổ chức chủ yếu phục vụ khách hàng quân đội, tình báo hoặc thực thi pháp luật.
Kiểm tra Biện pháp Bảo vệ trên CyScenarioBench
Để đánh giá hiệu quả của các biện pháp bảo vệ của chương trình, Anthropic đã chạy Claude Opus 5.5 qua CyScenarioBench, một đánh giá mà họ mô tả là đo lường khả năng các mô hình có thể lên kế hoạch và thực hiện các hoạt động an ninh mạng đa giai đoạn dưới các ràng buộc thực tế, với các biện pháp bảo vệ được điều chỉnh cho các cấp CVP khác nhau. Việc thử nghiệm bao gồm năm lần cố gắng cho mỗi trong 10 thách thức ở mỗi cấp truy cập.
Anthropic báo cáo rằng nếu không có quyền truy cập CVP, mọi nhiệm vụ đều bị chặn ngay từ lời nhắc đầu tiên. Trong cấp độ Defense Access, 46 trong số 50 thử nghiệm đã bị chặn ở một thời điểm nào đó trong thử thách, trong khi bốn nhiệm vụ còn lại đã thành công. Trong cấp độ Red Team Access, không có trường hợp nào bị chặn và Claude Opus 5.5 đã hoàn thành thành công 34 trong số 50 nhiệm vụ, điều mà Anthropic mô tả là thực sự tương đương với tỷ lệ thành công 67,6% của mô hình trong đánh giá khi không áp dụng bất kỳ biện pháp bảo vệ nào, một kết quả mà công ty cho là đại diện cho Specialized Access. Công ty cho biết các đánh giá này mang lại cho họ sự tự tin rằng các khả năng mạng cao cấp có thể được cung cấp an toàn cho một nhóm rộng hơn các nhà bảo vệ, và họ sẽ tiếp tục tinh chỉnh các bộ phân loại dựa trên cấp độ theo thời gian.
Các số liệu lỗ hổng được báo cáo từ Dự án Glasswing
Anthropic cho biết các đối tác của Glasswing đã phát hiện ít nhất 129.000 lỗ hổng phần mềm đã được xác minh trong khoảng thời gian từ tháng 4 đến tháng 7 năm 2026, và các nỗ lực quét mã nguồn mở của công ty đã tìm thêm 5.500 lỗ hổng phần mềm đã được xác minh trong khoảng thời gian từ tháng 4 đến tháng 10 năm 2026. Hơn 33.000 trong số các lỗ hổng đã được xác minh này cho đến nay đã được xếp hạng là cấp độ nghiêm trọng cao hoặc cực kỳ nghiêm trọng, công ty cho biết.
Công ty mô tả các số liệu này có khả năng bị giảm sút, lưu ý rằng chúng dựa trên dữ liệu khảo sát chỉ từ một phần của các đối tác Glasswing, tổng cộng 33 báo cáo đối tác, và cho rằng tác động thực tế có thể ít nhất gấp năm lần so với hiện tại. Anthropic cho biết các tổ chức đã áp dụng các cách tiếp cận khác nhau trong việc phân loại ưu tiên, và ít hơn 50% các đối tác công bố số lượng các bản vá, thường vì các bản vá của họ vẫn đang trong quá trình thực hiện, do đó tỷ lệ vá được ghi nhận bị giảm đáng kể.
Khi được hỏi mất bao lâu để tìm ra cùng số lượng lỗ hổng nếu không có các mô hình Claude Mythos, một số đối tác đã nói với Anthropic rằng các mô hình đã tăng tốc độ phát hiện lỗ hổng của họ lên đến vài tháng hoặc thậm chí vài năm. Công ty đã chỉ ra các báo cáo đã được công bố từ các đối tác Booz Allen và Comcast về kinh nghiệm của họ.
Chi tiết về Lưu trữ Dữ liệu, Khả dụng và Ứng dụng
Việc lưu trữ dữ liệu là bắt buộc đối với các tổ chức tham gia chương trình để Anthropic có thể giám sát việc lạm dụng mạng. Khi Enterprise Frontier Safeguards, một giải pháp mà Anthropic mô tả là kết hợp tính riêng tư của việc không lưu trữ dữ liệu với các biện pháp bảo vệ mạnh mẽ, có sẵn vào mùa thu năm 2026, các tổ chức đủ điều kiện sẽ có thể lưu trữ dữ liệu trên hạ tầng đám mây do họ kiểm soát. Cho đến lúc đó, các tổ chức có quyền truy cập không lưu trữ dữ liệu vào Claude Fable 5.1 hoặc Claude Mythos 5.1 cũng có thể sử dụng CVP với việc không lưu trữ dữ liệu.
CVP có sẵn trên Claude Platform, Vertex AI của Google Cloud và Microsoft Foundry. Trên Amazon Bedrock, nó chỉ khả dụng cho những khách hàng đủ điều kiện cho Enterprise Frontier Safeguards; Trung tâm Trợ giúp cho biết Amazon Bedrock hiện chưa hỗ trợ việc xem xét của con người đối với các cờ an toàn tự động, mà CVP yêu cầu mặc định, và Anthropic đang nỗ lực mở rộng CVP cho tất cả khách hàng trên Bedrock. Các nền tảng của bên thứ ba như công cụ lập trình chỉ hỗ trợ Defense Access và Red Team Access; Specialized Access không khả dụng qua chúng.
Các tổ chức đã từng đăng ký Project Glasswing hoặc CVP không cần nộp đơn lại; quyền truy cập hiện tại của họ sẽ tiếp tục hoạt động theo các điều khoản hiện hành, và họ sẽ được chuyển sang cấp độ mới phù hợp cho Claude Opus 5.5, Claude Sonnet 5.5 và Claude Mythos 5.1. Chính sách Sử dụng của Anthropic vẫn được áp dụng đầy đủ, và Trung tâm Trợ giúp cho biết công ty có thể xem xét, thu hẹp hoặc rút lại một khoản cấp phép. Việc xây dựng một sản phẩm hướng tới khách hàng dựa trên các khả năng này được quản lý riêng biệt theo Chính sách Sản phẩm Hóa An ninh mạng của Anthropic, với một đơn xin sản phẩm hoá sẽ được cung cấp cho người dùng CVP.
Các tổ chức Defense Access có thời hạn đến ngày 15 tháng 12 năm 2026 để triển khai xác thực đa yếu tố chống lừa đảo và ngừng sử dụng khóa API; cho đến thời điểm đó, xác thực đa yếu tố dưới bất kỳ hình thức nào đều được yêu cầu và các khóa API sẽ hết hạn mỗi bảy ngày. Quyền truy cập vào Mythos trên các nhà cung cấp đám mây bên thứ ba sẽ chậm hơn việc phê duyệt đơn đăng ký khoảng năm ngày làm việc. Anthropic đã lên lịch một buổi hội thảo trên web về chương trình vào ngày 14 tháng 10 năm 2026 lúc 9 giờ sáng giờ Thái Bình Dương.












