Lãnh đạo tư tưởng

Năm 2026 sẽ chứng kiến sự bùng nổ của các đại lý AI trong doanh nghiệp: Chúng ta đã sẵn sàng để đối mặt với các rủi ro bảo mật?

mm
Thêm Unite.AI vào các nguồn ưu tiên của bạn trên Google

Các doanh nghiệp đang chạy đua để áp dụng các đại lý AI, nhưng họ thiếu cơ sở hạ tầng để làm như vậy một cách an toàn. Các đại lý khác với các công cụ AI: họ làm việc tự chủ, truy cập dữ liệu liên tục và hành động với tốc độ máy móc mà không cần giám sát. Điều đó tạo ra những rủi ro hoàn toàn mới mà chúng ta phải chuẩn bị.

Người dân đã sử dụng các đại lý AI của riêng họ tại nơi làm việc – mà không nhất thiết phải thông báo cho cấp trên. Làm thế nào để chúng ta đảm bảo rằng các bot OpenClaw không xóa các tệp quan trọng? Ba trong số bốn doanh nghiệp lớn sẽ áp dụng hệ thống đa đại lý vào cuối năm 2026, theo Gartner. Làm thế nào để chúng ta đảm bảo rằng mỗi một trong những đại lý đó không mở ra cánh cửa cho các hacker tấn công chúng ta theo những cách mới?

Cơ sở hạ tầng bảo mật hiện tại được thiết kế để giải quyết các mối đe dọa đã biết, với tốc độ của con người. Điều đó không tính đến các đại lý độc hại can thiệp vào mã doanh nghiệp mà không có sự biết của chúng ta. Hoặc cho các tác nhân xấu tấn công chúng ta thông qua các cuộc tấn công bằng cách tiêm lệnh: các lệnh ẩn trong mã hoặc lệnh mà khiến AI tiết lộ thông tin nhạy cảm hoặc thực hiện mã độc.

Sự thật là, các công ty đang đói hơn là họ được chuẩn bị cho làn sóng sắp tới này. Chỉ 29% các tổ chức “đồng ý mạnh mẽ” rằng họ có các biện pháp bảo vệ AI an toàn, theo một khảo sát của Microsoft.

Các nhà lãnh đạo công ty cần thực hiện một số việc.

  1. Triển khai các biện pháp bảo mật bản địa cho AI trên toàn công ty.
  2. Xử lý các đại lý AI với các biện pháp bảo mật giống như con người.
  3. Tăng cường khả năng hiển thị của những gì các đại lý này đang làm.

Bằng cách thực hiện các biện pháp kiểm soát này, bảo mật có thể theo kịp tốc độ của các đại lý và cho phép đổi mới thay vì làm chậm nó lại.

Tạo bảo mật bản địa cho AI

Vào tháng 2, một nhà nghiên cứu bảo mật của Meta đã đăng một bài viết bất ngờ trên X: bot OpenClaw của cô đã bắt đầu xóa email và bỏ qua lệnh của cô để dừng lại. Vào thời điểm cô có thể can thiệp vào quá trình này một cách thủ công, thiệt hại đã được thực hiện.

Điều này là một minh họa cho tốc độ đáng kinh ngạc mà AI độc hại có thể hành động, khiến các biện pháp kiểm soát phụ thuộc vào con người trở nên không đủ. Bảo mật cần di chuyển với tốc độ giống như – và dọc theo các đường dẫn giống như – AI đại lý.

Điều này đòi hỏi phải đổi mới cơ sở hạ tầng bảo mật của công ty, không chỉ nâng cấp các công cụ hiện có. Một số lĩnh vực cần được tham gia vào sự thay đổi toàn diện này.

Tránh các tình huống nhanh chóng như trường hợp của nhà nghiên cứu Meta đòi hỏi các công cụ AI phát hiện các bất thường trong thời gian thực và phản ứng tự động. Ví dụ, các đại lý giám sát có thể được triển khai để xem xét các nhiệm vụ có tác động cao được thực hiện bởi các đại lý khác. Các công cụ Thông tin về mối đe dọa của Trí tuệ nhân tạo (ATI) có thể phát hiện và hành động tự động trong giai đoạn đầu của một cuộc tấn công tiềm năng.

Một cơ chế phòng ngừa quan trọng khác là đảm bảo an toàn cho chính mô hình được triển khai trên hệ thống của bạn. Các nền tảng như ProtectAI, TrojAI hoặc Aim Security có thể kiểm tra các nguy cơ trực tiếp như tiêm lệnh, sử dụng các công cụ AI để làm sạch mã trước khi xuất bản.

Đảm bảo nguồn gốc của dữ liệu mà các đại lý AI tiếp xúc cũng rất quan trọng. Các công cụ như Databricks Unity Catalog, Collibra hoặc Alation cho phép các nhóm quản lý việc di chuyển dữ liệu.

Chúng ta cũng có thể ngăn chặn việc can thiệp vào các đại lý AI của mình bằng cách bảo mật các thiết bị vật lý mà chúng ta sử dụng để triển khai chúng. Các nền tảng như CrowdStrike có thể giúp tránh việc lạm dụng các thông tin đăng nhập AI và phát hiện hành vi bất thường.

Việc có các nguyên tắc điều chỉnh hoạt động nội bộ cũng như cách chọn nhà cung cấp là rất quan trọng. Sử dụng các khuôn khổ ngành hiện có để hướng dẫn, như Google SAIF để xây dựng kiến trúc bảo mật, AWS CAF-AI cho quản lý AI hoặc NIST AI RMF cho tuân thủ. Dự án Bảo mật AI Gen của OWASP – một sáng kiến mã nguồn mở để giảm thiểu các rủi ro của AI – cung cấp hướng dẫn bảo mật liên quan cho các doanh nghiệp triển khai AI.

Xử lý AI với các hạn chế giống như con người

Năm ngoái, một nhà đầu tư đã sử dụng một đại lý AI Replit để mã hóa – cho đến khi vào ngày thứ 9, đại lý đã quyết định xóa mã từ một cơ sở dữ liệu sản xuất trực tiếp, ảnh hưởng đến 1.200 công ty.

Bởi vì các đại lý có thể hành động tự chủ, việc cấp cho họ quyền truy cập không được giám sát vào một loạt các tài liệu, dữ liệu và API có thể là thảm họa. Một lý do là các doanh nghiệp thường không gán cho họ một “hộ chiếu” giống như chúng ta làm với người dùng, có nghĩa là họ không thể theo dõi, giám sát và quản lý quyền truy cập của họ vào các không gian khác nhau.

Các doanh nghiệp có thể hành động bằng cách gán các hộ chiếu cho người dùng không phải con người: các nhà cung cấp quản lý quyền truy cập có thể quản lý chặt chẽ các khu vực mà các đại lý có quyền truy cập, trong bao lâu và xác định bất kỳ hành vi rủi ro nào. Điều này giảm quyền truy cập quá mức vào các khu vực mà đại lý không cần phải ở. Nó cũng hạn chế những gì nó có thể làm trong các khu vực mà nó hoạt động.

Gán các hộ chiếu cho các đại lý cũng giảm thiểu mối đe dọa từ các tác nhân bên ngoài.

Khi một đội ngũ các nhà nghiên cứu tiêm các lệnh độc hại vào một ứng dụng AI quản lý các hợp đồng pháp lý, một người dùng có thể truy cập dữ liệu riêng tư thuộc về một người dùng khác. Rõ ràng là không có sự tách biệt an toàn giữa dữ liệu của người dùng và ủy quyền cho dữ liệu đó đã được cấp cho AI ngay cả khi nó không liên quan đến tình huống.

Thiết lập các ranh giới cho các “hộ chiếu” AI có nghĩa là chúng sẽ không có quyền truy cập “luôn bật” rộng rãi. Ví dụ, các đại lý sẽ yêu cầu ủy quyền cho các chức năng nhất định hoặc chỉ có khả năng đọc trong các khu vực nhất định. Bằng cách làm như vậy, ngay cả khi một đại lý AI bị hack hoặc bị thao túng bởi một tác nhân xấu, tác động vẫn bị giới hạn chứ không phải là thảm họa.

Lãnh đạo cũng nên giáo dục các đội của họ về mối đe dọa của các đại lý hoạt động bí mật. Mối đe dọa lớn hơn khi các nhân viên kết nối “đại lý bóng tối” AI với không gian làm việc mà không có sự biết của lãnh đạo và không cung cấp hộ chiếu và biện pháp bảo vệ phù hợp. Hơn nữa, cách tiếp cận Quyền đặc biệt Zero (ZSP) tạo ra một mức cơ bản là 0 quyền truy cập cho bất kỳ đại lý nào. Vì vậy, nếu một nhân viên kết nối một đại lý bóng tối không được ủy quyền, nó sẽ vào một môi trường mà tất cả các cánh cửa đều đóng.

Có mắt trên đại lý của bạn

Mặc dù chúng ta biết câu nói “AI là một hộp đen”, việc triển khai nó trong doanh nghiệp của bạn nên được quan sát và theo dõi một cách rõ ràng.

Để thực thi các chính sách bảo mật nghiêm ngặt, mỗi đại lý phải được quản lý: chúng nên có quyền sở hữu, trách nhiệm và kiểm soát được ghi chép rõ ràng để bạn có thể theo dõi chính xác các đường dẫn của nó. Bạn nên có telemetry liên tục – theo dõi từ xa – theo dõi hành vi của đại lý và cung cấp cho các công cụ bảo mật hiện có để chúng có thể phát hiện các bất thường và thực hiện đánh giá tin cậy thích ứng.

Lãnh đạo cần coi trọng mặt trận bảo mật mới này và đảm bảo rằng các đội khác nhau chịu trách nhiệm về việc sử dụng các đại lý AI của họ. Họ có thể tạo ra các KPI tuân thủ mới, chẳng hạn như “Số lượng tập dữ liệu có nguồn gốc xác minh”, “% số đại lý AI có hộ chiếu được quản lý” hoặc “Đánh giá tin cậy AI”.

Điều này rất quan trọng để phòng ngừa, nhưng nó cũng là về việc có thể kiểm toán – ngay cả các ID không phải con người cũng cần có một đường dẫn kiểm toán để một tổ chức tuân thủ.

Chúng ta thường hiểu cách con người cư xử và những con đường họ đi trong không gian làm việc. Nhưng AI là một loài thú hoàn toàn mới. Có rất nhiều điều chúng ta không biết về cách nó hoạt động. Một số công ty đang chọn giải pháp ngắn hạn là chặn AI khỏi văn phòng – nhưng điều đó chỉ trì hoãn vấn đề hoặc khiến nhân viên sử dụng AI bóng tối. Hãy chuẩn bị kiến trúc bảo mật của bạn một cách chủ động cho các đại lý đang trở nên phổ biến.

Artyom Poghosyan là đồng sáng lập và CEO của Britive, một nền tảng quản lý quyền truy cập đặc biệt trên đám mây (CPAM) tiên phong, và một chuyên gia an ninh thông tin với hơn 20 năm kinh nghiệm trong lĩnh vực an ninh mạng.