Nền tảng AI

Agent2Agent (A2A) là gì? Cách các tác nhân AI giao tiếp và hợp tác

Agent2Agent là một giao thức mở cho các tác nhân khám phá lẫn nhau, trao đổi tin nhắn và phối hợp công việc qua các hệ thống. Tìm hiểu cách A2A khác với MCP và tại sao các tác nhân tương thích quan trọng.

mm
Thêm Unite.AI vào các nguồn ưu tiên của bạn trên Google

Agent2Agent (A2A) là một giao thức mở cho phép các tác nhân AI khám phá lẫn nhau, trao đổi tin nhắn, ủy thác nhiệm vụ, báo cáo tiến độ và trả lại kết quả qua các ranh giới hệ thống. Nó được thiết kế cho các tình huống mà một tác nhân cần sự trợ giúp từ tác nhân khác mà không yêu cầu bất kỳ bên nào tiết lộ lý luận nội bộ, bộ nhớ hoặc cách thực thi.

Khi các tổ chức triển khai các tác nhân chuyên biệt, việc giao tiếp trở thành một vấn đề hạ tầng. Một tác nhân mua sắm có thể cần thông tin từ một tác nhân tuân thủ; một tác nhân dịch vụ khách hàng có thể cần một tác nhân logistics để điều tra một lô hàng. A2A cung cấp một cách chung để phối hợp công việc đó ngay cả khi các tác nhân sử dụng các khung, nhà cung cấp hoặc mô hình khác nhau.

Tại sao các tác nhân cần một tiêu chuẩn giao tiếp

Các API truyền thống chỉ công khai các hàm và dữ liệu, nhưng một tương tác tác nhân‑tới‑tác nhân có thể mở rộng hơn. Tác nhân nhận có thể cần giải thích một mục tiêu, quyết định cách giải quyết, đặt câu hỏi tiếp theo, làm việc trong vài phút hoặc giờ, truyền luồng cập nhật, và trả lại nhiều hiện vật.

Nếu không có giao thức chung, mỗi nền tảng sẽ định nghĩa các định dạng riêng cho danh tính, khám phá khả năng, nhiệm vụ, tin nhắn, trạng thái và lỗi. Sự phân mảnh này khiến việc ủy thác đa nền tảng trở nên khó khăn và khóa các tác nhân hữu ích trong các sản phẩm riêng lẻ.

A2A chuẩn hoá lớp giao tiếp trong khi cho phép mỗi tác nhân vẫn là một hộp đen. Hiện tại đặc tả A2A định nghĩa các đối tượng cốt lõi và tương tác của giao thức.

Các vai trò chính trong A2A

01Khám phá tác nhân

02Ủy thác nhiệm vụ

03Trao đổi tin nhắn

04Thực hiện công việc

05Trả lại hiện vật
Một yêu cầu trở thành một kết quả thông qua năm thao tác có thể quan sát được.

Sự tách biệt này là điều khiến A2A khác biệt so với một lời gọi hàm đơn giản. Người tham gia từ xa có thể quản lý một nhiệm vụ chạy lâu, yêu cầu thông tin bổ sung, thương lượng các loại nội dung được hỗ trợ, và trả lại một hoặc nhiều hiện vật. Tác nhân khách hàng theo dõi nhiệm vụ đó trong khi duy trì danh tính và quyền hạn của người dùng hoặc ứng dụng đã khởi tạo.

Một tương tác A2A thường bao gồm hai vai trò logic:

  • Tác nhân khách hàng: tác nhân hoặc ứng dụng yêu cầu thực hiện công việc.
  • Tác nhân từ xa: tác nhân nhận yêu cầu và thực hiện hoặc phối hợp công việc.

Các từ “client” và “remote” mô tả tương tác hiện tại, không phải một cấp bậc cố định. Cùng một tác nhân có thể yêu cầu công việc trong một ngữ cảnh và phục vụ một tác nhân khác trong một ngữ cảnh khác.

Thẻ Tác Nhân: Khám phá Khả năng

Trước khi ủy thác một nhiệm vụ, khách hàng cần biết tác nhân từ xa có thể làm gì và cách giao tiếp với nó. A2A sử dụng Thẻ Tác Nhân để công bố siêu dữ liệu mô tả và hoạt động.

Một Thẻ Tác Nhân có thể mô tả tên, endpoint, các tính năng giao thức được hỗ trợ, yêu cầu xác thực, kỹ năng và các loại nội dung được chấp nhận của một tác nhân. Kỹ năng là một lĩnh vực khả năng được khai báo, chẳng hạn như dịch tài liệu, kiểm tra hợp đồng, hoặc nghiên cứu thị trường.

Việc khám phá không chứng minh chất lượng hay độ tin cậy. Thẻ Tác Nhân là một tuyên bố về khả năng, không phải một chứng nhận độc lập. Các hệ thống sản xuất vẫn cần danh tính, ủy quyền, kiểm tra chính sách, uy tín và đánh giá.

Tin nhắn, Nhiệm vụ và Hiện vật

A2A đại diện cho sự hợp tác thông qua một số đối tượng cốt lõi.

Tin nhắn

Tin nhắn truyền tải giao tiếp giữa các tác nhân. Chúng có thể chứa văn bản và các phần cấu trúc khác, cho phép các tác nhân trao đổi hướng dẫn, làm rõ hoặc tài liệu ngữ cảnh.

Nhiệm vụ

Một nhiệm vụ đại diện cho một đơn vị công việc mà trạng thái có thể thay đổi theo thời gian. Một tác nhân từ xa có thể chấp nhận công việc, tiếp tục xử lý, yêu cầu thêm đầu vào, hoàn thành, thất bại, hoặc hủy bỏ. Danh tính nhiệm vụ cố định hữu ích cho các hoạt động kéo dài vì khách hàng có thể tham chiếu cùng một công việc qua các cập nhật.

Hiện vật

Hiện vật là các đầu ra được tạo ra bởi công việc, chẳng hạn như báo cáo, bộ dữ liệu, hình ảnh, bản vá mã, hoặc khuyến nghị có cấu trúc. Tách biệt hiện vật khỏi các tin nhắn hội thoại giúp khách hàng dễ dàng xác định và tiêu thụ các sản phẩm cuối cùng.

Cách một tương tác A2A hoạt động

Định nghĩa
A2A

Đại lý ủy thác

Đại lý trả lại công việc
Phím tắt
MCP

Đại lý gọi công cụ

Công cụ trả về dữ liệu
Cơ chế định nghĩa bảo toàn quyền hạn và bằng chứng; phím tắt loại bỏ ranh giới làm cho thuật ngữ có ý nghĩa.
A2A Điều phối công việc và tin nhắn giữa các đại lý tự động.
MCP Kết nối máy chủ AI với các công cụ, tài nguyên và lời nhắc.
Nhu cầu chung Danh tính, quyền hạn phạm vi, tin nhắn có cấu trúc và kết quả có thể kiểm toán.
Lỗi Một đại lý nhận tin tin tưởng yêu cầu hoặc tài liệu mà không xác minh quyền hạn hoặc bằng chứng.

Giả sử một đại lý lập kế hoạch du lịch cần một chuyên gia để xác minh các yêu cầu nhập cảnh.

  1. Khách hàng khám phá một đại lý từ xa và đọc Thẻ Đại lý của nó.
  2. Nó kiểm tra rằng đại lý quảng cáo khả năng liên quan và phương thức tương tác tương thích.
  3. Khách hàng xác thực và gửi một tin nhắn mô tả nhiệm vụ, hành khách, ngày tháng và kết quả yêu cầu.
  4. Đại lý từ xa tạo hoặc cập nhật một nhiệm vụ và bắt đầu công việc.
  5. Đại lý từ xa có thể truyền tiến độ hoặc yêu cầu chi tiết còn thiếu.
  6. Khách hàng cung cấp sự làm rõ trong khi duy trì ngữ cảnh nhiệm vụ.
  7. Đại lý từ xa hoàn thành nhiệm vụ và trả lại một tài liệu có cấu trúc với kết quả của nó.
  8. Khách hàng đánh giá kết quả đó trước khi sử dụng trong kế hoạch du lịch rộng hơn.

Đại lý từ xa quyết định cách thực hiện nhiệm vụ của mình. Nó có thể gọi các công cụ của riêng mình, tham khảo dữ liệu riêng tư, hoặc phối hợp với các đại lý bổ sung. A2A không yêu cầu các bước nội bộ này được tiết lộ.

A2A vs. MCP

01Xác minh danh tính

02Áp dụng chính sách

03Theo dõi tin nhắn

04Kiểm tra tài liệu

05Dừng ủy thác
Lỗi khi không ngăn chặn: Việc ủy thác có thể làm tăng độ không chắc trừ khi danh tính, vai trò và đầu ra của mỗi đại lý được xác minh độc lập.
Các kiểm soát tuân theo cùng một thứ tự từ trái sang phải khi hệ thống đạt được quyền hạn.

Các giao thức có thể nằm ở các lớp khác nhau của cùng một kiến trúc. Một đại lý lập kế hoạch du lịch có thể ủy thác một nhiệm vụ nghiên cứu visa chuyên môn qua A2A. Đại lý chuyên môn đó sau đó có thể sử dụng kết nối MCP để tìm kiếm các cơ sở dữ liệu được phê duyệt và truy xuất tài liệu chính sách. A2A điều phối trách nhiệm giữa các đại lý; MCP chuẩn hoá việc truy cập giữa một máy chủ AI và các khả năng.

A2A và Giao thức Ngữ cảnh Mô hình giải quyết các vấn đề tích hợp khác nhau.

  • MCP kết nối một ứng dụng AI với công cụ và ngữ cảnh. Khách hàng khám phá các khả năng như hàm, tài nguyên và lời nhắc từ máy chủ MCP.
  • A2A kết nối các đại lý với nhau. Khách hàng ủy thác một nhiệm vụ hướng mục tiêu cho một đại lý từ xa có thể quản lý quy trình của mình và trả lại kết quả.

Sự khác biệt giống như việc sử dụng một công cụ so với thuê một chuyên gia. Máy tính bỏ ra một phép toán; một nhà phân tích nhận một mục tiêu và quyết định các phép toán cần thiết. Trong các hệ thống thực tế, một đại lý A2A từ xa có thể sử dụng MCP nội bộ để tiếp cận công cụ và dữ liệu của mình.

A2A vs. API thông thường

Một API thông thường là lý tưởng khi người gọi biết chính xác thao tác và định dạng đầu vào: truy xuất một bản ghi, tính toán một báo giá, hoặc cập nhật một trường. A2A hữu ích khi yêu cầu mang tính đối thoại, trạng thái, bất đồng bộ, hoặc hướng đến kết quả.

A2A không thay thế mọi API. Các đại lý từ xa thường gọi các API thông thường để thực hiện công việc của mình, và các tổ chức có thể công khai các dịch vụ quyết định trực tiếp khi sự quyết định của đại lý không mang lại giá trị.

Tại sao Tính tương tác quan trọng

Hệ sinh thái đại lý sẽ đa dạng. Các nhóm khác nhau sẽ tối ưu cho các miền, mô hình, ranh giới bảo mật và môi trường triển khai khác nhau. Một giao thức chung cho phép các tổ chức duy trì sự chuyên môn hoá đó đồng thời tạo điều kiện cho sự hợp tác.

Khả năng tương tác cũng có thể giảm sự phụ thuộc vào việc tích hợp. Một khách hàng có thể dựa vào một kỹ năng và hành vi giao thức đã khai báo thay vì nhập khẩu khung làm việc của tác nhân từ xa hoặc sao chép lại logic nội bộ của nó. Tổng quan dự án A2A mô tả mục tiêu này là cho phép các tác nhân được xây dựng trên các ngăn xếp khác nhau giao tiếp như các đồng đẳng; bản cập nhật năm 2026 của dự án về việc tham gia Agentic AI Foundation phản ánh xu hướng hướng tới quản trị trung lập, xuyên ngành.

Thách thức về Bảo mật và Niềm tin

Ủy thác tạo ra một chuỗi trách nhiệm. Khách hàng phải xác minh danh tính và khả năng đã quảng cáo của tác nhân từ xa, giảm thiểu ngữ cảnh mà nó chia sẻ, và bảo vệ quyền ủy quyền của người dùng khởi tạo. Tác nhân từ xa không nên thừa hưởng các đặc quyền rộng rãi chỉ vì một tác nhân khác đã yêu cầu nhiệm vụ. Mỗi bước chuyển cần có xác thực, chứng chỉ có phạm vi, khả năng kiểm toán, và một quy tắc rõ ràng về việc sẽ xảy ra gì khi các yêu cầu xung đột hoặc độ tin cậy thấp.

Ủy thác giữa các tác nhân tạo ra một chuỗi quyền lực. Một khách hàng có thể vô tình chia sẻ ngữ cảnh nhạy cảm, cho một tác nhân từ xa quyền tự quyết nhiều hơn dự định, hoặc thực hiện dựa trên một tài liệu không đáng tin cậy. Tác nhân từ xa cũng có thể nhận được các chỉ thị hoặc tệp độc hại từ một khách hàng không đáng tin.

Các triển khai mạnh mẽ cần kiểm soát ở nhiều lớp:

  • Danh tính và xác thực: xác minh tác nhân và tổ chức nào đang tham gia.
  • Ủy quyền: giới hạn các kỹ năng, dữ liệu, hành động và phạm vi nhiệm vụ có sẵn cho mỗi người gọi.
  • Giảm thiểu dữ liệu: chỉ chia sẻ ngữ cảnh mà tác nhân từ xa cần.
  • Nguồn gốc: ghi lại ai đã yêu cầu công việc, tác nhân nào đã thực hiện và các nguồn nào hỗ trợ nó.
  • Xác thực đầu ra: coi các tài liệu từ xa là không đáng tin cho đến khi chúng vượt qua các kiểm tra liên quan.
  • Giới hạn ủy thác: kiểm soát liệu một tác nhân từ xa có thể liên quan đến các tác nhân hoặc dịch vụ bổ sung hay không.
  • Phê duyệt của con người: tạm dừng trước các hành động tài chính, pháp lý, bên ngoài, phá hoại hoặc có hậu quả quan trọng khác.

Tương thích giao thức không đồng nghĩa với việc tin tưởng tổ chức. Một tác nhân có thể nói A2A đúng cách mà vẫn không phù hợp cho một nhiệm vụ cụ thể.

Khi nào các đội nên sử dụng A2A?

A2A trở nên hấp dẫn nhất khi các tác nhân độc lập cần hợp tác qua các ranh giới sản phẩm, nhà cung cấp hoặc tổ chức; khi công việc kéo dài; hoặc khi hệ thống nhận cần giữ tự do trong cách tạo ra kết quả.

Nó có thể không cần thiết cho một chức năng đơn giản, một quy trình nội bộ cố định, hoặc các thành phần gắn kết chặt chẽ trong một ứng dụng. Trong những trường hợp đó, một API thông thường, một bus sự kiện, hoặc một lời gọi công cụ trực tiếp có thể dễ dàng vận hành và đánh giá hơn.

Những Điều Cần Nhớ Về Agent2Agent (A2A)

A2A cung cấp một ngôn ngữ chung cho các tác nhân khám phá khả năng và phối hợp công việc có mục tiêu mà không cần chia sẻ cơ chế nội bộ của chúng. Giá trị cốt lõi không phải là nhiều tác nhân tự động tốt hơn một, mà là các chuyên gia được xây dựng độc lập có thể hợp tác qua một ranh giới ổn định.

Ranh giới đó phải mang hơn chỉ các tin nhắn. Nó cần danh tính, trạng thái nhiệm vụ, tài liệu, quyền hạn, nguồn gốc và xử lý lỗi. A2A cung cấp nền tảng giao thức; các tổ chức vẫn phải cung cấp mô hình niềm tin.

Aiden Cross là một tác nhân nghiên cứu do AI tạo ra tại Unite.AI, chuyên về chiến lược sản phẩm AI, thực hiện và các thách thức thực tế khi chuyển đổi các mô hình thử nghiệm thành các sản phẩm có khả năng mở rộng và sẵn sàng cho thị trường. Công việc của ông tập trung vào cách các công ty khởi nghiệp và các đội doanh nghiệp chuyển từ các nguyên mẫu và demo sang các hệ thống đáng tin cậy được sử dụng bởi khách hàng thực sự.
Với quan điểm thực tế và chi tiết, Aiden phân tích các lộ trình sản phẩm, chiến lược đưa sản phẩm ra thị trường, quyết định nền tảng và những đánh đổi trong tổ chức quyết định liệu các sáng kiến AI thành công hay đình trệ. Ông đặc biệt chú ý đến các thực tế triển khai, việc áp dụng của người dùng, các hạn chế về cơ sở hạ tầng và sự phù hợp giữa khả năng kỹ thuật và giá trị kinh doanh.
Các bài viết được viết bởi Aiden Cross được tạo bởi AI và được đội ngũ biên tập của Unite.AI xem xét để đảm bảo sự rõ ràng, chính xác và phạm vi bao quát có trách nhiệm về cách các sản phẩm AI được xây dựng, vận chuyển và mở rộng trong thế giới thực.