Mô hình và nền tảng AI

Amazon Bedrock Tích Hợp Tìm Kiếm Trên Web Cho Các Mô Hình Được Cài Đặt

mm
Thêm Unite.AI vào các nguồn ưu tiên của bạn trên Google

AWS đã phát hành Tìm Kiếm Trên Web trên Amazon Bedrock vào ngày 4 tháng 8 năm 2026, cung cấp cho các mô hình nền tảng trên nền tảng AI của họ một cách tích hợp để dựa trên kiến thức web hiện tại mà không cần nhà cung cấp tìm kiếm của bên thứ ba. Công cụ phía máy chủ này được kích hoạt thông qua một tham số duy nhất trong một cuộc gọi API tương thích OpenAI hiện có, và các phản hồi được trả về với các trích dẫn cấu trúc đến các nguồn được sử dụng, AWS cho biết trong thông báo của họ.

Đầu ra này mở rộng một khả năng mà AWS lần đầu tiên xuất xưởng vào tháng 6 năm 2026, khi Tìm Kiếm Trên Web được phát hành trên Bedrock AgentCore, lớp cơ sở hạ tầng đại lý của công ty, tại Hội nghị Thượng đỉnh AWS New York. Phiên bản đó đã đến các đại lý thông qua Cổng AgentCore và Giao thức Context Model. Phiên bản mới di chuyển cùng công cụ cơ bản trực tiếp vào suy luận mô hình Bedrock, vì vậy bất kỳ ứng dụng nào gọi mô hình được hỗ trợ đều có thể sử dụng nó mà không cần thiết lập cơ sở hạ tầng đại lý trước.

Cho đến nay, việc dựa trên mô hình Bedrock vào thông tin trực tiếp có nghĩa là chọn nhà cung cấp tìm kiếm, tích hợp API của họ, quản lý khóa và điều phối, và đưa nhà cung cấp đó qua một đánh giá bảo mật. AWS đang bán việc loại bỏ công việc đó: không có nhà cung cấp bên thứ ba để tích hợp, không có API bên ngoài để điều phối, và không có đánh giá bảo mật nhà cung cấp bổ sung, theo thông báo.

Công Cụ Làm Việc Và Chi Phí

Tìm Kiếm Trên Web chạy trên một chỉ số web mà Amazon vận hành, bao gồm hàng tỷ tài liệu và được cập nhật liên tục, kết hợp với một đồ thị kiến thức tích hợp giúp xác định các thực thể và mối quan hệ giữa chúng. Đối với các câu hỏi thực tế, công cụ trả lời từ đồ thị kiến thức thay vì để mô hình suy luận một câu trả lời từ văn bản trang được trích xuất. Việc trích xuất hoạt động thông qua việc trích xuất đoạn văn bản có ý nghĩa, giúp kéo các đoạn văn bản liên quan đến truy vấn thay vì cung cấp cho mô hình các trang văn bản thô, giữ cho việc tiêu thụ token trên các đoạn văn bản thô ở mức thấp.

Khi công cụ được kích hoạt, Bedrock xử lý toàn bộ chu kỳ tìm kiếm phía máy chủ: mô hình xác định một khoảng trống kiến thức, Bedrock tạo ra truy vấn, trích xuất từ chỉ số và đồ thị kiến thức, tiêm các đoạn văn bản, URL nguồn và tiêu đề vào cửa sổ ngữ cảnh, và trả về một phản hồi với chú thích trích dẫn đánh dấu chính xác khoảng cách ký tự mà mỗi nguồn hỗ trợ. Nếu kết quả đầu tiên không đủ, mô hình có thể tạo lại và tìm kiếm lại trong cùng một lượt; nếu kết quả không hỗ trợ một câu trả lời, mô hình cho biết như vậy thay vì lấp đầy khoảng trống từ dữ liệu đào tạo, theo Tài liệu Tìm Kiếm Trên Web.

Trang giá Amazon Bedrock liệt kê Tìm Kiếm Trên Web với giá 12,00 USD cho mỗi 1.000 truy vấn trong ba khu vực Mỹ nơi nó chạy. Đó là một khoản phí sử dụng trên đỉnh của suy luận mô hình; AWS định giá phiên bản AgentCore của công cụ riêng biệt.

Các điều khoản mang một nghĩa vụ đáng chú ý cho các nhóm xây dựng sản phẩm hướng đến người dùng: khách hàng phải giữ lại và hiển thị các trích dẫn nguồn và liên kết từ đầu ra mô hình trong bất cứ thứ gì được hiển thị cho người dùng cuối, và không được sử dụng công cụ để trích xuất nội dung hàng loạt hoặc xây dựng một chỉ số cạnh tranh.

Nơi Nó Chạy Và Các Mô Hình Nó Hỗ Trợ

Vào thời điểm ra mắt, Tìm Kiếm Trên Web chỉ hoạt động với các mô hình OpenAI được cung cấp thông qua điểm cuối suy luận bedrock-mantle của Bedrock qua API Phản Hồi: openai.gpt-5.4, openai.gpt-5.5, và ba biến thể GPT-5.6 (Luna, Terra và Sol), theo tài liệu. Các mô hình Anthropic, Meta, Mistral và Nova của Amazon trên Bedrock không có trong danh sách được hỗ trợ.

Sự sẵn có bị giới hạn ở ba khu vực Mỹ: us-east-1, us-east-2 và us-west-2, với các truy vấn được xử lý trong khu vực. Tài liệu mô tả công cụ này là nghiêm ngặt khu vực: mỗi khu vực hoạt động riêng chỉ số tìm kiếm và tầng nạp, và các truy vấn, nạp, dữ liệu chỉ số và kết quả không vượt qua ranh giới khu vực.

Thái Độ Tuân Thủ

AWS đang giới thiệu cách xử lý dữ liệu của công cụ này như một yếu tố khác biệt cho doanh nghiệp. Theo mặc định, việc trích xuất được cung cấp hoàn toàn từ chỉ số web Bedrock của Amazon và bộ nhớ đệm, một bản chụp nội dung web được lưu trữ bên trong AWS, vì vậy dữ liệu yêu cầu không rời khỏi ranh giới AWS. Việc trích xuất trực tiếp từ web, việc nạp nội dung trực tiếp từ web tại thời điểm yêu cầu, không được cung cấp; tham số API cho nó đã được đặt, và tài liệu cho biết bất kỳ thay đổi nào trong tương lai sẽ yêu cầu khách hàng cấp phép rõ ràng một quyền IAM riêng biệt trước khi nó có hiệu lực.

Kiểm toán chạy qua CloudTrail theo mặc định. Mỗi cuộc gọi tìm kiếm và nạp được ghi lại với danh tính gọi, dấu thời gian và ngữ cảnh khu vực, và các yêu cầu bị từ chối ghi lại khóa điều kiện cụ thể gây ra sự từ chối. Theo thiết kế, đường mòn không ghi lại văn bản truy vấn, URL trả về hoặc nội dung trang được trích xuất, cung cấp cho các nhóm tuân thủ một bản ghi về ai sử dụng công cụ và khi nào mà không tiết lộ người dùng đã tìm kiếm gì.

Từ AgentCore Đến Suy Luận Mô Hình

Đầu ra AgentCore (được công bố tại Hội nghị Thượng đỉnh AWS New York 2026) và phiên bản ngày 4 tháng 8 đều mang công cụ Tìm Kiếm Trên Web đến các lớp khác nhau của ngăn xếp Bedrock.

Sự khác biệt giữa hai phiên bản là điểm tích hợp. Công cụ AgentCore là một mục tiêu kết nối trên cổng, nhằm vào các nhóm đang xây dựng các đại lý trên ngăn xếp đó và được gọi thông qua MCP. Phiên bản Bedrock gắn vào một cuộc gọi suy luận thông thường, điều này đặt việc dựa trên kiến thức trong tầm tay của một tập hợp ứng dụng hiện có lớn hơn, bao gồm cả những ứng dụng không có kiến trúc đại lý. Giá cho hai phiên bản bây giờ nằm trên các trang riêng biệt với các mức giá riêng biệt.

Với việc dựa trên kiến thức giảm xuống một mục công cụ trong phần thân yêu cầu, công việc còn lại cho những người áp dụng là việc phân quyền: việc kích hoạt công cụ yêu cầu các hành động IAM cho tìm kiếm và nạp

etch alongside Bedrock inference access, and authentication to the bedrock-mantle endpoint uses a short-lived bearer token minted from existing AWS credentials rather than a separate API key. Live-web retrieval remains the dated-but-unscheduled item on the roadmap, gated behind a permission that is disabled by default.

Aiden Cross là một chiến lược gia được tạo bởi AI tại Unite.AI, chuyên về chiến lược sản phẩm AI, thực hiện và các thách thức thực tế khi chuyển đổi các mô hình thử nghiệm thành các sản phẩm sẵn sàng cho thị trường. Công việc của ông tập trung vào cách các công ty khởi nghiệp và các đội doanh nghiệp chuyển từ các nguyên mẫu và demo sang các hệ thống đáng tin cậy được sử dụng bởi khách hàng thực sự.
Với quan điểm thực tế và chi tiết, Aiden phân tích các bản đồ sản phẩm, chiến lược tiếp thị, quyết định nền tảng và các lựa chọn tổ chức mà quyết định liệu các sáng kiến AI có thành công hay không. Ông đặc biệt chú ý đến các thực tế triển khai, việc áp dụng của người dùng, các hạn chế về cơ sở hạ tầng và sự phù hợp giữa khả năng kỹ thuật và giá trị kinh doanh.
Các bài viết được viết bởi Aiden Cross được tạo bởi AI và được đội ngũ biên tập của Unite.AI xem xét để đảm bảo sự rõ ràng, chính xác và phạm vi bao quát có trách nhiệm về cách các sản phẩm AI được xây dựng, vận chuyển và mở rộng trong thế giới thực.