AI 모델 및 플랫폼
아마존 베드락, 내장 웹 검색 기능을 통해 기초 모델 응답에 대한 현실 세계 지식 제공

아마존 웹 서비스(AWS)는 2026년 8월 4일 아마존 베드락(Amazon Bedrock)에서 웹 검색(Web Search)을 일반적으로 제공하기 시작했으며, 이는 베드락의 기초 모델에 현실 세계 지식에 대한 내장된 방법을 제공하여 第三자 검색 제공 업체가 필요 없게 만들었습니다. 서버 측 도구는 기존의 오픈 AI와 호환되는 API 호출에서 단일 매개 변수를 통해 활성화되며, 응답은 사용된 소스의 구조화된 인용문을 함께 반환합니다. AWS는 발표에서 밝혔습니다.
이 출시로 2026년 6월에 베드락 에이전트 코어(Bedrock AgentCore)에서 일반적으로 제공된 웹 검색 기능이 확장되었습니다. 이 버전은 에이전트 코어 게이트웨이와 모델 컨텍스트 프로토콜을 통해 에이전트에 도달했습니다. 새로운 릴리스는 동일한 기본 도구를 베드락 모델 추론으로 직접 이동하여 지원되는 모델을 호출하는 모든 응용 프로그램에서 에이전트 인프라를 설정하지 않고도 사용할 수 있게 합니다.
지금까지 베드락 모델을 라이브 정보에 연결하려면 검색 공급자를 선택하고, 그들의 API를 통합하고, 키와 오케스트레이션을 관리하며, 공급자를 보안 검토를 거쳐야 했습니다. 아마존은 이러한 작업을 제거하는 것을 판매하고 있습니다. 즉, 第三자 공급자를 온보딩할 필요가 없으며, 외부 API를 오케스트레이션할 필요가 없으며, 추가적인 공급자 보안 검토가 필요하지 않습니다.
도구가 하는 일과 비용
웹 검색은 아마존이 운영하는 웹 인덱스와 연결된 내장 지식 그래프를 사용합니다. 사실적인 질문의 경우 도구는 지식 그래프에서 답변을 제공하며, 모델이 추출된 페이지 텍스트에서 답변을 추론하도록 남겨두지 않습니다. 검색은 의미적 스니펫 추출을 통해 작동하며, 모델에生的 원시 페이지를 제공하는 대신 쿼리와 관련된 구절을 가져옵니다. 이는 보일러プレ이트에 대한 토큰 지출을 줄입니다.
도구가 활성화되면 베드락은 서버 측에서 전체 검색 수명 주기를 처리합니다. 모델은 지식 격차를 식별하고, 베드락이 쿼리를 공식화하고, 인덱스와 지식 그래프에서 검색하고, 스니펫, 소스 URL 및 제목을 컨텍스트 창에 주입하고, 소스 각 구간을 표시하는 인용 注釈과 함께 응답을 반환합니다. 첫 번째 결과가 불충분한 경우 모델은 동일한 턴 내에서 다시 검색할 수 있으며, 결과가 답변을 지원하지 않는 경우 모델은 훈련 데이터에서 답변을 채우는 대신 그렇게 말합니다. 웹 검색 문서에 따르면
아마존 베드락 가격 페이지는 3개의 미국 지역에서 실행되는 웹 검색을 1,000개의 쿼리당 $12.00으로 나열합니다. 이는 모델 추론에 대한 사용량 요금이며, AWS는 에이전트 코어 버전의 도구를 별도로 가격을 책정합니다.
조건에는 사용자와의 상호작용을 하는 제품을 구축하는 팀에 대한 하나의 의무가 포함됩니다. 고객은 모델 출력에서 소스 인용문과 링크를 유지하고 표시해야 하며, 도구를 사용하여 콘텐츠를 대량으로 추출하거나 경쟁 인덱스를 구축할 수 없습니다.
どこで 실행되고 어떤 모델을 지원하는지
출시 당시 웹 검색은 베드락의 베드락-맨틀 추론 엔드포인트를 통해 오픈 AI 모델과 함께만 작동합니다. 이는 Responses API를 통해 제공되며, openai.gpt-5.4, openai.gpt-5.5 및 세 가지 GPT-5.6 변형(루나, 테라, 솔)을 지원합니다. 문서에 따르면
이 도구는 미국의 3개 지역에서만 사용할 수 있습니다. us-east-1, us-east-2 및 us-west-2에서 처리되며, 쿼리는 각 지역에서 처리됩니다. 문서는 이 도구를 엄격하게 지역적으로 설명하며, 각 지역은 자체 검색 및 가져오기 계층을 운영하며, 쿼리, 가져오기, 인덱스 데이터 및 결과가 지역 경계를 넘지 않습니다.
준수姿勢
AWS는 이 도구의 데이터 처리를 기업의 차별점으로 판매하고 있습니다. 기본적으로 검색은 아마존 베드락 웹 인덱스와 캐시에서 제공되며, 이는 AWS 내에 호스팅되는 웹 콘텐츠의 스냅샷입니다. 따라서 요청 데이터는 AWS 경계를 벗어나지 않습니다. 라이브 웹 검색은 아직 제공되지 않습니다. 즉, 요청 시에 웹에서 콘텐츠를 직접 가져오는 기능은 아직 제공되지 않습니다. API 매개 변수는 이미 준비되어 있으며, 문서에 따르면 향후 변경이 발생할 경우 고객이 명시적으로 별도의 IAM 권한을 부여하기 전까지는 효과가 없을 것입니다.
감사는 기본적으로 CloudTrail을 통해 작동합니다. 모든 검색 및 가져오기 호출은 호출 ID, 타임스탬프 및 지역 컨텍스트와 함께 기록되며, 거부된 요청은 거부를 일으킨 특정 조건 키를 기록합니다. 설계에 따라, 트레일은 쿼리 텍스트, 반환된 URL 또는 가져온 페이지 콘텐츠를 기록하지 않습니다. 이는 준수 팀에게 도구를 사용한 사용자와 사용 시각에 대한 기록을 제공하지만, 사용자가 무엇을 검색했는지에 대한 정보는 노출하지 않습니다.
에이전트 코어에서 모델 추론까지
에이전트 코어 출시(2026년 AWS 뉴욕 정상에서 발표됨)와 8월 4일 릴리스는 모두 베드락 스택의 다른 계층에서 웹 검색 도구를 제공합니다.
두 버전의 차이점은 통합 지점에 있습니다. 에이전트 코어 도구는 게이트웨이의 커넥터 대상이며, 에이전트 코어 스택에서 이미 에이전트를 구축 중인 팀을 대상으로 하며, MCP를 통해 호출됩니다. 베드락 버전은 普通한 추론 호출에 연결되며, 이는 기초를 더 큰 응용 프로그램 세트에 접근할 수 있게 합니다. 두 버전의 가격은 이제 별도의 페이지와 별도의 요금으로 책정됩니다.
도구를 활성화하려면 IAM 동작이 필요합니다. 검색 및 가져오기와 함께 베드락 추론 액세스 및 인증을 bedrock-mantle 엔드포인트에 대한 短期적 베어러 토큰으로부터 기존의 AWS 자격 증명에서 생성된 토큰을 사용하여 수행합니다. 라이브 웹 검색은 아직 로드맵에 계획되지 않은 항목으로 남아 있으며, 기본적으로 비활성화된 권한 뒤에 게이트되어 있습니다.












