Modelos y plataformas de IA
Amazon Bedrock incorpora bÚsqueda web integrada para respuestas de modelos basados en hechos

AWS ha puesto a disposiciÃģn la bÚsqueda web de forma general en Amazon Bedrock el 4 de agosto de 2026, lo que permite a los modelos de fundamentos en su plataforma de inteligencia artificial obtener respuestas basadas en conocimientos web actuales sin necesidad de un proveedor de bÚsqueda de terceros. La herramienta del lado del servidor se habilita a travÃĐs de un solo parÃĄmetro en una llamada a la API compatible con OpenAI existente, y las respuestas se devuelven con citas estructuradas a las fuentes utilizadas, segÚn anunciÃģ AWS.
El lanzamiento extiende una capacidad que AWS lanzÃģ por primera vez en junio de 2026, cuando la bÚsqueda web se puso a disposiciÃģn de Bedrock AgentCore, la capa de infraestructura de agentes de la empresa, en la cumbre de AWS en Nueva York. Esa versiÃģn llegÃģ a los agentes a travÃĐs de la puerta de enlace de AgentCore y el protocolo de contexto de modelo. El nuevo lanzamiento mueve la misma herramienta subyacente directamente a la inferencia de modelo de Bedrock, por lo que cualquier aplicaciÃģn que llame a un modelo compatible puede utilizarla sin necesidad de configurar la infraestructura de agentes primero.
Hasta ahora, basar un modelo de Bedrock en informaciÃģn en vivo significaba seleccionar un proveedor de bÚsqueda, integrar su API, administrar claves y orquestaciÃģn, y someter al proveedor a una revisiÃģn de seguridad. AWS estÃĄ vendiendo la eliminaciÃģn de ese trabajo: no hay proveedores de terceros para incorporar, no hay API externas para orquestar, y no hay revisiones de seguridad de proveedores adicionales, segÚn el anuncio.
QuÃĐ hace la herramienta y cuÃĄnto cuesta
La bÚsqueda web se ejecuta en un Ãndice web que opera Amazon, que abarca miles de millones de documentos y se actualiza continuamente, combinado con un grÃĄfico de conocimiento integrado que ancla entidades y las conexiones entre ellas. Para preguntas de hechos, la herramienta responde desde el grÃĄfico de conocimiento en lugar de dejar que el modelo infiera una respuesta de texto de pÃĄgina extraÃdo. La recuperaciÃģn funciona a travÃĐs de la extracciÃģn de fragmentos semÃĄnticos, que extrae los pasajes relevantes para la consulta en lugar de entregar al modelo pÃĄginas raw, lo que mantiene el gasto de tokens en texto de caldera abajo.
Cuando se habilita la herramienta, Bedrock maneja el ciclo de vida de bÚsqueda completo del lado del servidor: el modelo identifica una brecha de conocimiento, Bedrock formula la consulta, recupera del Ãndice y del grÃĄfico de conocimiento, inyecta fragmentos, URLs de fuente y tÃtulos en la ventana de contexto, y devuelve una respuesta con anotaciones de cita que marcan el span de caracteres exacto que cada fuente admite. Si los primeros resultados son insuficientes, el modelo puede reformular y buscar de nuevo dentro del mismo turno; si los resultados no admiten una respuesta, el modelo dice asà en lugar de llenar la brecha desde los datos de entrenamiento, segÚn la documentaciÃģn de bÚsqueda web.
La pÃĄgina de precios de Amazon Bedrock enumera la bÚsqueda web a $12.00 por 1,000 consultas en las tres regiones de EE. UU. donde se ejecuta. Ese es un cargo de uso en addition a la inferencia de modelo; AWS precio la versiÃģn de AgentCore de la herramienta por separado.
Los tÃĐrminos llevan una obligaciÃģn que vale la pena seÃąalar para los equipos que crean productos orientados al usuario: los clientes deben retener y mostrar las citas de fuente y los enlaces de las salidas del modelo en cualquier cosa que se les muestre a los usuarios finales, y no pueden utilizar la herramienta para extraer contenido a granel o construir un Ãndice competitivo.
DÃģnde se ejecuta y quÃĐ modelos admite
En el lanzamiento, la bÚsqueda web solo funciona con modelos de OpenAI servidos a travÃĐs del punto de inferencia de bedrock-mantle de Bedrock a travÃĐs de la API de respuestas: openai.gpt-5.4, openai.gpt-5.5 y las tres variantes de GPT-5.6 (Luna, Terra y Sol), segÚn la documentaciÃģn. Los modelos de Anthropic, Meta, Mistral y Nova de Amazon en Bedrock no estÃĄn en la lista de admitidos.
La disponibilidad estÃĄ limitada a tres regiones de EE. UU.: us-east-1, us-east-2 y us-west-2, con consultas procesadas en la regiÃģn. La documentaciÃģn describe la herramienta como estrictamente regional: cada regiÃģn opera su propia bÚsqueda y capa de recuperaciÃģn, y las consultas, las recuperaciones, los datos del Ãndice y los resultados no cruzan los lÃmites regionales.
La postura de cumplimiento
AWS estÃĄ promocionando el manejo de datos de la herramienta como su diferenciador empresarial. Por defecto, la recuperaciÃģn se sirve completamente desde el Ãndice web de Amazon Bedrock y la cachÃĐ, una instantÃĄnea de contenido web alojada dentro de AWS, por lo que los datos de la solicitud no salen del lÃmite de AWS. La recuperaciÃģn web en vivo, que recupera contenido directamente de la web en el momento de la solicitud, no se sirve aÚn; el parÃĄmetro de API para ello ya estÃĄ en su lugar, y la documentaciÃģn dice que cualquier cambio futuro requerirÃĄ que los clientes otorguen explÃcitamente un permiso de IAM separado antes de que surta efecto.
La auditorÃa se ejecuta a travÃĐs de CloudTrail de forma predeterminada. Cada llamada de bÚsqueda y recuperaciÃģn se registra con la identidad del llamador, la marca de tiempo y el contexto de la regiÃģn, y las solicitudes denegadas registran la clave de condiciÃģn especÃfica que causÃģ la denegaciÃģn. Por diseÃąo, el registro no registra el texto de la consulta, las URL devueltas o el contenido de la pÃĄgina recuperada, lo que da a los equipos de cumplimiento un registro de quiÃĐn utilizÃģ la herramienta y cuÃĄndo sin exponer quÃĐ buscaron los usuarios.
De AgentCore a la inferencia de modelo
El lanzamiento de AgentCore (anunciado en la cumbre de AWS en Nueva York 2026) y el lanzamiento del 4 de agosto llevan la herramienta de bÚsqueda web a diferentes capas de la pila de Bedrock.
La distinciÃģn entre las dos versiones es el punto de integraciÃģn. La herramienta de AgentCore es un objetivo de conector en una puerta de enlace, dirigida a los equipos que ya estÃĄn construyendo agentes en esa pila y se invoca a travÃĐs de MCP. La versiÃģn de Bedrock se adjunta a una llamada de inferencia ordinaria, lo que pone la fundamentaciÃģn al alcance de un conjunto mucho mayor de aplicaciones existentes, incluidas aquellas que no tienen arquitectura de agente en absoluto. El precio de las dos versiones ahora se encuentra en pÃĄginas separadas a tarifas separadas.
Con la fundamentaciÃģn reducida a una entrada de herramienta en el cuerpo de la solicitud, el trabajo restante para los adoptantes es la concesiÃģn de permisos: habilitar la herramienta requiere acciones de IAM para bÚsqueda y recuperaciÃģn junto con el acceso a la inferencia de Bedrock, y la autenticaciÃģn al punto de inferencia de bedrock-mantle utiliza un token de portador de vida corta acuÃąado a partir de las credenciales de AWS existentes en lugar de una clave de API separada. La recuperaciÃģn web en vivo sigue siendo el elemento programado pero no programado en la hoja de ruta, bloqueado detrÃĄs de un permiso que estÃĄ deshabilitado de forma predeterminada.












