Modèles et plateformes d’IA
Amazon Bedrock intègre une fonction de recherche Web pour les réponses de modèles fondés

AWS a rendu la recherche Web généralement disponible sur Amazon Bedrock le 4 août 2026, offrant ainsi aux modèles de base sur sa plateforme d’intelligence artificielle un moyen intégré de fonder les réponses sur les connaissances Web actuelles sans fournisseur de recherche tiers. L’outil serveur est activé via un seul paramètre dans un appel d’API OpenAI compatible existant, et les réponses sont renvoyées avec des citations structurées aux sources utilisées, a déclaré AWS dans son annonce.
Le lancement étend une fonctionnalité que AWS a initialement lancée en juin 2026, lorsque la recherche Web est devenue généralement disponible sur Bedrock AgentCore, la couche d’infrastructure d’agent de l’entreprise, lors de la conférence AWS New York Summit. Cette version a atteint les agents via la passerelle AgentCore et le protocole de contexte de modèle. La nouvelle version déplace l’outil sous-jacent directement dans l’inférence de modèle Bedrock, de sorte que toute application appelant un modèle pris en charge peut l’utiliser sans avoir à mettre en place une infrastructure d’agent au préalable.
Jusqu’à présent, fonder un modèle Bedrock sur des informations en temps réel signifiait sélectionner un fournisseur de recherche, intégrer son API, gérer les clés et l’orchestration, et soumettre le fournisseur à un examen de sécurité. AWS vend l’élimination de ce travail : aucun fournisseur tiers à intégrer, aucune API externe à orchestrer et aucun examen de sécurité de fournisseur supplémentaire, selon l’annonce.
Ce que fait l’outil et combien cela coûte
La recherche Web s’exécute sur un index Web exploité par Amazon, qui englobe des milliards de documents et est actualisé en continu, combiné avec un graphique de connaissances intégré qui ancre les entités et les connexions entre elles. Pour les questions factuelles, l’outil répond à partir du graphique de connaissances plutôt que de laisser le modèle déduire une réponse à partir du texte de page extrait. La récupération fonctionne via l’extraction de snippets sémantiques, qui extrait les passages pertinents pour la requête au lieu de fournir au modèle des pages brutes, en gardant les dépenses de jetons sur les textes de remplissage bas.
Lorsque l’outil est activé, Bedrock gère le cycle de vie de recherche complet côté serveur : le modèle identifie une lacune de connaissance, Bedrock formule la requête, récupère à partir de l’index et du graphique de connaissances, injecte des extraits, des URL de source et des titres dans la fenêtre de contexte, et renvoie une réponse avec des annotations de citation marquant la plage de caractères exacte que chaque source prend en charge. Si les premiers résultats sont insuffisants, le modèle peut reformuler et rechercher à nouveau dans le même tour ; si les résultats ne soutiennent pas une réponse, le modèle le déclare plutôt que de combler la lacune à partir des données de formation, selon la documentation de la recherche Web.
La page de tarification d’Amazon Bedrock liste la recherche Web à 12,00 $ par 1 000 requêtes dans les trois régions américaines où elle s’exécute. Il s’agit d’un frais d’utilisation en plus de l’inférence de modèle ; AWS facture la version AgentCore de l’outil séparément.
Les conditions comportent une obligation qui vaut la peine d’être notée pour les équipes qui créent des produits orientés utilisateurs : les clients doivent conserver et afficher les citations de source et les liens à partir des sorties de modèle dans tout ce qui est présenté aux utilisateurs finals, et ne peuvent pas utiliser l’outil pour extraire en bloc du contenu ou créer un index concurrent.
Où cela s’exécute et quels modèles il prend en charge
À son lancement, la recherche Web ne fonctionne qu’avec les modèles OpenAI servis via le point de terminaison d’inférence bedrock-mantle de Bedrock via l’API de réponses : openai.gpt-5.4, openai.gpt-5.5 et les trois variantes GPT-5.6 (Luna, Terra et Sol), selon la documentation. Les modèles Anthropic, Meta, Mistral et Nova d’Amazon sur Bedrock ne figurent pas sur la liste des modèles pris en charge.
La disponibilité est limitée à trois régions américaines : us-east-1, us-east-2 et us-west-2, avec des requêtes traitées dans la région. La documentation décrit l’outil comme étant strictement régional : chaque région exploite son propre niveau de recherche et de récupération, et les requêtes, les récupérations, les données d’index et les résultats ne franchissent pas les limites régionales.
La posture de conformité
AWS présente la gestion des données de l’outil comme son différentiateur d’entreprise. Par défaut, la récupération est servie entièrement à partir de l’index Web et du cache Amazon Bedrock, un instantané de contenu Web hébergé à l’intérieur d’AWS, de sorte que les données de requête ne quittent pas les limites d’AWS. La récupération Web en direct, qui consiste à récupérer du contenu directement sur le Web au moment de la requête, n’est pas encore servie ; le paramètre d’API est déjà en place, et la documentation indique que tout changement futur nécessitera que les clients accordent explicitement une autorisation IAM distincte avant qu’il prenne effet.
L’audit s’exécute via CloudTrail par défaut. Chaque appel de recherche et de récupération est enregistré avec l’identité de l’appelant, l’horodatage et le contexte de région, et les requêtes refusées enregistrent la clé de condition spécifique qui a causé le refus. Par conception, la traçabilité n’enregistre pas le texte de requête, les URL renvoyées ou le contenu de page récupéré, offrant ainsi aux équipes de conformité un enregistrement de qui a utilisé l’outil et quand, sans exposer ce que les utilisateurs ont recherché.
De AgentCore à l’inférence de modèle
Le lancement d’AgentCore (annoncé à la conférence AWS New York Summit 2026) et la version du 4 août apportent tous deux l’outil de recherche Web à différentes couches de la pile Bedrock.
La distinction entre les deux versions réside dans le point d’intégration. L’outil AgentCore est une cible de connecteur sur une passerelle, destinée aux équipes qui construisent déjà des agents sur cette pile et invoquée via le protocole de contexte de modèle. La version Bedrock s’attache à un appel d’inférence ordinaire, ce qui met le fondement à portée d’un ensemble beaucoup plus large d’applications existantes, y compris celles qui n’ont pas d’architecture d’agent du tout. La tarification des deux versions se trouve maintenant sur des pages distinctes à des tarifs distincts.
Avec le fondement réduit à une entrée d’outil dans le corps de la requête, le travail restant pour les adoptants est la permission : l’activation de l’outil nécessite des actions IAM pour la recherche et la récupération aux côtés de l’accès à l’inférence Bedrock, et l’authentification au point de terminaison bedrock-mantle utilise un jeton porteur à durée de vie courte créé à partir des informations d’identification AWS existantes plutôt qu’une clé API distincte. La récupération Web en direct reste l’élément daté mais non planifié de la feuille de route, verrouillé derrière une autorisation désactivée par défaut.












