KI-Modelle und Plattformen
Amazon Bedrock erhält integrierte Web-Suche für fundierte Modelantworten

AWS hat am 4. August 2026 die Web-Suche allgemein auf Amazon Bedrock verfügbar gemacht und damit Foundation-Modellen auf seiner AI-Plattform eine integrierte Möglichkeit gegeben, Antworten auf aktuelles Wissen aus dem Web zu begründen, ohne dass ein externer Suchanbieter erforderlich ist. Das serverseitige Tool ist durch einen einzigen Parameter in einem bestehenden OpenAI-kompatiblen API-Aufruf aktiviert, und die Antworten werden mit strukturierten Zitaten zu den verwendeten Quellen zurückgegeben, so AWS in seiner Ankündigung.
Der Launch erweitert eine Fähigkeit, die AWS erstmals im Juni 2026 ausgeliefert hatte, als die Web-Suche allgemein auf Bedrock AgentCore, der Agent-Infrastruktur-Ebene des Unternehmens, auf der AWS New York Summit verfügbar gemacht wurde. Diese Version war über das AgentCore-Gateway und das Model-Context-Protokoll für Agenten verfügbar. Die neue Version bringt das gleiche zugrunde liegende Tool direkt in die Bedrock-Modellinferenz, so dass jede Anwendung, die ein unterstütztes Modell aufruft, es ohne vorherige Einrichtung der Agent-Infrastruktur verwenden kann.
Bislang bedeutete die Grundlegung eines Bedrock-Modells in Live-Informationen, einen Suchanbieter auszuwählen, dessen API zu integrieren, Schlüssel und Orchestrierung zu verwalten und den Anbieter einer Sicherheitsprüfung zu unterziehen. AWS verkauft die Entfernung dieser Arbeit: keine externen Anbieter, die integriert werden müssen, keine externen APIs, die orchestriert werden müssen, und keine zusätzlichen Anbieter-Sicherheitsprüfungen, so die Ankündigung.
Was das Tool tut und was es kostet
Die Web-Suche läuft auf einem Web-Index, den Amazon (AMZN ) betreibt, der Milliarden von Dokumenten umfasst und kontinuierlich aktualisiert wird, kombiniert mit einem integrierten Wissensgraphen, der Entitäten und die Verbindungen zwischen ihnen verankert. Bei faktischen Fragen antwortet das Tool aus dem Wissensgraphen, anstatt das Modell zu zwingen, eine Antwort aus extrahiertem Seitentext abzuleiten. Die Abrufung erfolgt durch semantische Snippet-Extraktion, die die Passagen relevant zum Abfrageziel abruft, anstatt dem Modell rohe Seiten zu übergeben, was den Token-Aufwand für Boilerplate reduziert.
Wenn das Tool aktiviert ist, übernimmt Bedrock den gesamten Suchlebenszyklus serverseitig: das Modell identifiziert eine Wissenslücke, Bedrock formuliert die Abfrage, ruft aus dem Index und Wissensgraphen ab, injiziert Snippets, Quell-URLs und Titel in das Kontextfenster und gibt eine Antwort mit Zitationsannotationen zurück, die den genauen Zeichenspann jeder Quelle markieren. Wenn die ersten Ergebnisse unzureichend sind, kann das Modell die Abfrage neu formulieren und innerhalb desselben Turns erneut suchen; wenn die Ergebnisse keine Antwort unterstützen, sagt das Modell dies, anstatt die Lücke mit Trainingsdaten zu füllen, so die Web-Suchdokumentation.
Die Amazon Bedrock-Preisseite listet die Web-Suche mit 12,00 $ pro 1.000 Abfragen in den drei US-Regionen, in denen sie verfügbar ist. Dies ist eine Nutzungskosten aufgrund von Modellinferenz; AWS preist die AgentCore-Version des Tools separat.
Die Bedingungen enthalten eine Verpflichtung, die für Teams, die benutzerorientierte Produkte erstellen, von Bedeutung ist: Kunden müssen die Quellenzitate und -links aus Modellausgaben in allem, was an Endbenutzer weitergegeben wird, beibehalten und anzeigen und dürfen das Tool nicht verwenden, um Inhalte im Großen zu extrahieren oder einen konkurrierenden Index zu erstellen.
Wo es läuft und welche Modelle es unterstützt
Bei Launch funktioniert die Web-Suche nur mit OpenAI-Modellen, die über den Bedrock-Endpunkt bedrock-mantle der Inferenz über die Responses-API bereitgestellt werden: openai.gpt-5.4, openai.gpt-5.5 und die drei GPT-5.6-Varianten (Luna, Terra und Sol), so die Dokumentation. Anthropic-, Meta-, Mistral- und Amazon-eigene Nova-Modelle auf Bedrock sind nicht in der Liste der unterstützten Modelle enthalten.
Die Verfügbarkeit ist auf drei US-Regionen beschränkt: us-east-1, us-east-2 und us-west-2, wobei Abfragen in der Region verarbeitet werden. Die Dokumentation beschreibt das Tool als streng regional: jede Region betreibt ihre eigene Such- und Abruf-Ebene, und Abfragen, Abrufe, Indexdaten und Ergebnisse werden nicht über regionale Grenzen hinweg übertragen.
Die Compliance-Postur
AWS präsentiert die Datenverarbeitung des Tools als seinen Unternehmensunterschied. Standardmäßig wird die Abrufung vollständig aus dem Amazon Bedrock-Web-Index und -Cache bedient, einer Momentaufnahme von Web-Inhalten, die innerhalb von AWS gehostet wird, so dass Anfrage-Daten die AWS-Grenze nicht verlassen. Live-Web-Abruf, der direkte Abruf von Inhalten aus dem Web zum Zeitpunkt der Anfrage, wird derzeit nicht bereitgestellt; der API-Parameter dafür ist bereits vorhanden, und die Dokumentation sagt, dass jede zukünftige Änderung erfordert, dass Kunden eine separate IAM-Berechtigung explizit erteilen, bevor sie in Kraft tritt.
Die Überwachung läuft über CloudTrail standardmäßig. Jeder Such- und Abrufaufruf wird mit der aufrufenden Identität, dem Zeitstempel und dem Kontext der Region aufgezeichnet, und abgelehnte Anfragen protokollieren den spezifischen Schlüssel, der die Ablehnung verursachte. Durch Design wird der Pfad nicht den Abfrage-Text, die zurückgegebenen URLs oder die abgerufenen Seiteninhalte aufzeichnen, was Compliance-Teams eine Aufzeichnung darüber gibt, wer das Tool verwendet hat und wann, ohne zu offenbaren, was die Benutzer gesucht haben.
Von AgentCore zu Modellinferenz
Der Launch von AgentCore (angekündigt auf der AWS New York Summit 2026) und der Launch vom 4. August bringen das Web-Such-Tool zu verschiedenen Ebenen des Bedrock-Stacks.
Der Unterschied zwischen den beiden Versionen ist der Integrationspunkt. Das AgentCore-Tool ist ein Ziel auf einem Gateway, das auf Teams abzielt, die bereits auf diesem Stack Agents aufbauen und über das MCP aufgerufen werden. Die Bedrock-Version hängt an einen normalen Inferenzaufruf, was die Grundlegung innerhalb der Reichweite einer viel größeren Anzahl bestehender Anwendungen bringt, einschließlich solcher, die überhaupt keine Agent-Architektur haben. Die Preise für die beiden Versionen befinden sich nun auf separaten Seiten zu separaten Tarifen.
Da die Grundlegung auf einen Tools-Eintrag im Anforderungstext reduziert ist, bleibt für die Adoptierer die Berechtigung: die Aktivierung des Tools erfordert IAM-Aktionen für Suche und Abruf neben Bedrock-Inferenz-Zugriff, und die Authentifizierung am bedrock-mantle-Endpunkt verwendet ein kurzlebiges Bearer-Token, das aus bestehenden AWS-Anmeldeinformationen geprägt wird, anstatt einen separaten API-Schlüssel. Live-Web-Abruf bleibt das datierte, aber nicht geplante Element auf der Roadmap, das durch eine Berechtigung gesperrt ist, die standardmäßig deaktiviert ist.












