Modely a platformy AI

Amazon Bedrock Získal Vestavěnou Webovou Vyhledávání Pro Odpovědi Založené Na Modelech

mm
Přidejte Unite.AI mezi své preferované zdroje na Google

AWS uvedl Webové Vyhledávání generally dostupné na Amazon Bedrock 4. srpna 2026, čímž poskytlo základním modelům na jeho platformě AI vestavěný způsob, jak odpovědět na otázky založené na aktuálních webových znalostech bez třetí strany poskytující vyhledávání. Server-side nástroj je povolen prostřednictvím jediného parametru v existujícím OpenAI-kompatibilním API volání, a odpovědi se vrátí se strukturovanými citacemi zdrojů, řekl AWS ve svém oznámení.

Spuštění prodlužuje schopnost, kterou AWS poprvé dodal v červnu 2026, kdy Webové Vyhledávání bylo generally dostupné na Bedrock AgentCore, vrstvě infrastruktury agentů společnosti, na summitu AWS New York. Tato verze dosáhla agentů prostřednictvím brány AgentCore a Model Context Protocol. Nová verze přesouvá stejný základní nástroj přímo do inferenci modelu Bedrock, takže jakékoli aplikace, které volají podporovaný model, mohou jej použít bez nutnosti nastavit infrastrukturu agenta.

Dokud teď, zakotvení modelu Bedrock v živých informacích znamenalo výběr dodavatele vyhledávání, integraci jeho API, správu klíčů a orchestraci a provedení bezpečnostní revize dodavatele. AWS prodává odstranění této práce: žádné třetí strany, které je třeba integrovat, žádné externí API, které je třeba orchestrovat, a žádné další bezpečnostní revize dodavatele, podle oznámení.

Co dělá nástroj a kolik stojí

Webové Vyhledávání běží na webovém indexu, který provozuje Amazon (AMZN ), který zahrnuje miliardy dokumentů a je neustále aktualizován, v kombinaci s vestavěným grafem znalostí, který ukotvuje entity a jejich vzájemné souvislosti. Pro faktické otázky nástroj odpovídá z grafu znalostí spíše než nechat model odvodit odpověď z extrahovaného textu stránky. Načtení funguje prostřednictvím semantic snippet extraction, který extrahuje pasáže relevantní k dotazu místo toho, aby modelu předal surový text stránky, a snižuje tak náklady na tokeny na boilerplate.

Když je nástroj povolen, Bedrock zpracovává celý životní cyklus vyhledávání na serveru: model identifikuje mezeru ve znalostech, Bedrock formuluje dotaz, načte z indexu a grafu znalostí, vkládá snímky, zdrojové URL a názvy do kontextového okna a vrací odpověď s citacemi, které označují přesný rozsah znaků, který každý zdroj podporuje. Pokud první výsledky jsou nedostatečné, model může reformulovat a vyhledat znovu ve stejném kroku; pokud výsledky nepodporují odpověď, model řekne, že odpověď není k dispozici, místo toho, aby vyplnil mezeru ve znalostech z tréninkových dat, podle dokumentace Webového Vyhledávání.

Stránka cen Amazon Bedrock uvádí Webové Vyhledávání za 12,00 USD za 1 000 dotazů ve třech regionech USA, kde je k dispozici. Jedná se o poplatek za použití nad rámec inferenci modelu; AWS účtuje verzi AgentCore tohoto nástroje samostatně.

Podmínky obsahují jednu povinnost, kterou je třeba uvést pro týmy, které vytvářejí produkty pro koncové uživatele: zákazníci musí uchovávat a zobrazovat zdrojové citace a odkazy z výstupů modelu ve všech informacích, které jsou předávány koncovým uživatelům, a nesmí používat nástroj k hromadnému extrahování obsahu nebo vytváření konkurenčního indexu.

Kde běží a které modely podporuje

Při spuštění Webové Vyhledávání funguje pouze s modely OpenAI poskytovanými prostřednictvím koncového bodu inferenci modelu Bedrock – bedrock-mantle prostřednictvím API Antworten: openai.gpt-5.4, openai.gpt-5.5 a tři varianty GPT-5.6 (Luna, Terra a Sol), podle dokumentace. Modely Anthropic, Meta, Mistral a Amazonova vlastní modely Nova na Bedrock nejsou v seznamu podporovaných modelů.

Dostupnost je omezena na tři regiony USA: us-east-1, us-east-2 a us-west-2, s dotazy zpracovanými v rámci regionu. Dokumentace popisuje nástroj jako přísně regionální: každý region provozuje vlastní vrstvu pro vyhledávání a načítání obsahu, a dotazy, fetches, indexová data a výsledky nepřesahují regionální hranice.

Postura dodržování předpisů

AWS prezentuje zpracování dat nástrojem jako svou podnikovou odlišnost. Ve výchozím nastavení je načtení slouženo zcela z webového indexu a cache Amazon Bedrock, snapshotu webového obsahu hostovaného uvnitř AWS, takže data požadavku neopouštějí hranice AWS. Live-webové načtení, přímé načtení obsahu z webu v době požadavku, ještě není k dispozici; parametr API pro něj je již na místě, a dokumentace říká, že jakékoli budoucí změny budou vyžadovat, aby zákazníci výslovně udělili samostatnou IAM povolení, než budou mít účinek.

Auditování probíhá prostřednictvím CloudTrail ve výchozím nastavení. Každé vyhledávací a fetch volání je zaznamenáno s identitou volajícího, časovým razítkem a kontextem regionu, a zamítnuté požadavky protokolují konkrétní podmínku, která způsobila zamítnutí. Návrh nezaznamenává text dotazu, vrácené URL nebo načtený obsah stránky, poskytující tak týmu dodržování předpisů záznam o tom, kdo použil nástroj a kdy, bez odhalení toho, co uživatelé hledali.

Od AgentCore k inferenci modelu

Spouštění AgentCore (oznámeno na summitu AWS New York 2026) a vydání 4. srpna přinášejí nástroj Webového Vyhledávání do různých vrstev zásobníku Bedrock.

Rozdíl mezi dvěma verzemi je bod integrace. Nástroj AgentCore je cílem konektoru na bráně, zaměřeným na týmy, které již staví agenty na tomto zásobníku a vyvolané prostřednictvím MCP. Verze Bedrock se připojuje k obyčejnému volání inferenci, což umístění nástroje do dosahu mnohem větší sady existujících aplikací, včetně těch, které nemají žádnou architekturu agenta. Ceny pro obě verze nyní sedí na samostatných stránkách za samostatné sazby.

S tím, že je snížení na nástroj v žádosti, zbývající práce pro přijímače je povolení: povolení nástroje vyžaduje IAM akce pro vyhledávání a načtení vedle přístupu k inferenci Bedrock, a autentizace koncového bodu bedrock-mantle používá krátkodobý bearer token vygenerovaný z existujících AWS přihlašovacích údajů spíše než samostatný API klíč. Live-webové načtení zůstává datované, ale neplánované položky na roadmapu, bráněné povolením, které je ve výchozím nastavení zakázáno.

Aiden Cross je AI-generovaný stratég v Unite.AI, který se zabývá strategií AI produktů, jejich prováděním a praktickými výzvami spojenými s transformací experimentálních modelů na škálovatelné a tržně připravené produkty. Jeho práce se zaměřuje na to, jak startupy a podnikové týmy přecházejí od prototypů a demonstrací k spolehlivým systémům používaným skutečnými zákazníky.
S pragmatickým a detailním pohledem analyzuje Aiden produktové mapy, strategie vstupu na trh, rozhodnutí o platformách a organizační kompromisy, které určují, zda iniciativy AI uspějí nebo uváznou. Zvláštní pozornost věnuje realitám nasazení, přijetí uživatelů, omezením infrastruktury a souladu mezi technickými schopnostmi a obchodními hodnotami.
Články napsané Aidenem Crossem jsou AI-generované a recenzované redakčním týmem Unite.AI, aby zajistily jasnost, přesnost a odpovědné pokrytí toho, jak jsou AI produkty vyvíjeny, expedovány a škálovány v reálném světě.