Modely a platformy AI

Google Cloud Next 2025: Dvojnásobná sázka na umělou inteligenci se silikonem, softwarem a otevřenou ekosystémem agentů

mm
Přidejte Unite.AI mezi své preferované zdroje na Google

Las Vegas hostí Google Cloud Next 2025 (GOOGL ) , událost, která se koná v kritickém okamžiku pro technologický průmysl. Umělé inteligence závod mezi cloudovými titány – Amazon (AMZN ) Web Services (AWS), Microsoft Azure a Google Cloud – se rychle zvyšuje. Google, často považovaný za třetího uchazeče, navzdory své formidabilní technologické síle a hlubokým kořenům výzkumu umělé inteligence, využil stage Cloud Next, aby představil komplexní a agresivní strategii zaměřenou přímo na trh podnikové umělé inteligence.

Narrativ, přednesený generálním ředitelem Google Cloud Thomasem Kurianem a zopakován generálním ředitelem Google a Alphabet (GOOG ) Sundarem Pichaiem, se soustředil na přeměnu umělé inteligence z pouhé možnosti na skutečnost. Google zdůraznil svou proklamovanou dynamiku, s více než 3 000 produktovými inovacemi za poslední rok, dvacetinásobným nárůstem platformy Vertex AI, více než čtyřmi miliony vývojáři aktivně budujícími s jeho rodinou modelů Gemini a představil více než 500 úspěchů zákazníků během konference.

Google Cloud Next 2025 však nebyl pouze ukázkou.incrementálních aktualizací nebo působivých metrik. Také odhalil víceznačný útok. Spuštěním výkonného, inference-optimovaného vlastního silikonu ( Ironwood TPU), zdokonalením své vlajkové lodi umělé inteligence s důrazem na praktičnost (Gemini 2.5 Flash), otevřením své rozsáhlé globální sítě infrastruktury pro podniky ( Cloud WAN) a učiněním významného, strategického sázka na otevřenou, interoperabilní ekosystém pro umělou inteligenci (protokol Agent2Agent), Google agresivně позиcionuje sám sebe, aby definoval další evoluční fázi podnikové umělé inteligence – co společnost stále více označuje jako „ agentic éru“.

Ironwood, Gemini a síťový efekt

Centrální pro Googleovy ambice umělé inteligence je jeho pokračující investice do vlastního silikonu. Hvězdou Cloud Next 2025 byl Ironwood, sedmá generace Googleova Tensor Processing Unit (TPU). Kriticky, Ironwood je prezentován jako první TPU navržený výslovně pro inference – proces, který využívá trénované modely k vytváření předpovědí nebo generování výstupů v reálných aplikacích.

Výkonnostní nároky na Ironwood jsou podstatné. Google podrobně popsal konfigurace škálování až na ohromující 9 216 tekutě chlazených čipů propojených v rámci jednoho podu. Tato největší konfigurace má dodat ohromujících 42,5 exaflops výpočetní síly. Google tvrdí, že to představuje více než 24krát větší výpočetní sílu na pod než El Capitan, který je aktuálně hodnocen jako nejvýkonnější superpočítač na světě.

Zatímco je to působivé, je důležité poznamenat, že takové srovnání často zahrnuje různé úrovně numerické přesnosti, což činí přímou ekvivalenci složitou. Nicméně Google poziciuje Ironwood jako více než desetinásobné zlepšení oproti jeho předchozí generaci s vysokým výkonem.

Mimo surový výkon Ironwood nabízí významná zlepšení v paměti a propojení ve srovnání se svým předchůdcem, Trilium (TPU v6).

Možná stejně důležité je zdůraznění energetické efektivity. Google tvrdí, že Ironwood dodává dvakrát lepší výkon na watt ve srovnání s Trilium a je téměř 30krát více energeticky efektivní než jeho první Cloud TPU z roku 2018. To přímo řeší rostoucí omezení dostupnosti energie pro škálování datových center pro umělou inteligenci.

Srovnání generací Google TPU: Ironwood (v7) vs. Trillium (v6)

Feature Trillium (TPU v6) Ironwood (TPU v7) Improvement Factor
Primary Focus Trénování a inference Inference Specializace
Peak Compute/Chip Není přímo srovnatelné (různé generace) 4 614 TFLOPs (FP8 likely)
HBM Capacity/Chip 32 GB (odhadováno na základě 6x tvrzení) 192 GB 6x
HBM Bandwidth/Chip ~1,6 Tbps (odhadováno na základě 4,5x) 7,2 Tbps 4,5x
ICI Bandwidth (bidir.) ~0,8 Tbps (odhadováno na základě 1,5x) 1,2 Tbps 1,5x
Perf/Watt vs. Prev Gen Základní srovnání 2x vs Trillium 2x
Perf/Watt vs. TPU v1 (2018) ~15x (odhadováno) Téměř 30x ~2x vs Trillium

Poznámka: Některé hodnoty Trillium jsou odhadnuty na základě tvrzení Google o zlepšeních Ironwood. Srovnání špičkového výkonu je složité kvůli generacím a pravděpodobným variacím přesnosti.

Ironwood tvoří klíčovou část Googleova konceptu „AI Hypercomputer“ – architektury, která integruje optimalizovaný hardware (včetně TPU a GPU, jako je Nvidia Blackwell (NVDA ) a nadcházející Vera Rubin), software (jako distribuovaný ML runtime Pathways), úložiště (Hyperdisk Exapools, Managed Lustre) a síť pro řešení náročných úloh umělé inteligence.

Na modelové frontě Google představil Gemini 2.5 Flash, strategický protipól k high-end Gemini 2.5 Pro. Zatímco Pro cílí na maximální kvalitu pro komplexní uvažování, Flash je explicitně optimalizován pro nízkou latenci a náklady, což z něj činí vhodný pro aplikace s vysokým objemem a reálným časem, jako jsou interakce zákaznické podpory nebo rychlé souhrny.

Gemini 2.5 Flash nabízí dynamický „rozpočet pro myšlení“, který upravuje zpracování na základě složitosti dotazu, což umožňuje uživatelům nastavit rovnováhu mezi rychlostí, náklady a přesností. Toto současné zaměření na inference-optimovaný čip (Ironwood) a náklady/latenci-optimální model (Gemini Flash) zdůrazňuje Googleův tlak na praktické operacionalizaci umělé inteligence, uznávající, že náklady a efektivita běhu modelů v produkci se stávají-paramountními záležitostmi pro podniky.

Doplňující aktualizace silikonu a modelu je spuštění Cloud WAN. Google efektivně produktizuje svou rozsáhlou vnitřní globální síť – sahající přes dva miliony mil vláken, spojující 42 regionů prostřednictvím více než 200 bodů přítomnosti – a činí ji přímo dostupnou pro podnikové zákazníky.

Google tvrdí, že tato služba může dodat až o 40 % rychlejší výkon ve srovnání s veřejným internetem a snížit celkové náklady na vlastnictví až o 40 % ve srovnání se samořízenými WAN, podpořené 99,99% SLA spolehlivosti. Primárně zaměřené na vysokovýkonnou konektivitu mezi datovými centry a připojování prostředí poboček/kampusů, Cloud WAN využívá Googleovu stávající infrastrukturu, včetně Network Connectivity Center.

Zatímco Google uvedl Nestlé a Citadel Securities jako rané adoptéry, tento krok fundamentálně zbraní základní infrastrukturní aktivum. Transformuje interní operační nutnost na konkurenční diferenciátor a potenciální zdroj příjmů, přímo vyzyvající tradiční telekomunikační poskytovatele a síťové nabídky rivalizujících cloudových platforem, jako je AWS Cloud WAN a Azure Virtual WAN.

(Source: Google DeepMind)

Ofenziva agentů: Budování mostů s ADK a A2A

Mimo infrastrukturu a jádrové modely Google Cloud Next 2025 umístil mimořádný důraz na agenty umělé inteligence a nástroje pro jejich budování a propojení. Představená vize sahá daleko za jednoduché chatboty, představující si sofistikované systémy schopné autonomního uvažování, plánování a provádění komplexních, vícekrokových úkolů. Zaměření se jasně přesouvá na umožnění multi-agentních systémů, kde specializovaní agenti spolupracují na dosažení širších cílů.

Pro usnadnění této vize Google představil Agent Development Kit (ADK). ADK je otevřený framework, který je inicializován v Pythonu, určený pro zjednodušení vytváření jednotlivých agentů a komplexních multi-agentních systémů. Google tvrdí, že vývojáři mohou postavit funkčního agenta s méně než 100 řádky kódu.

Klíčové funkce zahrnují kód-first přístup pro přesnou kontrolu, nativní podporu pro multi-agentní architektury, flexibilní integraci nástrojů (včetně podpory Model Context Protocol, nebo MCP), vestavěné vyhodnocovací schopnosti a možnosti nasazení sahající od místních kontejnerů až po spravovaný Vertex AI Agent Engine. ADK také jedinečně podporuje bidirectional audio a video streaming pro více přirozené, lidské interakce. Spolu s „Agent Garden“ poskytuje připravené vzorky a více než 100 předem vytvořených konektorů pro urychlení vývoje.

Skutečným centrem Googleovy strategie agentů je však Agent2Agent (A2A) protokol. A2A je nový, otevřený standard, který je navržen výslovně pro interoperabilitu agentů. Jeho základní cíl je umožnit agentům umělé inteligence, bez ohledu na framework, ve kterém byli postaveni (ADK, LangGraph, CrewAI atd.), nebo dodavatele, který je vytvořil, komunikovat bezpečně, vyměňovat informace a koordinovat akce. To přímo řeší významnou výzvu izolovaných systémů umělé inteligence v podnicích, kde agenti postavení pro různé úkoly nebo oddělení často nemohou interagovat.

Tento tlak na otevřený A2A protokol představuje významnou strategickou sázku. Místo budování proprietární, uzavřené ekosystémy agentů se Google snaží etablovat de facto standard pro komunikaci agentů. Tento přístup potenciálně obětuje krátkodobou vazbu za perspektivu dlouhodobého vedení ekosystému a, zásadně, snižuje tření, které brání podnikové adopci komplexních multi-agentních systémů.

Championing otevřenosti, Google se snaží urychlit celý trh agentů, позиcionující svou cloudovou platformu a nástroje jako centrální facilitátory.

Jak A2A funguje (Source: Google)

Přepočítání cloudové soutěže: Googleova konkurenční sázka

Tyto oznámení se nacházejí přímo v kontextu probíhající cloudové soutěže. Google Cloud, zatímco demonstruje působivý růst, často poháněný adopcí umělé inteligence, stále drží třetí pozici v tržním podílu, za AWS a Microsoft Azure. Cloud Next 2025 ukázal Googleovu strategii, aby přepočítal tuto soutěž, silně se spoléhající na své jedinečné silné stránky a řešící vnímané slabosti.

Googleovy klíčové diferenciátory byly plně zobrazeny. Dlouhodobá investice do vlastního silikonu, vyvrcholící v inference-orientovaném Ironwood TPU, poskytuje odlišný hardwarový narativ ve srovnání s čipy Trainium/Inferentia od AWS a urychlovačem Maia od Azure. Google stále zdůrazňuje vedení v oblasti výkonu na watt, potenciálně zásadního faktoru, jelikož energetické nároky umělé inteligence rostou. Spuštění Cloud WAN zbraní Googleovu jedinečnou globální síťovou infrastrukturu, nabízející odlišnou síťovou výhodu.

Google pokračuje ve využívání svého dědictví umělé inteligence a strojového učení, pocházejícího z výzkumu DeepMind a ztělesněného v komplexní platformě Vertex AI, odpovídajícímu jeho tržnímu vnímání jako lídra v oblasti umělé inteligence a datové analýzy.

Současně Google signálizoval úsilí řešit historické podnikové obavy. Ohromující 32 miliardový nákup cloudové bezpečnostní firmy Wiz, oznámený krátce před Next, je jasným prohlášením o úmyslu posílit svou bezpečnostní pozici a zlepšit uživatelský zážitek a bezpečnostní nabídky – oblasti kritické pro podnikové důvěru.

Pokračující důraz na odvětvové řešení, podnikovou připravenost a strategické partnerství dále cílí na změnu tržního vnímání z pouhého technologického poskytovatele na důvěryhodného podnikového partnera.

Celkově se Googleova strategie jeví méně zaměřená na službu za službou ve srovnání s AWS a Azure, a více soustředěná na využití svých jedinečných aktiv – výzkumu umělé inteligence, vlastního hardwaru, globální sítě a otevřené affinity – pro etablování vedení v tom, co považuje za další kritickou vlnu cloud computingu: umělou inteligenci v měřítku, zejména efektivní inference a sofistikované agentic systémy.

Cesta vpřed pro Google AI

Google Cloud Next 2025 představil přesvědčivý narativ ambice a strategické koherence. Google se dvojnásobně soustředí na umělou inteligenci, mobilizuje své zdroje napříč vlastním silikonem optimalizovaným pro éru inference (Ironwood), vyváženým a praktickým portfoliem modelů umělé inteligence (Gemini 2.5 Pro a Flash), jeho jedinečnou globální síťovou infrastrukturou (Cloud WAN) a odvážným, otevřeným přístupem k rostoucímu světu agentů umělé inteligence (ADK a A2A).

Ultimately, událost ukázala společnost, která se agresivně snaží přeložit své hluboké technologické schopnosti do komplexní, diferencované podnikové nabídky pro éru umělé inteligence. Integrovaná strategie – hardware, software, síť a otevřené standardy – je solidní. Nicméně, cesta vpřed vyžaduje více než jen inovace.

Googleova největší výzva může ležet méně v technologii a více v překonání podnikové adopční setrvačnosti a budování trvalé důvěry. Přetvoření těchto ambiciózních oznámení v udržitelné zisky tržního podílu proti hluboce zakořeněným konkurentům vyžaduje bezchybnou realizaci, jasnou tržní strategii a schopnost přesvědčit velké organizace, že Google Cloud je nezbytnou platformou pro jejich budoucnost poháněnou umělou inteligencí. Agentic future, kterou Google představuje, je přesvědčivá, ale její realizace závisí na navigaci těchto komplexních tržních dynamik dlouho poté, co lasvegasský reflektor zhasne.

Alex McFarland je AI novinář a spisovatel, který zkoumá nejnovější vývoj v oblasti umělé inteligence. Spolupracoval s mnoha AI startupy a publikacemi po celém světě.