AI-modellen en platforms
Google Cloud Next 2025: Inzetten op AI met Silicon, Software en een Open Agent Ecosysteem
Las Vegas is de gastheer van Google Cloud Next 2025 (GOOGL ) , een evenement dat plaatsvindt op een kritiek moment voor de technologie-industrie. De artificiële intelligentie-wapenwedloop tussen de cloud-reuzen – Amazon (AMZN ) Web Services (AWS), Microsoft Azure en Google Cloud – escaleert snel. Google, vaak gezien als de derde deelnemer ondanks zijn formidabele technologische kracht en diepe AI-onderzoeksroots, greep de Cloud Next-podium aan om een uitgebreide en agressieve strategie te articuleren die rechtstreeks gericht is op de enterprise AI-markt.
Het verhaal, verteld door Google Cloud CEO Thomas Kurian en herhaald door Google en Alphabet (GOOG ) CEO Sundar Pichai, draaide om het verplaatsen van AI-transformatie van een mogelijke naar een tastbare realiteit. Google benadrukte zijn beweerde momentum, met meer dan 3.000 productverbeteringen in het afgelopen jaar, een twintigvoudige toename van Vertex AI-platform-gebruik sinds het vorige Cloud Next-evenement, meer dan vier miljoen ontwikkelaars die actief bouwen met zijn Gemini-familie van modellen en meer dan 500 klantensuccesverhalen tijdens de conferentie.
Google Cloud Next 2025 was echter meer dan een showcase van incrementele updates of indrukwekkende metrics. Het evenement onthulde ook een meervoudige offensief. Door het lanceren van krachtige, inference-geoptimaliseerde aangepaste siliconen (de Ironwood TPU), het verfijnen van zijn vlaggenschip AI-modelportfolio met een focus op praktische toepassing (Gemini 2.5 Flash), het openen van zijn uitgebreide wereldwijde netwerk-infrastructuur voor ondernemingen (Cloud WAN) en het doen van een significante, strategische inzet op een open, interoperabele ecosystem voor AI-agents (de Agent2Agent-protocol), positioneert Google zich agressief om de volgende evolutionaire fase van enterprise AI te definiëren – wat het bedrijf steeds vaker de “agentic-era” noemt.
Ironwood, Gemini en het Netwerkeffect
Centraal in Google’s AI-ambities staat zijn voortdurende investering in aangepaste siliconen. De ster van Cloud Next 2025 was Ironwood, de zevende generatie van Google’s Tensor Processing Unit (TPU). Critici presenteren Ironwood als de eerste TPU die expliciet is ontworpen voor AI-inferentie – het proces van het gebruiken van getrainde modellen om voorspellingen te doen of outputs te genereren in real-world toepassingen.
De prestatieclaims voor Ironwood zijn aanzienlijk. Google heeft configuraties gedetailleerd die opschalen tot een immense 9.216 vloeistofgekoelde chips die zijn verbonden binnen een enkele pod. Deze grootste configuratie wordt geclaimd om een verbluffende 42,5 exaflops aan rekenkracht te leveren. Google beweert dat dit meer dan 24 keer de per-pod rekenkracht van El Capitan vertegenwoordigt, momenteel gerangschikt als de krachtigste supercomputer ter wereld.
Hoewel indrukwekkend, is het belangrijk om op te merken dat dergelijke vergelijkingen vaak betrekking hebben op verschillende niveaus van numerieke precisie, waardoor directe equivalentie complex is. Niettemin positioneert Google Ironwood als een verbetering van meer dan tien keer ten opzichte van zijn vorige hoge prestatie TPU-generatie.
Buiten brute rekenkracht om, beschikt Ironwood over significante verbeteringen in geheugen en interconnectiviteit in vergelijking met zijn voorganger, Trillium (TPU v6).
Misschien nog belangrijker is de nadruk op energie-efficiëntie. Google beweert dat Ironwood tweemaal de prestatie per watt levert in vergelijking met Trillium en bijna 30 keer meer energie-efficiënt is dan zijn eerste Cloud TPU uit 2018. Dit adresseert rechtstreeks de groeiende beperking van energieverbruik bij het schalen van datacenters voor AI.
Google TPU Generatie Vergelijking: Ironwood (v7) vs. Trillium (v6)
| Functie | Trillium (TPU v6) | Ironwood (TPU v7) | Verbeteringsfactor |
| Primaire Focus | Training & Inferentie | Inferentie | Specialisatie |
| Piekrekenkracht/Chip | Niet direct vergelijkbaar (verschillende generaties) | 4.614 TFLOPs (FP8 waarschijnlijk) | – |
| HBM-capaciteit/Chip | 32 GB (geschat op basis van 6x claim) | 192 GB | 6x |
| HBM-bandbreedte/Chip | ~1,6 Tbps (geschat op basis van 4,5x) | 7,2 Tbps | 4,5x |
| ICI-bandbreedte (bidirectioneel) | ~0,8 Tbps (geschat op basis van 1,5x) | 1,2 Tbps | 1,5x |
| Prestatie/Watt vs. Vorige Generatie | Basis voor vergelijking | 2x vs Trillium | 2x |
| Prestatie/Watt vs. TPU v1 (2018) | ~15x (geschat) | Bijna 30x | ~2x vs Trillium |
Opmerking: Sommige Trillium-cijfers zijn geschat op basis van Google’s beweerde verbeteringsfactoren voor Ironwood. De vergelijking van piekrekenkracht is complex vanwege generatieverschillen en waarschijnlijke precisievariaties.
Ironwood vormt een cruciaal onderdeel van Google’s “AI Hypercomputer”-concept – een architectuur die geoptimaliseerde hardware (inclusief TPU’s en GPU’s zoals Nvidia’s Blackwell en de komende Vera Rubin), software (zoals de Pathways distributed ML-runtime), opslag (Hyperdisk Exapools, Managed Lustre) en netwerken om veeleisende AI-werklasten aan te pakken.
Op het gebied van modellen introduceerde Google Gemini 2.5 Flash, een strategisch tegengewicht voor het high-end Gemini 2.5 Pro. Terwijl Pro is gericht op maximale kwaliteit voor complexe redenering, is Flash expliciet geoptimaliseerd voor lage latentie en kostenefficiëntie, waardoor het geschikt is voor high-volume, real-time toepassingen zoals klantenservice-interacties of snelle samenvatting.
Gemini 2.5 Flash beschikt over een dynamische “denkbudget” dat de verwerking aanpast op basis van querycomplexiteit, waardoor gebruikers de balans tussen snelheid, kosten en nauwkeurigheid kunnen afstemmen. Deze gelijktijdige focus op een high-performance inference-chip (Ironwood) en een kostenefficiënte model (Gemini Flash) benadrukt Google’s push naar de praktische operationalisering van AI, waarbij wordt erkend dat de kosten en efficiëntie van het uitvoeren van modellen in productie steeds belangrijker worden voor ondernemingen.
De lancering van Cloud WAN vult de siliconen- en modelupdates aan. Google maakt zijn uitgebreide wereldwijde netwerk-infrastructuur effectief beschikbaar voor ondernemingen – een dienst die tot 40% snellere prestaties kan leveren in vergelijking met het openbare internet en de totale kosten van eigendom kan verlagen met tot 40% ten opzichte van zelfbeheerde WAN’s, ondersteund door een 99,99% betrouwbaarheids-SLA. Primair gericht op high-performance connectiviteit tussen datacenters en het verbinden van filiaal/campus-omgevingen, maakt Cloud WAN gebruik van Google’s bestaande infrastructuur, inclusief het Network Connectivity Center.
Terwijl Google Nestlé en Citadel Securities noemde als vroege adoptanten, is deze stap fundamenteel het wapenen van een kerninfrastructuuractivum. Het transformeert een interne operationele noodzaak in een concurrentieel differentiatiepunt en potentieel inkomstenstroom, waarmee het rechtstreeks de traditionele telecommunicatieproviders en de netwerkdiensten van concurrerende cloudplatforms zoals AWS Cloud WAN en Azure Virtual WAN uitdaagt.

(Bron: Google DeepMind)
De Agent Offensief: Bruggen Bouwen met ADK en A2A
Verder dan infrastructuur en core-modellen, legde Google Cloud Next 2025 een buitengewone nadruk op AI-agents en de tools om deze te bouwen en te verbinden. De visie die werd gepresenteerd, gaat verder dan eenvoudige chatbots, en voorziet in geavanceerde systemen die in staat zijn tot autonome redenering, planning en uitvoering van complexe, multi-stap taken. De focus verschuift duidelijk naar het mogelijk maken van multi-agent systemen, waarin gespecialiseerde agents samenwerken om bredere doelen te bereiken.
Om deze visie te faciliteren, introduceerde Google de Agent Development Kit (ADK). ADK is een open-source framework, aanvankelijk beschikbaar in Python, ontworpen om de creatie van individuele agents en complexe multi-agent systemen te vereenvoudigen. Google beweert dat ontwikkelaars een functionele agent kunnen bouwen met minder dan 100 regels code.
Belangrijke functies zijn een code-first benadering voor precieze controle, native ondersteuning voor multi-agent architectuur, flexibele toolintegratie (inclusief ondersteuning voor de Model Context Protocol, of MCP), ingebouwde evaluatiecapaciteiten en implementatieopties variërend van lokale containers tot de beheerde Vertex AI Agent Engine. ADK ondersteunt ook uniek bidirectionele audio- en videostreaming voor meer natuurlijke, menselijke interacties. Een bijbehorende “Agent Garden” biedt klaar-voor-gebruik voorbeelden en meer dan 100 vooraf gebouwde connectors om de ontwikkeling te versnellen.
Het centrale punt van Google’s agentstrategie is echter de Agent2Agent (A2A)-protocol. A2A is een nieuwe, open standaard ontworpen voor agent-interoperabiliteit. De fundamentele doelstelling is om AI-agents, ongeacht het framework waarin ze zijn gebouwd (ADK, LangGraph, CrewAI, etc.) of de leverancier die ze heeft gemaakt, in staat te stellen om veilig te communiceren, informatie uit te wisselen en acties te coördineren. Dit adresseert rechtstreeks de significante uitdaging van geïsoleerde AI-systemen binnen ondernemingen, waar agents die zijn gebouwd voor verschillende taken of afdelingen vaak niet kunnen communiceren.
Deze push voor een open A2A-protocol vertegenwoordigt een significante strategische gok. In plaats van een propriëtaire, gesloten agent-ecosysteem te bouwen, probeert Google de de facto standaard voor agentcommunicatie te vestigen. Deze benadering offreert potentieel korte-termijn lock-in voor de vooruitzichten van langetermijn-ecosysteemleiderschap en, cruciaal, vermindert de wrijving die de adoptie van complexe multi-agent systemen door ondernemingen belemmert.
Door openheid te bevorderen, streeft Google ernaar de hele agentmarkt te versnellen, waarbij zijn cloudplatform en -tools worden gepositioneerd als centrale facilitators.

Hoe A2A werkt (Bron: Google)
Herijking van de Cloud-race: Google’s Concurrentie Gambit
Deze aankondigingen vinden plaats in de context van de voortdurende cloud-oorlogen. Google Cloud, terwijl het indrukwekkende groei vertoont, vaak aangedreven door AI-adoptie, houdt nog steeds de derde positie in marktaandeel, achter AWS en Microsoft Azure. Cloud Next 2025 toonde Google’s strategie om deze race te herijken door zwaar in te zetten op zijn unieke sterktes en om perceptuele zwakheden aan te pakken.
Google’s belangrijkste differentiatoren waren volop zichtbaar. De langetermijninvestering in aangepaste siliconen, culminerend in de inference-georiënteerde Ironwood TPU, biedt een uniek hardwareverhaal in vergelijking met AWS’ Trainium/Inferentia-chips en Azure’s Maia-accelerator. Google benadrukt consistent prestatie-per-watt-leiderschap, een potentieel cruciaal factor aangezien AI-energievraag stijgt. De lancering van Cloud WAN wapent Google’s ongeëvenaarde wereldwijde netwerk-infrastructuur, waarmee een distinctief netwerkvoordeel wordt geboden.
Verder zet Google zijn AI- en machine learning-erfgoed voort, dat voortkomt uit DeepMind’s onderzoek en wordt geïllustreerd in het uitgebreide Vertex AI-platform, in overeenstemming met zijn marktperceptie als leider in AI en data-analyse.
Tegelijkertijd signaleerde Google inspanningen om historische ondernemingszorgen aan te pakken. De massive $32 miljard overname van cloud-beveiligingsbedrijf Wiz, aangekondigd kort voor Next, is een duidelijke verklaring van intentie om zijn beveiligingspositie te versterken en de gebruikservaring van zijn beveiligingsaanbod te verbeteren – gebieden die kritiek zijn voor ondernemingsvertrouwen.
De voortdurende nadruk op brancheoplossingen, ondernemingsgereedheid en strategische partnerschappen is erop gericht om de marktperceptie te herschikken van een pure technologieaanbieder naar een vertrouwd ondernemingspartner.
Samen genomen, lijkt Google’s strategie minder gericht op het dienst-naar-dienst volgen van AWS en Azure, en meer geconcentreerd op het benutten van zijn unieke activa – AI-onderzoek, aangepaste hardware, wereldwijde netwerk en open-source affiniteit – om leiderschap te vestigen in wat het ziet als de volgende cruciale golf van cloud-computing: AI op grote schaal, in het bijzonder efficiënte inferentie en geavanceerde agentic systemen.
De Weg Vooruit voor Google AI
Google Cloud Next 2025 presenteerde een overtuigend verhaal van ambitie en strategische coherentie. Google zet fors in op kunstmatige intelligentie, waarbij het zijn middelen over custom siliconen (Ironwood), een evenwichtig en praktisch AI-modelportfolio (Gemini 2.5 Pro en Flash), zijn unieke wereldwijde netwerk-infrastructuur (Cloud WAN) en een open benadering van de opkomende wereld van AI-agents (ADK en A2A) inzet.
Uiteindelijk toonde het evenement een bedrijf dat agressief zijn diepe technologische capaciteiten vertaalt in een uitgebreid, gedifferentieerd ondernemingsaanbod voor de AI-era. De geïntegreerde strategie – hardware, software, netwerken en open standaarden – is solide. Echter, de weg vooruit vereist meer dan alleen innovatie.
Google’s meest significante uitdaging kan minder liggen in technologie en meer in het overwinnen van ondernemingsadoptie-inertie en het opbouwen van duurzaam vertrouwen. Het omzetten van deze ambitieuze aankondigingen in duurzame marktaandeelwinsten tegenover diep gewortelde concurrenten vereist foutloze uitvoering, duidelijke go-to-market-strategieën en de capaciteit om consistent grote ondernemingen te overtuigen dat Google Cloud het onmisbare platform is voor hun AI-gedreven toekomst. De agentic toekomst die Google zich voorstelt, is overtuigend, maar de realisatie ervan hangt af van het navigeren door deze complexe marktdynamiek, lang nadat de Las Vegas-spotlight is gedoofd.










