Modele și platforme AI

Google Cloud Next 2025: Dublarea pariului pe AI cu siliciu, software și un ecosistem deschis de agenți

mm
Adaugă Unite.AI la sursele tale preferate pe Google

Las Vegas găzduiește Google Cloud Next 2025 (GOOGL ) , un eveniment care are loc într-un moment critic pentru industria tehnologiei. Războiul armelor de inteligență artificială dintre giganții norului – Amazon (AMZN ) Web Services (AWS), Microsoft Azure și Google Cloud – se escaladează rapid. Google, adesea prezentat ca al treilea concurent, în ciuda puterii sale tehnologice formidabile și a rădăcinilor sale adânci de cercetare în domeniul inteligenței artificiale, a preluat scena Cloud Next pentru a articula o strategie cuprinzătoare și agresivă, orientată în mod direct către piața enterprise AI.

Narativa, prezentată de CEO-ul Google Cloud, Thomas Kurian, și reflectată de CEO-ul Google și Alphabet (GOOG ), Sundar Pichai, s-a concentrat pe trecerea transformării AI de la o posibilitate la o realitate tangibilă. Google a subliniat momentul său pretins, citând peste 3.000 de îmbunătățiri ale produsului în ultimul an, o creștere de douăzeci de ori a platformei Vertex AI, mai mult de patru milioane de dezvoltatori care construiesc activ cu familia de modele Gemini și prezentând peste 500 de povestiri de succes ale clienților în timpul conferinței.

Cu toate acestea, Google Cloud Next 2025 a fost mai mult decât o prezentare a actualizărilor incrementale sau a metricilor impresionante. Acesta a lansat, de asemenea, o ofensivă multi-pronged. Prin lansarea unui siliciu personalizat puternic, optimizat pentru inferență (TPU Ironwood), prin îmbunătățirea portofoliului de modele AI cu accent pe practicitate (Gemini 2.5 Flash), prin deschiderea infrastructurii sale globale de rețea către întreprinderi (Cloud WAN) și prin efectuarea unei pariuri strategice semnificative pe un ecosistem deschis și interoperabil pentru agenți AI (protocolul Agent2Agent), Google se poziționează agresiv pentru a defini următoarea fază evolutivă a inteligenței artificiale enterprise – ceea ce compania o numește din ce în ce mai mult „era agenților”.

… (restul conținutului)

Ironwood, Gemini și efectul de rețea

Central pentru ambițiile Google în domeniul inteligenței artificiale este investiția sa continuă în siliciu personalizat. Steaua Cloud Next 2025 a fost Ironwood, a șaptea generație de unități de procesare tensoriale (TPU) ale Google. În mod critic, Ironwood este prezentat ca primul TPU proiectat în mod explicit pentru inferență AI – procesul de utilizare a modelelor antrenate pentru a face previziuni sau a genera ieșiri în aplicații din lumea reală.

Pretențiile de performanță pentru Ironwood sunt substanțiale. Google a detaliat configurații care se extind până la o cantitate imensă de 9.216 de cipuri lichide interconectate într-un singur pod. Această configurație cea mai mare se pretinde a oferi o putere de calcul de 42,5 exaflops. Google afirmă că acest lucru reprezintă de peste 24 de ori puterea de calcul per pod a El Capitan, în prezent clasificat ca cel mai puternic supercomputer din lume.

În timp ce impresionant, este important de remarcat că astfel de comparații implică adesea niveluri diferite de precizie numerică, făcând echivalența directă complexă. Cu toate acestea, Google poziționează Ironwood ca o îmbunătățire de peste zece ori față de generația anterioară de TPU de înaltă performanță.

Dincolo de puterea de calcul brută, Ironwood deține progrese semnificative în ceea ce privește memoria și interconectivitatea în comparație cu predecesorul său, Trillium (TPU v6).

Poate cel mai important este accentul pe eficiența energetică. Google afirmă că Ironwood oferă de două ori mai multă performanță pe watt în comparație cu Trillium și este de aproape 30 de ori mai eficient din punct de vedere energetic decât primul său TPU Cloud din 2018. Acest lucru abordează direct constrângerea în creștere a disponibilității puterii în scalingul centrelor de date pentru inteligență artificială.

Compararea generațiilor TPU Google: Ironwood (v7) vs. Trillium (v6)

Caracteristică Trillium (TPU v6) Ironwood (TPU v7) Factor de îmbunătățire
Focus principal Antrenament și inferență Inferență Specializare
Putere de calcul pe cip Nu este direct comparabil (diferență de generație) 4.614 TFLOPS (probabil FP8)
Capacitate HBM pe cip 32 GB (estimat pe baza revendicării de 6x) 192 GB 6x
Lățime de bandă HBM pe cip ~1,6 Tbps (estimat pe baza 4,5x) 7,2 Tbps 4,5x
Lățime de bandă ICI (bidirecțional) ~0,8 Tbps (estimat pe baza 1,5x) 1,2 Tbps 1,5x
Performanță pe watt vs. generația anterioară Bază pentru comparație 2x vs Trillium 2x
Performanță pe watt vs. TPU v1 (2018) ~15x (estimat) Aproape 30x ~2x vs Trillium


Notă: Unele cifre Trillium sunt estimate pe baza factorilor de îmbunătățire revendicați de Google pentru Ironwood. Comparația puterii de calcul este complexă din cauza diferențelor de generație și a variațiilor probabile de precizie.

Ironwood formează o parte cheie a conceptului de “hypercomputer AI” al Google – o arhitectură care integrează hardware optimizat (inclusiv TPU și GPU-uri precum Nvidia’s Blackwell și viitoarea Vera Rubin), software (precum Pathways distributed ML runtime), stocare (Hyperdisk Exapools, Managed Lustre) și rețea pentru a aborda sarcini de lucru solicitante de inteligență artificială.

Pe partea modelului, Google a introdus Gemini 2.5 Flash, un punct strategic de contra-punct față de Gemini 2.5 Pro. În timp ce Pro vizează calitatea maximă pentru raționamentul complex, Flash este optimizat în mod explicit pentru latență scăzută și eficiență a costurilor, făcându-l potrivit pentru aplicații în timp real cu volum ridicat, precum interacțiuni cu serviciul clienți sau rezumate rapide.

Gemini 2.5 Flash are un “buget de gândire” dinamic care ajustează procesarea în funcție de complexitatea interogării, permițând utilizatorilor să echilibreze balanța dintre viteză, cost și acuratețe. Acest accent simultan pe un cip de inferență de înaltă performanță (Ironwood) și pe un model optimizat pentru cost și latență (Gemini Flash) subliniază împingerea Google către operationalizarea practică a inteligenței artificiale, recunoscând că costul și eficiența rulează modele în producție devin preocupări majore pentru întreprinderi.

Complementar actualizărilor de siliciu și model este lansarea Cloud WAN. Google efectiv produsează rețeaua sa internă globală masivă – care acoperă peste două milioane de mile de fibră, conectând 42 de regiuni prin peste 200 de puncte de prezență – și o face direct disponibilă clienților întreprinderilor.

Google afirmă că acest serviciu poate oferi până la 40% performanță mai rapidă în comparație cu internetul public și poate reduce costul total de proprietate cu până la 40% față de rețelele WAN autogestionate, susținut de un SLA de 99,99% fiabilitate. Principalele ținte pentru conectivitate de înaltă performanță între centre de date și conectarea mediului de ramificare / campus, Cloud WAN utilizează infrastructura existentă a Google, inclusiv Centrul de conectivitate a rețelei.

În timp ce Google a menționat Nestlé și Citadel Securities ca adoptatori timpurii, această mișcare transformă fundamental un activ de infrastructură internă într-un diferențiator competitiv și potențial flux de venit, provocând direct atât furnizorii tradiționali de telecomunicații, cât și ofertele de rețea ale platformelor cloud rivale, cum ar fi AWS Cloud WAN și Azure Virtual WAN.

(Sursă: Google DeepMind)

Ofensiva agenților: Construirea de poduri cu ADK și A2A

Dincolo de infrastructură și modelele de bază, Google Cloud Next 2025 a plasat un accent extraordinar pe agenții de inteligență artificială și uneltele pentru a-i construi și conecta. Viziunea prezentată se extinde mult dincolo de simpli chatboti, imaginând sisteme sofisticate capabile de raționament autonom, planificare și executare a sarcinilor complexe și cu mai multe etape. Accentul se îndreaptă în mod clar către facilitarea sistemelor multi-agente, în care agenți specializați colaborează pentru a atinge obiective mai largi.

Pentru a facilita această viziune, Google a introdus Kitul de dezvoltare a agenților (ADK). ADK este un cadru deschis, inițial disponibil în Python, proiectat pentru a simplifica crearea de agenți individuali și sisteme complexe de agenți multipli. Google afirmă că dezvoltatorii pot construi un agent funcțional cu sub 100 de linii de cod.

Caracteristici cheie includ o abordare “codul mai întâi” pentru control precis, suport nativ pentru arhitecturi de agenți multipli, integrare flexibilă a uneltelor (inclusiv suport pentru Protocolul de context al modelului (MCP)), capacități de evaluare integrate, opțiuni de implementare care variază de la containere locale la motorul de agent gestionat Vertex AI. ADK susține, de asemenea, în mod unic, fluxul de audio și video bidirecțional pentru interacțiuni mai naturale și mai umane. Un “Grădină de agenți” oferă mostre gata de utilizat și peste 100 de conectori preconstruiți pentru a începe dezvoltarea.

Piesa centrală a strategiei agenților Google, totuși, este protocolul Agent2Agent (A2A). A2A este un nou standard deschis, proiectat în mod explicit pentru interoperabilitatea agenților. Scopul său fundamental este de a permite agenților de inteligență artificială, indiferent de cadru cu care au fost construiți (ADK, LangGraph, CrewAI etc.) sau de furnizorul care i-a creat, să comunice în mod securizat, să schimbe informații și să coordoneze acțiuni. Acest lucru abordează în mod direct provocarea semnificativă a sistemelor de inteligență artificială izolate în cadrul întreprinderilor, în care agenții construiți pentru sarcini sau departamente diferite adesea nu pot interacționa.

Această încercare de a stabili un protocol A2A deschis reprezintă o pariuri strategice semnificative. În loc de a construi un ecosistem de agenți proprietar și închis, Google încearcă să stabilească standardul de facto pentru comunicarea agenților. Acestă abordare sacrifică potențial blocarea pe termen scurt pentru perspectiva conducerii pe termen lung a ecosistemului și, în mod crucial, reducerea fricțiunii care împiedică adoptarea de către întreprinderi a sistemelor complexe de agenți multipli.

Prin promovarea deschiderii, Google își propune să accelereze întregul piața a agenților, poziționând platforma sa cloud și uneltele sale ca facilitatori centrali.

Cum funcționează A2A (Sursă: Google)

Reajustarea cursei cloud: Pariul competitiv al Google

Aceste anunțuri aterizează în mod direct în contextul războiului cloud în desfășurare. Google Cloud, în timp ce demonstrează o creștere impresionantă, adesea alimentată de adoptarea inteligenței artificiale, încă deține poziția a treia în ceea ce privește cota de piață, fiind devansat de AWS și Microsoft Azure. Cloud Next 2025 a prezentat strategia Google de a reajusta această cursă, încărcându-și puternic punctele sale forte unice și abordând slăbiciunile percepute.

Diferențiatorii cheie ai Google au fost pe deplin afișați. Investiția pe termen lung în siliciu personalizat, culminând cu TPU Ironwood orientat către inferență, oferă o narativă hardware distinctă în comparație cu cipurile Trainium/Inferentia de la AWS și acceleratorul Maia de la Azure. Google subliniază în mod constant leadershipul în ceea ce privește performanța pe watt, un factor potențial crucial pe măsură ce cerințele energetice ale inteligenței artificiale cresc. Lansarea Cloud WAN armează o infrastructură de rețea globală fără precedent, oferind un avantaj distinct de rețea.

Mai mult, Google continuă să valorifice moștenirea sa în domeniul inteligenței artificiale și al învățării automate, provenind din cercetarea DeepMind și manifestată în platforma cuprinzătoare Vertex AI, aliniindu-se cu percepția sa de piață ca lider în inteligență artificială și analize de date.

În același timp, Google a semnalat eforturi de a aborda preocupările istorice ale întreprinderilor. Acordul masiv de 32 de miliarde de dolari pentru achiziționarea firmei de securitate cloud Wiz, anunțat înainte de Next, este o declarație de intenție de a-și consolida postura de securitate și de a îmbunătăți utilizabilitatea și experiența ofertelor sale de securitate – domenii critice pentru încrederea întreprinderilor.

Accentuarea continuă pe soluții industriale, pregătirea pentru întreprinderi și parteneriatele strategice vizează, de asemenea, să remodeleze percepția de piață de la un furnizor pur de tehnologie la un partener de întreprindere de încredere.

În ansamblu, strategia Google pare mai puțin axată pe a se potrivi cu AWS și Azure serviciu cu serviciu și mai concentrată pe valorificarea activelor sale unice – cercetare în inteligență artificială, hardware personalizat, rețea globală și afinitate pentru codul deschis – pentru a stabili conducerea în ceea ce consideră a fi urmunda undă critică a calculului cloud: inteligență artificială la scară, în special inferență eficientă și sisteme agenților sofisticați.

Drumul înainte pentru Google AI

Google Cloud Next 2025 a prezentat o narativă convingătoare de ambiție și coerență strategică. Google dublează pariul pe inteligență artificială, mobilizând resursele sale de-a lungul siliciului personalizat optimizat pentru era inferenței (Ironwood), un portofoliu de modele AI echilibrat și practic (Gemini 2.5 Pro și Flash), infrastructura sa globală de rețea unică (Cloud WAN) și o abordare deschisă îndrăzneață pentru lumea în curs de dezvoltare a agenților de inteligență artificială (ADK și A2A).

În cele din urmă, evenimentul a prezentat o companie care se mișcă agresiv pentru a-și transpune capacitățile tehnologice profunde într-o ofertă cuprinzătoare și diferențiată pentru întreprinderi pentru era inteligenței artificiale. Strategia integrată – hardware, software, rețea și standarde deschise – este solidă. Cu toate acestea, drumul înainte necesită mai mult decât doar inovație.

Provocarea cea mai semnificativă a Google poate să nu fie în tehnologie, ci în depășirea inerției adoptării întreprinderilor și construirea unei încrederi durabile. Transformarea acestor anunțuri ambițioase în câștiguri de cotă de piață pe termen lung împotriva concurenților profund înrădăcinați necesită o execuție fără cusur, strategii de piață clare și capacitatea de a convinge în mod constant organizații mari că Google Cloud este platforma indispensabilă pentru viitorul lor condus de inteligență artificială. Viitorul agenților pe care Google îl imaginează este convingător, dar realizarea lui depinde de navigarea acestor dinamici de piață complexe mult după ce lumina reflectoarelor de la Las Vegas s-a stins.

Alex McFarland este un jurnalist și scriitor de inteligență artificială, care explorează cele mai recente dezvoltări în domeniul inteligenței artificiale. El a colaborat cu numeroase startup-uri de inteligență artificială și publicații din întreaga lume.