AI-modellen en platforms
CoreWeave gaat NVIDIA Vera CPU Bare Metal op rack‑schaal draaien

CoreWeave zei op 30 september 2026 dat het zijn compute‑portfolio zal uitbreiden met de NVIDIA Vera CPU, die het beschreef als de eerste CPU die speciaal is ontworpen voor AI‑agents, en dat het de processor bare metal op rack‑schaal zal draaien voor agentische AI‑ en reinforcement‑learning‑workloads.
Het nieuws werd gedeeld tijdens Fully Connected, de AI‑cloudconferentie van CoreWeave in San Francisco, die het bedrijf omschrijft als een bijeenkomst van meer dan 4.500 klanten, partners, ontwikkelaars en AI‑leiders. Fully Connected 2026 vindt plaats van 29 september tot 1 oktober 2026 in Moscone South, 747 Howard Street.
Het CPU‑werk achter agentische AI
CoreWeave beschrijft agentische AI als een doorlopende lus van uitvoeren, observeren, cureren, verbeteren en evalueren. Binnen die lus behandelen GPU’s het model‑training en redeneren, terwijl CPU’s het werk rondom elke stap uitvoeren: geïsoleerde sandboxes, reinforcement‑learning‑omgevingen, tool‑aanroepen, code‑executie en datapipe‑lines.
CoreWeave noemde de vraag naar datapre‑processing‑pipelines en reinforcement‑learning‑trainingssessies bursty en moeilijk te voorspellen: een enkele stap in de lus kan duizenden omgevingen voor een uur vereisen, en daarna bijna niets tot de volgende run. Naarmate post‑training‑ en agent‑workloads groeien, zei het bedrijf, wordt dat CPU‑intensieve werk steeds meer de snelheid van de AI‑lus bepalend, en heeft de infrastructuur zowel de dichtheid voor die vraag als de flexibiliteit om op te schalen wanneer de vraag verandert.
Het bedrijf zei dat de Vera CPU op dezelfde manier werkt als de rest van haar vloot op CoreWeave: bare metal, onder hetzelfde platform, dezelfde consumptiemodellen en economische voorwaarden.
Rack‑Scale‑implementatie en CoreWeave Sandboxes
CoreWeave stelde dat een kritische prestatiemaatstaf voor agentische AI het aantal geïsoleerde agent‑omgevingen is dat een team gelijktijdig kan draaien, en of de prestaties per sandbox consistent blijven naarmate dat aantal stijgt. De rack‑scale Vera‑implementatie past 128 CPU’s en 11.264 kernen in één rack, met BlueField‑4 DPU’s en Spectrum‑X Ethernet‑switching die de Vera‑nodes verbinden; het bedrijf zei dat dit capaciteit biedt voor meer dan 11.000 gelijktijdige omgevingen.
CoreWeave zei dat haar Sandboxes‑product deze agents met volledige hardware‑isolatie implementeert, direct naast de trainingsjobs die ze ondersteunen. In haar tests meldde het bedrijf dat de opstarttijd van een agent‑sandbox op de NVIDIA Vera CPU meer dan 3 × sneller was dan op een x86 CPU.
“Algemene infrastructuur vormt een knelpunt voor agentische AI; Vera is de eerste CPU die expliciet is ontworpen om dit te versnellen,” zei Chen Goldberg, uitvoerend vice-president product en engineering bij CoreWeave, in de aankondiging van het bedrijf. Goldberg zei dat het platform van CoreWeave Vera van nature ondersteunt via producten zoals CoreWeave Sandboxes, waardoor teams onmiddellijk duizenden geïsoleerde omgevingen kunnen opzetten zonder extra operationele frictie.
Ryan Shrout, president en general manager bij Signal65, zei dat een groeiend deel van elke agent‑cyclus CPU‑werk is, en dat dit aandeel alleen maar zal toenemen naarmate post‑training‑ en agent‑implementaties opschalen. Hij stelde dat het omringende platform bepaalt of teams die capaciteit daadwerkelijk kunnen benutten, en dat het operationele verschil voortkomt uit het draaien van het CPU‑werk op bare metal naast de trainingsvloot onder een orkestratie die al bestaat.
CoreWeave lanceerde CoreWeave Sandboxes op 14 mei 2026 als een uitvoeringslaag die veilige, geïsoleerde omgevingen biedt waar AI‑onderzoekers en platformteams reinforcement learning, agent‑toolgebruik en model‑evaluatie uitvoeren. Het is beschikbaar op de eigen CoreWeave‑infrastructuur van een klant via CoreWeave Kubernetes Service of als een serverless‑runtime via Weights & Biases, met een Python‑SDK die sessiebeheer, opslagintegratie en monitoring‑tools omvat. CoreWeave stelt dat standaard elke sandbox opereert in een volledig geïsoleerde virtuele omgeving, zodat een fout of een uit de hand gelopen proces in de ene sandbox niet kan overlopen naar een andere.
CoreWeave verwees ook naar haar MLPerf‑benchmarkresultaten in inferentie en training en haar positie als de enige AI‑cloud die drie keer achter elkaar de hoogste Platinum‑ranking behaalde in SemiAnalysis ClusterMAX.
NVIDIA Vera CPU‑specificaties
NVIDIA’s Vera CPU-productpagina beschrijft de processor als gebouwd voor het CPU-werk achter agentische AI en reinforcement learning: code‑executie, tool‑gebruik, sandboxing, analytics, datapipe‑lines en orkestratie buiten het model. Volgens NVIDIA bevat Vera 88 aangepaste Olympus‑kernen, en creëert de Spatial Multithreading 176 threads met gepartitioneerde kern‑resources.
Het geheugen‑bandbreedte bereikt tot 1,2 terabyte per seconde op LPDDR5X, met een geheugen‑capaciteit tot 1,5 TB, aldus NVIDIA. Een tweede‑generatie NVIDIA Scalable Coherency Fabric verbindt alle 88 kernen, cache, geheugen, I/O en NVLink‑C2C over één compute‑die met 3,4 TB/s bissectiebandbreedte, en NVLink‑C2C levert tot 1,8 TB/s coherente bandbreedte tussen Vera‑CPU’s en NVIDIA‑GPU’s, volgens het bedrijf.
NVIDIA zegt dat Vera de compilatie, code‑analyse en Python‑toolchain‑werkbelastingen van de redeneerlus van een agent tot 1,8 × sneller uitvoert dan toonaangevende x86‑CPU’s, en dat het LPDDR5X‑geheugenonderdeel 2 × de bandbreedte en 3 × de bandbreedte per core levert ten opzichte van toonaangevende x86‑CPU’s met DDR5. De productpagina vermeldt dat die relatieve prestatiecijfers gebaseerd zijn op gemeten gegevens, gebaseerd op de nieuwste generatie x86‑CPU, en onder voorbehoud van wijziging.
NVIDIA positioneert Vera zowel als host‑CPU voor versnelde systemen, inclusief de Vera Rubin NVL72 en HGX Vera Rubin NVL8‑platformen, alsook als een zelfstandige CPU voor agent‑AI, reinforcement learning, gegevensverwerking en analyse. De Vera CPU Rack, gebouwd op NVIDIA MGX, bevat tot 256 Vera‑CPU’s en draait meer dan 22,5 K gelijktijdige omgevingen, aldus het bedrijf. Vera Rubin NVL72 combineert 72 Rubin‑GPU’s, 36 Vera‑CPU’s, ConnectX‑9 SuperNIC’s en BlueField‑4‑DPU’s in één rack‑scale platform.












