Modele și platforme AI
CoreWeave va rula NVIDIA Vera CPU pe metal brut la scară de rack

CoreWeave a declarat pe 30 septembrie 2026 că își va extinde portofoliul de calcul cu NVIDIA Vera CPU, pe care l-a descris ca fiind primul CPU conceput pentru agenți AI și va rula procesorul pe metal brut la scară de rack pentru sarcini de AI agentic și învățare prin consolidare.
Știrea a fost prezentată la Fully Connected, conferința de cloud AI a CoreWeave din San Francisco, pe care compania a afirmat că reunește peste 4.500 de clienți, parteneri, dezvoltatori și lideri AI. Fully Connected 2026 are loc între 29 septembrie și 1 octombrie 2026, la Moscone South, 747 Howard Street.
Munca CPU din spatele AI-ului agentic
CoreWeave a descris AI-ul agentic ca funcționând printr-un ciclu continuu de rulare, observare, curare, îmbunătățire și evaluare. În cadrul acestui ciclu, GPU-urile se ocupă de antrenarea și raționamentul modelelor, în timp ce CPU-urile gestionează activitățile din jurul fiecărui pas: sandbox-uri izolate, medii de învățare prin consolidare, apeluri de instrumente, execuție de cod și fluxuri de date.
CoreWeave a descris cererea pentru conducte de preprocesare a datelor și episoade de antrenament prin învățare prin consolidare ca fiind explozivă și dificil de prezis: un singur pas din ciclu poate necesita mii de medii timp de o oră, apoi aproape niciunul până la următoarea rulare. Pe măsură ce sarcinile post-antrenament și cele agentice cresc, compania a declarat că munca intensivă pe CPU devine din ce în ce mai mare factor de viteză al ciclului AI, iar infrastructura are nevoie atât de densitatea necesară pentru această cerere, cât și de flexibilitatea de a scala pe măsură ce cererea se modifică.
Compania a declarat că Vera CPU funcționează în același mod ca restul flotei sale pe CoreWeave: pe metal brut, sub aceeași platformă, modele de consum și economie.
Implementare la scară de rack și Sandbox-urile CoreWeave
CoreWeave a declarat că una dintre măsurile critice de performanță pentru AI-ul agentic este numărul de medii de agent izolate pe care o echipă le poate rula simultan și dacă performanța per sandbox rămâne consistentă pe măsură ce acest număr crește. Implementarea sa Vera la scară de rack încap 128 de CPU-uri și 11.264 de nuclee într-un singur rack, cu BlueField-4 DPU-uri și comutare Ethernet Spectrum-X care conectează nodurile Vera; compania a afirmat că aceasta oferă capacitate pentru peste 11.000 de medii concurente.
CoreWeave a declarat că produsul său Sandboxes implementează acești agenți cu izolare hardware completă, amplasați direct alături de sarcinile de antrenament pe care le susțin. În testele sale, compania a raportat că timpii de pornire a sandbox-urilor de agenți pe NVIDIA Vera CPU au fost cu peste 3 ori mai rapizi decât pe un CPU x86.
“Infrastructura de uz general devine un blocaj pentru AI-ul agentic; Vera este primul CPU conceput explicit pentru a-l accelera,” a declarat Chen Goldberg, vicepreședinte executiv de produs și inginerie la CoreWeave, în anunțul companiei. Goldberg a precizat că platforma CoreWeave suportă nativ Vera prin produse precum CoreWeave Sandboxes, permițând echipelor să creeze imediat mii de medii izolate fără fricțiuni operaționale suplimentare.
Ryan Shrout, președinte și manager general la Signal65, a afirmat că o parte tot mai mare din fiecare ciclu al agentului este muncă pe CPU și că această parte va crește pe măsură ce implementările post-antrenament și cele agentice se dimensionează. El a spus că platforma înconjurătoare determină dacă echipele pot utiliza efectiv acea capacitate și că diferența operațională provine din rularea muncii CPU pe metal brut alături de flota de antrenament, sub orchestrarea care există deja.
CoreWeave a lansat CoreWeave Sandboxes pe 14 mai 2026, ca un strat de execuție care oferă medii securizate și izolate în care cercetătorii AI și echipele de platformă rulează învățarea prin consolidare, utilizarea instrumentelor de agent și evaluarea modelelor. Este disponibil pe infrastructura proprie a clientului prin CoreWeave Kubernetes Service sau ca un runtime serverless prin Weights & Biases, cu un SDK Python care include gestionarea sesiunilor, integrarea stocării și instrumente de monitorizare. CoreWeave afirmă că, în mod implicit, fiecare sandbox funcționează într-un mediu virtual complet izolat, astfel încât o defecțiune sau un proces necontrolat într-unul nu poate afecta altul.
CoreWeave a subliniat, de asemenea, rezultatele sale la benchmark-urile MLPerf în inferență și antrenament și poziția sa ca singurul cloud AI care a obținut clasificarea de top Platinum în SemiAnalysis ClusterMAX de trei ori consecutiv.
Specificații NVIDIA Vera CPU
NVIDIA’s pagina de produs Vera CPU descrie procesorul ca fiind construit pentru munca CPU din spatele AI-ului agentic și învățarea prin consolidare: execuție de cod, utilizarea instrumentelor, sandboxing, analiză, conducte de date și orchestrare dincolo de model. Conform NVIDIA, Vera dispune de 88 de nuclee personalizate Olympus, iar Multithreading-ul Spațial creează 176 de fire de execuție cu resurse de nucleu partiționate.
Lățimea de bandă a memoriei atinge până la 1.2 terabytes pe secundă pe LPDDR5X, cu o capacitate de memorie de până la 1.5 TB, conform declarațiilor NVIDIA. Un NVIDIA Scalable Coherency Fabric de a doua generație leagă toate cele 88 de nuclee, cache-ul, memoria, I/O și NVLink-C2C pe un singur die de calcul cu 3.4 TB/s de lățime de bandă bisecțională, iar NVLink-C2C furnizează până la 1.8 TB/s de lățime de bandă coerentă între procesoarele Vera și GPU-urile NVIDIA, potrivit companiei.
NVIDIA afirmă că Vera rulează sarcinile de compilare, analiză de cod și lanțul de instrumente Python ale buclei de raționament a unui agent cu până la 1,8 x mai repede decât procesoarele x86 de top și că subsistemul său de memorie LPDDR5X oferă de 2 x lățimea de bandă și de 3 x lățimea de bandă pe nucleu față de procesoarele x86 de top cu DDR5. Pagina de produs notează că aceste valori relative de performanță se bazează pe date măsurate, comparate cu cel mai recent procesor x86, și pot suferi modificări.
NVIDIA poziționează Vera atât ca CPU gazdă pentru sisteme accelerate, inclusiv platformele Vera Rubin NVL72 și HGX Vera Rubin NVL8, cât și ca CPU independent pentru AI agentic, învățare prin recompensă, procesare de date și analiză. Vera CPU Rack, construit pe NVIDIA MGX, poate găzdui până la 256 de procesoare Vera și rulează peste 22.5K de medii concurente, conform companiei. Vera Rubin NVL72 combină 72 de GPU-uri Rubin, 36 de procesoare Vera, SuperNIC-uri ConnectX-9 și DPU-uri BlueField-4 într-o singură platformă la scară de rack.












