Model dan platform AI
CoreWeave Akan Menjalankan NVIDIA Vera CPU Bare Metal pada Skala Rak

CoreWeave mengatakan pada 30 September 2026 bahwa mereka akan memperluas portofolio komputasi mereka dengan NVIDIA Vera CPU, yang mereka gambarkan sebagai CPU pertama yang dirancang untuk agen AI, dan akan menjalankan prosesor tersebut secara bare metal pada skala rak untuk beban kerja AI agen dan pembelajaran penguatan.
Berita tersebut dibagikan pada Fully Connected, konferensi cloud AI CoreWeave di San Francisco, yang menurut perusahaan mempertemukan lebih dari 4.500 pelanggan, mitra, pengembang, dan pemimpin AI. Fully Connected 2026 berlangsung dari 29 September hingga 1 Oktober 2026, di Moscone South, 747 Howard Street.
Pekerjaan CPU di Balik AI Agen
CoreWeave menggambarkan AI agen sebagai beroperasi melalui siklus berkelanjutan menjalankan, mengamati, mengkurasi, meningkatkan, dan mengevaluasi. Dalam siklus tersebut, GPU menangani pelatihan model dan penalaran, sementara CPU menjalankan pekerjaan di sekitar setiap langkah: sandbox terisolasi, lingkungan pembelajaran penguatan, pemanggilan alat, eksekusi kode, dan pipeline data.
CoreWeave menyebut permintaan untuk pipeline pra-pemrosesan data dan episode pelatihan pembelajaran penguatan bersifat bergejolak dan sulit diprediksi: satu langkah dalam siklus dapat membutuhkan ribuan lingkungan selama satu jam, kemudian hampir tidak ada hingga siklus berikutnya. Seiring beban kerja pasca-pelatihan dan AI agen meningkat, perusahaan mengatakan, pekerjaan yang intensif CPU semakin menentukan kecepatan siklus AI, dan infrastruktur membutuhkan baik kepadatan untuk permintaan tersebut maupun fleksibilitas untuk skalabilitas saat permintaan berubah.
Perusahaan menyatakan bahwa Vera CPU beroperasi dengan cara yang sama seperti seluruh armada mereka di CoreWeave: bare metal, di bawah platform, model konsumsi, dan ekonomi yang sama.
Penerapan Skala Rak dan CoreWeave Sandboxes
CoreWeave mengatakan satu ukuran kinerja kritis untuk AI agen adalah jumlah lingkungan agen terisolasi yang dapat dijalankan tim secara bersamaan, serta apakah kinerja per-sandbox tetap konsisten seiring peningkatan jumlah tersebut. Penerapan Vera pada skala rak mereka menampung 128 CPU dan 11.264 core dalam satu rak, dengan BlueField-4 DPU dan switching Ethernet Spectrum‑X yang menghubungkan node Vera; perusahaan menyatakan hal ini menyediakan kapasitas untuk lebih dari 11.000 lingkungan bersamaan.
CoreWeave mengatakan produk Sandboxes mereka menempatkan agen-agen ini dengan isolasi perangkat keras penuh, ditempatkan langsung di samping pekerjaan pelatihan yang mereka dukung. Dalam pengujian mereka, perusahaan melaporkan bahwa waktu startup sandbox agen pada NVIDIA Vera CPU lebih dari 3 kali lebih cepat dibandingkan pada CPU x86.
“Infrastruktur tujuan umum menjadi kendala bagi AI agen; Vera adalah CPU pertama yang secara eksplisit dirancang untuk mempercepatnya,” kata Chen Goldberg, wakil presiden eksekutif produk dan rekayasa di CoreWeave, dalam pengumuman perusahaan. Goldberg menyatakan bahwa platform CoreWeave secara native mendukung Vera melalui produk seperti CoreWeave Sandboxes, memungkinkan tim langsung membuat ribuan lingkungan terisolasi tanpa friksi operasional tambahan.
Ryan Shrout, presiden dan manajer umum di Signal65, mengatakan proporsi kerja CPU yang semakin meningkat dalam setiap siklus agen, dan proporsi tersebut akan terus naik seiring skala penyebaran pasca-pelatihan dan AI agen. Ia menyatakan bahwa platform di sekitarnya menentukan apakah tim dapat benar-benar memanfaatkan kapasitas tersebut, dan perbedaan operasional berasal dari menjalankan pekerjaan CPU secara bare metal bersamaan dengan armada pelatihan di bawah orkestrasi yang sudah ada.
CoreWeave meluncurkan CoreWeave Sandboxes pada 14 Mei 2026, sebagai lapisan eksekusi yang menyediakan lingkungan aman dan terisolasi di mana peneliti AI dan tim platform menjalankan pembelajaran penguatan, penggunaan alat agen, dan evaluasi model. Layanan ini tersedia pada infrastruktur CoreWeave milik pelanggan melalui CoreWeave Kubernetes Service atau sebagai runtime tanpa server melalui Weights & Biases, dengan SDK Python yang mencakup manajemen sesi, integrasi penyimpanan, dan alat pemantauan. CoreWeave menyatakan bahwa secara default setiap sandbox beroperasi dalam lingkungan virtual yang sepenuhnya terisolasi miliknya sendiri, sehingga kegagalan atau proses yang tidak terkendali di satu sandbox tidak dapat merembet ke sandbox lain.
CoreWeave juga menyoroti hasil benchmark MLPerf mereka dalam inferensi dan pelatihan serta posisinya sebagai satu-satunya cloud AI yang memperoleh peringkat Platinum tertinggi di SemiAnalysis ClusterMAX tiga kali berturut-turut.
Spesifikasi NVIDIA Vera CPU
halaman produk Vera CPU menjelaskan prosesor tersebut dibangun untuk pekerjaan CPU di balik AI agen dan pembelajaran penguatan: eksekusi kode, penggunaan alat, sandboxing, analitik, pipeline data, dan orkestrasi di luar model. Menurut NVIDIA, Vera memiliki 88 core Olympus khusus, dan Spatial Multithreading‑nya menciptakan 176 thread dengan sumber daya core yang dipartisi.
Bandwidth memori mencapai hingga 1,2 terabyte per detik pada LPDDR5X, dengan kapasitas memori hingga 1,5 TB, menurut NVIDIA. Fabrik Koherensi Skalabel generasi kedua NVIDIA menghubungkan semua 88 core, cache, memori, IO, dan NVLink‑C2C melalui satu die komputasi dengan bandwidth bisektual 3,4 TB/detik, dan NVLink‑C2C menyediakan hingga 1,8 TB/detik bandwidth koheren antara CPU Vera dan GPU NVIDIA, menurut perusahaan.
NVIDIA mengatakan Vera menjalankan beban kerja kompilasi, analisis kode, dan rantai alat Python dari loop penalaran agen hingga 1.8x lebih cepat dibandingkan CPU x86 terkemuka, dan bahwa subsistem memori LPDDR5X‑nya memberikan bandwidth 2x dan bandwidth per core 3x dibandingkan CPU x86 terkemuka dengan DDR5. Halaman produk mencatat bahwa angka kinerja relatif tersebut didasarkan pada data terukur, dibasiskan pada CPU x86 generasi terbaru, dan dapat berubah.
NVIDIA menempatkan Vera baik sebagai CPU host untuk sistem yang dipercepat, termasuk platform Vera Rubin NVL72 dan HGX Vera Rubin NVL8, maupun sebagai CPU mandiri untuk AI agen, pembelajaran penguatan, pemrosesan data, dan analitik. Vera CPU Rack, yang dibangun di atas NVIDIA MGX, dapat menampung hingga 256 CPU Vera dan menjalankan lebih dari 22.5K lingkungan bersamaan, menurut perusahaan. Vera Rubin NVL72 menggabungkan 72 GPU Rubin, 36 CPU Vera, ConnectX-9 SuperNICs, dan BlueField-4 DPUs dalam satu platform skala rak.












