Ortaklıklar
Crusoe, Perplexity Eğitim ve Çıkarımını Güçlendirmek İçin Çok Yıllı Anlaşma İmzalıyor

Crusoe, 15 Eylül 2026’da Perplexity ile çok yıllı bir ortaklık duyurdu ve bu kapsamda Perplexity, tam model yaşam döngüsünü Crusoe Cloud üzerinde çalıştıracak, sınır modellerini özel NVIDIA GB300 NVL72 kümelerinde eğitecek ve üretimde Crusoe’nun Yönetilen Çıkarım hizmeti aracılığıyla sunacak.
San Francisco tarihli duyuru, ayrıca Crusoe’nun 1.800 çalışanı için Perplexity Enterprise Pro ve Max’i benimsemesini de taahhüt ediyor. Basına göre, bu dağıtım personeli web ve iç bilgi araması, çok adımlı araştırma, veri analizi ve sınır AI modellerine erişimle donatmayı amaçlıyor.
Basıntı, Perplexity ürünlerini milyonlarca kullanıcı için gerçek zamanlı çalışıyor olarak tanımlıyor; bu ortamda çıkarım gecikmesi ve verimlilik, teorik ölçütlerden ziyade ürünün kendisidir. Crusoe, Yönetilen Çıkarım hizmetinin, özel optimizasyonlarla desteklenen ve popüler modellerde performans ve maliyet için tasarlanmış üretim düzeyinde çıkarım için inşa edildiğini ve Crusoe Cloud’un, Perplexity’nin büyümesine uyum sağlayacak operasyonel derinlik ve ölçek sunduğunu belirtti.
Yönetici Açıklamaları
Crusoe’nun kurucu ortağı ve CEO’su Chase Lochmiller, en hızlı hareket eden AI şirketlerinin tüm model yaşam döngüsü boyunca tempo tutan ve büyüdükçe ölçeklenen bir altyapıya ihtiyaç duyduğunu söyledi. “Perplexity, insanların cevap bulma şeklinin geleceğini inşa ediyor ve Crusoe, bunu mümkün kılan ana ortak; ilk elektrondan son tokena kadar,” dedi Lochmiller.
Perplexity’nin kurucu ortağı ve CEO’su Aravind Srinivas, Perplexity ölçeğinde AI çalıştırmanın, gecikmenin her milisaniyesinin kullanıcılar tarafından hissedildiği anlamına geldiğini söyledi. Crusoe’yi bu sınıra göre inşa edildiğini tanımlayarak, yüksek verimli, düşük gecikmeli çıkarım ve bir sonraki nesil donanım tarafından desteklendiğini belirtti.
NVIDIA’da HPC ve AI Altyapı Çözümleri kıdemli direktörü Dion Harris, modern AI’nın araştırmadan dağıtıma kadar birleşik bir bilgi işlem mimarisi gerektirdiğini söyledi. NVIDIA GB300 NVL72 ve NVIDIA InfiniBand ile güçlendirilmiş olarak, Harris, Crusoe Cloud’un Perplexity’nin sınır modellerini üretimde eğitmesini, ince ayar yapmasını ve sunmasını, ajan AI’nın talep ettiği hız ve verimlilikle mümkün kıldığını belirtti.
GB300 NVL72 Platformu
NVIDIA tarafından tam sıvı soğutmalı, raf ölçeğinde bir sistem olarak tanımlanan ve 72 Blackwell Ultra GPU ile 36 Arm tabanlı Grace CPU’yu entegre eden NVIDIA GB300 NVL72 üzerinde, anlaşmada adı geçen özel eğitim kümeleri çalışıyor. NVIDIA’nın yayınladığı teknik özelliklerde 130 TB/s NVLink bant genişliği, 20 TB GPU belleği ve 576 TB/s’ye kadar bant genişliği, 37 TB hızlı bellek ve 2.592 Arm Neoverse V2 CPU çekirdeği yer alıyor. Sistemdeki her GPU, ConnectX-8 SuperNIC IO modülü aracılığıyla 800 Gb/s ağ bağlantısı alıyor ve Quantum-X800 InfiniBand ya da Spectrum-X Ethernet ağ platformlarıyla çalışıyor.
NVIDIA, GB300 NVL72 üzerine kurulan AI fabrikalarının Hopper tabanlı platformlarla karşılaştırıldığında AI fabrikası çıktı performansında toplamda 50 katına kadar artış sağladığını iddia ediyor. Şirket bu rakamı, kullanıcı başına saniye başına token ölçüsüyle ölçülen kullanıcı yanıt süresinde 10 kat, megawatt başına verimlilikte Hopper’a göre 5 kat iyileşme olarak açıklıyor ve bu sayıların değişebilecek tahmini performans olduğunu belirtiyor.
Yönetilen Çıkarım Hizmeti ve Geçmiş
Anlaşmanın üretim hizmeti bölümü, Crusoe Yönetilen Çıkarım üzerinde çalışıyor; şirket bu hizmeti 20 Kasım 2025’te genel kullanıma sundu, Crusoe Cloud üzerindeki üretim çıkarım iş yükleri için. Hizmet, Crusoe’nun MemoryAlloy etrafında inşa edilen özel çıkarım motoru tarafından destekleniyor; bu motor, GPU’ların yerel ve uzak düğümlerden önek önbelleklerini almasına izin vererek yinelenen ön doldurmaları ortadan kaldıran küme çapında bir anahtar-değer önbelleğidir. Crusoe, motorun ilk tokena ulaşma süresini 9,9 kat daha hızlı ve verimliliği 5 kat daha yüksek sağladığını, Llama-3.3-70B modeli için dört düğümlü bir dağıtımda vLLM’ye karşı benchmarklandığını belirtiyor.
Crusoe, hizmeti Yönetilen Çıkarım ürün sayfasına göre üç dağıtım seçeneğiyle sunuyor. Sunucusuz Çıkarım, tamamen yönetilen bir API aracılığıyla açık modellerin kullanım bazlı tüketimini sunar; erken aşama iş yükleri, düşük hacimli trafik ve hızlı deneme amaçlıdır. Sayfanın artık genel kullanıma sunulduğunu belirttiği Kendin-Yöneten Dağıtımlar, verimlilik veya yanıt süresi için optimize edilmiş modelleri çalıştırır; bunlar arasında Crusoe’nun Sunucusuz İnce Ayarıyla özelleştirilmiş modeller de bulunur. Özelleştirilmiş Dağıtımlar, müşterileri Crusoe ekibiyle eşleştirerek özel, benchmarklanmış bir uç nokta sağlar; bu seçenek sayfada tescilli modellere yönlendirilmiştir.
Geliştiriciler, API anahtarları oluşturabilecekleri, her modele göre ayarlanmış yönetilen uç noktaları kullanabilecekleri, performans metriklerini izleyebilecekleri ve üretim ölçeğinde dağıtımlar için tahsis edilmiş verimliliği etkinleştirebilecekleri bir merkez olan Crusoe Intelligence Foundry aracılığıyla hizmete erişir. Crusoe’nun model merkezi, DeepSeek, Google, Z.ai, OpenAI, Meta, Alibaba ve NVIDIA gibi laboratuvarlardan önceden yapılandırılmış açık modelleri listeler; her model için belirtilen parametre sayısı ve bağlam uzunlukları da yer alır.












