Yapay zeka modelleri ve platformları

Ramp, Router.com Model Ağ Geçidini 2026’ya Kadar Ücretsiz Yönlendirme ile Açıyor

mm
Unite.AI sitesini Google'daki tercih ettiğiniz kaynaklara ekleyin

Ramp, yılda 200 milyar dolardan fazla satın alımı yöneten kurumsal harcama platformu, 19 Ağustos 2026: tarihinde Router.com’u başlattı; bu, her AI isteğini geliştiricinin kalite standardını karşılayan en düşük maliyetli modele yönlendiren tek bir API uç noktasını sunar. Hizmeti hâlihazırda kullanan müşterilerin ortalama %40 oranında çıkarım maliyetini azalttığı, şirketin duyurusuna göre belirtilmiştir. Yönlendirme 2026’ya kadar ücretsizdir; kullanıcılar tükettikleri tokenlar için liste fiyatını öder ve yeni kullanıcılara 26$ kredi verilir.

Ürün, Ramp’ın üç yıl önce kendi içinde geliştirdiği aracın genel yayın sürümüdür. Her iç işi doğru modele eşleştirerek, şirket aynı çıktıyı elde ederken kendi çıkarım maliyetini yaklaşık %30 azalttığını ve üretim trafiğinde %99,9+ güvenilirliği koruduğunu belirtiyor. Router sitesi, mevcut üretim hacmini aylık 2,75 trilyondan fazla yönlendirilen token olarak gösteriyor.

“AI, çoğu şirkette en hızlı büyüyen kalem ve en az ölçülebilen kalem,” dedi Ramp’ın teknoloji sorumlusu Rahul Sengottuvelu duyuruda. “Router, tüm tokenları tek bir yerde toplar ve her isteği doğru performansı doğru maliyetle sunan modele yönlendirir.”

Zamanlama, Ramp’ın kendi verileriyle örtüşüyor. Platformun müşteri tabanındaki işletme AI harcamalarını izleyen Ramp AI Index, AI harcamalarının Haziran 2025’ten itibaren 20,7 kat arttığını duyuruda belirtiyor.

Tek Bir Uçnokta, 27 Model ve Sayıyor

Geliştiriciler, OpenAI ve Anthropic ile uyumlu tek bir API üzerinden bağlanarak OpenAI, Anthropic ve SpaceXAI’den modelleri erişebilir; Gemini desteği yakında eklenecek olarak listelenmiştir. Nvidia, Kimi, DeepSeek, GLM ve Qwen gibi açık ağırlıklı modeller, duyuruda belirtildiği üzere Fireworks AI gibi sağlayıcılar aracılığıyla sunulmakta, Google, AWS, Together AI, Baseten ve Crusoe ise yolda. Ramp’ın Router sayfasındaki model seçici şu anda Claude Opus 5 ve GPT-5.6 Sol’dan bütçe seviyesindeki GPT-5.4 Nano ve DeepSeek V4 Flash’e kadar 27 modeli kapsamaktadır. Grok’un eklenmesi, Grok 4.6’nın aynı gün Amazon Bedrock’ta genel kullanıma açılmasını sağlayan bir dağıtım hamlesini genişletiyor.

Yönlendirme motoru, model seçimi, önbellekleme, sıkıştırma, zamanlama ve istek işleme gibi alanlarda 100’den fazla optimizasyon uygular; bir sağlayıcı başarısız olduğunda otomatik geri dönüş sağlar. Ekipler, Ramp’ın varsayılan yönlendirme stratejisini kabul edebilir veya istek türüne göre kendi maliyet-performans önceliklerini yapılandırabilir. Tüm modeller, ABD merkezli altyapıda barındırılır ve sıfır veri saklama seçenekleri mevcuttur.

Üretim Çalışmalarından Oluşan Bir Benchmark

Dayanak unsuru, şirketin gerçek üretim mühendislik görevlerinden oluşturulan, halka açık sıralama tabloları yerine Ramp SWE-Bench adlı benchmark’tır. Router, yeni modelleri bu iş yüküne karşı sürekli test eder ve kazananları otomatik olarak varsayılanlarına ekler. Yayınlanan sonuçlar tablosu, yönlendiricinin kullandığı dağılımı gösterir: Claude Opus 5, görevleri ortalama $1,84 maliyetle çözerken Qwen3.7 Plus benzer bir çözüm oranını $0,15 ile elde eder ve GPT-5.4 Nano daha ucuz işleri $0,09’dan gerçekleştirir.

Bu tür isteğe dayalı arbitraj, model menüsü genişledikçe çıkarım ekonomisinin yöneldiği yerdir. Benchmark’lanmış hizmet maliyetleri, benzer çözüm oranları için modeller arasında bir mertebeden fazla farklılık gösterir; bu dağılım, Ramp’ın SWE-Bench tablosunda ve Runware’ın konteynerleştirilmiş veri merkezleri gibi daha ucuz çıkarım çözümlerinde görülür.

Müşterilerin Bildirdikleri ve Şartların Söyledikleri

Ürün sayfasında belirtilen erken kullanıcılar, %40 ortalamanın çok üzerindeki tasarrufları rapor ediyor. Delphi’den Valentin De Matos, şirketinin milyarlarca tokenı Router üzerinden çalıştırdığını ve model maliyetlerini %92 azalttığını belirtiyor. Anthropic’ın platform mühendisliği başkanı Katelyn Lesse, Claude’un birinci günden itibaren Router üzerinden kullanılabilir olduğunu, SpaceXAI ise Grok’un eklenmesinin ekiplerin modellerini uygulamalarına entegre etme yollarını genişlettiğini söyledi.

Detaylar: ücretsiz yönlendirme 2026’ya kadar devam eder; ardından Ramp duyuruda fiyatlandırma belirlememiştir. Router, model girdilerini, çıktıları ve meta verileri saklar ve hizmeti iyileştirmek için bu verileri kullanır; ancak kullanıcılar ayarlardan bunu kapatabilir ve sıfır veri saklama ile ABD’de barındırılan modelleri seçebilir. Hizmet, başlangıçta yalnızca ABD geliştiricileri ve ekipleriyle sınırlıdır; kurumsal özellikler ve daha fazla ülke yakında eklenecek olarak listelenmiştir. Ramp, bir Ramp kartı veya şirket hesabının gerekmediğini, mevcut entegrasyonu değiştirmek için OpenAI veya Anthropic SDK kullanıcılarının temel URL’yi tek satırda değiştirmeleri yeterli olduğunu belirtiyor.

Theo Nash yapay zeka altyapısı, hesaplamalar ve modern yapay zekayı güçlendirerek donanımsal sistemler konusunda uzmanlaşmış bir yapay zeka üreten uzman olarak Unite.AI'de çalışmaktadır. Çalışmaları, büyük ölçekli yapay zeka iş yüklerinin arkasındaki teknik temellere odaklanmaktadır, bunlar veri merkezleri, hızlandırıcılar, ağlar ve bunları birleştiren yazılım yığınlarını içermektedir.
Analitik ve mühendislik odaklı bir perspektifle, Theo, GPU'lar, özel silikon, bellek mimarileri ve dağıtılmış sistemlerdeki gelişmelerin yeni nesil yapay zeka modellerini nasıl mümkün kıldığını inceliyor. Performans ticaretinin, enerji verimliliğinin, ölçeklenebilirliğin ve yapay zeka altyapısının gerçek dünya dağıtımını şekillendiren pratik kısıtlara özel dikkat gösteriyor.
Theo Nash tarafından yazılan makaleler, teknik doğruluk, açıklık ve hızla gelişen yapay zeka hesaplaması manzarasının sorumlu bir şekilde kapsülendiğinden emin olmak için Unite.AI'nin editör ekibi tarafından incelenerek oluşturulmaktadır.