Model dan platform AI
Ramp Membuka Gerbang Model Router.com dengan Routing Gratis hingga 2026

Ramp, platform pengeluaran perusahaan yang mendukung lebih dari $200 miliar pembelian setiap tahun, meluncurkan Router.com pada 19 Agustus 2026: satu titik akhir API yang mengirim setiap permintaan AI ke model berbiaya terendah yang memenuhi standar kualitas pengembang. Pelanggan yang sudah menggunakan layanan ini telah mengurangi biaya inferensi mereka rata‑rata 40%, menurut pengumuman perusahaan. Routing gratis hingga 2026, dengan pengguna membayar harga daftar untuk token yang mereka konsumsi dan pengguna baru menerima kredit $26.
Produk ini adalah versi publik dari alat yang Ramp kembangkan untuk dirinya sendiri tiga tahun lalu. Dengan mencocokkan setiap pekerjaan internal ke model yang tepat, perusahaan mengatakan bahwa ia mengurangi biaya inferensi internal sekitar 30% untuk output yang sama sambil mempertahankan keandalan lebih dari 99,9% pada lalu lintas produksi. The Router site mencatat volume produksi saat ini lebih dari 2,75 triliun token yang diarahkan setiap bulan.
“AI adalah pos pengeluaran yang tumbuh paling cepat di kebanyakan perusahaan, dan yang paling sulit diukur,” kata Rahul Sengottuvelu, chief technology officer Ramp, dalam pengumuman. “Router menempatkan setiap token di satu tempat dan mengirim setiap permintaan ke model yang memberikan kinerja yang tepat dengan biaya yang tepat.”
Waktu peluncurannya selaras dengan data Ramp sendiri. Ramp AI Index, yang melacak pengeluaran AI bisnis di seluruh basis pelanggan platform, menunjukkan bahwa pengeluaran AI telah tumbuh 20,7 kali sejak Juni 2025, menurut pengumuman.
Satu Titik Akhir, 27 Model dan Masih Bertambah
Pengembang terhubung melalui satu API yang kompatibel dengan OpenAI dan Anthropic serta dapat mengakses model dari OpenAI, Anthropic, dan SpaceXAI, dengan dukungan Gemini yang akan datang. Model open-weight termasuk Nvidia, Kimi, DeepSeek, GLM, dan Qwen disediakan melalui penyedia seperti Fireworks AI, dengan Google, AWS, Together AI, Baseten, dan Crusoe akan segera hadir, menurut pengumuman. Pemilih model di halaman Router Ramp saat ini mencakup 27 model, mulai dari Claude Opus 5 dan GPT-5.6 Sol hingga tier anggaran seperti GPT-5.4 Nano dan DeepSeek V4 Flash. Penambahan Grok memperluas dorongan distribusi yang membuat Grok 4.6 tersedia secara umum di Amazon Bedrock pada hari yang sama.
Mesin routing menerapkan lebih dari 100 optimasi pada pemilihan model, caching, kompresi, penjadwalan, dan penanganan permintaan, dengan fallback otomatis bila penyedia gagal. Tim dapat menerima strategi routing default Ramp atau mengonfigurasi prioritas biaya‑kinerja mereka sendiri per jenis permintaan. Semua model dihosting pada infrastruktur berbasis AS, dengan opsi tanpa retensi data tersedia.
Benchmark yang Dibangun dari Pekerjaan Produksi
Komponen utama adalah Ramp SWE-Bench, sebuah benchmark yang dibangun dari tugas rekayasa produksi nyata perusahaan, bukan dari papan peringkat publik. Router secara terus‑menerus menguji model baru terhadap beban kerja tersebut dan secara otomatis memasukkan pemenang ke dalam defaultnya. Tabel hasil yang dipublikasikan menunjukkan rentang yang dimanfaatkan router: Claude Opus 5 menyelesaikan tugas dengan biaya rata‑rata $1,84 per eksekusi, sementara Qwen3.7 Plus mencapai tingkat penyelesaian yang sebanding dengan $0,15, dan GPT-5.4 Nano menangani pekerjaan yang lebih murah dengan $0,09.
Arbitrase per‑permintaan seperti itu adalah arah ekonomi inferensi seiring menu model yang semakin luas. Biaya layanan yang di‑benchmark kini bervariasi lebih dari satu orde besaran antar model untuk tingkat penyelesaian yang sebanding, sebuah rentang yang tercermin dalam tabel SWE‑Bench Ramp serta dalam solusi inferensi murah seperti pusat data terkontainerisasi milik Runware.
Apa yang Dilaporkan Pelanggan dan Apa yang Tertulis dalam Ketentuan
Pengguna awal yang disebutkan di halaman produk melaporkan penghematan jauh di atas rata‑rata 40%. Valentin De Matos dari Delphi mengatakan perusahaannya memproses miliaran token melalui Router dan mengurangi biaya model sebesar 92%. Kepala rekayasa platform Anthropic, Katelyn Lesse, menyatakan bahwa Claude tersedia melalui Router sejak hari pertama, dan SpaceXAI mengatakan bahwa penambahan Grok memperluas cara tim dapat mengintegrasikan modelnya ke dalam aplikasi mereka.
Syarat dan ketentuan: routing gratis berlangsung hingga 2026, setelah itu Ramp belum menetapkan harga dalam pengumuman. Router menyimpan masukan, keluaran, dan metadata model serta menggunakan data tersebut untuk meningkatkan layanan, meskipun pengguna dapat menonaktifkannya di pengaturan dan memilih model yang dihosting di AS tanpa retensi data. Layanan ini terbatas pada pengembang dan tim AS pada peluncuran, dengan fitur perusahaan dan lebih banyak negara yang akan datang segera. Ramp menyatakan tidak diperlukan kartu Ramp atau akun perusahaan, dan mengganti integrasi yang ada cukup dengan mengubah satu baris base‑URL bagi pengguna SDK OpenAI atau Anthropic.












