AI-modellen en platforms
Ramp lanceert Router.com Modelgateway met gratis routering tot 2026

Ramp, het platform voor bedrijfsuitgaven dat jaarlijks meer dan $200 miljard aan aankopen mogelijk maakt, lanceerde Router.com op 19 augustus 2026: een enkele API‑endpoint die elke AI‑verzoek naar het goedkoopste model stuurt dat voldoet aan de kwaliteitsnorm van de ontwikkelaar. Klanten die de dienst al gebruiken, hebben hun inferentiekosten gemiddeld met 40 % verlaagd, volgens de aankondiging van het bedrijf. Routering is gratis tot 2026, waarbij gebruikers de catalogusprijs betalen voor de verbruikte tokens en nieuwe gebruikers $26 aan credits ontvangen.
Het product is de publieke versie van de tooling die Ramp drie jaar geleden voor zichzelf heeft ontwikkeld. Door elke interne taak aan het juiste model te koppelen, zegt het bedrijf dat het zijn eigen inferentiekosten ongeveer 30 % heeft verlaagd voor dezelfde output, terwijl het een betrouwbaarheid van meer dan 99,9 % behoudt bij productie‑verkeer. De Router‑site meldt een huidig productievolume van meer dan 2,75 triljoen tokens per maand.
“AI is het snelst groeiende kostenpostje bij de meeste bedrijven, en degene die ze het minst kunnen meten,” zei Rahul Sengottuvelu, CTO van Ramp, in de aankondiging. “Router plaatst elke token op één plek en stuurt elk verzoek naar het model dat de juiste prestaties levert tegen de juiste kosten.”
De timing volgt Ramp’s eigen gegevens. De Ramp AI Index, die de AI‑uitgaven van bedrijven over de klantenbasis van het platform bijhoudt, toont aan dat de AI‑uitgaven sinds juni 2025 met een factor 20,7 zijn gegroeid, aldus de aankondiging.
Één endpoint, 27 modellen en groeiend
Ontwikkelaars verbinden via één API die compatibel is met zowel OpenAI als Anthropic en krijgen toegang tot modellen van OpenAI, Anthropic en SpaceXAI, waarbij Gemini-ondersteuning binnenkort beschikbaar komt. Open‑weight‑modellen zoals Nvidia, Kimi, DeepSeek, GLM en Qwen worden aangeboden via providers als Fireworks AI, met Google, AWS, Together AI, Baseten en Crusoe in de pijplijn, volgens de aankondiging. De modelkiezer op Ramp’s Router page omvat momenteel 27 modellen, van Claude Opus 5 en GPT‑5.6 Sol tot budgetvarianten zoals GPT‑5.4 Nano en DeepSeek V4 Flash. De opname van Grok breidt een distributie‑push uit die ervoor zorgde dat Grok 4.6 dezelfde dag algemene beschikbaarheid kreeg op Amazon Bedrock.
De routeringsengine past meer dan 100 optimalisaties toe op modelselectie, caching, compressie, timing en request‑afhandeling, met automatische fallback wanneer een provider faalt. Teams kunnen Ramp’s standaard routeringsstrategie accepteren of hun eigen kosten‑prestatiedoelstellingen per verzoektype configureren. Alle modellen worden gehost op infrastructuur in de VS, met opties voor nul‑data‑retentie beschikbaar.
Een benchmark gebouwd op basis van productie‑werk
Het dragende onderdeel is Ramp SWE‑Bench, een benchmark die is opgebouwd uit de echte productie‑engineeringtaken van het bedrijf in plaats van uit openbare ranglijsten. Router test continu nieuwe modellen tegen die workload en integreert winnaars automatisch in de standaardinstellingen. De gepubliceerde resultaatstabel toont de spreiding die de router benut: Claude Opus 5 lost taken op tegen een gemiddelde kostprijs van $1,84 per run, terwijl Qwen 3.7 Plus een vergelijkbare oplossingsratio bereikt tegen $0,15, en GPT‑5.4 Nano verwerkt goedkopere taken tegen $0,09.
Dit soort per‑request arbitrage is de richting waarin de inferentie‑economie zich ontwikkelt naarmate het modelmenu groter wordt. De geteste servicerkosten variëren nu over meer dan een orde van grootte tussen modellen voor vergelijkbare oplossingsratio’s, een spreiding die zichtbaar is in Ramp’s SWE‑Bench‑tabel en in goedkopere inferentie‑oplossingen zoals de container‑datacenters van Runware.
Wat klanten melden en wat de voorwaarden zeggen
Vroege gebruikers die op de productpagina worden genoemd, rapporteren besparingen ver boven het gemiddelde van 40 %. Valentin De Matos van Delphi zegt dat zijn bedrijf miljarden tokens via Router verwerkt en de modelkosten met 92 % heeft verlaagd. Katelyn Lesse, hoofd platform‑engineering bij Anthropic, verklaarde dat Claude vanaf dag één via Router beschikbaar is, en SpaceXAI meldde dat de opname van Grok de mogelijkheden voor teams vergroot om haar modellen in hun toepassingen te integreren.
De kleine lettertjes: gratis routering loopt tot 2026, waarna Ramp in de aankondiging geen prijs heeft vastgesteld. Router slaat model‑invoer, -uitvoer en metadata op en gebruikt die gegevens om de dienst te verbeteren, hoewel gebruikers dit in de instellingen kunnen uitschakelen en kunnen kiezen voor in de VS gehoste modellen met nul dataretentie. De dienst is bij de lancering beperkt tot ontwikkelaars en teams in de VS, met enterprise‑functies en meer landen die binnenkort beschikbaar komen. Ramp stelt dat geen Ramp‑kaart of bedrijfsaccount vereist is, en het overschakelen van een bestaande integratie is een één‑regelige wijziging van de basis‑URL voor OpenAI‑ of Anthropic‑SDK‑gebruikers.












