Modely a platformy AI
Ramp spouští Router.com Model Gateway s bezplatným směrováním až do roku 2026

Ramp, platforma pro firemní výdaje, která ročně zprostředkuje nákupy v hodnotě přes 200 miliard dolarů, spustila Router.com dne 19. srpna 2026: jediný API endpoint, který každou AI žádost směruje na nejlevnější model, který splňuje požadovanou úroveň kvality vývojáře. Zákazníci, kteří službu již používají, snížili své náklady na inferenci v průměru o 40 % podle oznámení společnosti. Směrování je zdarma až do roku 2026, uživatelé platí ceníkovou cenu za spotřebované tokeny a noví uživatelé dostanou 26 USD v kreditech.
Produkt je veřejnou verzí nástrojů, které Ramp vytvořil pro sebe před třemi lety. Díky přiřazování každé interní úlohy ke správnému modelu společnost uvádí, že snížila vlastní náklady na inferenci zhruba o 30 % při stejném výstupu a zároveň udržela spolehlivost nad 99,9 % v produkčním provozu. Stránka Router uvádí, že aktuální objem produkce přesahuje 2,75 biliardu tokenů směrovaných měsíčně.
„AI je nejrychleji rostoucí položkou výdajů ve většině firem a zároveň tou, kterou nejhůře měří,“ řekl Rahul Sengottuvelu, technický ředitel Rampu, v oznámení. „Router umístí každý token na jedno místo a pošle každou žádost do modelu, který poskytne správný výkon za správnou cenu.“
Časování odpovídá vlastním údajům Rampu. Index Ramp AI, který sleduje výdaje firem na AI napříč zákaznickou základnou platformy, ukazuje, že výdaje na AI vzrostly od června 2025 o 20,7‑násobek, uvádí oznámení.
Jeden endpoint, 27 modelů a stále přibývá
Vývojáři se připojují přes jedno API kompatibilní s OpenAI a Anthropic a mají přístup k modelům od OpenAI, Anthropic a SpaceXAI, přičemž podpora Gemini je uvedena jako připravovaná. Modely s otevřenou váhou, včetně Nvidia, Kimi, DeepSeek, GLM a Qwen, jsou poskytovány přes poskytovatele jako Fireworks AI, a podle oznámení se na scéně objeví Google, AWS, Together AI, Baseten a Crusoe. Výběr modelů na stránce Router společnosti Ramp aktuálně zahrnuje 27 modelů, od Claude Opus 5 a GPT‑5.6 Sol po cenově dostupné úrovně jako GPT‑5.4 Nano a DeepSeek V4 Flash. Zařazení modelu Grok rozšiřuje distribuční push, který umožnil, že Grok 4.6 dosáhl obecné dostupnosti na Amazon Bedrock ve stejný den.
Směrovací engine používá více než 100 optimalizací napříč výběrem modelu, cachováním, kompresí, časováním a zpracováním požadavků, s automatickým přepnutím na záložní řešení při selhání poskytovatele. Týmy mohou přijmout výchozí směrovací strategii Rampu nebo si nakonfigurovat vlastní priority poměru cena‑výkon podle typu požadavku. Všechny modely jsou hostovány na infrastruktuře se sídlem v USA, s možností volby modelů bez uchovávání dat.
Benchmark postavený na reálné produkční práci
Klíčovým prvkem je Ramp SWE‑Bench, benchmark vytvořený z reálných produkčních inženýrských úkolů společnosti místo veřejných žebříčků. Router neustále testuje nové modely proti tomuto pracovnímu zatížení a automaticky začleňuje vítěze do svých výchozích nastavení. Publikovaná tabulka výsledků ukazuje rozložení, které router využívá: Claude Opus 5 řeší úlohy za průměrnou cenu 1,84 USD za běh, zatímco Qwen3.7 Plus dosahuje srovnatelné úspěšnosti za 0,15 USD, a GPT‑5.4 Nano zvládá levnější práci za 0,09 USD.
Taková arbitráž na úrovni jednotlivých požadavků ukazuje směr ekonomiky inferencí, jak se rozšiřuje nabídka modelů. Náklady na poskytování služby podle benchmarku se nyní liší o více než řád velikosti napříč modely při srovnatelné úspěšnosti, což je patrné v tabulce SWE‑Bench od Ramp a v levnějších inferenčních řešeních, jako jsou kontejnerizovaná datová centra Runware.
Co zákazníci uvádějí a co říkají podmínky
Raní uživatelé uvedení na produktové stránce hlásí úspory výrazně nad 40 % průměru. Valentin De Matos z Delphi uvádí, že jeho společnost zpracovává miliardy tokenů přes Router a snížila náklady na modely o 92 %. Vedoucí platformového inženýrství v Anthropic, Katelyn Lesse, řekla, že Claude je k dispozici přes Router od prvního dne, a SpaceXAI uvedla, že zařazení modelu Grok rozšiřuje možnosti týmů integrovat jeho modely do svých aplikací.
Jemné písmo: bezplatné směrování běží až do roku 2026, poté Ramp v oznámení nezveřejnil cenu. Router ukládá vstupy, výstupy a metadata modelů a používá tato data ke zlepšení služby, ačkoliv uživatelé mohou tuto funkci vypnout v nastavení a vybrat modely hostované v USA s nulovým uchováváním dat. Služba je při spuštění omezena na vývojáře a týmy v USA, s enterprise funkcemi a dalšími zeměmi uvedenými jako připravované. Ramp uvádí, že není vyžadována žádná karta Ramp ani firemní účet a přepnutí existující integrace je jednorázová změna základní URL pro uživatele SDK OpenAI nebo Anthropic.












