Modele și platforme AI
Ramp lansează Router.com Model Gateway cu rutare gratuită până în 2026

Ramp, platforma de cheltuieli corporative care susține peste 200 de miliarde de dolari în achiziții anual, a lansat Router.com pe 19 august 2026: un singur punct final API care trimite fiecare solicitare AI către modelul cu cel mai mic cost care îndeplinește standardul de calitate al dezvoltatorului. Clienții care utilizează deja serviciul au redus costurile de inferență cu în medie 40%, conform anunțului companiei. Rutarea este gratuită până în 2026, utilizatorii plătind prețul de listă pentru token‑urile consumate, iar noii utilizatori primesc 26 de dolari în credite.
Produsul este versiunea publică a instrumentelor pe care Ramp le‑a dezvoltat pentru sine în urmă cu trei ani. Prin potrivirea fiecărei sarcini interne cu modelul potrivit, compania afirmă că și‑a redus costurile de inferență cu aproximativ 30% pentru același rezultat, menținând o fiabilitate de peste 99,9% în traficul de producție. Site‑ul Router indică un volum de producție curent de peste 2,75 trilioane de token‑uri rutate lunar.
„Inteligența artificială este cea mai rapidă creștere a cheltuielilor la majoritatea companiilor și cea pe care o pot măsura cel mai puțin”, a declarat Rahul Sengottuvelu, directorul tehnic al Ramp, în anunț. „Router centralizează fiecare token și trimite fiecare solicitare către modelul care oferă performanța corectă la costul potrivit.”
Momentul coincid cu datele proprii ale Ramp. Indexul AI al Ramp, care monitorizează cheltuielile AI ale afacerilor în rândul clienților platformei, arată că cheltuielile pentru AI au crescut de 20,7 ori din iunie 2025, conform anunțului.
Un singur punct final, 27 de modele și în creștere
Dezvoltatorii se conectează printr-un singur API compatibil cu OpenAI și Anthropic și accesează modele de la OpenAI, Anthropic și SpaceXAI, cu suport pentru Gemini listat ca în curând. Modelele cu greutate deschisă, inclusiv Nvidia, Kimi, DeepSeek, GLM și Qwen, sunt furnizate prin furnizori precum Fireworks AI, iar Google, AWS, Together AI, Baseten și Crusoe urmează să fie adăugați, conform anunțului. Selectorul de modele de pe pagina Router a Ramp cuprinde în prezent 27 de modele, de la Claude Opus 5 și GPT‑5.6 Sol până la niveluri bugetare precum GPT‑5.4 Nano și DeepSeek V4 Flash. Incluziunea lui Grok extinde o mișcare de distribuție care a făcut ca Grok 4.6 să devină disponibil general pe Amazon Bedrock în aceeași zi.
Motorul de rutare aplică peste 100 de optimizări în selecția modelelor, caching, comprimare, sincronizare și gestionarea solicitărilor, cu revenire automată la o alternativă atunci când un furnizor eșuează. Echipele pot accepta strategia de rutare implicită a Ramp sau pot configura propriile priorități de cost‑performanță pentru fiecare tip de solicitare. Toate modelele sunt găzduite pe infrastructură din Statele Unite, cu opțiuni de retenție zero a datelor disponibile.
Un benchmark construit din munca de producție
Componenta esențială este Ramp SWE‑Bench, un benchmark construit pe baza sarcinilor reale de inginerie de producție ale companiei, nu pe clasamente publice. Router testează continuu modele noi împotriva acelei încărcări și integrează automat câștigătorii în setările implicite. Tabelul cu rezultate publicat arată distribuția exploatată de router: Claude Opus 5 rezolvă sarcini la un cost mediu de 1,84 $ pe rulare, în timp ce Qwen 3.7 Plus atinge un nivel comparabil la 0,15 $, iar GPT‑5.4 Nano gestionează lucrări mai ieftine la 0,09 $.
Acest tip de arbitraj per solicitare este direcția în care economia inferenței se îndreaptă pe măsură ce meniul de modele se lărgește. Costurile de servire evaluate variază acum cu mai mult de o ordine de mărime între modele pentru rate de rezolvare comparabile, o diferență reflectată în tabelul SWE‑Bench al Ramp și în soluții de inferență mai ieftine, cum ar fi centrele de date containerizate ale Runware.
Ce raportează clienții și ce spun condițiile
Utilizatorii timpurii menționați pe pagina produsului raportează economii mult peste media de 40 %. Valentin De Matos de la Delphi spune că compania sa procesează miliarde de token‑uri prin Router și a redus costurile modelelor cu 92 %. Șefa ingineriei de platformă la Anthropic, Katelyn Lesse, a declarat că Claude este disponibil prin Router din prima zi, iar SpaceXAI a afirmat că includerea lui Grok extinde modul în care echipele își pot integra modelele în aplicații.
Mici detalii: rutarea gratuită este valabilă până în 2026, după care Ramp nu a stabilit încă prețurile în anunț. Router stochează intrările, ieșirile și metadatele modelelor și folosește aceste date pentru a îmbunătăți serviciul, deși utilizatorii pot dezactiva această funcție în setări și pot selecta modele găzduite în SUA fără retenție de date. Serviciul este limitat la dezvoltatori și echipe din Statele Unite la lansare, cu funcționalități enterprise și alte țări listate ca în curând. Ramp afirmă că nu este necesar niciun card Ramp sau cont de companie, iar schimbarea unei integrări existente se realizează printr-o modificare pe o singură linie a URL‑ului de bază pentru utilizatorii SDK OpenAI sau Anthropic.












