Моделі та платформи ШІ

Ramp відкриває шлюз моделей Router.com з безкоштовною маршрутизацією до 2026 року

mm
Додайте Unite.AI до бажаних джерел у Google

Ramp, платформа корпоративних витрат, яка щорічно забезпечує понад $200 мільярдів покупок, запустила Router.com 19 серпня 2026: єдиний API‑кінцевий пункт, який надсилає кожен запит ШІ до найдешевшої моделі, що відповідає вимогам розробника щодо якості. Клієнти, які вже користуються сервісом, скоротили свої витрати на інференс у середньому на 40 % згідно оголошення компанії. Маршрутизація безкоштовна до 2026 р, користувачі сплачують список цін за спожиті токени, а нові користувачі отримують $26 у вигляді кредитів.

Продукт — це публічна версія інструменту, який Ramp створив для себе три роки тому. Підбираючи кожне внутрішнє завдання до відповідної моделі, компанія стверджує, що скоротила власні витрати на інференс приблизно на 30 % при тому ж вихідному результаті, зберігаючи надійність понад 99,9 % у виробничому трафіку. Сайт Router повідомляє, що поточний обсяг виробництва становить понад 2,75 трильйона токенів, маршрутизованих щомісяця.

«AI is the fastest-growing line item at most companies, and the one they can least measure», said Rahul Sengottuvelu, Ramp’s chief technology officer, in the announcement. «Router puts every token in one place and sends each request to the model that delivers the right performance at the right cost».

Таймінг відповідає власним даним Ramp. Ramp AI Index, який відстежує витрати компаній на ШІ серед клієнтів платформи, показує, що витрати на ШІ зросли у 20,7 рази з червня 2025 р, згідно оголошення.

One Endpoint, 27 Models and Counting

Розробники підключаються через один API, сумісний з OpenAI та Anthropic, і отримують доступ до моделей від OpenAI, Anthropic і SpaceXAI, при цьому підтримка Gemini зазначена як майбутня. Моделі з відкритою вагою, включаючи Nvidia, Kimi, DeepSeek, GLM та Qwen, надаються через провайдерів, таких як Fireworks AI, а Google, AWS, Together AI, Baseten і Crusoe вже в процесі підключення, згідно оголошення. Перемикач моделей на сторінці Router від Ramp наразі охоплює 27 моделей, від Claude Opus 5 та GPT‑5.6 Sol до бюджетних рівнів, таких як GPT‑5.4 Nano і DeepSeek V4 Flash. Додавання Grok розширює розповсюдження, завдяки чому Grok 4.6 став доступним у загальному доступі на Amazon Bedrock того ж дня.

Маршрутизуючий движок застосовує понад 100 оптимізацій у виборі моделей, кешуванні, стисненні, таймінгу та обробці запитів, з автоматичним переключенням у випадку збою провайдера. Команди можуть прийняти стандартну стратегію маршрутизації Ramp або налаштувати власні пріоритети співвідношення вартості та продуктивності для кожного типу запиту. Усі моделі розміщені на інфраструктурі в США, доступні варіанти без збереження даних.

A Benchmark Built From Production Work

Ключовим елементом є Ramp SWE-Bench, бенчмарк, створений на основі реальних виробничих інженерних завдань компанії, а не публічних рейтингів. Router безперервно тестує нові моделі проти цього навантаження і автоматично включає переможців у свої типові налаштування. Опублікована таблиця результатів показує розбіжність, яку використовується маршрутизатором: Claude Opus 5 виконує завдання за середньою вартістю $1.84 за запуск, тоді як Qwen3.7 Plus досягає подібної швидкості за $0.15, а GPT‑5.4 Nano виконує дешевшу роботу за $0.09.

Такий арбітраж на рівні окремих запитів — це напрямок, у якому розвиваються економічні аспекти інференсу, коли асортимент моделей розширюється. Вартість обслуговування, виміряна в бенчмарках, тепер варіюється більш ніж на один порядок величини між моделями при подібних швидкостях розв’язання, що відображено в таблиці SWE‑Bench від Ramp та в більш доступних рішеннях інференсу, таких як контейнеризовані дата‑центри Runware.

What Customers Report and What the Terms Say

Початкові користувачі, зазначені на сторінці продукту, повідомляють про заощадження значно вище середнього 40 %. Валентин Де Матос з Delphi стверджує, що його компанія обробляє мільярди токенів через Router і знизила витрати на моделі на 92 %. Керівник інженерії платформи в Anthropic, Кейтлін Лесс, зазначила, що Claude доступний через Router з першого дня, а SpaceXAI заявив, що включення Grok розширює можливості команд інтегрувати його моделі у свої додатки.

Дрібний шрифт: безкоштовна маршрутизація діє до 2026 р, після чого Ramp не визначив ціну у оголошенні. Router зберігає вхідні дані моделей, вихідні дані та метадані і використовує їх для поліпшення сервісу, хоча користувачі можуть вимкнути це в налаштуваннях і обрати моделі, розміщені в США, без збереження даних. Сервіс обмежений розробниками та командами в США на старті, а функції для підприємств і більше країн будуть додані найближчим часом. Ramp заявляє, що не потрібна карта Ramp або корпоративний акаунт, а перехід існуючої інтеграції здійснюється зміною базового URL в один рядок для користувачів SDK OpenAI або Anthropic.

Тео Неш - це спеціаліст з генерації штучного інтелекту в Unite.AI, який займається інфраструктурою штучного інтелекту, обчисленнями та апаратними системами, які живлять сучасний штучний інтелект. Його робота зосереджена на технічних засадах великомасштабних завдань штучного інтелекту, включаючи центри даних, прискорювачі, мережування та програмні стеки, які їх поєднують.
З аналітичною та інженерно-орієнтованою перспективою Тео вивчає, як вдосконалення графічних процесорів, спеціалізованої мікросхеми, архітектур пам'яті та розподілених систем дозволяють створювати нові покоління моделей штучного інтелекту. Він приділяє особливу увагу компромісам між продуктивністю, енергоефективністю, масштабованістю та практичними обмеженнями, які формують реальне розгортання інфраструктури штучного інтелекту.
Статті, написані Тео Нешем, генеруються штучним інтелектом і перевіряються редакційною командою Unite.AI для забезпечення технічної точності, ясності та відповідальної висвітлення швидко розвивається ландшафту обчислень штучного інтелекту.