Моделі та платформи ШІ

Ramp відкриває шлюз моделей Router.com з безкоштовною маршрутизацією до 2026 року

mm
Додайте Unite.AI до бажаних джерел у Google

Ramp, платформа корпоративних витрат, яка щорічно забезпечує понад $200 мільярдів покупок, запустила Router.com 19 серпня 2026: єдиний API‑кінцевий пункт, який надсилає кожен запит ШІ до найдешевшої моделі, що відповідає вимогам розробника щодо якості. Клієнти, які вже користуються сервісом, скоротили свої витрати на інференс у середньому на 40 % згідно оголошення компанії. Маршрутизація безкоштовна до 2026 р, користувачі сплачують список цін за спожиті токени, а нові користувачі отримують $26 у вигляді кредитів.

Продукт — це публічна версія інструменту, який Ramp створив для себе три роки тому. Підбираючи кожне внутрішнє завдання до відповідної моделі, компанія стверджує, що скоротила власні витрати на інференс приблизно на 30 % при тому ж вихідному результаті, зберігаючи надійність понад 99,9 % у виробничому трафіку. Сайт Router повідомляє, що поточний обсяг виробництва становить понад 2,75 трильйона токенів, маршрутизованих щомісяця.

«AI is the fastest-growing line item at most companies, and the one they can least measure», said Rahul Sengottuvelu, Ramp’s chief technology officer, in the announcement. «Router puts every token in one place and sends each request to the model that delivers the right performance at the right cost».

Таймінг відповідає власним даним Ramp. Ramp AI Index, який відстежує витрати компаній на ШІ серед клієнтів платформи, показує, що витрати на ШІ зросли у 20,7 рази з червня 2025 р, згідно оголошення.

Одна точка доступу, 27 моделей — і список зростає

Розробники підключаються через один API, сумісний з OpenAI та Anthropic, і отримують доступ до моделей від OpenAI, Anthropic і SpaceXAI, при цьому підтримка Gemini зазначена як майбутня. Моделі з відкритою вагою, включаючи Nvidia (NVDA ), Kimi, DeepSeek, GLM та Qwen, надаються через провайдерів, таких як Fireworks AI, а Google, AWS, Together AI, Baseten і Crusoe вже в процесі підключення, згідно оголошення. Перемикач моделей на сторінці Router від Ramp наразі охоплює 27 моделей, від Claude Opus 5 та GPT‑5.6 Sol до бюджетних рівнів, таких як GPT‑5.4 Nano і DeepSeek V4 Flash. Додавання Grok розширює розповсюдження, завдяки чому Grok 4.6 став доступним у загальному доступі на Amazon Bedrock того ж дня.

Маршрутизуючий движок застосовує понад 100 оптимізацій у виборі моделей, кешуванні, стисненні, таймінгу та обробці запитів, з автоматичним переключенням у випадку збою провайдера. Команди можуть прийняти стандартну стратегію маршрутизації Ramp або налаштувати власні пріоритети співвідношення вартості та продуктивності для кожного типу запиту. Усі моделі розміщені на інфраструктурі в США, доступні варіанти без збереження даних.

Бенчмарк на основі реальних робочих завдань

Ключовим елементом є Ramp SWE-Bench, бенчмарк, створений на основі реальних виробничих інженерних завдань компанії, а не публічних рейтингів. Router безперервно тестує нові моделі проти цього навантаження і автоматично включає переможців у свої типові налаштування. Опублікована таблиця результатів показує розбіжність, яку використовується маршрутизатором: Claude Opus 5 виконує завдання за середньою вартістю $1.84 за запуск, тоді як Qwen3.7 Plus досягає подібної швидкості за $0.15, а GPT‑5.4 Nano виконує дешевшу роботу за $0.09.

Такий арбітраж на рівні окремих запитів — це напрямок, у якому розвиваються економічні аспекти інференсу, коли асортимент моделей розширюється. Вартість обслуговування, виміряна в бенчмарках, тепер варіюється більш ніж на один порядок величини між моделями при подібних швидкостях розв’язання, що відображено в таблиці SWE‑Bench від Ramp та в більш доступних рішеннях інференсу, таких як контейнеризовані дата‑центри Runware.

Що повідомляють клієнти та що зазначено в умовах

Початкові користувачі, зазначені на сторінці продукту, повідомляють про заощадження значно вище середнього 40 %. Валентин Де Матос з Delphi стверджує, що його компанія обробляє мільярди токенів через Router і знизила витрати на моделі на 92 %. Керівник інженерії платформи в Anthropic, Кейтлін Лесс, зазначила, що Claude доступний через Router з першого дня, а SpaceXAI заявив, що включення Grok розширює можливості команд інтегрувати його моделі у свої додатки.

Дрібний шрифт: безкоштовна маршрутизація діє до 2026 р, після чого Ramp не визначив ціну у оголошенні. Router зберігає вхідні дані моделей, вихідні дані та метадані і використовує їх для поліпшення сервісу, хоча користувачі можуть вимкнути це в налаштуваннях і обрати моделі, розміщені в США, без збереження даних. Сервіс обмежений розробниками та командами в США на старті, а функції для підприємств і більше країн будуть додані найближчим часом. Ramp заявляє, що не потрібна карта Ramp або корпоративний акаунт, а перехід існуючої інтеграції здійснюється зміною базового URL в один рядок для користувачів SDK OpenAI або Anthropic.

Theo Nash є спеціалістом, створеним за допомогою ШІ, у Unite.AI, який охоплює AI‑інфраструктуру, обчислення та апаратні системи, що живлять сучасний штучний інтелект. Його робота зосереджена на технічних основах великих AI‑навантажень, включаючи дата‑центри, акселератори, мережі та програмні стеки, що їх об’єднують.

З аналітичної та інженерно‑орієнтованої точки зору, Тео досліджує, як прогрес у GPU, спеціальному кремнії, архітектурах пам’яті та розподілених системах дозволяє створювати нові покоління AI‑моделей. Він особливу увагу приділяє компромісам продуктивності, енергоефективності, масштабованості та практичним обмеженням, які формують реальне впровадження AI‑інфраструктури.

Статті, написані Theo Nash, створені за допомогою ШІ та перевірені редакційною командою Unite.AI, щоб забезпечити технічну точність, зрозумілість та відповідальне висвітлення швидко розвиваючогося ландшафту AI‑обчислень.