Модели и платформы ИИ

Ramp открывает Router.com Model Gateway с бесплатной маршрутизацией до 2026 года

mm
Добавьте Unite.AI в избранные источники в Google

Ramp, платформа корпоративных расходов, обеспечивающая более $200 млрд покупок ежегодно, запустила Router.com 19 августа 2026: единый API‑конечный пункт, который направляет каждый запрос к ИИ к модели с наименьшей стоимостью, удовлетворяющей требованиям качества разработчика. По анонсу компании клиенты, уже использующие сервис, в среднем сократили расходы на инференс на 40 %. Маршрутизация бесплатна до 2026 года, при этом пользователи платят по прайс‑листу за потреблённые токены, а новые пользователи получают $26 в виде кредитов.

Продукт представляет собой публичную версию инструментария, который Ramp разработала для себя три года назад. Сопоставляя каждую внутреннюю задачу с подходящей моделью, компания заявляет, что сократила собственные расходы на инференс примерно на 30 % при том же результате, сохраняя надёжность выше 99,9 % в производственном трафике. Сайт Router указывает текущий объём производства более 2,75 трлн токенов, маршрутизируемых ежемесячно.

«AI – самая быстрорастущая статья расходов в большинстве компаний, и та, которую сложнее всего измерить», – сказал Рахул Сэнготтувелю, технический директор Ramp, в анонсе. «Router собирает каждый токен в одном месте и отправляет каждый запрос к модели, которая обеспечивает нужную производительность при оптимальной стоимости».

Тайминг согласуется с данными Ramp. Индекс AI Ramp, отслеживающий расходы компаний на ИИ по базе клиентов платформы, показывает, что расходы на ИИ выросли в 20,7 раз с июня 2025, согласно заявлению.

One Endpoint, 27 Models and Counting

Разработчики подключаются через один совместимый с OpenAI и Anthropic API и получают доступ к моделям от OpenAI, Anthropic и SpaceXAI, при этом поддержка Gemini объявлена в ближайшее время. Модели с открытыми весами, включая Nvidia, Kimi, DeepSeek, GLM и Qwen, обслуживаются провайдерами, такими как Fireworks AI, а Google, AWS, Together AI, Baseten и Crusoe находятся в пути, согласно анонсу. Выбор модели на странице Router от Ramp в настоящее время охватывает 27 моделей, от Claude Opus 5 и GPT‑5.6 Sol до бюджетных вариантов, таких как GPT‑5.4 Nano и DeepSeek V4 Flash. Добавление Grok расширяет распределение, позволившее Grok 4.6 выйти в общедоступный режим на Amazon Bedrock в тот же день.

Маршрутизирующий движок применяет более 100 оптимизаций в выборе модели, кэшировании, сжатии, тайминге и обработке запросов, с автоматическим переключением при сбое провайдера. Команды могут принимать стратегию маршрутизации по умолчанию от Ramp или настраивать собственные приоритеты соотношения стоимости и производительности для каждого типа запроса. Все модели размещены на инфраструктуре в США, доступны варианты без сохранения данных.

A Benchmark Built From Production Work

Ключевой элемент – SWE‑Bench от Ramp, бенчмарк, построенный на реальных производственных инженерных задачах компании, а не на публичных лидербордах. Router постоянно тестирует новые модели против этой нагрузки и автоматически интегрирует победителей в свои настройки по умолчанию. Опубликованная таблица результатов показывает разброс, который использует роутер: Claude Opus 5 решает задачи в среднем за $1.84 за запуск, тогда как Qwen3.7 Plus достигает сопоставимого уровня решения за $0.15, а GPT‑5.4 Nano обрабатывает более дешёвую работу за $0.09.

Такой арбитраж на уровне отдельного запроса определяет направление экономики инференса по мере расширения меню моделей. Стоимость обслуживания, измеренная в бенчмарках, теперь различается более чем в один порядок величины между моделями при сопоставимых скоростях решения, что отражено в таблице SWE‑Bench от Ramp и в более дешёвых решениях инференса, таких как контейнерные дата‑центры Runware.

What Customers Report and What the Terms Say

Ранние пользователи, указанные на странице продукта, сообщают о экономии, значительно превышающей средний показатель в 40 %. Валентин Де Матос из Delphi заявляет, что его компания обрабатывает миллиарды токенов через Router и сократила затраты на модели на 92 %. Руководитель платформенной инженерии Anthropic, Кэйтлин Лесс, отметила, что Claude доступен через Router с первого дня, а SpaceXAI заявила, что включение Grok расширяет возможности команд интегрировать её модели в свои приложения.

Мелкий шрифт: бесплатная маршрутизация действует до 2026 года, после чего Ramp не указал цены в анонсе. Router сохраняет входные данные модели, её выводы и метаданные, используя их для улучшения сервиса, хотя пользователи могут отключить эту функцию в настройках и выбрать модели, размещённые в США, без сохранения данных. Сервис ограничен разработчиками и командами из США на этапе запуска, а функции для предприятий и поддержка дополнительных стран объявлены в ближайшем будущем. Ramp заявляет, что карта Ramp или корпоративный аккаунт не требуются, а переключение существующей интеграции сводится к однострочному изменению базового URL для пользователей SDK OpenAI или Anthropic.

Тео Нэш - специалист, сгенерированный ИИ, в Unite.AI, освещающий инфраструктуру ИИ, вычисления и аппаратные системы, которые обеспечивают современный искусственный интеллект. Его работа сосредоточена на технических основах, лежащих в основе крупномасштабных рабочих нагрузок ИИ, включая центры данных, ускорители, сетевое взаимодействие и программные стеки, которые их объединяют.
С аналитической и инженерно-ориентированной точки зрения, Тео исследует, как достижения в области GPU, специального кремния, архитектур памяти и распределенных систем позволяют создавать новые поколения моделей ИИ. Он уделяет особое внимание компромиссам между производительностью, энергоэффективностью, масштабируемостью и практическими ограничениями, которые формируют реальное развертывание инфраструктуры ИИ.
Статьи, написанные Тео Нэшем, сгенерированы ИИ и рассмотрены редакционной командой Unite.AI, чтобы обеспечить техническую точность, ясность и ответственное освещение быстро развивающегося ландшафта вычислений ИИ.