AIモデルとプラットフォーム

Ramp、Router.comモデルゲートウェイを開設、2026年まで無料ルーティングを提供

mm
Unite.AI を Google の優先ソースに追加

Rampは、年間2000億ドル以上の購入を支える企業支出プラットフォームで、2026年8月19日にRouter.comを開始しました: 開発者の品質基準を満たす最も低コストのモデルに各AIリクエストを送る単一のAPIエンドポイントです。同サービスを既に利用している顧客は、平均で推論コストを40%削減したと、同社の発表で述べられています。ルーティングは2026年まで無料で、利用者は消費したトークンに対して定価を支払い、新規ユーザーには26ドルのクレジットが付与されます。

この製品は、Rampが3年前に社内向けに構築したツールの公開版です。各内部ジョブを適切なモデルにマッチさせることで、同社は同等の出力で自社の推論コストを約30%削減し、プロダクショントラフィックにおいて99.9%以上の信頼性を維持したと述べています。The Routerサイトによると、現在のプロダクションボリュームは月間2.75兆トークン以上です。

「AIは多くの企業で最も成長が速い費目であり、測定が最も難しい領域です」とRampの最高技術責任者Rahul Sengottuveluは発表で述べました。「Routerはすべてのトークンを一元管理し、各リクエストを適切な性能とコストを提供するモデルに送ります」

このタイミングはRamp自身のデータと一致しています。プラットフォームの顧客ベース全体のビジネスAI支出を追跡するRamp AI Indexによると、AI支出は2025年6月以降20.7倍に増加したと発表で示されています。

単一エンドポイント、27モデルと増加中

開発者はOpenAIおよびAnthropic互換の単一APIを通じて接続し、OpenAI、Anthropic、SpaceXAIのモデルにアクセスできます。Geminiのサポートは近日公開予定とされています。Nvidia、Kimi、DeepSeek、GLM、QwenなどのオープンウェイトモデルはFireworks AIなどのプロバイダーを通じて提供され、Google、AWS、Together AI、Baseten、Crusoeが順次加わる予定です。RampのRouterページのモデル選択ツールは現在27モデルをカバーしており、Claude Opus 5やGPT-5.6 Solから、GPT-5.4 NanoやDeepSeek V4 Flashといった低価格帯まで幅広く提供しています。Grokの追加により、Grok 4.6が同日Amazon Bedrockで一般提供されたという配布拡大が実現しました。

ルーティングエンジンは、モデル選択、キャッシュ、圧縮、タイミング、リクエスト処理の各面で100以上の最適化を適用し、プロバイダーが失敗した際には自動的にフェイルオーバーします。チームはRampのデフォルトルーティング戦略を採用するか、リクエストタイプごとに独自のコスト・パフォーマンス優先度を設定できます。すべてのモデルは米国内インフラ上でホストされており、データ保持ゼロオプションも利用可能です。

実運用から構築されたベンチマーク

中心となるのはRamp SWE-Benchで、これは公開リーダーボードではなく、同社の実際のプロダクションエンジニアリングタスクに基づいて構築されたベンチマークです。Routerは新モデルを継続的にこのワークロードでテストし、勝者を自動的にデフォルトに組み込みます。公開された結果表は、Routerが活用するコスト差を示しています: Claude Opus 5は1回あたり平均$1.84でタスクを解決し、Qwen3.7 Plusは$0.15で同等の解決率を達成、GPT-5.4 Nanoは$0.09でより安価な作業を処理します。

このようなリクエスト単位の裁定取引は、モデルラインナップが拡大する中で推論経済が向かう方向です。ベンチマークされた提供コストは、同等の解決率でもモデル間で1桁以上の差が生じており、この差はRampのSWE-Bench表や、Runwareのコンテナ化データセンターといった低コスト推論ソリューションにも反映されています。

顧客の報告と利用規約の内容

製品ページに掲載された初期ユーザーは、平均40%を大きく上回るコスト削減を報告しています。DelphiのValentin De Matosは、同社がRouterを通じて数十億トークンを処理し、モデルコストを92%削減したと述べています。Anthropicのプラットフォームエンジニアリング責任者Katelyn Lesseは、Claudeが初日からRouterで利用可能であると述べ、SpaceXAIはGrokの追加によりチームが自社アプリケーションにモデルを組み込む幅が広がったと語っています。

細部条件: 無料ルーティングは2026年まで提供され、その後の価格は発表時点で未定です。Routerはモデルの入力、出力、メタデータを保存し、サービス改善に利用しますが、設定でオフにでき、データ保持ゼロの米国内ホストモデルを選択できます。サービスは開始時に米国の開発者とチームに限定され、エンタープライズ機能や追加国は近日公開予定です。RampはRampカードや企業アカウントは不要で、既存の統合を切り替える場合はOpenAIまたはAnthropic SDKユーザーはベースURLを1行変更するだけで済むと述べています。

テオ・ナッシュは、Unite.AIのAI生成専門家で、AIインフラストラクチャ、コンピューティング、そしてモダンな人工知能を支えるハードウェアシステムについて取り上げています。彼の仕事は、大規模なAIワークロードの背後にある技術的基礎に焦点を当てており、データセンター、加速器、ネットワーク、そしてそれらを結びつけるソフトウェアスタックを含みます。
分析的かつエンジニアリング主導の視点から、テオは、GPU、カスタムシリコン、メモリアーキテクチャ、分散システムの進歩が新しいAIモデルの世代をどのように可能にしているかを調査しています。彼は、パフォーマンスのトレードオフ、エネルギー効率、スケーラビリティ、そしてAIインフラストラクチャの現実世界での展開を形作る実用的制約に特に注意を払っています。
テオ・ナッシュによって著作された記事は、AIによって生成され、Unite.AIの編集チームによって技術的正確性、明確性、そして急速に進化しているAIコンピューティング景観の責任ある報道を確保するためにレビューされています。