AIモデルとプラットフォーム

マイクロソフト、Fireworks AIを通じて26のオープンモデルをスタートアップに公開

mm
Unite.AI を Google の優先ソースに追加

マイクロソフト (MSFT ) は、スタートアップ向けに新しく一般提供されたFireworks AI統合を推進しており、2026年8月4日にデプロイブループリントを公開しました。このブループリントは、Microsoft Foundryでオープンモデルを実行するためのリファレンスアーキテクチャと、請求の特典を提供します。Microsoft for Startupsプログラムのメンバーは、AzureクレジットをFireworksモデルデプロイに適用でき、プログラムは最大15万ドル相当のクレジットを提供しています。

Fireworks統合自体は一般提供に達しており、DeepSeek、Moonshot AI、Z.ai、MiniMax、Qwen、Google、OpenAIのオープンモデルをAzureのモデルカタログに追加し、Azure側のガバナンスと請求を行っています。Fireworks AIは、カタログの背後にあるモデルを提供するインフERENCEプロバイダーであり、Foundryはコントロールプレーンを提供します。このブループリントは、Azureを基盤とするAIネイティブ企業のデフォルトスタートアップスタックとして、この組み合わせを提供するマイクロソフトの試みです。

Fireworksブループリントがスタートアップに構築するもの

リファレンスアーキテクチャは、スタートアップ自身のAzureサブスクリプション内で完全に実行されます。Azure Container Apps上のコンテナ化アプリケーションは、Foundryを介してデプロイされたFireworksモデルエンドポイントを呼び出し、Azure Container Registryはイメージを保持し、Azure Key Vaultは資格情報を保存します。その後、ブループリントは段階的にスケールアップします。Azure API Managementを介してトラフィックをルーティングし、Azure Cache for Redisを追加して冗長なインフERENCE呼び出しを削減し、Azure Monitorで待ち時間、エラー率、トークン消費を追跡します。

ドキュメントの独自の枠組みは、インフERENCEがAIネイティブ企業にとって最大の制御可能なコストの一つであり、アーキテクチャは、チームが最初にサーバーレスモデルエンドポイントで開始し、測定されたトラフィックがそれらを必要とする場合にのみコンポーネントを追加するように設計されているということです。モデル検出、ガバナンス、請求は1つのコントロールプレーンに残り、スタートアップは独自のGPUクラスターを立ち上げたり管理したりすることはありません。

カタログに26のモデルがあり、請求には除外がある

Foundryカタログには現在、Moonshot AIのKimi K2.5、DeepSeek V3.2、MiniMax M2.5、OpenAIのgpt-oss-120b、および1.6兆パラメータのフラグシップであるDeepSeek V4 Proを含む、26のFireworks提供モデルがリストされています。6つ、Kimi K2.6やZ.aiのGLM-5.1を含むものは、トークン単位の請求で利用可能であり、残りはプロビジョニングされたスループット単位、Azureの予約容量価格で実行されます。チームはまた、LoRAアダプタサポートを含むBYOW(Bring Your Own Weights)ワークフローを介して、カスタムまたはファインチューンされた重みをインポートできます。

スタートアップクレジットの条件には実際の制限があります。クレジットは、トークン単位のData Zone Standard使用のみに適用され、プロビジョニングされたスループット単位は除外されます。コンプライアンスの境界はさらに狭いです。サーバーレスデプロイは、6つの米国Azureリージョンに限定され、このサービスはMicrosoftのEU Data Boundaryコミットメントの外側にあり、FedRAMPの認証を受けておらず、決済カードデータにアクセスできません。マイクロソフトの透明性に関する注意書きは、Fireworks提供モデルについての安全性または動作の評価は行わず、評価は顧客に任せていることを示しています。

近い将来の日付アイテム:GLM-5.1とMiniMax M2.5のトークン単位請求は、2026年8月7日から非推奨となりますが、両方のモデルはプロビジョニングされたスループットで利用可能であり、カタログの他の4つのモデルはすでにトークン単位の提供を非推奨としています。

マイクロソフトは数ヶ月間Foundryのカタログを充実させてきた

Fireworksブループリントは、カタログの構築の一部です。マイクロソフトは、2026年7月にMistralの取り決めを拡大して、規制された購入者を迎え入れるためにUnite.AIが報じたように、規制された購入者を迎え入れるためにMistralの取り決めを拡大しました。また、以前の報道によると、Office AIワークロードの一部をモデルプロバイダー間でコストを管理するためにシフトしています。Fireworks統合は、インフERENCEレイヤーを専門家にアウトソーシングすることにより、オープンモデルにこのマルチベンダーの姿勢を拡大します。

選択肢を検討しているスタートアップにとって、マイクロソフトが公開している比較は示唆的です。ドキュメントでは、Foundry上のFireworksを、GPUフリート上の自己ホスト型vLLM、フロンティアのクローズドソースAPI、および一般的なクラウドAIサービスと比較し、AIがコア製品の違いとなる会社向けに位置付けます。一般提供のマイルストーン、クレジットの適格性、およびカタログドキュメントに表示される非推奨通知はすべて同じことを示しています。つまり、これは付帯する条件を持つプロダクションオファリングであり、マイクロソフトは、次のAIネイティブ企業の波がアーキテクチャが固まる前にそれらを読むことを望んでいます。

エイデン・クロスは、Unite.AIのAI生成ストラテジストであり、AI製品戦略、実行、実験モデルをスケーラブルで市場向けの製品に変える実践的な課題について取り上げています。彼の仕事は、スタートアップとエンタープライズチームがプロトタイプとデモから信頼性の高いシステムに移行する方法に焦点を当てています。
実用主義的な観点と詳細に注目した視点から、エイデンは製品ロードマップ、市場戦略、プラットフォームの決定、組織のトレードオフを分析しています。これらは、AIイニシアチブが成功するか停滞するかを決定する要因です。彼は、特にデプロイの現実、ユーザーの採用、インフラストラクチャの制約、および技術的能力とビジネス価値の整合性に注意を払っています。
エイデン・クロスによって執筆された記事は、AIによって生成され、Unite.AIの編集チームによってレビューされています。記事は、AI製品がどのように構築され、出荷され、現実の世界でスケールされるかについて、明確性、正確性、責任ある報道を保証するためにです。