Модели и платформы ИИ

Microsoft открывает 26 открытых моделей для стартапов через Fireworks AI на Foundry

mm
Добавьте Unite.AI в избранные источники в Google

Microsoft (MSFT ) продвигает свое новое интеграционное решение Fireworks AI для стартапов, публикуя деплойный план 4 августа 2026 года, который включает в себя эталонную архитектуру для запуска открытых моделей на Microsoft Foundry и льготную систему оплаты: участники программы Microsoft для стартапов могут использовать свои кредиты Azure для развертывания моделей Fireworks, и программа предлагает до 150 000 долларов в качестве кредитов.

Интеграция Fireworks сама по себе достигла общедоступности, размещая открытые модели от DeepSeek, Moonshot AI, Z.ai, MiniMax, Qwen, Google и OpenAI’s open-weight gpt-oss линии внутри каталога моделей Azure с управлением и оплатой на стороне Azure. Fireworks AI, провайдер вывода, обслуживающий модели за каталогом, обрабатывает вывод; Foundry поставляет контрольную плоскость. Этот план является попыткой Microsoft сделать эту комбинацию стартовой структурой для AI-ориентированных компаний, строящихся на Azure.

Что построено стартапами по плану Fireworks

Эталонная архитектура работает полностью внутри подписки стартапа на Azure. Контейнерное приложение на Azure Container Apps вызывает конечную точку модели Fireworks, развернутую через Foundry, с Azure Container Registry, хранящим изображения, и Azure Key Vault, хранящим учетные данные. Оттуда план масштабируется поэтапно: маршрутизация трафика через Azure API Management для ограничения скорости, добавление Azure Cache для Redis для сокращения избыточных вызовов вывода и отслеживание задержки, скорости ошибок и потребления токенов в Azure Monitor.

Собственная формулировка документов заключается в том, что вывод является одним из крупнейших контролируемых затрат для AI-ориентированной компании, и архитектура разработана так, что команда начинает с одной серверной модели и добавляет компоненты только тогда, когда измеренный трафик требует их. Обнаружение модели, управление и оплата остаются в одной контрольной плоскости, поэтому стартап никогда не развертывает или управляет кластерами GPU самостоятельно.

26 моделей в каталоге, и оплата включает исключения

Каталог Foundry теперь включает 26 моделей, обслуживаемых Fireworks, включая Moonshot AI’s Kimi K2.5, DeepSeek V3.2, MiniMax M2.5, OpenAI’s gpt-oss-120b и DeepSeek V4 Pro, описываемый как флагман с 1,6 триллионами параметров. Шесть из них, включая Kimi K2.6 и Z.ai’s GLM-5.1, доступны на основе оплаты за токен серверного вычисления; остальные работают на основе зарезервированной пропускной способности, ценообразования Azure. Команды также могут импортировать пользовательские или тонко настроенные веса через рабочий процесс “принеси свои веса”, с поддержкой адаптера LoRA в общедоступной предварительной версии.

Условия кредитов стартапов включают реальный лимит: кредиты применяются только к использованию токенов Data Zone Standard, а зарезервированная пропускная способность исключена. Границы соответствия еще уже. Серверные развертывания ограничены шестью регионами Azure в США, и сервис находится вне обязательств Microsoft по границе данных EU, не имеет авторизации FedRAMP и не может обрабатывать данные платежных карт. Примечание Microsoft о прозрачности добавляет, что компания не оценивает безопасность или поведение моделей Fireworks и оставляет эту оценку клиенту.

Одна ближайшая дата: оплата за токен для GLM-5.1 и MiniMax M2.5 прекращается с 7 августа 2026 года, хотя обе модели остаются доступными на основе зарезервированной пропускной способности, и оплата за токен для четырех других моделей каталога уже прекращена.

Microsoft пополняет каталог Foundry уже несколько месяцев

План Fireworks является одним из шагов в более широком развитии каталога. Microsoft расширила соглашение Mistral в июле 2026 года, чтобы привлечь регулируемых покупателей, как сообщает Unite.AI, и уже перенесла часть своей собственной работы AI в офисе на поставщиков моделей для управления затратами, согласно предыдущим отчетам. Интеграция Fireworks расширяет эту многостороннюю позицию на открытые модели, с выводом, переданным на сторону специалиста, а не построенного внутри.

Для стартапов, взвешивающих свои варианты, сравнение, которое Microsoft сама публикует, является показательным: документы противопоставляют Fireworks на Foundry самому хостингу vLLM на флоте GPU, закрытым API и общим облачным сервисам AI и позиционируют его для компаний, чей AI является основным дифференциатором продукта. Веха общедоступности, условия кредитов и уведомления о прекращении, теперь появляющиеся в документах каталога, говорят одно и то же: это предложение для производства с условиями, и Microsoft хочет, чтобы следующая волна AI-ориентированных компаний прочитала их до того, как их архитектура станет жесткой.

Эйден Кросс - это стратег, сгенерированный ИИ, в Unite.AI, который занимается стратегией продукта ИИ, выполнением и практическими проблемами превращения экспериментальных моделей в масштабируемые, готовые к рынку продукты. Его работа фокусируется на том, как стартапы и команды предприятий переходят от прототипов и демонстраций к надежным системам, используемым реальными клиентами.
С прагматичной и детальной точки зрения, Эйден анализирует дорожные карты продукта, стратегии выхода на рынок, решения по платформам и организационные компромиссы, которые определяют, будут ли инициативы ИИ успешными или застрянут. Он уделяет особое внимание реалиям развертывания, принятию пользователей, ограничениям инфраструктуры и соответствию между техническими возможностями и бизнес-ценностью.
Статьи, написанные Эйденом Кроссом, сгенерированы ИИ и проверены редакционной командой Unite.AI, чтобы обеспечить ясность, точность и ответственное освещение того, как продукты ИИ создаются, доставляются и масштабируются в реальном мире.