Modelos y plataformas de IA
Microsoft abre 26 modelos abiertos a las startups a través de Fireworks AI en Foundry

Microsoft (MSFT ) está impulsando su nueva integración de Fireworks AI, que ahora está disponible de forma general, en el segmento de startups, publicando una guía de implementación el 4 de agosto de 2026 que combina una arquitectura de referencia para ejecutar modelos abiertos en Microsoft Foundry con un beneficio de facturación: los miembros del programa Microsoft for Startups pueden aplicar sus créditos de Azure a las implementaciones de modelos de Fireworks, y el programa anuncia hasta $150,000 en créditos.
La integración de Fireworks en sí ha alcanzado la disponibilidad general, lo que coloca los modelos de peso abierto de DeepSeek, Moonshot AI, Z.ai, MiniMax, Qwen, Google y la línea de gpt-oss de OpenAI dentro del catálogo de modelos de Azure con gobernanza y facturación de Azure. Fireworks AI, el proveedor de inferencia que sirve los modelos detrás del catálogo, maneja la inferencia; Foundry suministra el plano de control. La guía es la oferta de Microsoft para hacer que esa combinación sea la pila de inicio predeterminada para las empresas nativas de IA que se construyen en Azure.
Qué construyen las startups con la guía de Fireworks
La arquitectura de referencia se ejecuta completamente dentro de la suscripción de Azure de una startup. Una aplicación contenerizada en Azure Container Apps llama a un punto de conexión de modelo de Fireworks implementado a través de Foundry, con Azure Container Registry que mantiene las imágenes y Azure Key Vault que almacena las credenciales. Desde allí, la guía se escala en etapas: ruta del tráfico a través de Azure API Management para límites de velocidad, agregar Azure Cache para Redis para reducir las llamadas de inferencia redundantes y rastrear la latencia, la tasa de error y el consumo de tokens en Azure Monitor.
El marco de la documentación es que la inferencia es uno de los costos controlables más grandes para una empresa nativa de IA, y la arquitectura está diseñada para que un equipo comience con un solo punto de conexión de modelo sin servidor y agregue componentes solo cuando el tráfico medido lo exija. El descubrimiento de modelos, la gobernanza y la facturación permanecen en un solo plano de control, por lo que una startup nunca configura ni administra clusters de GPU por su cuenta.
26 modelos en el catálogo, y la facturación viene con excepciones
El catálogo de Foundry ahora enumera 26 modelos servidos por Fireworks, incluidos Kimi K2.5 de Moonshot AI, DeepSeek V3.2, MiniMax M2.5, gpt-oss-120b de OpenAI y un DeepSeek V4 Pro descrito como un modelo insignia de 1,6 billones de parámetros. Seis de ellos, incluidos Kimi K2.6 y GLM-5.1 de Z.ai, están disponibles en facturación por servidor sin servidor por token; el resto se ejecuta en unidades de rendimiento provisionadas, la tarifa de capacidad reservada de Azure. Los equipos también pueden importar pesos personalizados o afinados a través de un flujo de trabajo de “traiga sus propios pesos”, con soporte de adaptador LoRA en vista previa pública.
Los términos de crédito de la startup llevan un límite real: los créditos solo se aplican al uso de la Zona de datos estándar por token, y las unidades de rendimiento provisionadas están excluidas. Los límites de cumplimiento son aún más estrechos. Las implementaciones sin servidor están confinadas a seis regiones de Azure en EE. UU., y el servicio se encuentra fuera de los compromisos de la frontera de datos de la UE de Microsoft, no lleva autorización FedRAMP y no puede procesar datos de tarjetas de pago. La nota de transparencia de Microsoft agrega que no evalúa la seguridad ni el comportamiento de los modelos servidos por Fireworks y deja esa evaluación al cliente.
Un elemento fechado a corto plazo: la facturación por token para GLM-5.1 y MiniMax M2.5 está en desuso a partir del 7 de agosto de 2026, aunque ambos modelos siguen disponibles en unidades de rendimiento provisionadas, y las ofertas de facturación por token para cuatro modelos de catálogo más ya están en desuso.
Microsoft ha estado llenando el catálogo de Foundry durante meses
La guía de Fireworks es un movimiento en una construcción de catálogo más larga. Microsoft amplió su acuerdo con Mistral en julio de 2026 para atraer a compradores regulados, como informó Unite.AI, y ha estado cambiando algunos de sus propios flujos de trabajo de IA de Office a través de proveedores de modelos para administrar costos, según una cobertura anterior. La integración de Fireworks extiende esa postura de múltiples proveedores a modelos abiertos, con la capa de inferencia externalizada a un especialista en lugar de construida en casa.
Para las startups que sopesan sus opciones, la comparación que publica Microsoft es reveladora: la documentación compara Fireworks en Foundry con vLLM autohospedado en una flota de GPU, con API de frontera cerrada y con servicios de IA genéricos de la nube, y lo posiciona para las empresas cuyo producto principal es la IA. El hito de disponibilidad general, la elegibilidad de crédito y las notas de obsolescencia que ahora aparecen en la documentación del catálogo dicen lo mismo: esta es una oferta de producción con términos adjuntos, y Microsoft quiere que la próxima ola de empresas nativas de IA lea los términos antes de que su arquitectura se endurezca.












