AI-modeller och plattformar
Microsoft Ãķppnar 26 Ãķppna modeller fÃķr start-ups genom Fireworks AI pÃĨ Foundry

Microsoft (MSFT ) driver pÃĨ sin nyss allmÃĪnt tillgÃĪngliga Fireworks AI-integration pÃĨ start-up-segmentet och publicerar en distributionsskiss den 4 augusti 2026 som parar en referensarkitektur fÃķr att kÃķra Ãķppna modeller pÃĨ Microsoft Foundry med en faktureringsfÃķrmÃĨn: medlemmar i Microsoft for Startups-programmet kan anvÃĪnda sina Azure-crediter fÃķr Fireworks-modelldistributioner, och programmet annonserar upp till 150 000 dollar i crediter.
Fireworks-integrationen i sig har nÃĨtt allmÃĪn tillgÃĪnglighet, vilket placerar Ãķppna modeller frÃĨn DeepSeek, Moonshot AI, Z.ai, MiniMax, Qwen, Google och OpenAI:s Ãķppna modell gpt-oss i Azures modellkatalog med Azure-sidan governance och fakturering. Fireworks AI, som tillhandahÃĨller inferens fÃķr modellerna bakom katalogen, hanterar inferens; Foundry tillhandahÃĨller kontrollplanet. Skissen ÃĪr Microsofts bud fÃķr att gÃķra den kombinationen till standardstartstacken fÃķr AI-nativa fÃķretag som bygger pÃĨ Azure.
Vad Fireworks-skissen har start-ups bygga
Referensarkitekturen kÃķrs helt inom en start-ups egen Azure-prenumeration. En containeriserad applikation pÃĨ Azure Container Apps anropar en Fireworks-modellslutpunkt som distribueras via Foundry, med Azure Container Registry som innehÃĨller bilder och Azure Key Vault som lagrar autentiseringsuppgifter. DÃĪrifrÃĨn skalar skissen i etapper: dirigera trafik via Azure API Management fÃķr ratelimits, lÃĪgg till Azure Cache fÃķr Redis fÃķr att minska onÃķdiga inferensanrop och spÃĨra fÃķrdrÃķjning, felrate och tokenkonsumtion i Azure Monitor.
Dokumentens egen ram ÃĪr att inferens ÃĪr en av de stÃķrsta kontrollerbara kostnaderna fÃķr ett AI-nativt fÃķretag, och arkitekturen ÃĪr utformad sÃĨ att ett team bÃķrjar med en enda serverless modellslutpunkt och lÃĪgger till komponenter endast nÃĪr mÃĪttrafik krÃĪver dem. ModellupptÃĪckt, governance och fakturering fÃķrblir i ett kontrollplan, sÃĨ en start-up behÃķver aldrig stÃĪlla upp eller hantera GPU-kluster pÃĨ egen hand.
26 modeller i katalogen, och faktureringen kommer med undantag
Foundry-katalogen listar nu 26 Fireworks-betjÃĪnade modeller, inklusive Moonshot AI:s Kimi K2.5, DeepSeek V3.2, MiniMax M2.5, OpenAI:s gpt-oss-120b och en DeepSeek V4 Pro som beskrivs som en 1,6-biljonerparametrarsflaggskepp. Sex av dem, inklusive Kimi K2.6 och Z.ai:s GLM-5.1, ÃĪr tillgÃĪngliga pÃĨ betala-per-token serverless fakturering; resten kÃķrs pÃĨ provisionerad genomsnittsenheter, Azures reserverad kapacitetsprissÃĪttning. Team kan ocksÃĨ importera anpassade eller finjusterade vikter via en bring-your-own-weights-arbetsflÃķde, med LoRA-adapterstÃķd i offentlig fÃķrhandsversion.
Start-up-kreditvillkoren har ett verkligt tak: krediter gÃĪller endast fÃķr betala-per-token Data Zone Standard-anvÃĪndning, och provisionerad genomsnittsenhet ÃĪr exkluderad. KompatibilitetsgrÃĪnserna ÃĪr ÃĪnnu smalare. Serverless-distributioner ÃĪr begrÃĪnsade till sex amerikanska Azure-regioner, och tjÃĪnsten ligger utanfÃķr Microsofts EU Data Boundary-ÃĨtaganden, har ingen FedRAMP-auktorisation och kan inte hantera betalkortdata. Microsofts egen transparensnotis tillÃĪgger att de inte utvÃĪrderar sÃĪkerheten eller beteendet hos Fireworks-betjÃĪnade modeller och lÃĪmnar den bedÃķmningen till kunden.
En nÃĪra fÃķrestÃĨende tidsbunden artikel: betala-per-token-fakturering fÃķr GLM-5.1 och MiniMax M2.5 ÃĪr fÃķrÃĨldrad frÃĨn och med den 7 augusti 2026, ÃĪven om bÃĨda modellerna fortfarande ÃĪr tillgÃĪngliga pÃĨ provisionerad genomsnittsenhet, och betala-per-token-erbjudanden fÃķr fyra andra katalogmodeller ÃĪr redan fÃķrÃĨldrade.
Microsoft har lagerhÃĨllit Foundry-katalogen i mÃĨnader
Fireworks-skissen ÃĪr ett drag i en lÃĪngre katalogbyggnad. Microsoft utvidgade sitt Mistral-avtal i juli 2026 fÃķr att locka till sig reglerade kÃķpare, som Unite.AI rapporterade, och de har flyttat en del av sitt eget Office AI-arbete Ãķver modellleverantÃķrer fÃķr att hantera kostnader, enligt tidigare rapportering. Fireworks-integrationen utvidgar den multi-vendor-hÃĨllningen till Ãķppna modeller, med inferenslagret outsourcat till en specialist snarare ÃĪn byggt internt.
FÃķr start-ups som vÃĪger sina alternativ ÃĪr den jÃĪmfÃķrelse som Microsoft sjÃĪlv publicerar talande: dokumenten stÃĪller Fireworks pÃĨ Foundry mot sjÃĪlvvÃĪrd vLLM pÃĨ en GPU-flotta, mot frontier-stÃĪngda API:er och mot generiska molntjÃĪnster, och positionerar det fÃķr fÃķretag vars AI ÃĪr den centrala produktdifferentiatoren. Den allmÃĪnt tillgÃĪngliga milstolpen, kreditberÃĪttigandet och de fÃķrÃĨldrade meddelandena som nu visas i katalogdokumenten sÃĪger alla samma sak: detta ÃĪr ett produktionserbjudande med villkor, och Microsoft vill att nÃĪsta vÃĨg av AI-nativa fÃķretag lÃĪser dem innan deras arkitektur hÃĪrdar.












