AI-modeller och plattformar

Microsoft Ãķppnar 26 Ãķppna modeller fÃķr start-ups genom Fireworks AI pÃĨ Foundry

mm
LÃĪgg till Unite.AI bland dina fÃķredragna kÃĪllor pÃĨ Google

Microsoft (MSFT ) driver pÃĨ sin nyss allmÃĪnt tillgÃĪngliga Fireworks AI-integration pÃĨ start-up-segmentet och publicerar en distributionsskiss den 4 augusti 2026 som parar en referensarkitektur fÃķr att kÃķra Ãķppna modeller pÃĨ Microsoft Foundry med en faktureringsfÃķrmÃĨn: medlemmar i Microsoft for Startups-programmet kan anvÃĪnda sina Azure-crediter fÃķr Fireworks-modelldistributioner, och programmet annonserar upp till 150 000 dollar i crediter.

Fireworks-integrationen i sig har nÃĨtt allmÃĪn tillgÃĪnglighet, vilket placerar Ãķppna modeller frÃĨn DeepSeek, Moonshot AI, Z.ai, MiniMax, Qwen, Google och OpenAI:s Ãķppna modell gpt-oss i Azures modellkatalog med Azure-sidan governance och fakturering. Fireworks AI, som tillhandahÃĨller inferens fÃķr modellerna bakom katalogen, hanterar inferens; Foundry tillhandahÃĨller kontrollplanet. Skissen ÃĪr Microsofts bud fÃķr att gÃķra den kombinationen till standardstartstacken fÃķr AI-nativa fÃķretag som bygger pÃĨ Azure.

Vad Fireworks-skissen har start-ups bygga

Referensarkitekturen kÃķrs helt inom en start-ups egen Azure-prenumeration. En containeriserad applikation pÃĨ Azure Container Apps anropar en Fireworks-modellslutpunkt som distribueras via Foundry, med Azure Container Registry som innehÃĨller bilder och Azure Key Vault som lagrar autentiseringsuppgifter. DÃĪrifrÃĨn skalar skissen i etapper: dirigera trafik via Azure API Management fÃķr ratelimits, lÃĪgg till Azure Cache fÃķr Redis fÃķr att minska onÃķdiga inferensanrop och spÃĨra fÃķrdrÃķjning, felrate och tokenkonsumtion i Azure Monitor.

Dokumentens egen ram ÃĪr att inferens ÃĪr en av de stÃķrsta kontrollerbara kostnaderna fÃķr ett AI-nativt fÃķretag, och arkitekturen ÃĪr utformad sÃĨ att ett team bÃķrjar med en enda serverless modellslutpunkt och lÃĪgger till komponenter endast nÃĪr mÃĪttrafik krÃĪver dem. ModellupptÃĪckt, governance och fakturering fÃķrblir i ett kontrollplan, sÃĨ en start-up behÃķver aldrig stÃĪlla upp eller hantera GPU-kluster pÃĨ egen hand.

26 modeller i katalogen, och faktureringen kommer med undantag

Foundry-katalogen listar nu 26 Fireworks-betjÃĪnade modeller, inklusive Moonshot AI:s Kimi K2.5, DeepSeek V3.2, MiniMax M2.5, OpenAI:s gpt-oss-120b och en DeepSeek V4 Pro som beskrivs som en 1,6-biljonerparametrarsflaggskepp. Sex av dem, inklusive Kimi K2.6 och Z.ai:s GLM-5.1, ÃĪr tillgÃĪngliga pÃĨ betala-per-token serverless fakturering; resten kÃķrs pÃĨ provisionerad genomsnittsenheter, Azures reserverad kapacitetsprissÃĪttning. Team kan ocksÃĨ importera anpassade eller finjusterade vikter via en bring-your-own-weights-arbetsflÃķde, med LoRA-adapterstÃķd i offentlig fÃķrhandsversion.

Start-up-kreditvillkoren har ett verkligt tak: krediter gÃĪller endast fÃķr betala-per-token Data Zone Standard-anvÃĪndning, och provisionerad genomsnittsenhet ÃĪr exkluderad. KompatibilitetsgrÃĪnserna ÃĪr ÃĪnnu smalare. Serverless-distributioner ÃĪr begrÃĪnsade till sex amerikanska Azure-regioner, och tjÃĪnsten ligger utanfÃķr Microsofts EU Data Boundary-ÃĨtaganden, har ingen FedRAMP-auktorisation och kan inte hantera betalkortdata. Microsofts egen transparensnotis tillÃĪgger att de inte utvÃĪrderar sÃĪkerheten eller beteendet hos Fireworks-betjÃĪnade modeller och lÃĪmnar den bedÃķmningen till kunden.

En nÃĪra fÃķrestÃĨende tidsbunden artikel: betala-per-token-fakturering fÃķr GLM-5.1 och MiniMax M2.5 ÃĪr fÃķrÃĨldrad frÃĨn och med den 7 augusti 2026, ÃĪven om bÃĨda modellerna fortfarande ÃĪr tillgÃĪngliga pÃĨ provisionerad genomsnittsenhet, och betala-per-token-erbjudanden fÃķr fyra andra katalogmodeller ÃĪr redan fÃķrÃĨldrade.

Microsoft har lagerhÃĨllit Foundry-katalogen i mÃĨnader

Fireworks-skissen ÃĪr ett drag i en lÃĪngre katalogbyggnad. Microsoft utvidgade sitt Mistral-avtal i juli 2026 fÃķr att locka till sig reglerade kÃķpare, som Unite.AI rapporterade, och de har flyttat en del av sitt eget Office AI-arbete Ãķver modellleverantÃķrer fÃķr att hantera kostnader, enligt tidigare rapportering. Fireworks-integrationen utvidgar den multi-vendor-hÃĨllningen till Ãķppna modeller, med inferenslagret outsourcat till en specialist snarare ÃĪn byggt internt.

FÃķr start-ups som vÃĪger sina alternativ ÃĪr den jÃĪmfÃķrelse som Microsoft sjÃĪlv publicerar talande: dokumenten stÃĪller Fireworks pÃĨ Foundry mot sjÃĪlvvÃĪrd vLLM pÃĨ en GPU-flotta, mot frontier-stÃĪngda API:er och mot generiska molntjÃĪnster, och positionerar det fÃķr fÃķretag vars AI ÃĪr den centrala produktdifferentiatoren. Den allmÃĪnt tillgÃĪngliga milstolpen, kreditberÃĪttigandet och de fÃķrÃĨldrade meddelandena som nu visas i katalogdokumenten sÃĪger alla samma sak: detta ÃĪr ett produktionserbjudande med villkor, och Microsoft vill att nÃĪsta vÃĨg av AI-nativa fÃķretag lÃĪser dem innan deras arkitektur hÃĪrdar.

Aiden Cross ÃĪr en AI-genererad strateg som tÃĪcker AI-produktstrategi, genomfÃķrande och de praktiska utmaningarna med att omvandla experimentella modeller till skalbara, marknadsfÃĪrdiga produkter. Hans arbete fokuserar pÃĨ hur startups och fÃķretagsgrupper gÃĨr frÃĨn prototyper och demon till pÃĨlitliga system som anvÃĪnds av riktiga kunder.
Med en pragmatisk och detaljorienterad perspektiv analyserar Aiden produktvÃĪgar, marknadsstrategier, plattformsbeslut och organisatoriska avvÃĪgningar som avgÃķr om AI-initiativ lyckas eller stannar av. Han ÃĪgnar sÃĪrskild uppmÃĪrksamhet ÃĨt distributionsrealiteter, anvÃĪndarantagande, infrastruktur begrÃĪnsningar och samstÃĪmmigheten mellan teknisk kapacitet och affÃĪrsverdi.
Artiklar skrivna av Aiden Cross ÃĪr AI-genererade och granskade av Unite.AIs redaktion fÃķr att sÃĪkerstÃĪlla tydlighet, noggrannhet och ansvarsfull rapportering om hur AI-produkter byggs, skickas och skalaras i den riktiga vÃĪrlden.