AI-modeller og platforme
Microsoft åbner 26 åbne modeller for startups gennem Fireworks AI på Foundry

Microsoft (MSFT ) driver sin nyeste generelt tilgængelige Fireworks AI-integration på startup-segmentet og offentliggør en implementeringsblueprint den 4. august 2026, som parrer en referencearkitektur for at køre åbne modeller på Microsoft Foundry med en faktureringsgevinst: medlemmer af Microsoft for Startups-programmet kan anvende deres Azure-kreditter på Fireworks-modelinstallationer, og programmet annoncerer op til 150.000 dollars i kreditter.
Fireworks-integrationen selv har nået generel tilgængelighed, hvilket placerer åbne vægtmodeller fra DeepSeek, Moonshot AI, Z.ai, MiniMax, Qwen, Google og OpenAI’s åbne vægt-gpt-oss-linje inde i Azures modelkatalog med Azure-side governance og fakturering. Fireworks AI, den inferensudbyder, der betjener modellerne bag kataloget, håndterer inferens; Foundry leverer kontrolplanet. Blueprintet er Microsofts bud på at gøre den kombination til standardstartstakken for AI-naturlige virksomheder, der bygger på Azure.
Hvad Fireworks-blueprintet får startups til at bygge
Den referencearkitektur kører helt inden for en startups egen Azure-abonnement. En containeriseret aplikation på Azure Container Apps kalder en Fireworks-modelendepunkt, der er installeret gennem Foundry, med Azure Container Registry, der holder billeder, og Azure Key Vault, der gemmer legitimationsoplysninger. Herfra skalerer blueprintet i etaper: rout trafik gennem Azure API Management for rategrænser, tilføj Azure Cache for Redis for at reducere redundante inferensopkald og sporing af latency, fejlrate og tokenforbrug i Azure Monitor.
Dokumenternes egen ramme er, at inferens er en af de største kontrollerbare omkostninger for en AI-naturlig virksomhed, og arkitekturen er designet, så et team starter med en enkelt serverless modelendepunkt og kun tilføjer komponenter, når målt trafik kræver det. Modelopdagelse, governance og fakturering forbliver på ét kontrolplan, så en startup aldrig selv opstiller eller administrerer GPU-klynger.
26 modeller i kataloget, og faktureringen kommer med undtagelser
Foundry-kataloget viser nu 26 Fireworks-betjente modeller, herunder Moonshot AI’s Kimi K2.5, DeepSeek V3.2, MiniMax M2.5, OpenAI’s gpt-oss-120b og en DeepSeek V4 Pro, der beskrives som en 1,6 billion-parameter flagskib. Seks af dem, herunder Kimi K2.6 og Z.ai’s GLM-5.1, er tilgængelige på betal-per-token serverless fakturering; resten kører på provisionerede gennemløbsenheder, Azures reserved-capacity-pris. Hold kan også importere brugerdefinerede eller finjusterede vægte gennem en bring-your-own-weights-arbejdsgang, med LoRA-adapter-understøttelse i offentlig preview.
Startups-kreditvilkårene har en reel grænse: kreditter kan kun anvendes på betal-per-token Data Zone Standard-brug, og provisionerede gennemløbsenheder er ekskluderet. Overholdelsesgrænserne er endnu smallere. Serverless-installationer er begrænset til seks US Azure-regioner, og tjenesten ligger uden for Microsofts EU Data Boundary-forpligtelser, har ingen FedRAMP-godkendelse og kan ikke berøre betalingskortdata. Microsofts egen gennemsigtighedsnotis tilføjer, at det ikke vurderer sikkerheden eller adfærden af Fireworks-betjente modeller og overlader denne vurdering til kunden.
En nær-fristet dato: betal-per-token-fakturering for GLM-5.1 og MiniMax M2.5 er nedlagt fra den 7. august 2026, selvom begge modeller stadig er tilgængelige på provisioneret gennemløb, og betal-per-token-tilbud for fire andre katalogmodeller er allerede nedlagt.
Microsoft har lagt modeller til Foundry-kataloget i måneder
Fireworks-blueprintet er ét træk i en længere katalogopbygning. Microsoft udvidede sin Mistral-aftale i juli 2026 for at tiltrække reguleringsskyldige købere, som Unite.AI rapporterede, og det har flyttet nogle af sine egne Office AI-arbejdslaster over modeller til at administrere omkostninger, ifølge tidligere dækning. Fireworks-integrationen udvider denne multi-vendor-holdning til åbne modeller, med inferenslaget outsourcet til en specialist i stedet for bygget internt.
For startups, der vejer deres muligheder, er sammenligningen, som Microsoft selv offentliggør, talende: dokumenterne stiller Fireworks på Foundry op mod selvhostet vLLM på en GPU-flåde, mod frontier lukkede API’er og mod generiske sky AI-tjenester og positionerer det for virksomheder, hvis AI er den centrale produktdifferentiator. Den generelt tilgængelige milepæl, kreditberettigelsen og de nedlagte meddelelser, der nu vises i katalognoteapparatet, siger alle det samme: dette er et produktionsudbud med vilkår vedhæftet, og Microsoft ønsker, at den næste bølge af AI-naturlige virksomheder læser dem, før deres arkitektur hårdner.












