Modely a platformy AI

Microsoft otevře 26 otevřených modelů startupům prostřednictvím Fireworks AI na Foundry

mm
Přidejte Unite.AI mezi své preferované zdroje na Google

Microsoft (MSFT ) tlačí svou nově obecně dostupnou integraci Fireworks AI na segment startupů, publikuje deployovací modul z 4. srpna 2026, který spojuje referenční architekturu pro běh otevřených modelů na Microsoft Foundry s fakturační výhodou: členové programu Microsoft for Startups mohou použít své Azure kredity pro nasazení modelů Fireworks a program inzeruje až 150 000 dolarů v kreditech.

Integrace Fireworks sama o sobě dosáhla obecné dostupnosti, umístila otevřené modely z DeepSeek, Moonshot AI, Z.ai, MiniMax, Qwen, Google a otevřené modely gpt-oss od OpenAI do katalogu modelů Azure s governancí a fakturací na straně Azure. Fireworks AI, poskytovatel inferencí, který obsluhuje modely za katalogem, zajišťuje inferenci; Foundry dodává řídicí rovinu. Modul je Microsoftovým pokusem učinit tuto kombinaci výchozím startovacím balíčkem pro AI-rodné společnosti, které staví na Azure.

Co modul Fireworks staví pro startupy

Referenční architektura běží zcela uvnitř předplatného startupu Azure. Kontejnerová aplikace v Azure Container Apps volá koncový bod modelu Fireworks nasazený prostřednictvím Foundry, přičemž Azure Container Registry uchovává obrázky a Azure Key Vault uchovává přihlašovací údaje. Odtud se modul škáluje ve fázích: směruje provoz přes Azure API Management pro limity sazeb, přidává Azure Cache for Redis pro snížení redundancia inferenčních volání a sleduje latenci, míru chyb a spotřebu tokenů v Azure Monitor.

Vlastní rámcování dokumentů je takové, že inferencia je jednou z největších kontrolovatelných nákladů pro AI-rodnou společnost a architektura je navržena tak, aby tým začal s jedním serverless modelem koncového bodu a přidával komponenty pouze tehdy, když měřený provoz je vyžaduje. Objev modelu, governance a fakturace zůstávají v jedné řídicí rovině, takže startup nikdy nezřizuje ani neřídí cluster GPU.

26 modelů v katalogu a fakturace přichází s výjimkami

Katalog Foundry nyní nabízí 26 modelů Fireworks, včetně Moonshot AI Kimi K2.5, DeepSeek V3.2, MiniMax M2.5, otevřeného modelu gpt-oss-120b od OpenAI a DeepSeek V4 Pro, který je popsán jako vlajková loď s 1,6 bilionem parametrů. Šest z nich, včetně Kimi K2.6 a Z.ai GLM-5.1, je k dispozici na základě fakturace za tokeny; zbytek běží na základě rezervované kapacity Azure. Týmy mohou také importovat vlastní nebo jemně vyladěné váhy prostřednictvím workflow „přineste si vlastní váhy“, s podporou LoRA adapteru ve veřejné verzi preview.

Podmínky kreditů pro startupy nesou skutečné omezení: kredity platí pouze pro použití Data Zone Standard na základě platby za tokeny a rezervované jednotky propustnosti jsou vyloučeny. Kompatibilní hranice jsou ještě užší. Serverless nasazení jsou omezena na šest regionů Azure v USA a služba se nachází mimo závazky Microsoftu EU Data Boundary, nemá autorizaci FedRAMP a nemůže zpracovávat platební karty. Vlastní poznámka transparentnosti Microsoftu dodává, že společnost nehodnotí bezpečnost nebo chování modelů Fireworks a ponechává tuto evaluaci zákazníkovi.

Jedna blízká datová položka: fakturace za tokeny pro GLM-5.1 a MiniMax M2.5 je zastaralá od 7. srpna 2026, ačkoli oba modely zůstávají k dispozici na základě rezervované propustnosti a fakturace za tokeny pro čtyři další modely v katalogu jsou již zastaralé.

Microsoft doplňuje katalog Foundry po měsíce

Modul Fireworks je jedním z kroků v delším budování katalogu. Microsoft rozšířil svou dohodu Mistral v červenci 2026, aby oslovil regulované kupce, jak Unite.AI oznámil, a přesunul některé ze svých vlastních AI úloh Office do modelů poskytovatelů, aby snížil náklady, podle dřívějších zpráv. Integrace Fireworks rozšiřuje tuto víceuživatelskou pozici na otevřené modely, s vrstvou inferencí outsourcovánou na specialistu místo toho, aby byla postavena interně.

Pro startupy, které váží své možnosti, je srovnání, které Microsoft sám publikuje, výmluvné: dokumenty staví Fireworks na Foundry proti samo-hostovaným vLLM na flotile GPU, proti uzavřeným API a proti obecným cloudovým službám AI, a staví je pro společnosti, jejichž AI je hlavní produktovou diferenciací. Milník obecné dostupnosti, způsobilost kreditů a oznámení o zastarání, která se nyní objevují v dokumentaci katalogu, vše říká totéž: jedná se o produktivní nabídku s podmínkami, a Microsoft chce, aby příští vlna AI-rodných společností četla tyto podmínky, než jejich architektura ztuhne.

Aiden Cross je AI-generovaný stratég v Unite.AI, který se zabývá strategií AI produktů, jejich prováděním a praktickými výzvami spojenými s transformací experimentálních modelů na škálovatelné a tržně připravené produkty. Jeho práce se zaměřuje na to, jak startupy a podnikové týmy přecházejí od prototypů a demonstrací k spolehlivým systémům používaným skutečnými zákazníky.
S pragmatickým a detailním pohledem analyzuje Aiden produktové mapy, strategie vstupu na trh, rozhodnutí o platformách a organizační kompromisy, které určují, zda iniciativy AI uspějí nebo uváznou. Zvláštní pozornost věnuje realitám nasazení, přijetí uživatelů, omezením infrastruktury a souladu mezi technickými schopnostmi a obchodními hodnotami.
Články napsané Aidenem Crossem jsou AI-generované a recenzované redakčním týmem Unite.AI, aby zajistily jasnost, přesnost a odpovědné pokrytí toho, jak jsou AI produkty vyvíjeny, expedovány a škálovány v reálném světě.