Model dan platform AI

Microsoft Membuka 26 Model Terbuka untuk Startup Melalui Fireworks AI di Foundry

mm
Tambahkan Unite.AI ke sumber pilihan Anda di Google

Microsoft (MSFT ) mendorong integrasi Fireworks AI yang baru saja tersedia secara umum untuk segmen startup, dengan menerbitkan blueprint penerapan pada 4 Agustus 2026 yang memasangkan arsitektur referensi untuk menjalankan model terbuka di Microsoft Foundry dengan keuntungan tagihan: anggota program Microsoft for Startups dapat menerapkan kredit Azure mereka untuk penerapan model Fireworks, dan program tersebut mengiklankan hingga $150.000 dalam kredit.

Integrasi Fireworks itu sendiri telah mencapai ketersediaan umum, meletakkan model berat terbuka dari DeepSeek, Moonshot AI, Z.ai, MiniMax, Qwen, Google, dan garis gpt-oss terbuka dari OpenAI di dalam katalog model Azure dengan tata kelola dan tagihan Azure. Fireworks AI, penyedia inferensi yang melayani model di balik katalog, menangani inferensi; Foundry menyediakan kontrol plane. Blueprint ini adalah upaya Microsoft untuk membuat kombinasi tersebut menjadi tumpukan awal default untuk perusahaan asli AI yang membangun di Azure.

Apa yang Dibangun oleh Blueprint Fireworks untuk Startup

Arsitektur referensi berjalan sepenuhnya di dalam langganan Azure startup. Aplikasi kontainer di Azure Container Apps memanggil titik akhir model Fireworks yang diterapkan melalui Foundry, dengan Azure Container Registry yang memegang gambar dan Azure Key Vault yang menyimpan kredensial. Dari sana, blueprint tersebut diperluas dalam tahap-tahap: mengalihkan lalu lintas melalui Azure API Management untuk batas tarif, menambahkan Azure Cache untuk Redis untuk mengurangi panggilan inferensi berlebihan, dan melacak latensi, tingkat kesalahan, dan konsumsi token di Azure Monitor.

Dokumen sendiri membingkai bahwa inferensi adalah salah satu biaya terbesar yang dapat dikendalikan untuk perusahaan asli AI, dan arsitektur dirancang sehingga tim memulai dengan satu titik akhir model serverless dan menambahkan komponen hanya ketika lalu lintas yang diukur memerlukannya. Penemuan model, tata kelola, dan tagihan tetap dalam satu kontrol plane, sehingga startup tidak pernah membangun atau mengelola klaster GPU mereka sendiri.

26 Model di Katalog, dan Tagihan Datang dengan Pemotongan

Katalog Foundry sekarang mencantumkan 26 model yang dilayani oleh Fireworks, termasuk Kimi K2.5 dari Moonshot AI, DeepSeek V3.2, MiniMax M2.5, gpt-oss-120b dari OpenAI, dan DeepSeek V4 Pro yang digambarkan sebagai model andalan dengan 1,6 triliun parameter. Enam di antaranya, termasuk Kimi K2.6 dan GLM-5.1 dari Z.ai, tersedia pada tagihan serverless per-token; sisanya berjalan pada unit throughput yang dipesan, dengan harga kapasitas yang dipesan oleh Azure. Tim juga dapat mengimpor bobot kustom atau bobot yang diperhalus melalui alur kerja bawa-bawa-bobot, dengan dukungan adapter LoRA dalam pratinjau publik.

Syarat kredit startup membawa batas nyata: kredit hanya berlaku untuk penggunaan Data Zone Standard per-token, dan unit throughput yang dipesan dikecualikan. Batas kepatuhan lebih sempit. Penerapan serverless dibatasi pada enam wilayah Azure AS, dan layanan tersebut berada di luar komitmen Batas Data EU Microsoft, tidak membawa otorisasi FedRAMP, dan tidak dapat menyentuh data kartu pembayaran. Catatan transparansi Microsoft sendiri menambahkan bahwa mereka tidak mengevaluasi keamanan atau perilaku model yang dilayani oleh Fireworks dan meninggalkan penilaian tersebut kepada pelanggan.

Satu item yang memiliki tanggal dekat: tagihan per-token untuk GLM-5.1 dan MiniMax M2.5 telah usang sejak 7 Agustus 2026, meskipun kedua model tersebut tetap tersedia pada unit throughput yang dipesan, dan penawaran per-token untuk empat model katalog lainnya sudah usang.

Microsoft Telah Mengisi Katalog Foundry Selama Beberapa Bulan

Blueprint Fireworks adalah salah satu langkah dalam pembangunan katalog yang lebih luas. Microsoft memperluas kesepakatan Mistral-nya pada Juli 2026 untuk menggaet pembeli yang diatur, seperti yang dilaporkan oleh Unite.AI, dan telah mengalihkan beberapa beban kerja AI Office-nya ke penyalur model untuk mengelola biaya, menurut laporan sebelumnya. Integrasi Fireworks memperluas sikap multi-vendor tersebut ke model terbuka, dengan lapisan inferensi yang diserahkan kepada spesialis daripada dibangun di dalam.

Bagi startup yang mempertimbangkan pilihan mereka, perbandingan yang diterbitkan oleh Microsoft sendiri sangat mengungkapkan: dokumen tersebut membandingkan Fireworks di Foundry dengan vLLM yang di-host sendiri di armada GPU, dengan API tertutup, dan dengan layanan AI cloud generik, dan memposisikannya untuk perusahaan yang inti produknya adalah pembeda AI. Batu loncatan ketersediaan umum, kelayakan kredit, dan pemberitahuan penghapusan yang sekarang muncul di dokumen katalog semua mengatakan hal yang sama: ini adalah penawaran produksi dengan syarat yang melekat, dan Microsoft ingin gelombang berikutnya dari perusahaan asli AI membaca mereka sebelum arsitektur mereka mengeras.

Aiden Cross adalah seorang strategi yang dihasilkan oleh AI di Unite.AI, yang meliputi strategi produk AI, eksekusi, dan tantangan praktis dalam mengubah model eksperimental menjadi produk yang siap pasar dan dapat diskalakan. Pekerjaannya berfokus pada bagaimana startup dan tim perusahaan bergerak dari prototipe dan demo ke sistem yang dapat diandalkan yang digunakan oleh pelanggan nyata.
Dengan perspektif yang pragmatis dan detail, Aiden menganalisis peta jalan produk, strategi go-to-market, keputusan platform, dan pertukaran organisasi yang menentukan apakah inisiatif AI berhasil atau terhambat. Ia memperhatikan khusus kenyataan penerapan, adopsi pengguna, keterbatasan infrastruktur, dan keselarasan antara kemampuan teknis dan nilai bisnis.
Artikel yang ditulis oleh Aiden Cross dihasilkan oleh AI dan ditinjau oleh tim editorial Unite.AI untuk memastikan kejelasan, akurasi, dan liputan yang bertanggung jawab tentang bagaimana produk AI dibangun, dikirim, dan diskalakan di dunia nyata.