Mô hình và nền tảng AI
Microsoft Mở 26 Mô Hình Mở Cho Các Công Ty Khởi Nghiệp Thông Qua Fireworks AI Trên Foundry

Microsoft (MSFT ) đang đẩy mạnh tích hợp Fireworks AI mới của mình cho phân khúc khởi nghiệp, xuất bản một khung kiến trúc triển khai vào ngày 4 tháng 8 năm 2026, kết hợp một kiến trúc tham chiếu để chạy các mô hình mở trên Microsoft Foundry với một ưu đãi hóa đơn: các thành viên của chương trình Microsoft for Startups có thể áp dụng tín dụng Azure của họ cho các triển khai mô hình Fireworks, và chương trình quảng cáo lên đến 150.000 đô la Mỹ trong tín dụng.
Tích hợp Fireworks bản thân đã đạt được tính khả dụng chung, đặt các mô hình mở từ DeepSeek, Moonshot AI, Z.ai, MiniMax, Qwen, Google và dòng gpt-oss mở của OpenAI bên trong danh mục mô hình của Azure với quản lý và hóa đơn của Azure. Fireworks AI, nhà cung cấp suy luận phục vụ các mô hình đằng sau danh mục, xử lý suy luận; Foundry cung cấp mặt điều khiển. Khung kiến trúc này là nỗ lực của Microsoft để biến sự kết hợp này trở thành ngăn xếp khởi đầu mặc định cho các công ty bản địa AI xây dựng trên Azure.
Fireworks Blueprint Của Microsoft Xây Dựng Gì Cho Các Công Ty Khởi Nghiệp
Kiến trúc tham chiếu chạy hoàn toàn bên trong đăng ký Azure của một công ty khởi nghiệp. Một ứng dụng được chứa trên Azure Container Apps gọi một điểm cuối mô hình Fireworks được triển khai thông qua Foundry, với Azure Container Registry giữ hình ảnh và Azure Key Vault lưu trữ thông tin đăng nhập. Từ đó, khung kiến trúc mở rộng theo từng giai đoạn: định tuyến lưu lượng truy cập qua Azure API Management để giới hạn tỷ lệ, thêm Azure Cache for Redis để cắt giảm các cuộc gọi suy luận trùng lặp và theo dõi độ trễ, tỷ lệ lỗi và tiêu thụ token trong Azure Monitor.
Khung tài liệu của chính nó cho rằng suy luận là một trong những chi phí có thể kiểm soát được lớn nhất cho một công ty bản địa AI, và kiến trúc được thiết kế để một nhóm bắt đầu với một điểm cuối mô hình không có máy chủ và chỉ thêm các thành phần khi lưu lượng truy cập đo lường yêu cầu. Khám phá mô hình, quản lý và hóa đơn vẫn ở một mặt điều khiển, vì vậy một công ty khởi nghiệp không bao giờ phải thiết lập hoặc quản lý các cụm GPU của riêng họ.
26 Mô Hình Trong Danh Mục, Và Hóa Đơn Đi Kèm Với Các Ưu Đãi
Danh mục Foundry hiện liệt kê 26 mô hình được phục vụ bởi Fireworks, bao gồm Kimi K2.5 của Moonshot AI, DeepSeek V3.2, MiniMax M2.5, gpt-oss-120b của OpenAI và DeepSeek V4 Pro được mô tả là một mô hình cờ bạc 1,6 nghìn tỷ tham số. Sáu trong số chúng, bao gồm Kimi K2.6 và GLM-5.1 của Z.ai, có sẵn trên hóa đơn theo từng token máy chủ; phần còn lại chạy trên đơn vị thông lượng được cung cấp, giá cả dự trữ của Azure. Các nhóm cũng có thể nhập các trọng số tùy chỉnh hoặc tinh chỉnh thông qua một quy trình làm việc mang trọng số của riêng họ, với hỗ trợ bộ điều hợp LoRA trong bản xem trước công khai.
Điều khoản tín dụng khởi nghiệp mang một giới hạn thực: tín dụng chỉ áp dụng cho sử dụng Data Zone Standard theo từng token, và đơn vị thông lượng được cung cấp là không bao gồm. Các ranh giới tuân thủ còn hẹp hơn. Triển khai không có máy chủ bị giới hạn ở sáu khu vực Azure của Mỹ, và dịch vụ nằm ngoài cam kết ranh giới dữ liệu EU của Microsoft, không có ủy quyền FedRAMP và không thể chạm vào dữ liệu thẻ thanh toán. Lưu ý minh bạch của Microsoft thêm rằng họ không đánh giá sự an toàn hoặc hành vi của các mô hình được phục vụ bởi Fireworks và để lại đánh giá đó cho khách hàng.
Một mục gần hạn: hóa đơn theo từng token cho GLM-5.1 và MiniMax M2.5 đã bị lỗi thời kể từ ngày 7 tháng 8 năm 2026, mặc dù cả hai mô hình vẫn có sẵn trên thông lượng được cung cấp, và các dịch vụ hóa đơn theo từng token cho bốn mô hình danh mục khác đã bị lỗi thời.
Microsoft Đã Đang Cung Cấp Danh Mục Foundry Trong Vài Tháng
Khung Fireworks là một bước trong việc xây dựng danh mục dài hơn. Microsoft đã mở rộng thỏa thuận Mistral của mình vào tháng 7 năm 2026 để thu hút người mua được quản lý, như Unite.AI đã báo cáo, và họ đã chuyển một số công việc AI của Office của mình sang các nhà cung cấp mô hình khác để quản lý chi phí, theo báo cáo trước đó. Tích hợp Fireworks mở rộng tư thế đa nhà cung cấp này sang các mô hình mở, với lớp suy luận được外包 cho một chuyên gia thay vì được xây dựng nội bộ.
Đối với các công ty khởi nghiệp đang cân nhắc các lựa chọn của mình, so sánh mà Microsoft tự xuất bản là đáng chú ý: tài liệu đặt Fireworks trên Foundry so với vLLM tự tổ chức trên một đội GPU, so với các API đóng nguồn tiên phong và so với các dịch vụ AI đám mây chung, và đặt nó cho các công ty mà AI là yếu tố phân biệt sản phẩm cốt lõi. Mốc tính khả dụng chung, điều kiện đủ điều kiện tín dụng và các thông báo lỗi thời hiện đang xuất hiện trong tài liệu danh mục đều nói cùng một điều: đây là một dịch vụ sản xuất với các điều khoản đính kèm, và Microsoft muốn làn sóng tiếp theo của các công ty bản địa AI đọc chúng trước khi kiến trúc của họ cứng lại.












