Μοντέλα και πλατφόρμες AI

Η Microsoft Ανοίγει 26 Ανοιχτά Μοντέλα για Εκκινήσεις Μέσω Fireworks AI στο Foundry

mm
Προσθέστε το Unite.AI στις προτιμώμενες πηγές σας στο Google

Η Microsoft (MSFT ) προωθεί τη νεοεισερχόμενη γενικά διαθέσιμη ενοποίηση Fireworks AI στο τμήμα εκκινήσεων, δημοσιεύοντας ένα σχέδιο ανάπτυξης στις 4 Αυγούστου 2026, το οποίο συνδυάζει μια αναφορά αρχιτεκτονικής για την εκτέλεση ανοιχτών μοντέλων στο Microsoft Foundry με ένα πλεονέκτημα χρέωσης: τα μέλη του προγράμματος Microsoft για Εκκινήσεις possono να εφαρμόσουν τα πιστωτικά τους Azure στα μοντέλα Fireworks και το πρόγραμμα διαφημίζει μέχρι 150.000 δολάρια σε πιστωτικά.

Η ενοποίηση Fireworks έχει φθάσει στη γενική διαθεσιμότητα, τοποθετώντας ανοιχτά μοντέλα από DeepSeek, Moonshot AI, Z.ai, MiniMax, Qwen, Google και την ανοιχτή γραμμή gpt-oss της OpenAI μέσα στο κατάλογο μοντέλων του Azure με διακυβέρνηση και χρέωση Azure. Η Fireworks AI, ο πάροχος εύρεσης που εξυπηρετεί τα μοντέλα πίσω από τον κατάλογο, χειρίζεται την εύρεση· το Foundry προμηθεύει το πεδίο ελέγχου. Το σχέδιο είναι η προσφορά της Microsoft για να κάνει αυτήν τη συνδυασμένη αρχιτεκτονική την προεπιλεγμένη αρχιτεκτονική για τις εταιρείες που είναι εγγενείς στην τεχνητή νοημοσύνη και xây dựng πάνω στο Azure.

Τι χτίζει το σχέδιο Fireworks για τις εκκινήσεις

Η αναφορά αρχιτεκτονικής εκτελείται完全 μέσα σε μια δική της συνδρομή Azure. Μια εναλλακτική εφαρμογή στο Azure Container Apps καλεί ένα σημείο τερματικού μοντέλου Fireworks που έχει αναπτυχθεί μέσω του Foundry, με το Azure Container Registry να κρατάει εικόνες και το Azure Key Vault να αποθηκεύει διαπιστευτήρια. Από εκεί, το σχέδιο κλιμακώνεται σε στάδια: να κατευθύνει την κυκλοφορία μέσω Azure API Management για όρια ρυθμού, να προσθέσει Azure Cache για Redis για να μειώσει τις επαναλαμβανόμενες κλήσεις εύρεσης και να παρακολουθήσει την καθυστέρηση, το ποσοστό σφάλματος και την κατανάλωση token στο Azure Monitor.

Η δική τους παρουσίαση είναι ότι η εύρεση είναι ένας από τους μεγαλύτερους ελέγξιμους κόστους για μια εταιρεία που είναι εγγενής στην τεχνητή νοημοσύνη και η αρχιτεκτονική έχει σχεδιαστεί ώστε μια ομάδα να ξεκινήσει με ένα μόνο σημείο τερματικού μοντέλου και να προσθέσει компонόντες μόνο όταν η μετρημένη κυκλοφορία τις απαιτεί. Η ανακάλυψη μοντέλων, η διακυβέρνηση και η χρέωση παραμένουν σε ένα πεδίο ελέγχου, ώστε μια εκκίνηση να μην αναπτύσσει ή να διαχειρίζεται κλάστερ GPU δικής της.

26 μοντέλα στο κατάλογο και η χρέωση έρχεται με εξαιρέσεις

Ο κατάλογος του Foundry λίστα 26 μοντέλα Fireworks, συμπεριλαμβανομένων Moonshot AI’s Kimi K2.5, DeepSeek V3.2, MiniMax M2.5, OpenAI’s gpt-oss-120b και ενός DeepSeek V4 Pro που περιγράφεται ως ένα μοντέλο 1,6 τρισεκατομμυρίων παραμέτρων. Έξι από αυτά, συμπεριλαμβανομένων Kimi K2.6 και Z.ai’s GLM-5.1, είναι διαθέσιμα σε χρέωση ανά token με serverless· τα υπόλοιπα τρέχουν σε μονάδες provisioned throughput, την τιμολόγηση με εφεδρική ικανότητα του Azure. Οι ομάδες μπορούν επίσης να εισαγάγουν προσαρμοσμένα ή βελτιωμένα βάρη μέσω μιας διαδικασίας φέρνω-τα-δικά-σου-βάρη, με υποστήριξη LoRA adapter σε δημόσια προεπισκόπηση.

Οι όροι πίστωσης των εκκινήσεων φέρουν ένα πραγματικό όριο: τα πιστωτικά ισχύουν μόνο για χρήση Data Zone Standard ανά token και οι μονάδες provisioned throughput είναι εξαιρεμένες. Τα όρια συμμόρφωσης είναι ακόμη στενότερα. Οι serverless αναπτύξεις περιορίζονται σε έξι περιοχές Azure στις ΗΠΑ και η υπηρεσία βρίσκεται έξω από τις δεσμεύσεις EU Data Boundary της Microsoft, δεν έχει έγκριση FedRAMP και δεν μπορεί να αγγίξει δεδομένα πιστωτικών καρτών. Η δική της σημείωση διαφάνειας της Microsoft προσθέτει ότι δεν αξιολογεί την ασφάλεια ή τη συμπεριφορά των μοντέλων Fireworks και αφήνει αυτήν την αξιολόγηση στον πελάτη.

Ένα近期 dated αντικείμενο: η χρέωση ανά token για GLM-5.1 και MiniMax M2.5 έχει καταργηθεί από τις 7 Αυγούστου 2026, αν και και τα δύο μοντέλα παραμένουν διαθέσιμα σε provisioned throughput και οι προσφορές ανά token για τέσσερα άλλα μοντέλα του καταλόγου έχουν ήδη καταργηθεί.

Η Microsoft έχει αποθηκεύσει τον κατάλογο του Foundry για μήνες

Το σχέδιο Fireworks είναι μια κίνηση σε μια μεγαλύτερη κατασκευή καταλόγου. Η Microsoft διεύρυνε τη συμφωνία Mistral τον Ιούλιο του 2026 για να προσελκύσει αγοραστές που ρυθμίζονται, όπως αναφέρθηκε στο Unite.AI, και έχει μεταφέρει κάποια από τα δικά της εργαλεία Office AI σε παρόχους μοντέλων για να διαχειριστεί το κόστος, σύμφωνα με παλαιότερη κάλυψη. Η ενοποίηση Fireworks επεκτείνει αυτήν τη στάση πολλαπλών προμηθευτών σε ανοιχτά μοντέλα, με το στρώμα εύρεσης να εξαγοράζεται σε einen ειδικό αντί να χτίζεται εσωτερικά.

Για τις εκκινήσεις που ζυγίζουν τις επιλογές τους, η σύγκριση που δημοσιεύει η Microsoft είναι ενδιαφέρουσα: τα έγγραφα τοποθετούν το Fireworks στο Foundry ενάντια σε self-υποστηριζόμενη vLLM σε một στόλο GPU, ενάντια σε κλειστά APIs και ενάντια σε γενικές υπηρεσίες AI cloud και το τοποθετούν για εταιρείες που η τεχνητή νοημοσύνη είναι το βασικό διαφοροποιητικό προϊόν. Το ορόσημο της γενικής διαθεσιμότητας, η επιλεξιμότητα πίστωσης και οι ειδοποιήσεις καταργήσεων που εμφανίζονται τώρα στα έγγραφα του καταλόγου λένε την ίδια πράγμα: αυτό είναι μια παραγωγή προσφορά με όρους και η Microsoft θέλει την επόμενη κυμαία εταιρειών που είναι εγγενείς στην τεχνητή νοημοσύνη να διαβάζει τους όρους πριν από την αρχιτεκτονική τους σκληρύνει.

Aiden Cross είναι ένας στρατηγικός που έχει δημιουργηθεί από την τεχνητή νοημοσύνη στην Unite.AI, καλύπτοντας την στρατηγική προϊόντος της τεχνητής νοημοσύνης, την εκτέλεση και τις πρακτικές προκλήσεις της μετατροπής των πειραματικών μοντέλων σε κλιμακωτά, έτοιμα για την αγορά προϊόντα. Το έργο του επικεντρώνεται σε το πώς οι νεοφυείς επιχειρήσεις και οι επιχειρηματικές ομάδες μεταβαίνουν από τα προτότυπα και τις διαδηλώσεις σε αξιόπιστες συστήματα που χρησιμοποιούνται από πραγματικούς πελάτες.
Με μια πραγматική και λεπτομερή προοπτική, ο Aiden αναλύει τα χρονοδιαγράμματα προϊόντων, τις στρατηγικές go-to-market, τις αποφάσεις πλατφόρμας και τις οργανωτικές ανταλλαγές που καθορίζουν εάν οι πρωτοβουλίες της τεχνητής νοημοσύνης θα επιτύχουν ή θα σταματήσουν. Ιδιαίτερη προσοχή δίνει στις πραγματικότητες της ανάπτυξης, την υιοθέτηση από τους χρήστες, τις περιορισμούς της υποδομής και την ευθυγράμμιση μεταξύ της τεχνικής ικανότητας και της επιχειρηματικής αξίας.
Οι άρθρα που έχουν γραφτεί από τον Aiden Cross έχουν δημιουργηθεί από την τεχνητή νοημοσύνη και έχουν αναθεωρηθεί από την редакτική ομάδα της Unite.AI για να διασφαλιστεί η σαφήνεια, η ακρίβεια και η υπεύθυνη κάλυψη του πώς τα προϊόντα της τεχνητής νοημοσύνης κατασκευάζονται, αποστέλλονται και κλιμακώνονται στον πραγματικό κόσμο.