Μοντέλα και πλατφόρμες AI

Η εταιρεία Benchmark δίνει στο Mistral Large 4 Preview βαθμολογία 38 Intelligence Score

mm
Προσθέστε το Unite.AI στις προτιμώμενες πηγές σας στο Google

Artificial Analysis δημοσίευσε την ανάλυση benchmark του Mistral Large 4 Preview στις 6 Οκτωβρίου 2026, αποδίδοντας στο μοντέλο 38 στο Intelligence Index του και περιγράφοντάς το ως το πιο έξυπνο μοντέλο AI εκτός των ΗΠΑ και της Κίνας.

Αποτελέσματα Intelligence Index

Η ανάλυση αναφέρει ότι το Mistral Large 4 Preview αποδίδει 38 στο Artificial Analysis Intelligence Index έκδοση 4.3.2, ένα αποτέλεσμα που η εταιρεία benchmark περιγράφει ως συγκρίσιμο με το GPT-6 Luna (max) στα 38 και το DeepSeek V4.1 Flash (max) στα 39. Στο πλαίσιο αυτό, η Γαλλία επανέρχεται με το πιο έξυπνο μοντέλο εκτός των ΗΠΑ και της Κίνας, προπορεύοντας χώρες όπως η Νότια Κορέα και τα Ηνωμένα Αραβικά Εμιράτα.

Στη σελίδα μοντέλου για την προεπισκόπηση του Artificial Analysis, αυτή η βαθμολογία τοποθετεί το μοντέλο στην 64η θέση από 225 μοντέλα στην κατηγορία σύγκρισης, πάνω από το μεσαίο όριο της κατηγορίας 26. Η σελίδα καταγράφει την προεπισκόπηση ως μοντέλο λογικής που κυκλοφόρησε στις 6 Οκτωβρίου 2026, με είσοδο κειμένου και εικόνας, έξοδο κειμένου και υπηρεσία μέσω δύο παρόχων API.

Σύμφωνα με τη δημοσιευμένη μεθοδολογία Intelligence Index, η έκδοση 4.3.2 συνδυάζει δέκα αξιολογήσεις — AA‑Briefcase v1.1, GDPval‑AA v2.1, AutomationBench‑AA, Terminal‑Bench 4.0, SciCode, Humanity’s Last Exam, GDP.pdf, CritPt, AA‑Omniscience και AA‑LCR v1.1 — ως σταθμισμένο μέσο ανά τέσσερις κατηγορίες: πράκτορες 30%, προγραμματισμός 20%, επιστημονική λογική 20% και γενικά 30%. Η Artificial Analysis εκτιμά ένα διάστημα εμπιστοσύνης 95% μικρότερο από ±1% για το δείκτη και περιγράφει τη σουίτα ως κυρίως κειμενική και αγγλόφωνη, με την απόδοση εικόνας, ομιλίας και πολύγλωσσης να μετριέται ξεχωριστά.

Αποτελέσματα Cyber Index

Στο Cyber Index της Artificial Analysis, η προεπισκόπηση αποδίδει 50, ισοδύναμο με το GLM-5.3-Flash στα 50 και πίσω από το MiMo‑V2.6‑Pro στα 56, ενώ είναι μπροστά από μοντέλα όπως το Kimi K3 και το DeepSeek V4.1 Flash (max). Η Artificial Analysis δηλώνει ότι μόλις κυκλοφορήσουν τα βάρη του μοντέλου, θα κατατάσσεται μεταξύ των τριών κορυφαίων μοντέλων ανοιχτών βαρών στο Cyber Index.

Το ισχυρότερο ατομικό αποτέλεσμα στον τομέα cyber του μοντέλου εμφανίστηκε στο CyberGym‑E2E‑AA, όπου αποδίδει 82%, μπροστά από το MiMo‑V2.6‑Pro στο 79% και το GPT‑6 Luna (max) στο 78%, σύμφωνα με την ανάλυση.

Κόστος, Ταχύτητα και Χρήση Tokens

Η ανάλυση τοποθετεί το κόστος εκτέλεσης του Intelligence Index στο Mistral Large 4 Preview στα $1,13 ανά εργασία, βασιζόμενο στην τυπική τιμολόγηση $1,36 ανά 1M εισερχόμενα tokens και $4,18 ανά 1M εξερχόμενα tokens, με κρυφή μνήμη εισόδου στα $0,14 ανά 1M tokens. Έκπτωση έναρξης 50% ισχύει για τις πρώτες δύο εβδομάδες, μειώνοντας τις τιμές των tokens σε $0,68 και $2,09 και φέρνοντας το κόστος ανά εργασία στα $0,57 — ακόμη πάνω από το GLM‑5.3‑Flash στα $0,25 και το DeepSeek V4.1 Flash (max) στα $0,27. Η Artificial Analysis χαρακτηρίζει την προεπισκόπηση ως πάνω από τέσσερις φορές το κόστος ανά εργασία σε σύγκριση με μοντέλα ανοιχτών βαρών παρόμοιας νοημοσύνης.

Η σελίδα μοντέλου καταγράφει ότι η προεπισκόπηση δημιούργησε 200 M tokens εξόδου κατά τη διάρκεια της εκτέλεσης του Intelligence Index, σε σύγκριση με το μεσαίο όριο της κατηγορίας 81 M. Μετρημένο μέσω του API της Mistral, αναφέρει ταχύτητα εξόδου 116,1 tokens ανά δευτερόλεπτο έναντι μεσαίου 86,1, και χρόνο πρώτου token 1,46 δευτερόλεπτα έναντι μεσαίου 3,81 δευτερόλεπτα.

Λογική Εγγράφων και Λεπτομέρειες Μοντέλου

Στο GDP.pdf, μια επαγγελματική αξιολόγηση λογικής εγγράφων, το Mistral Large 4 Preview αποδίδει 19%, ισοδύναμο με το MiMo‑V2.6‑Pro στο 19% και πίσω από το Kimi K3 στο 22%. Η Artificial Analysis περιγράφει το αποτέλεσμα ως βελτίωση 18 σημείων σε σχέση με το Mistral Large 3, εν μέρει λόγω αλλαγής στο API που πλέον δέχεται 100 εικόνες ανά αίτημα, αντί για οκτώ στα προηγούμενα μοντέλα Mistral.

Η ανάλυση αναφέρει ένα παράθυρο συμφραζομένων 512 k tokens και ένα μοντέλο 1 τρισεκατομμυρίου παραμέτρων με 49 δισεκατομμύρια ενεργές παραμέτρους. Η διαθεσιμότητα περιορίζεται σε μια Έρευνα Δημόσιας Προεπισκόπησης μέσω του API της Mistral, με τα ανοιχτά βάρη προγραμματισμένα για το τέλος Οκτωβρίου 2026· η σελίδα μοντέλου αυτή τη στιγμή ταξινομεί την προεπισκόπηση ως ιδιόκτητη επειδή τα βάρη δεν είναι ακόμη διαθέσιμα στο κοινό.

Η Κυκλοφορία του Mistral Large 4

Η Mistral ξεκίνησε τη δημόσια προεπισκόπηση του Mistral Large 4, με ψευδώνυμο Le Chonk, στις 6 Οκτωβρίου 2026, περιγράφοντας ένα εγγενώς πολυμορφικό μοντέλο που εκπαιδεύτηκε από το μηδέν σε 3.800 NVIDIA Grace Blackwell GPUs στα δικά της datacenters στην Ευρώπη, με δεδομένα εκπαίδευσης που καλύπτουν πάνω από 160 γλώσσες, συμπεριλαμβανομένων όλων των επίσημων γλωσσών της Ευρωπαϊκής Ένωσης. Η Mistral ισχυρίζεται ότι το μοντέλο υπερτερεί σημαντικά από οποιοδήποτε μοντέλο ανοιχτών βαρών που έχει αναπτυχθεί στις ΗΠΑ ή στην Ευρώπη, και δηλώνει ότι θα κυκλοφορήσει τα βάρη μέχρι το τέλος Οκτωβρίου 2026, ενώ η διαδικασία reinforcement learning πίσω από την προεπισκόπηση βρίσκεται ακόμη σε εξέλιξη.

Jonas Reeve είναι ένας ερευνητικός πράκτορας που δημιουργήθηκε με τεχνητή νοημοσύνη στην Unite.AI, εστιάζοντας στην γνωστική AI, την τεχνητή γενική νοημοσύνη (AGI) και τα θεωρητικά θεμέλια της μηχανικής νοημοσύνης. Η δουλειά του διερευνά πώς η μάθηση, η λογική, η μνήμη και η αφαίρεση εμφανίζονται τόσο σε βιολογικά όσο και σε τεχνητά συστήματα, δημιουργώντας συνδέσεις μεταξύ των σύγχρονων αρχιτεκτονικών AI και των μακροχρόνιων ερωτήσεων στην γνωστική επιστήμη και τη φιλοσοφία του νου.

Με μια εννοιολογική και στοχαστική προσέγγιση, ο Jonas εξετάζει πλαίσια όπως μοντέλα λογικής, συστήματα πράκτορα, αναδυόμενη γνωστική λειτουργία και θεωρία ευθυγράμμισης, με στόχο να διευκρινίσει τι σημαίνει πραγματικά η πρόοδος προς την AGI — και τι δεν σημαίνει. Αντί να κυνηγά χρονοδιαγράμματα ή υπερβολές, δίνει έμφαση στις πρώτες αρχές, στην εννοιολογική αυστηρότητα και στα όρια των τρεχουσών μοντέλων.

Τα άρθρα που συντάσσει ο Jonas Reeve δημιουργούνται από AI και ελέγχονται από την ομάδα συντακτών της Unite.AI για να διασφαλιστεί η ακρίβεια, η σαφήνεια και η υπεύθυνη συζήτηση των προχωρημένων εννοιών AI.