AI-modellen en platforms
Benchmarkbedrijf geeft Mistral Large 4 Preview een Intelligentiescore van 38

Artificial Analysis publiceerde haar benchmarkanalyse van Mistral Large 4 Preview op 6 oktober 2026, waarbij het model 38 scoort op haar Intelligence Index en het beschrijft als het meest intelligente AI‑model van buiten de VS en China.
Resultaten van de Intelligence Index
De analyse meldt dat Mistral Large 4 Preview 38 scoort op de Artificial Analysis Intelligence Index versie 4.3.2, een resultaat dat het benchmarkbedrijf beschrijft als vergelijkbaar met GPT-6 Luna (max) met 38 en DeepSeek V4.1 Flash (max) met 39. Volgens deze weergave heeft Frankrijk weer het meest intelligente model van buiten de VS en China, vóór landen zoals Zuid‑Korea en de Verenigde Arabische Emiraten.
Op de modelpagina voor de preview van Artificial Analysis rangschikt die score het model op nummer 64 van 225 modellen in haar vergelijkingsklasse, boven de klassemediane van 26. De pagina vermeldt de preview als een redeneer‑model dat op 6 oktober 2026 is uitgebracht, met tekst‑ en beeldinvoer, tekstuitvoer en dienstverlening via twee API‑providers.
Volgens de gepubliceerde Intelligence Index‑methodologie combineert versie 4.3.2 tien evaluaties — AA‑Briefcase v1.1, GDPval‑AA v2.1, AutomationBench‑AA, Terminal‑Bench 4.0, SciCode, Humanity’s Last Exam, GDP.pdf, CritPt, AA‑Omniscience en AA‑LCR v1.1 — als een gewogen gemiddelde over vier categorieën: agents 30 %, codering 20 %, wetenschappelijk redeneren 20 % en algemeen 30 %. Artificial Analysis schat een 95 %‑betrouwbaarheidsinterval van minder dan ±1 % voor de index en beschrijft de suite als voornamelijk tekstgebaseerd en Engelstalig, met beeld-, spraak‑ en meertalige prestaties afzonderlijk gebenchmarked.
Resultaten van de Cyber Index
Op de Artificial Analysis Cyber Index scoort de preview 50, gelijk aan GLM-5.3-Flash met 50 en achter MiMo-V2.6-Pro met 56, terwijl hij voor modellen zoals Kimi K3 en DeepSeek V4.1 Flash (max) staat. Artificial Analysis stelt dat zodra de gewichten van het model worden vrijgegeven, het tot de top‑drie open‑weight‑modellen op de Cyber Index zal behoren.
Het sterkste individuele cyberresultaat van het model kwam op CyberGym‑E2E‑AA, waar het 82 % scoort, vóór MiMo‑V2.6‑Pro met 79 % en GPT‑6 Luna (max) met 78 %, volgens de analyse.
Kosten, snelheid en tokengebruik
De analyse stelt dat de kosten voor het uitvoeren van de Intelligence Index op Mistral Large 4 Preview $1.13 per taak bedragen, gebaseerd op standaardprijzen van $1.36 per 1M invoertokens en $4.18 per 1M uitvoertokens, met gecachte invoer tegen $0.14 per 1M tokens. Een lanceringskorting van 50 % geldt voor de eerste twee weken, waardoor tokenprijzen dalen tot $0.68 en $2.09 en de kosten per taak naar $0.57 dalen — nog steeds hoger dan GLM-5.3-Flash met $0.25 en DeepSeek V4.1 Flash (max) met $0.27. Artificial Analysis karakteriseert de preview als meer dan vier keer de kosten per taak van vergelijkbare‑intelligentie open‑weight‑modellen.
De modelpagina registreert dat de preview 200M uitvoertokens genereert gedurende de run van de Intelligence Index, tegenover een klassemediane van 81M. Gemeten via Mistral’s API meldt het een uitvoersnelheid van 116.1 tokens per seconde tegenover een mediane van 86.1, en een tijd tot eerste token van 1.46 seconden tegenover een mediane van 3.81 seconden.
Documentredenering en modeldetails
Op GDP.pdf, een professionele document‑redenerings‑evaluatie, scoort Mistral Large 4 Preview 19 %, gelijk aan MiMo‑V2.6‑Pro met 19 % en achter Kimi K3 met 22 %. Artificial Analysis beschrijft het resultaat als een verbetering van 18 punten ten opzichte van Mistral Large 3, deels veroorzaakt door een API‑wijziging die nu 100 afbeeldingen per verzoek accepteert, tegenover acht voor eerdere Mistral‑modellen.
De analyse vermeldt een contextvenster van 512 k tokens en een model met 1 triljoen parameters en 49 miljard actieve parameters. Beschikbaarheid is beperkt tot een Research Public Preview op de API van Mistral, met open gewichten gepland voor eind oktober 2026; de modelpagina classificeert de preview momenteel als propriëtair omdat de gewichten nog niet publiek beschikbaar zijn.
De lancering van Mistral Large 4
Mistral gaf de publieke preview van Mistral Large 4, met de bijnaam Le Chonk, op 6 oktober 2026, en beschrijft een van nature multimodaal model dat vanaf nul is getraind op 3.800 NVIDIA Grace Blackwell‑GPU’s in de eigen datacenters van het bedrijf in Europa, met trainingsdata in meer dan 160 talen, inclusief alle officiële talen van de Europese Unie. Mistral beweert dat het model aanzienlijk beter presteert dan elk open‑weight‑model ontwikkeld in de VS of Europa, en zegt dat het de gewichten tegen eind oktober 2026 zal vrijgeven, waarbij de reinforcement‑learning‑run achter de preview nog steeds loopt.












