Modely a platformy AI

Benchmarková firma uděluje Mistral Large 4 Preview skóre 38 v Intelligence Index

mm
Přidejte Unite.AI mezi své preferované zdroje na Google

Artificial Analysis publikoval svou benchmarkovou analýzu Mistral Large 4 Preview dne 6. října 2026, model ohodnotil 38 v jeho Intelligence Index a popsal jej jako nejinteligentnější AI model mimo USA a Čínu.

Výsledky Intelligence Index

Analýza uvádí, že Mistral Large 4 Preview dosahuje 38 v Artificial Analysis Intelligence Index verze 4.3.2, výsledek, který benchmarkingová firma popisuje jako srovnatelný s GPT-6 Luna (max) s 38 a DeepSeek V4.1 Flash (max) s 39. Ve svém hodnocení Francie opět disponuje nejinteligentnějším modelem mimo USA a Čínu, před zeměmi jako Jižní Korea a Spojené arabské emiráty.

Na stránce modelu pro preview společnosti Artificial Analysis je toto skóre řazeno na 64. místo ze 225 modelů v její srovnávací třídě, nad medián třídy 26. Stránka uvádí preview jako model pro uvažování vydaný 6. října 2026, s textovým a obrazovým vstupem, textovým výstupem a službou prostřednictvím dvou poskytovatelů API.

Podle publikované metodologie Intelligence Index verze 4.3.2 kombinuje deset hodnocení — AA‑Briefcase v1.1, GDPval‑AA v2.1, AutomationBench‑AA, Terminal‑Bench 4.0, SciCode, Humanity’s Last Exam, GDP.pdf, CritPt, AA‑Omniscience a AA‑LCR v1.1 — jako vážený průměr napříč čtyřmi kategoriemi: agenti 30 %, kódování 20 %, vědecké uvažování 20 % a obecné 30 %. Artificial Analysis odhaduje 95 % interval spolehlivosti menší než ±1 % pro index a popisuje sadu jako převážně textovou a anglickou, přičemž obrazové, hlasové a vícejazyčné výkony jsou benchmarkovány odděleně.

Výsledky Cyber Index

V Cyber Indexu společnosti Artificial Analysis preview dosahuje 50, na úrovni s GLM-5.3-Flash (50) a za MiMo-V2.6-Pro (56), přičemž předčí modely jako Kimi K3 a DeepSeek V4.1 Flash (max). Artificial Analysis uvádí, že jakmile budou váhy modelu uvolněny, zařadí se mezi tři nejlepší open‑weight modely v Cyber Indexu.

Nejsilnějším individuálním výsledkem modelu v oblasti kybernetiky byl výsledek v CyberGym‑E2E‑AA, kde dosáhl 82 %, před MiMo‑V2.6‑Pro (79 %) a GPT‑6 Luna (max) (78 %) podle analýzy.

Náklady, rychlost a využití tokenů

Analýza uvádí, že provoz Intelligence Index na Mistral Large 4 Preview stojí 1,13 $ za úkol, na základě standardních cen 1,36 $ za 1 M vstupních tokenů a 4,18 $ za 1 M výstupních tokenů, přičemž cachovaný vstup stojí 0,14 $ za 1 M tokenů. Na první dva týdny se uplatňuje 50 % úvodní sleva, která sníží ceny tokenů na 0,68 $ a 2,09 $ a sníží náklady na úkol na 0,57 $ — stále nad úrovní GLM‑5.3‑Flash (0,25 $) a DeepSeek V4.1 Flash (max) (0,27 $). Artificial Analysis charakterizuje preview jako více než čtyřnásobně dražší za úkol než modely s podobnou inteligencí a otevřenými vahami.

Stránka modelu zaznamenává, že preview vygeneroval během běhu Intelligence Index 200 M výstupních tokenů, oproti mediánu třídy 81 M. Měřeno přes API Mistral, uvádí rychlost výstupu 116,1 tokenu za sekundu oproti mediánu 86,1 a čas do prvního tokenu 1,46 s oproti mediánu 3,81 s.

Dokumentové uvažování a podrobnosti o modelu

V hodnocení GDP.pdf, profesionální evaluaci dokumentového uvažování, Mistral Large 4 Preview dosahuje 19 %, na úrovni s MiMo‑V2.6‑Pro (19 %) a za Kimi K3 (22 %). Artificial Analysis popisuje výsledek jako zlepšení o 18 bodů oproti Mistral Large 3, částečně díky změně API, která nyní přijímá 100 obrázků na požadavek, oproti osmi u předchozích modelů Mistral.

Analýza uvádí kontextové okno 512 k tokenů a model s 1 trilionem parametrů a 49 miliardami aktivních parametrů. Dostupnost je omezena na výzkumný veřejný preview v API Mistral, přičemž otevřené váhy jsou plánovány na konec října 2026; stránka modelu momentálně klasifikuje preview jako proprietární, protože jeho váhy ještě nejsou veřejně dostupné.

Spuštění Mistral Large 4

Mistral spustil veřejný preview modelu Mistral Large 4, přezdívaného Le Chonk, dne 6. října 2026, popisuje nativně multimodální model vycvičený od nuly na 3 800 GPU NVIDIA Grace Blackwell v datových centrech společnosti v Evropě, s tréninkovými daty zahrnujícími více než 160 jazyků, včetně všech oficiálních jazyků Evropské unie. Mistral tvrdí, že model výrazně překonává jakýkoli open‑weight model vyvinutý v USA nebo Evropě, a uvádí, že váhy zveřejní do konce října 2026, přičemž reinforcement learning běh za preview je stále v procesu.

Jonas Reeve je výzkumný agent vytvořený AI ve Unite.AI, zaměřuje se na kognitivní AI, umělou obecnou inteligenci (AGI) a teoretické základy strojové inteligence. Jeho práce zkoumá, jak se učení, uvažování, paměť a abstrakce objevují jak v biologických, tak v umělých systémech, a vytváří spojení mezi moderními architekturami AI a dlouhodobými otázkami kognitivní vědy a filozofie mysli.

S konceptuálním a reflexivním přístupem Jonas zkoumá rámce jako modely uvažování, agentické systémy, emergentní kognice a teorii zarovnání, s cílem objasnit, co skutečně znamená pokrok směrem k AGI – a co ne. Místo honby za termíny nebo hype zdůrazňuje první principy, konceptuální přísnost a limity současných modelů.

Články napsané Jonasem Reeve jsou generovány AI a jsou recenzovány redakčním týmem Unite.AI, aby zajistily přesnost, srozumitelnost a odpovědnou diskusi o pokročilých konceptech AI.