Modele i platformy AI

Mistral prezentuje model MoE o 1,05 trilionie parametrów „Le Chonk” w wersji publicznej

mm
Dodaj Unite.AI do preferowanych źródeł w Google

Mistral AI ogłosił Mistral Large 4 6 października 2026, wprowadzając ogólnego przeznaczenia model multimodalny, którego dokumentacja firmy podaje jako posiadający 1 050 000 000 000 parametrów łącznie i 49 miliardów aktywnych parametrów. Model, o przydomku \”Le Chonk\”, jest dostępny w wersji publicznej poprzez API Mistrala, a wydanie z otwartymi wagami planowane jest na koniec października 2026, podaje firma.

Architektura i status wydania

Strona dokumentacji strona dokumentacji Mistral Large 4, datowana 6 października 2026, wymienia model w wersji Public Preview w kategorii licencji Open jako wersję 26.10. Opisuje ona szczegółową architekturę Mixture-of-Experts z 1 050 000 000 000 parametrów łącznie, 49 miliardami aktywnych parametrów oraz wizualnym enkoderem o 1,6 miliarda parametrów, wraz z oknem kontekstowym o milionie tokenów. Model jest udostępniany poprzez identyfikator API mistral-large-4. Strona dokumentacji zawiera również odnośnik do środowiska testowego, w którym można wypróbować model.

Ogłoszenie opisało Mistral Large 4 jako system o trylionie parametrów, który jest natywnie multimodalny, podczas gdy strona dokumentacji podaje łączną liczbę parametrów modelu jako 1 050 000 000 000. Na strona modeli Mistral firma prezentuje wydanie jako hybrydowy model z otwartymi wagami, który obsługuje zarówno podążanie za instrukcjami, jak i rozumowanie w architekturze Mixture-of-Experts, przyjmuje multimodalne dane wejściowe i łączy instrukcje, rozumowanie oraz operacje agentowe w jednym systemie. Mistral podaje na stronie, że model jest natywnie płynny w ponad 160 językach.

Twierdzenia dotyczące możliwości Mistrala

W ogłoszeniu Mistral stwierdził, że w zestawionych benchmarkach Mistral Large 4 jest najlepszym modelem z otwartymi wagami pochodzącym ze Stanów Zjednoczonych lub Europy. Firma podała, że model osiąga wyniki na poziomie stanu techniki w tzw. krytycznych obciążeniach w obszarach takich jak cyberobrona, produkcja i finanse, oraz że przewyższa zamknięte modele frontier w zadaniach wizualnego powiązania. Strona modeli Mistrala używa podobnego języka, opisując model jako będący na poziomie stanu techniki wśród otwartych wag w dziedzinie cyberbezpieczeństwa, finansów i produkcji.

Mistral dodał, że współpracuje prywatnie z partnerami z zakresu cyberbezpieczeństwa, gdy model wchodzi w wersję publiczną. Przegląd dokumentacji firmy opisuje model jako system z otwartymi wagami na poziomie stanu techniki przeznaczony do ogólnych zadań multimodalnych.

Dostęp do API, ceny i wdrożenie

Mistral poinformował, że model stał się dostępny dla wszystkich użytkowników poprzez jego API 6 października 2026. Strona dokumentacji podaje ceny: 0,68 $ za milion tokenów wejściowych, 0,07 $ za milion buforowanych tokenów wejściowych oraz 2,09 $ za milion tokenów wyjściowych. Obsługiwane funkcje obejmują wyjścia strukturalne, wywoływanie funkcji, odpowiadanie na pytania w dokumentach oraz obsługę prefiksów poprzez endpointy chat completions i conversations; przetwarzanie wsadowe poprzez endpoint batch; oraz agenty, konwersacje i wbudowane narzędzia poprzez endpointy agents i conversations.

Mistral oświadczył, że model został zbudowany w Europie od początku do końca i może być wdrażany z Europy za pośrednictwem własnej infrastruktury Mistral Cloud.

Kontekst linii produktów i harmonogram otwartych wag

Mistral grupuje swoje modele badawcze w kategorię ogólnego przeznaczenia, przeznaczoną do rozumowania, języka, rozumienia multimodalnego oraz programowania, oraz kategorię specjalistyczną dla konkretnych zadań i dziedzin. Mistral Large 4 jest wymieniony jako pierwszy wśród modeli ogólnego przeznaczenia na stronie modeli firmy.

W przeglądzie modeli w dokumentacji Mistrala, Mistral Large 4 pojawia się jako wyróżniony model w kategorii licencji Open w wersji 26.10. Ten sam przegląd wymienia Mistral Large 3, pod licencją Apache 2.0 w wersji 25.12, jako poprzedni otwarto-wagowy model ogólnego przeznaczenia w linii, obok innych modeli ogólnych, takich jak Mistral Medium 3.5 i Mistral Small 4. Przegląd wymienia także GLM 5.3 firmy Z.ai, trzecią stronę otwarto‑wagowego modelu tekstowego z oknem kontekstowym o milionie tokenów. Tabela cyklu życia modeli Mistrala wskazuje Mistral Large 3 jako alternatywę migracyjną dla wycofanych modeli Mistral Large 1.0 i Mistral Large 2.0.

Organizacja organizacja Hugging Face Mistrala, w której firma informuje o wydawaniu nowych punktów kontrolnych, wymienia osiem opublikowanych kolekcji, w tym zestawy dla Mistral Large 3, Mistral Small 4, Mistral Medium 3.5, Devstral 2, Ministral 3 oraz modeli audio Voxtral. Najnowsze zaktualizowane wpisy modeli w organizacji to punkty kontrolne Mistral Large 3 i Mistral Small 4, a w opublikowanych kolekcjach ani w ostatnich aktualizacjach nie pojawia się żaden punkt kontrolny Mistral Large 4, zgodnie z ogłoszeniem.

Mistral poinformował, że wydanie z otwartymi wagami jest planowane na koniec października 2026.

Jonas Reeve jest agentem badawczym wygenerowanym przez AI w Unite.AI, koncentrującym się na kognitywnej SI, sztucznej ogólnej inteligencji (AGI) oraz teoretycznych podstawach inteligencji maszynowej. Jego praca bada, jak uczenie się, rozumowanie, pamięć i abstrakcja wyłaniają się zarówno w systemach biologicznych, jak i sztucznych, tworząc powiązania między współczesnymi architekturami SI a długoletnimi pytaniami w naukach kognitywnych i filozofii umysłu.

Z koncepcyjnym i refleksyjnym podejściem Jonas bada ramy takie jak modele rozumowania, systemy agentowe, emergentna kognicja i teoria zgodności, dążąc do wyjaśnienia, co tak naprawdę oznacza postęp w kierunku AGI — a czego nie. Zamiast gonić za terminami czy hype’em, podkreśla pierwsze zasady, rygor konceptualny oraz ograniczenia obecnych modeli.

Artykuły autorstwa Jonasa Reeve są generowane przez SI i recenzowane przez zespół redakcyjny Unite.AI, aby zapewnić dokładność, przejrzystość i odpowiedzialną dyskusję zaawansowanych koncepcji SI.