Mô hình và nền tảng AI
Công ty Benchmark cho Mistral Large 4 Preview đạt 38 điểm Trí tuệ

Artificial Analysis đã công bố phân tích chuẩn mực của mình về Mistral Large 4 Preview vào ngày 6 tháng 10, 2026, cho mô hình đạt 38 trên Chỉ số Trí tuệ và mô tả nó là mô hình AI thông minh nhất ngoài Hoa Kỳ và Trung Quốc.
Kết quả Chỉ số Trí tuệ
Phân tích cho biết Mistral Large 4 Preview đạt 38 trên Chỉ số Trí tuệ Artificial Analysis phiên bản 4.3.2, kết quả mà công ty chuẩn mực mô tả là tương đương với GPT-6 Luna (tối đa) ở 38 và DeepSeek V4.1 Flash (tối đa) ở 39. Trong cách nhìn của họ, Pháp đã trở lại với mô hình thông minh nhất ngoài Hoa Kỳ và Trung Quốc, vượt lên trước các quốc gia như Hàn Quốc và Các Tiểu vương quốc Ả Rập Thống nhất.
Trên trang mô hình cho bản xem trước của Artificial Analysis, điểm số này xếp mô hình ở vị trí 64 trong số 225 mô hình thuộc lớp so sánh của họ, cao hơn mức trung vị lớp là 26. Trang này liệt kê bản xem trước là một mô hình suy luận được phát hành vào ngày 6 tháng 10, 2026, với đầu vào văn bản và hình ảnh, đầu ra văn bản, và dịch vụ thông qua hai nhà cung cấp API.
Theo phương pháp luận Chỉ số Trí tuệ đã công bố, phiên bản 4.3.2 kết hợp mười đánh giá — AA‑Briefcase v1.1, GDPval‑AA v2.1, AutomationBench‑AA, Terminal‑Bench 4.0, SciCode, Humanity’s Last Exam, GDP.pdf, CritPt, AA‑Omniscience và AA‑LCR v1.1 — như một trung bình có trọng số qua bốn danh mục: đại lý 30%, lập trình 20%, suy luận khoa học 20%, và chung 30%. Artificial Analysis ước tính khoảng tin cậy 95% dưới ±1% cho chỉ số và mô tả bộ công cụ chủ yếu dựa trên văn bản và tiếng Anh, trong khi hiệu năng hình ảnh, giọng nói và đa ngôn ngữ được đánh giá riêng.
Kết quả Chỉ số An ninh mạng
Trên Chỉ số An ninh mạng của Artificial Analysis, bản xem trước đạt 50, bằng với GLM-5.3-Flash ở 50 và thấp hơn MiMo‑V2.6‑Pro ở 56, trong khi vượt qua các mô hình như Kimi K3 và DeepSeek V4.1 Flash (tối đa). Artificial Analysis cho biết một khi trọng số của mô hình được phát hành, nó sẽ xếp vào ba mô hình mở trọng số hàng đầu trên Chỉ số An ninh mạng.
Kết quả an ninh mạng cá nhân mạnh nhất của mô hình đạt trên CyberGym‑E2E‑AA, nơi nó ghi 82%, vượt MiMo‑V2.6‑Pro ở 79% và GPT-6 Luna (tối đa) ở 78%, theo phân tích.
Chi phí, Tốc độ và Sử dụng Token
Phân tích đưa ra chi phí chạy Chỉ số Trí tuệ trên Mistral Large 4 Preview là 1,13 $ mỗi tác vụ, dựa trên giá chuẩn 1,36 $ cho mỗi 1 triệu token đầu vào và 4,18 $ cho mỗi 1 triệu token đầu ra, với token đầu vào được lưu trong bộ nhớ cache với giá 0,14 $ cho mỗi 1 triệu token. Giảm giá ra mắt 50 % áp dụng trong hai tuần đầu, giảm giá token xuống 0,68 $ và 2,09 $ và đưa chi phí mỗi tác vụ xuống 0,57 $ — vẫn cao hơn GLM-5.3-Flash ở 0,25 $ và DeepSeek V4.1 Flash (tối đa) ở 0,27 $. Artificial Analysis mô tả bản xem trước có chi phí mỗi tác vụ hơn bốn lần so với các mô hình mở trọng số có trí tuệ tương tự.
Trang mô hình ghi nhận bản xem trước tạo ra 200 triệu token đầu ra trong suốt quá trình chạy Chỉ số Trí tuệ, so với mức trung vị lớp là 81 triệu. Được đo qua API của Mistral, nó báo tốc độ đầu ra 116,1 token mỗi giây so với trung vị 86,1, và thời gian tới token đầu tiên là 1,46 giây so với trung vị 3,81 giây.
Lý luận Tài liệu và Chi tiết Mô hình
Trong GDP.pdf, một đánh giá chuyên nghiệp về lý luận tài liệu, Mistral Large 4 Preview đạt 19 %, tương đương với MiMo‑V2.6‑Pro ở 19 % và thấp hơn Kimi K3 ở 22 %. Artificial Analysis mô tả kết quả này là sự cải thiện 18 điểm so với Mistral Large 3, một phần do thay đổi API cho phép nhận 100 hình ảnh mỗi yêu cầu, tăng từ tám hình ảnh của các mô hình Mistral trước đây.
Phân tích liệt kê cửa sổ ngữ cảnh 512 nghìn token và một mô hình 1 nghìn tỷ tham số với 49 tỷ tham số hoạt động. Khả dụng bị giới hạn ở Bản xem trước Nghiên cứu Công cộng trên API của Mistral, với trọng số mở dự kiến vào cuối tháng 10 năm 2026; hiện tại trang mô hình phân loại bản xem trước là độc quyền vì trọng số chưa được công khai.
Ra mắt Mistral Large 4
Mistral đã ra mắt bản xem trước công cộng của Mistral Large 4, có biệt danh Le Chonk, vào ngày 6 tháng 10, 2026, mô tả một mô hình đa phương tiện nguyên bản được huấn luyện từ đầu trên 3.800 GPU NVIDIA Grace Blackwell trong các trung tâm dữ liệu của công ty tại châu Âu, với dữ liệu huấn luyện bao phủ hơn 160 ngôn ngữ, bao gồm mọi ngôn ngữ chính thức của Liên minh Châu Âu. Mistral khẳng định mô hình này vượt trội đáng kể so với bất kỳ mô hình mở trọng số nào được phát triển ở Hoa Kỳ hoặc châu Âu, và cho biết sẽ phát hành trọng số vào cuối tháng 10 năm 2026, trong khi quá trình học tăng cường phía sau bản xem trước vẫn đang diễn ra.












