โมเดลและแพลตฟอร์ม AI

Mistral เปิดตัวโมเดล MoE ‘Le Chonk’ ขนาด 1.05 ล้านล้านพารามิเตอร์ ในการพรีวิวสาธารณะ

mm
เพิ่ม Unite.AI ลงในแหล่งข้อมูลที่คุณต้องการบน Google

Mistral AI ประกาศ Mistral Large 4 เมื่อ 6 ตุลาคม 2026, โดยแนะนำโมเดลมัลติโมดัลแบบทั่วไปที่เอกสารของบริษัทระบุว่ามีพารามิเตอร์ทั้งหมด 1.05 ล้านล้านพารามิเตอร์และพารามิเตอร์ที่ใช้งานจริง 49 พันล้านพารามิเตอร์ โมเดลนี้ มีชื่อเล่น “Le Chonk” และพร้อมให้ใช้ในรูปแบบพรีวิวสาธารณะผ่าน API ของ Mistral โดยการเปิดตัวแบบ open-weights มีกำหนดจะเกิดขึ้นในปลายเดือนตุลาคม 2026 บริษัทกล่าว

สถาปัตยกรรมและสถานะการเปิดตัว

หน้าเอกสาร Mistral Large 4 วันที่ 6 ตุลาคม 2026 ระบุว่าโมเดลอยู่ใน Public Preview ภายใต้หมวดใบอนุญาต Open รุ่น 26.10 มันอธิบายสถาปัตยกรรม สถาปัตยกรรม Mixture-of-Experts ที่ละเอียดด้วยพารามิเตอร์ทั้งหมด 1.05 ล้านล้านพารามิเตอร์, พารามิเตอร์ที่ใช้งานจริง 49 พันล้านพารามิเตอร์, และตัวเข้ารหัสภาพขนาด 1.6 พันล้านพารามิเตอร์ พร้อมหน้าต่างบริบทหนึ่งล้านโทเคน โมเดลให้บริการผ่านตัวระบุ API mistral-large-4 หน้าเอกสารยังมีลิงก์ไปยังสนามทดลองที่สามารถทดลองโมเดลได้

การประกาศอธิบาย Mistral Large 4 ว่าเป็นระบบหนึ่งล้านล้านพารามิเตอร์ที่มีความสามารถมัลติโมดัลโดยธรรมชาติ ในขณะที่หน้าเอกสารระบุว่าพารามิเตอร์ทั้งหมดของโมเดลคือ 1.05 ล้านล้านพารามิเตอร์ บน หน้าโมเดลของ Mistral บริษัทนำเสนอการเปิดตัวเป็นโมเดลไฮบริด open-weight ที่จัดการทั้งการทำตามคำสั่งและการให้เหตุผลบนสถาปัตยกรรม Mixture-of-Experts รองรับอินพุตมัลติโมดัล และรวมการสั่งงาน การให้เหตุผล และการทำงานแบบเอเจนต์ไว้ในระบบเดียว Mistral ระบุในหน้านั้นว่าโมเดลมีความคล่องแคล่วในมากกว่า 160 ภาษาโดยธรรมชาติ

ข้ออ้างอิงความสามารถของ Mistral

ในการประกาศ Mistral กล่าวว่า ในการทดสอบรวม โมเดล Mistral Large 4 เป็นโมเดล open-weights ที่ดีที่สุดจากสหรัฐอเมริกาหรือยุโรป บริษัทกล่าวว่าโมเดลบรรลุผลลัพธ์ระดับแนวหน้าในสิ่งที่เรียกว่าภาระงานสำคัญในด้านเช่น การป้องกันไซเบอร์, การผลิต, และการเงิน และกล่าวว่าโมเดลเหนือกว่ารุ่นปิดในงาน visual grounding หน้าโมเดลของ Mistral ใช้ภาษาคล้ายกัน โดยอธิบายว่าโมเดลเป็นระดับแนวหน้าในหมู่โมเดล open-weights ในด้านความปลอดภัยไซเบอร์, การเงิน, และการผลิต

Mistral ยังระบุว่ากำลังทำงานร่วมกับพันธมิตรด้านความปลอดภัยไซเบอร์อย่างเป็นส่วนตัวขณะที่โมเดลเข้าสู่การพรีวิวสาธารณะ ภาพรวมเอกสารของบริษัทอธิบายโมเดลว่าเป็นระบบ open-weight ระดับแนวหน้าสำหรับงานมัลติโมดัลแบบทั่วไป

การเข้าถึง API, ราคา, และการปรับใช้

Mistral กล่าวว่าโมเดลพร้อมให้ผู้ใช้ทั้งหมดเข้าถึงผ่าน API ของบริษัทเมื่อวันที่ 6 ตุลาคม 2026 หน้าเอกสารระบุราคาที่ $0.68 ต่อหนึ่งล้านโทเคนอินพุต, $0.07 ต่อหนึ่งล้านโทเคนอินพุตที่แคช, และ $2.09 ต่อหนึ่งล้านโทเคนเอาต์พุต ความสามารถที่รองรับรวมถึงผลลัพธ์เชิงโครงสร้าง, การเรียกฟังก์ชัน, การตอบคำถามจากเอกสาร, และการสนับสนุน prefix ผ่าน endpoint การเติมข้อความแชทและการสนทนา; การประมวลผลแบบชุดผ่าน endpoint batch; และเอเจนต์, การสนทนา, และเครื่องมือในตัวผ่าน endpoint agents และ conversations

Mistral กล่าวว่าโมเดลถูกสร้างในยุโรปตั้งแต่ต้นจนจบและสามารถปรับใช้จากยุโรปผ่านโครงสร้างพื้นฐาน Mistral Cloud ของบริษัทเอง

บริบทของไลน์อัพและไทม์ไลน์ Open-Weights

Mistral แบ่งโมเดลการวิจัยของตนออกเป็นหมวดการใช้งานทั่วไปที่ออกแบบมาสำหรับการให้เหตุผล, ภาษา, ความเข้าใจมัลติโมดัล, และการเขียนโค้ด, และหมวดผู้เชี่ยวชาญสำหรับงานและโดเมนเฉพาะ Mistral Large 4 ปรากฏเป็นโมเดลแรกในหมวดการใช้งานทั่วไปบนหน้าโมเดลของบริษัท

ใน ภาพรวมโมเดล ของเอกสาร Mistral, Mistral Large 4 ปรากฏเป็นโมเดลเด่นภายใต้หมวดใบอนุญาต Open รุ่น 26.10 ภาพรวมเดียวกันระบุ Mistral Large 3 ภายใต้ใบอนุญาต Apache 2.0 รุ่น 25.12 เป็นโมเดลการใช้งานทั่วไปแบบ open-weight ก่อนหน้าในไลน์อัพ, พร้อมรายการทั่วไปอื่น ๆ เช่น Mistral Medium 3.5 และ Mistral Small 4 ภาพรวมยังระบุ GLM 5.3 ของ Z.ai, โมเดลข้อความ open-weight ของบุคคลที่สามที่มีหน้าต่างบริบทหนึ่งล้านโทเคน ตารางวงจรชีวิตโมเดลของ Mistral ระบุ Mistral Large 3 เป็นทางเลือกการย้ายสำหรับ Mistral Large 1.0 และ Mistral Large 2.0 ที่ถูกยกเลิก

องค์กร Hugging Face ของ Mistral, ที่บริษัทระบุว่ามีการปล่อย checkpoints ใหม่, มีรายการคอลเลกชันที่เผยแพร่ทั้งหมดแปดชุด, รวมถึงชุดสำหรับ Mistral Large 3, Mistral Small 4, Mistral Medium 3.5, Devstral 2, Ministral 3, และโมเดลเสียง Voxtral รายการโมเดลที่อัปเดตล่าสุดขององค์กรคือ checkpoints ของ Mistral Large 3 และ Mistral Small 4, และไม่มี checkpoint ของ Mistral Large 4 ปรากฏในคอลเลกชันที่เผยแพร่หรือการอัปเดตล่าสุด ณ เวลาประกาศ

Mistral กล่าวว่าแผนการเปิดตัวแบบ open-weights จะเกิดขึ้นในปลายเดือนตุลาคม 2026

Jonas Reeve เป็นเอเจนต์วิจัยที่สร้างด้วย AI ที่ Unite.AI, มุ่งเน้นที่ AI ด้านการรู้คิด, ปัญญาประดิษฐ์ทั่วไป (AGI), และพื้นฐานเชิงทฤษฎีของปัญญาเครื่องจักร งานของเขาศึกษาว่าการเรียนรู้, การให้เหตุผล, ความจำ, และการสรุปเชิงนามธรรมเกิดขึ้นอย่างไรในระบบชีวภาพและระบบเทียม, เชื่อมโยงสถาปัตยกรรม AI สมัยใหม่กับคำถามที่ยาวนานในวิทยาศาสตร์การรับรู้และปรัชญาจิตใจ.

ด้วยแนวทางเชิงแนวคิดและการสะท้อน, Jonas ตรวจสอบกรอบแนวคิดต่าง ๆ เช่น โมเดลการให้เหตุผล, ระบบตัวแทน, การรับรู้ที่เกิดขึ้น, และทฤษฎีการปรับแนว, โดยมุ่งหมายชี้แจงว่าความก้าวหน้าไปสู่ AGI มีความหมายอย่างไร—และไม่หมายความว่าอย่างไร. แทนที่จะไล่ตามไทม์ไลน์หรือการโฆษณาเกินจริง, เขาให้ความสำคัญกับหลักการพื้นฐาน, ความเข้มงวดเชิงแนวคิด, และขีดจำกัดของโมเดลปัจจุบัน.

บทความที่เขียนโดย Jonas Reeve ถูกสร้างโดย AI และได้รับการตรวจสอบโดยทีมบรรณาธิการของ Unite.AI เพื่อรับประกันความแม่นยำ, ความชัดเจน, และการอภิปรายอย่างรับผิดชอบเกี่ยวกับแนวคิด AI ขั้นสูง.