โมเดลและแพลตฟอร์ม AI
SpaceXAI เปิดตัว Grok 4.6 สำหรับเอเย่นต์ที่ทำงานยาว

SpaceXAI บริษัทอินเทลลิเจนต์เทียมที่เคยเป็นที่รู้จักในชื่อ xAI ได้เปิดตัว Grok 4.6 เมื่อวันที่ 12 สิงหาคม 2026 เป็นโมเดลแฟลกชิปใหม่ที่สร้างขึ้นสำหรับเอเย่นต์ที่ทำงานยาวและงานอินเทอร์แอคทีฟและวิชวลที่มีความทะเยอทะยานมากขึ้น โมเดลนี้มีจำหน่ายในวันเดียวกันในตัวแก้ไขโค้ด Cursor และเครื่องมือ Grok Build ของบริษัทเอง รวมถึงผ่าน API ด้วยราคาเริ่มต้นที่ 2 ดอลลาร์ต่อล้านโทเค็นอินพุตและ 6 ดอลลาร์ต่อล้านโทเคนออัพพุต ตามที่ระบุใน ประกาศของบริษัท
Grok 4.6 สร้างขึ้นบนพื้นฐานของ Grok 4.5 และขยายการผลักดันของบริษัทในการเขียนโค้ดและงานความรู้
สิ่งที่ Grok 4.6 ทำ
บริษัทอธิบาย Grok 4.6 ว่าเป็นโมเดลที่ “ยังคงอยู่กับงานที่ซับซ้อนหลายขั้นตอน” ไม่ว่าจะเป็นการวิจัยหัวข้อ การทำงานข้ามฐานโค้ด หรือการเปลี่ยนแนวคิดผลิตภัณฑ์ที่กว้างขวางให้เป็นเวอร์ชันแรกที่ทำงานของแอปพลิเคชัน ในเส้นทางที่ยาวขึ้น บริษัทระบุว่าได้สังเกตเห็นการตรวจสอบและยืนยันตัวเองมากขึ้น โดยโมเดลตรวจสอบงานของตัวเองก่อนที่จะดำเนินการต่อ และมีการผ่านขั้นตอนแรกที่แข็งแกร่งกว่าในโครงการวิชวลและอินเทอร์แอคทีฟมากกว่าที่เห็นใน Grok 4.5
ความสามารถที่เพิ่มขึ้นอยู่บนพื้นฐานของการฝึกอบรมเสริมที่ยาวขึ้นกว่า Grok 4.5 ได้รับ SpaceXAI ใช้ข้อมูลที่สร้างโดยโมเดลและคัดเลือกมาเพื่อการให้เหตุผลและแนวคิดทางเทคนิค ตัวเพิ่มประสิทธิภาพที่ดีขึ้น และ SFT ที่สร้างขึ้นใหม่โดย Grok 4.5 ในความพยายามในการให้เหตุผล ห่วงโซ่เอเย่นต์ และโดเมนต่างๆ รวมถึง STEM วิศวกรรมซอฟต์แวร์ และงานความรู้ โดยมีเส้นทางที่มีปัญหากรองออกโดยการตรวจสอบแบบโมเดล ต่อมาโมเดลได้รับการฝึกอบรมบนงานการเรียนรู้แบบเสริมกำลังแบบอเจนติก รวมถึงสภาพแวดล้อมเฉพาะโดเมนสำหรับการเพิ่มประสิทธิภาพเคอร์เนล การพัฒนาเว็บ และการออกแบบโดยใช้คอมพิวเตอร์
การแข่งขัน Benchmark
SpaceXAI รายงานว่า Grok 4.6 เทียบเท่ากับ GPT-5.6 Sol ของ OpenAI ในดัชนีความฉลาดการวิเคราะห์เทียม ซึ่งเป็นผลรวมของเกณฑ์มาตรฐาน 9 รายการ โดยทั้งสองโมเดลได้คะแนน 61 คะแนน ตามหลัง Fable 5 Max ของ Anthropic ที่ 62 และนำหน้า Grok 4.5 High ที่ 56 ตารางการประเมินของบริษัทเองแสดงภาพที่หลากหลายมากขึ้นในแต่ละการทดสอบ
ในแบบทดสอบ DeepSWE v1.1 สำหรับการวิศวกรรมซอฟต์แวร์ Grok 4.6 ได้คะแนน 65.9% ขึ้นจาก 54% ของ Grok 4.5 แต่ตามหลัง GPT-5.6 Sol Max ที่ 73% ใน Terminal-Bench v3.0 มันถึง 26% เป็นขั้นตอนที่ใหญ่จาก 15.7% ของ Grok 4.5 แต่ตามหลัง GPT-5.6 Sol Max และ Fable 5 Max ที่ประมาณ 34% มันนำหน้าใน GDPVal-AA v2 การประเมินงานความรู้ที่ 1753 และมีการปรับปรุงใน CursorBench และ FrontierCode ตัวเลขเหล่านี้เป็นของบริษัท โดยมีคะแนนโมเดลของบุคคลที่สามจากผลลัพธ์ที่รายงานโดยตนเองหรือสาธารณะ และยังไม่มีการประเมินอิสระที่ได้ยืนยันสิ่งเหล่านี้
การเปิดตัวนี้ลงในตลาดที่มีการแข่งขันสูง Anthropic ได้ผลักดันไลน์ Opus ไปสู่ความฉลาดด้านหน้าด้วยราคาที่ก้าวร้าว และ GPT-5.6 ของ OpenAI เป็นเป้าหมายที่เป็นที่ยอมรับสำหรับการเขียนโค้ดแบบอเจนติก กลยุทธ์ของ SpaceXAI คือการแข่งขันด้านราคาและกระจายสินค้ามากที่สุดเท่าที่จะเป็นไปได้: ที่ 2 ดอลลาร์ต่อล้านโทเค็นอินพุต Grok 4.6 มีราคาถูกกว่าโมเดลด้านหน้าหลายรุ่น และบริษัทกำลังเสนอการใช้งานที่รวมอยู่ใน Grok Build และ Cursor สองเท่าในช่วงสัปดาห์แรกเพื่อดึงนักพัฒนาไปยังโมเดลนี้ นอกเหนือจาก Cursor และ Grok Build มันใช้งานได้ผ่านพันธมิตรรวมถึง OpenRouter, Vercel และ Cloudflare
บริษัทใหม่เบื้องหลังโมเดล
Grok 4.6 เป็นคำสั่งผลิตภัณฑ์ที่ชัดเจนที่สุดจากธุรกิจที่ได้รับการRestructure ทั้งหมดในช่วงปีที่ผ่านมา
Grok 4.6 เป็นโมเดลแฟลกชิปแรกที่มีชื่อ SpaceXAI ตั้งแต่เริ่มต้น และราคา การกระจายสินค้า และการเน้นไปที่เอเย่นต์แสดงให้เห็นว่าแผนกนี้จัดตำแหน่ง Grok เป็นแพลตฟอร์มสำหรับนักพัฒนาและองค์กรมากกว่าเป็นคุณลักษณะของเครือข่ายสังคม X ss ที่ได้รับการRestructure ทั้งหมดในช่วงปีที่ผ่านมา Grok 4.6 เป็นโมเดลแฟลกชิปแรกที่มีชื่อ SpaceXAI ตั้งแต่เริ่มต้น และราคา การกระจายสินค้า และการเน้นไปที่เอเย่นต์แสดงให้เห็นว่าแผนกนี้จัดตำแหน่ง Grok เป็นแพลตฟอร์มสำหรับนักพัฒนาและองค์กรมากกว่าเป็นคุณลักษณะของเครือข่ายสังคม X












