Mô hình và nền tảng AI
SpaceXAI Ra Mắt Grok 4.6 Cho Các Agent Chạy Lâu

SpaceXAI, công ty trí tuệ nhân tạo trước đây được biết đến với tên xAI, đã phát hành Grok 4.6 vào ngày 12 tháng 8 năm 2026, một mô hình mới được xây dựng cho các agent chạy lâu và các công việc tương tác và trực quan tham vọng hơn. Mô hình này có sẵn cùng ngày trong trình biên tập mã Cursor và công cụ xây dựng Grok của công ty, cũng như thông qua API của nó, với giá khởi điểm là 2 đô la cho mỗi triệu token đầu vào và 6 đô la cho mỗi triệu token đầu ra, theo thông báo của công ty.
Grok 4.6 xây dựng trên Grok 4.5 và mở rộng nỗ lực của công ty trong lĩnh vực mã hóa và công việc kiến thức.
Điều Gì Grok 4.6 Làm
Công ty mô tả Grok 4.6 là một mô hình “đi cùng với các nhiệm vụ phức tạp qua nhiều bước”, dù đó là nghiên cứu một chủ đề, làm việc trên một cơ sở mã, hoặc biến một ý tưởng sản phẩm rộng thành một phiên bản ứng dụng hoạt động đầu tiên. Trên các đường dẫn dài hơn, công ty cho biết họ quan sát thấy nhiều tự kiểm tra và xác minh hơn, với mô hình kiểm tra công việc của chính nó trước khi chuyển sang, và các lần đi đầu mạnh hơn trên các dự án trực quan và tương tác so với những gì họ thấy với Grok 4.5.
Các lợi ích về khả năng dựa trên một lần đào tạo bổ sung dài hơn so với Grok 4.5. SpaceXAI sử dụng dữ liệu được tạo bởi mô hình và được kiểm duyệt cho lý lẽ và các khái niệm kỹ thuật, một bộ tối ưu hóa được cải tiến, và các đường dẫn SFT được tái tạo bởi Grok 4.5 trên các nỗ lực lý lẽ, bộ phận agent, và các lĩnh vực bao gồm STEM, kỹ thuật phần mềm, và công việc kiến thức, với các dấu vết có vấn đề được lọc ra bởi các kiểm tra dựa trên mô hình. Sau đó, mô hình được đào tạo trên một loạt các nhiệm vụ học tăng cường agentic, bao gồm các môi trường cụ thể cho lĩnh vực tối ưu hóa kernel, phát triển web, và thiết kế hỗ trợ máy tính.
Cuộc Đua Benchmark
SpaceXAI báo cáo rằng Grok 4.6 phù hợp với GPT-5.6 Sol của OpenAI trên Chỉ số Trí tuệ Phân tích Nhân tạo, một tổng hợp của chín benchmark, với cả hai mô hình đạt 61, sau Fable 5 Max của Anthropic ở 62 và trước Grok 4.5 High ở 56. Bảng đánh giá của công ty cho thấy một bức tranh hỗn hợp hơn trên các thử nghiệm cá nhân.
Trên benchmark DeepSWE v1.1 về kỹ thuật phần mềm, Grok 4.6 đạt 65,9%, tăng từ 54% của Grok 4.5 nhưng thấp hơn GPT-5.6 Sol Max ở 73%. Trên Terminal-Bench v3.0, nó đạt 26%, một bước nhảy lớn từ 15,7% của Grok 4.5 nhưng thấp hơn nhiều so với khoảng 34% được đăng bởi GPT-5.6 Sol Max và Fable 5 Max. Nó dẫn đầu trên GDPVal-AA v2, một đánh giá về công việc kiến thức, ở 1753, và đăng các lợi ích trên CursorBench và FrontierCode. Các con số này là của công ty, với các điểm số mô hình của bên thứ ba được rút từ kết quả tự báo cáo hoặc công khai, và chưa có đánh giá độc lập nào xác nhận chúng.
Sự ra mắt này diễn ra trong một phần đông đúc của thị trường. Anthropic đã đẩy dòng Opus của mình hướng tới trí tuệ tiền phong với giá cả cạnh tranh, và gia đình GPT-5.6 của OpenAI là mục tiêu đương nhiệm cho mã hóa agentic. Chiến lược của SpaceXAI là cạnh tranh về giá và phân phối cũng như khả năng thô: ở mức 2 đô la cho mỗi triệu token đầu vào, Grok 4.6 vượt trội so với nhiều đối thủ tiền phong, và công ty đang cung cấp gấp đôi số lượng sử dụng bao gồm trong Grok Build và Cursor trong tuần đầu tiên để thu hút các nhà phát triển đến với mô hình. Ngoài Cursor và Grok Build, nó cũng có sẵn thông qua các đối tác bao gồm OpenRouter, Vercel, và Cloudflare.
Công Ty Mới Đằng Sau Mô Hình
Grok 4.6 là tuyên bố sản phẩm rõ ràng nhất từ một doanh nghiệp đã được tái cấu trúc hoàn toàn trong năm qua.
Grok 4.6 là mô hình đầu tiên mang tên SpaceXAI từ đầu, và giá của nó, phân phối đối tác, và tập trung agentic cho thấy bộ phận này định vị Grok như một nền tảng cho nhà phát triển và doanh nghiệp chứ không phải là một tính năng của mạng xã hội X.












