AI-modeller og platforme
SpaceXAI Lancerer Grok 4.6 Til Lange-Kørende Agenter

SpaceXAI, det kunstig intelligensselskab tidligere kendt som xAI, udgav Grok 4.6 den 12. august 2026, en ny flagship-model bygget til lange-kørende agenter og mere ambitiøse interaktive og visuelle arbejder. Modellen er tilgængelig samme dag i Cursor-kodeeditoren og selskabets eget Grok Build-værktøj, samt gennem dets API, til en startpris på 2 dollar pr. million input-token og 6 dollar pr. million output-token, ifølge selskabets meddelelse.
Grok 4.6 bygger på Grok 4.5 og udvider selskabets indsats i agentic coding og videnarbejde.
Hvad Grok 4.6 Gør
Selskabet beskriver Grok 4.6 som en model, der “bliver ved komplekse opgaver over mange skridt”, uanset om det handler om at researche et emne, arbejde på tværs af en kodebase eller omdanne en bred produktidé til en fungerende første version af en applikation. På længere tidsrummer har selskabet observeret mere selvtest og verificering, hvor modellen checker sin egen arbejde, før den går videre, og stærkere første forsøg på visuelle og interaktive projekter end det så med Grok 4.5.
Kapacitetsgevinsterne hviler på en længere supplerende træningsgang end Grok 4.5 fik. SpaceXAI brugte kurateret model-genereret data til reasoning og tekniske koncepter, en forbedret optimizer og SFT-traektorier regenereret af Grok 4.5 på tværs af reasoning-bestræbelser, agent-harnesser og domæner, herunder STEM, software-ingeniørarbejde og videnarbejde, med problematiske spor filtreret ud af model-baserede checks. Modellen blev derefter trænet på en række agentic reinforcement-learning-opgaver, herunder domænespecifikke miljøer til kernel-optimering, webudvikling og computer-aided design.
Benchmark-Konkurrencen
SpaceXAI rapporterer, at Grok 4.6 matcher OpenAI’s GPT-5.6 Sol på Artificial Analysis Intelligence Index, en sammensat af ni benchmarks, med begge modeller, der scorer 61, bag Anthropic’s Fable 5 Max på 62 og foran Grok 4.5 High på 56. Selskabets egen evalueringstabel viser et mere blandet billede over individuelle tests.
På DeepSWE v1.1 software-ingeniør-benchmarken scorede Grok 4.6 65,9%, op fra Grok 4,5’s 54% men bag GPT-5.6 Sol Max på 73%. På Terminal-Bench v3.0 nåede den 26%, et stort spring fra Grok 4.5’s 15,7% men langt bag den omtrentlige 34% posteret af GPT-5.6 Sol Max og Fable 5 Max. Den ledede feltet på GDPVal-AA v2, en videnarbejds-evaluering, på 1753, og opnåede gevinster på CursorBench og FrontierCode. Talene er selskabets egne, med tredjeparts-model-scores trukket fra selv-rapporteret eller offentligt tilgængelige resultater, og ingen uafhængig evaluering har endnu bekræftet dem.
Lanceringen lander i en overfyldt del af markedet. Anthropic har været ved at skubbe sin Opus-linje mod frontier-intelligens til aggressive priser, og OpenAI’s GPT-5.6-familie er den siddende mål for agentic coding. SpaceXAI’s strategi er at konkurrere på pris og distribution såvel som rå kapacitet: til 2 dollar pr. million input-token, underkutter Grok 4.6 mange frontier-rivaler, og selskabet tilbyder dobbelt så meget inkluderet brug i Grok Build og Cursor i den første uge for at trække udviklere over på modellen. Ud over Cursor og Grok Build er den også tilgængelig gennem partnere, herunder OpenRouter, Vercel og Cloudflare.
Et Nyt Selskab Bag Modellen
Grok 4.6 er den klareste produkt-erklæring hidtil fra et selskab, der er blevet helt omstruktureret over det sidste år.
Grok 4.6 er den første flagship-model, der bærer SpaceXAI-navnet fra bunden, og dens pris, partner-distribution og agentic fokus viser, at afdelingen positionerer Grok som en udvikler- og enterprise-platform snarere end en funktion af X-socialnetværket.












