AI-modeller og platforme
SpaceXAI Lancerer Grok 4.6 Til Lange-KÃļrende Agenter

SpaceXAI, det kunstig intelligensselskab tidligere kendt som xAI, udgav Grok 4.6 den 12. august 2026, en ny flagship-model bygget til lange-kÃļrende agenter og mere ambitiÃļse interaktive og visuelle arbejder. Modellen er tilgÃĶngelig samme dag i Cursor-kodeeditoren og selskabets eget Grok Build-vÃĶrktÃļj, samt gennem dets API, til en startpris pÃĨ 2 dollar pr. million input-token og 6 dollar pr. million output-token, ifÃļlge selskabets meddelelse.
Grok 4.6 bygger pÃĨ Grok 4.5 og udvider selskabets indsats i agentic coding og videnarbejde.
Hvad Grok 4.6 GÃļr
Selskabet beskriver Grok 4.6 som en model, der âbliver ved komplekse opgaver over mange skridtâ, uanset om det handler om at researche et emne, arbejde pÃĨ tvÃĶrs af en kodebase eller omdanne en bred produktidÃĐ til en fungerende fÃļrste version af en applikation. PÃĨ lÃĶngere tidsrummer har selskabet observeret mere selvtest og verificering, hvor modellen checker sin egen arbejde, fÃļr den gÃĨr videre, og stÃĶrkere fÃļrste forsÃļg pÃĨ visuelle og interaktive projekter end det sÃĨ med Grok 4.5.
Kapacitetsgevinsterne hviler pÃĨ en lÃĶngere supplerende trÃĶningsgang end Grok 4.5 fik. SpaceXAI brugte kurateret model-genereret data til reasoning og tekniske koncepter, en forbedret optimizer og SFT-traektorier regenereret af Grok 4.5 pÃĨ tvÃĶrs af reasoning-bestrÃĶbelser, agent-harnesser og domÃĶner, herunder STEM, software-ingeniÃļrarbejde og videnarbejde, med problematiske spor filtreret ud af model-baserede checks. Modellen blev derefter trÃĶnet pÃĨ en rÃĶkke agentic reinforcement-learning-opgaver, herunder domÃĶnespecifikke miljÃļer til kernel-optimering, webudvikling og computer-aided design.
Benchmark-Konkurrencen
SpaceXAI rapporterer, at Grok 4.6 matcher OpenAIâs GPT-5.6 Sol pÃĨ Artificial Analysis Intelligence Index, en sammensat af ni benchmarks, med begge modeller, der scorer 61, bag Anthropicâs Fable 5 Max pÃĨ 62 og foran Grok 4.5 High pÃĨ 56. Selskabets egen evalueringstabel viser et mere blandet billede over individuelle tests.
PÃĨ DeepSWE v1.1 software-ingeniÃļr-benchmarken scorede Grok 4.6 65,9%, op fra Grok 4,5âs 54% men bag GPT-5.6 Sol Max pÃĨ 73%. PÃĨ Terminal-Bench v3.0 nÃĨede den 26%, et stort spring fra Grok 4.5âs 15,7% men langt bag den omtrentlige 34% posteret af GPT-5.6 Sol Max og Fable 5 Max. Den ledede feltet pÃĨ GDPVal-AA v2, en videnarbejds-evaluering, pÃĨ 1753, og opnÃĨede gevinster pÃĨ CursorBench og FrontierCode. Talene er selskabets egne, med tredjeparts-model-scores trukket fra selv-rapporteret eller offentligt tilgÃĶngelige resultater, og ingen uafhÃĶngig evaluering har endnu bekrÃĶftet dem.
Lanceringen lander i en overfyldt del af markedet. Anthropic har vÃĶret ved at skubbe sin Opus-linje mod frontier-intelligens til aggressive priser, og OpenAIâs GPT-5.6-familie er den siddende mÃĨl for agentic coding. SpaceXAIâs strategi er at konkurrere pÃĨ pris og distribution sÃĨvel som rÃĨ kapacitet: til 2 dollar pr. million input-token, underkutter Grok 4.6 mange frontier-rivaler, og selskabet tilbyder dobbelt sÃĨ meget inkluderet brug i Grok Build og Cursor i den fÃļrste uge for at trÃĶkke udviklere over pÃĨ modellen. Ud over Cursor og Grok Build er den ogsÃĨ tilgÃĶngelig gennem partnere, herunder OpenRouter, Vercel og Cloudflare.
Et Nyt Selskab Bag Modellen
Grok 4.6 er den klareste produkt-erklÃĶring hidtil fra et selskab, der er blevet helt omstruktureret over det sidste ÃĨr.
Grok 4.6 er den fÃļrste flagship-model, der bÃĶrer SpaceXAI-navnet fra bunden, og dens pris, partner-distribution og agentic fokus viser, at afdelingen positionerer Grok som en udvikler- og enterprise-platform snarere end en funktion af X-socialnetvÃĶrket.












