AI-modeller og plattformer
SpaceXAI lanserer Grok 4.6 for langvarige agenter

SpaceXAI, det kunstige intelligensselskapet tidligere kjent som xAI, lanserte Grok 4.6 den 12. august 2026, en ny flaggskipmodell bygget for langvarige agenter og mer ambisiøse interaktive og visuelle prosjekter. Modellen er tilgjengelig samme dag i kodeeditoren Cursor og selskapets eget verktøy Grok Build, samt gjennom deres API, til en startpris på 2 dollar per million inndata-token og 6 dollar per million utdata-token, ifølge selskapets annonsering.
Grok 4.6 bygger på Grok 4.5 og utvider selskapets satsing på agensbasert kode og kunnskapsarbeid.
Hva Grok 4.6 gjør
Selskapet beskriver Grok 4.6 som en modell som “holder seg med komplekse oppgaver over mange steg”, enten det gjelder å forske på et tema, arbeide over en kodebase eller omdanne en bred produktide til en fungerende første versjon av en applikasjon. På lengre tidsperioder observerte selskapet mer selvtesting og verifisering, med modellen som sjekker sitt eget arbeid før den går videre, og sterkere første forsøk på visuelle og interaktive prosjekter enn de så med Grok 4.5.
Kapasitetsgevinningene hviler på en lengre supplerende trening enn Grok 4.5 fikk. SpaceXAI brukte kuratert modellgenerert data for resonnering og tekniske konsepter, en forbedret optimizer og SFT-traektorier generert av Grok 4.5 over resonneringsforsøk, agentharness og domener, inkludert STEM, programvareutvikling og kunnskapsarbeid, med problematiske spor filtrert ut av modellbaserte sjekker. Modellen ble deretter trent på en rekke agensbaserte forsterkningslæringsoppgaver, inkludert domenespesifikke miljøer for kerneloptimering, webutvikling og datamaskinstøttet design.
Benchmark-konkurransen
SpaceXAI rapporterer at Grok 4.6 matcher OpenAI sin GPT-5.6 Sol på Artificial Analysis Intelligence Index, en sammenslåing av ni benchmark, med begge modellene som scorer 61, bak Anthropic sin Fable 5 Max på 62 og foran Grok 4.5 High på 56. Selskapets egen vurderingstabell viser en mer blandet bilde over individuelle tester.
På DeepSWE v1.1 programvareutviklingsbenchmark, scoret Grok 4.6 65,9%, opp fra Grok 4.5 sin 54% men bak GPT-5.6 Sol Max på 73%. På Terminal-Bench v3.0 nådde den 26%, et stort sprang fra Grok 4.5 sin 15,7% men langt bak den omtrentlige 34% postet av GPT-5.6 Sol Max og Fable 5 Max. Den ledet feltet på GDPVal-AA v2, en kunnskapsarbeidsutvurdering, på 1753, og postet gevinster på CursorBench og FrontierCode. Tallene er selskapets egne, med tredjepartsmodellscoringer hentet fra selvrapporterte eller offentlig tilgjengelige resultater, og ingen uavhengig vurdering har ennå bekreftet dem.
Lanseringen skjer i en travelt del av markedet. Anthropic har presset sin Opus-linje mot frontierintelligens til aggressive priser, og OpenAI sin GPT-5.6-familie er den etablerte målet for agensbasert kode. SpaceXAI sin strategi er å konkurrere på pris og distribusjon like mye som rå kapasitet: til 2 dollar per million inndata-token, underkutter Grok 4.6 mange frontier-rivaler, og selskapet tilbyr dobbelt så mye inkludert bruk i Grok Build og Cursor i den første uken for å trekke utviklere til modellen. Foruten Cursor og Grok Build er den også tilgjengelig gjennom partnere, inkludert OpenRouter, Vercel og Cloudflare.
Et nytt selskap bak modellen
Grok 4.6 er den tydeligste produktuttalelsen ennå fra et selskap som har blitt helt omstrukturert over det siste året.
Grok 4.6 er den første flaggskipmodellen som bærer SpaceXAI-navnet fra bunnen av, og dens prising, partnerdistribusjon og agensfokus viser at avdelingen stiller Grok som en utvikler- og bedriftsplattform snarere enn en funksjon av X-sosiale nettverk.












