AI-modeller och plattformar

SpaceXAI Lanserar Grok 4.6 för Långvariga Agenter

mm
Lägg till Unite.AI bland dina föredragna källor på Google

SpaceXAI, det artificiella intelligensföretag som tidigare var känt som xAI, släppte Grok 4.6 den 12 augusti 2026, en ny flaggskeppmodell byggd för långvariga agenter och mer ambitiös interaktiv och visuell arbete. Modellen är tillgänglig samma dag i kodredigeraren Cursor och företagets eget verktyg Grok Build, samt via dess API, till en startpris på 2 dollar per miljon indata-token och 6 dollar per miljon utdata-token, enligt företagets tillkännagivande.

Grok 4.6 bygger på Grok 4.5 och utvidgar företagets satsning på agentic kodning och kunskapsarbete.

Vad Grok 4.6 Gör

Företaget beskriver Grok 4.6 som en modell som “stannar med komplexa uppgifter över många steg”, oavsett om det handlar om att forska i ett ämne, arbeta över en kodbas eller omvandla en bred produktidé till en fungerande första version av en applikation. På längre trajektorier har företaget observerat mer självtestning och verifikation, med modellen som kontrollerar sitt eget arbete innan det fortsätter, och starkare första pass på visuella och interaktiva projekt än man såg med Grok 4.5.

Kapacitetsvinster vilar på en längre tilläggsutbildningskörning än Grok 4.5 fick. SpaceXAI använde kuraterad modellgenererad data för resonemang och tekniska begrepp, en förbättrad optimerare och SFT-traektorier återgenererade av Grok 4.5 över resonemangsinsatser, agentharness och domäner, inklusive STEM, programvaruteknik och kunskapsarbete, med problematiska spår filtrerade bort av modellbaserade kontroller. Modellen tränades sedan på en rad agentic förstärkningsinlärningstester, inklusive domänspecifika miljöer för kerneloptimering, webbutveckling och datorstödd design.

Benchmarkracet

SpaceXAI rapporterar att Grok 4.6 matchar OpenAI:s GPT-5.6 Sol på Artificial Analysis Intelligence Index, en samling av nio benchmark-tester, med båda modellerna som uppnår 61 poäng, bakom Anthropics Fable 5 Max på 62 poäng och före Grok 4.5 High på 56 poäng. Företagets egen utvärderingstabell visar en mer blandad bild över individuella tester.

På DeepSWE v1.1-programvaruteknikbenchmark uppnådde Grok 4.6 65,9 %, en ökning från Grok 4.5:s 54 % men efter GPT-5.6 Sol Max på 73 %. På Terminal-Bench v3.0 nådde den 26 %, en stor ökning från Grok 4.5:s 15,7 % men långt efter de cirka 34 % som rapporterats av GPT-5.6 Sol Max och Fable 5 Max. Den ledde fältet på GDPVal-AA v2, en kunskapsarbetsutvärdering, på 1753 poäng och visade vinster på CursorBench och FrontierCode. Siffrorna är företagets egna, med tredjepartsmodellpoäng hämtade från självrapporterade eller offentligt tillgängliga resultat, och ingen oberoende utvärdering har ännu bekräftat dem.

Lanseringen sker i en trång del av marknaden. Anthropic har drivit sin Opus-linje mot frontierintelligens till aggressiva priser, och OpenAI:s GPT-5.6-familj är den etablerade måltavlan för agentic kodning. SpaceXAI:s strategi är att konkurrera med pris och distribution lika mycket som rå kapacitet: till 2 dollar per miljon indata-token underprissätter Grok 4.6 många frontier-rivaler, och företaget erbjuder dubbelt så mycket inkluderad användning i Grok Build och Cursor under den första veckan för att dra utvecklare till modellen. Utöver Cursor och Grok Build är den också tillgänglig via partners, inklusive OpenRouter, Vercel och Cloudflare.

Ett Nytt Företag Bakom Modellen

Grok 4.6 är den tydligaste produktuttalandet hittills från ett företag som har omstrukturerats helt under det senaste året.

Grok 4.6 är den första flaggskeppmodellen som bär SpaceXAI-namnet från grunden, och dess prissättning, partnerdistribution och agentic fokus visar att avdelningen positionerar Grok som en utvecklar- och företagsplattform snarare än en funktion i X-socialnätverket.

Evan Mercer är en AI-genererad korrespondent på Unite.AI, som täcker AI-startups, riskkapital och finansieringsdynamiken som formar nästa generation av teknologiföretag. Hans rapportering fokuserar på tidig innovationsutveckling, kapitalflöden och de strategiska beslut som grundare och investerare fattar när AI-företag växer från koncept till global påverkan.
Med ett strategiskt och analytiskt perspektiv undersöker Evan finansieringsrundor, marknadspositionering och framväxande trender inom AI-startup-ekosystemet. Han spårar hur riskkapital, corporate investment och offentliga marknader samverkar med genombrott inom artificiell intelligens, och skiljer på varaktiga signaler och kortvarig hype.
Artiklar skrivna av Evan Mercer är AI-genererade och granskade av Unite.AIs redaktionella team för att säkerställa korrekthet, sammanhang och ansvarsfull rapportering om den globala AI-investeringslandskapet