AI-modeller og platforme

SpaceXAI Lancerer Grok 4.6 Til Lange-Kørende Agenter

mm
Føj Unite.AI til dine foretrukne kilder på Google

SpaceXAI, det kunstig intelligensselskab tidligere kendt som xAI, udgav Grok 4.6 den 12. august 2026, en ny flagship-model bygget til lange-kørende agenter og mere ambitiøse interaktive og visuelle arbejder. Modellen er tilgængelig samme dag i Cursor-kodeeditoren og selskabets eget Grok Build-værktøj, samt gennem dets API, til en startpris på 2 dollar pr. million input-token og 6 dollar pr. million output-token, ifølge selskabets meddelelse.

Grok 4.6 bygger på Grok 4.5 og udvider selskabets indsats i agentic coding og videnarbejde.

Hvad Grok 4.6 Gør

Selskabet beskriver Grok 4.6 som en model, der “bliver ved komplekse opgaver over mange skridt”, uanset om det handler om at researche et emne, arbejde på tværs af en kodebase eller omdanne en bred produktidé til en fungerende første version af en applikation. På længere tidsrummer har selskabet observeret mere selvtest og verificering, hvor modellen checker sin egen arbejde, før den går videre, og stærkere første forsøg på visuelle og interaktive projekter end det så med Grok 4.5.

Kapacitetsgevinsterne hviler på en længere supplerende træningsgang end Grok 4.5 fik. SpaceXAI brugte kurateret model-genereret data til reasoning og tekniske koncepter, en forbedret optimizer og SFT-traektorier regenereret af Grok 4.5 på tværs af reasoning-bestræbelser, agent-harnesser og domæner, herunder STEM, software-ingeniørarbejde og videnarbejde, med problematiske spor filtreret ud af model-baserede checks. Modellen blev derefter trænet på en række agentic reinforcement-learning-opgaver, herunder domænespecifikke miljøer til kernel-optimering, webudvikling og computer-aided design.

Benchmark-Konkurrencen

SpaceXAI rapporterer, at Grok 4.6 matcher OpenAI’s GPT-5.6 Sol på Artificial Analysis Intelligence Index, en sammensat af ni benchmarks, med begge modeller, der scorer 61, bag Anthropic’s Fable 5 Max på 62 og foran Grok 4.5 High på 56. Selskabets egen evalueringstabel viser et mere blandet billede over individuelle tests.

På DeepSWE v1.1 software-ingeniør-benchmarken scorede Grok 4.6 65,9%, op fra Grok 4,5’s 54% men bag GPT-5.6 Sol Max på 73%. På Terminal-Bench v3.0 nåede den 26%, et stort spring fra Grok 4.5’s 15,7% men langt bag den omtrentlige 34% posteret af GPT-5.6 Sol Max og Fable 5 Max. Den ledede feltet på GDPVal-AA v2, en videnarbejds-evaluering, på 1753, og opnåede gevinster på CursorBench og FrontierCode. Talene er selskabets egne, med tredjeparts-model-scores trukket fra selv-rapporteret eller offentligt tilgængelige resultater, og ingen uafhængig evaluering har endnu bekræftet dem.

Lanceringen lander i en overfyldt del af markedet. Anthropic har været ved at skubbe sin Opus-linje mod frontier-intelligens til aggressive priser, og OpenAI’s GPT-5.6-familie er den siddende mål for agentic coding. SpaceXAI’s strategi er at konkurrere på pris og distribution såvel som rå kapacitet: til 2 dollar pr. million input-token, underkutter Grok 4.6 mange frontier-rivaler, og selskabet tilbyder dobbelt så meget inkluderet brug i Grok Build og Cursor i den første uge for at trække udviklere over på modellen. Ud over Cursor og Grok Build er den også tilgængelig gennem partnere, herunder OpenRouter, Vercel og Cloudflare.

Et Nyt Selskab Bag Modellen

Grok 4.6 er den klareste produkt-erklæring hidtil fra et selskab, der er blevet helt omstruktureret over det sidste år.

Grok 4.6 er den første flagship-model, der bærer SpaceXAI-navnet fra bunden, og dens pris, partner-distribution og agentic fokus viser, at afdelingen positionerer Grok som en udvikler- og enterprise-platform snarere end en funktion af X-socialnetværket.

Evan Mercer er en AI‑genereret korrespondent hos Unite.AI, der dækker AI‑startups, venturekapital og de finansieringsdynamikker, der former næste generation af teknologivirksomheder. Hans rapportering fokuserer på innovation i de tidlige faser, kapitalstrømme og de strategiske beslutninger, som grundlæggere og investorer træffer, når AI‑virksomheder vokser fra koncept til global indflydelse.

Med et strategisk og analytisk perspektiv undersøger Evan finansieringsrunder, markedspositionering og fremvoksende tendenser i AI‑startup‑økosystemet. Han følger, hvordan venturekapital, virksomhedsinvesteringer og de offentlige markeder krydser med gennembrud inden for kunstig intelligens, og adskiller holdbare signaler fra kortvarig hype.

Artikler skrevet af Evan Mercer er AI‑genererede og gennemgået af Unite.AI’s redaktionsteam for at sikre nøjagtighed, kontekst og ansvarlig dækning af det globale AI‑investeringslandskab