KI-Modelle und Plattformen

SpaceXAI startet Grok 4.6 für lang laufende Agenten

mm
Unite.AI zu deinen bevorzugten Quellen auf Google hinzufügen

SpaceXAI, das KI-Unternehmen, das früher als xAI bekannt war, hat am 12. August 2026 Grok 4.6 veröffentlicht, ein neues Flaggschiff-Modell, das für lang laufende Agenten und ambitioniertere interaktive und visuelle Arbeiten konzipiert ist. Das Modell ist am selben Tag im Code-Editor Cursor und im eigenen Tool Grok Build sowie über die API verfügbar, zu einem Startpreis von 2 $ pro Million Eingabetoken und 6 $ pro Million Ausgabetoken, wie in der Unternehmensmitteilung angegeben.

Grok 4.6 baut auf Grok 4.5 auf und erweitert den Schwerpunkt des Unternehmens auf agente Coding und Wissensarbeit.

Was Grok 4.6 kann

Das Unternehmen beschreibt Grok 4.6 als ein Modell, das “bei komplexen Aufgaben über viele Schritte hinweg bleibt”, sei es bei der Recherche eines Themas, der Arbeit an einem Code oder der Umsetzung einer breiten Produktidee in eine funktionierende erste Version einer Anwendung. Bei längeren Trajektoren hat das Unternehmen mehr Selbsttests und Verifizierungen beobachtet, wobei das Modell seine eigene Arbeit überprüft, bevor es weitermacht, und stärkere erste Durchläufe bei visuellen und interaktiven Projekten als bei Grok 4.5.

Die Fähigkeitssteigerungen basieren auf einem längeren Supplementär-Training als bei Grok 4.5. SpaceXAI hat kuratierte, modellgenerierte Daten für Reasoning und technische Konzepte verwendet, einen verbesserten Optimizer und SFT-Trajektorien, die von Grok 4.5 bei Reasoning-Bemühungen, Agenten-Harnesses und Domänen wie STEM, Software-Engineering und Wissensarbeit regeneriert wurden, wobei problematische Spuren durch modellbasierte Checks gefiltert wurden. Das Modell wurde dann auf einer Reihe von agenter Verstärkungs-Lernalgorithmen trainiert, einschließlich domänen-spezifischer Umgebungen für Kernel-Optimierung, Web-Entwicklung und Computer-Aided-Design.

Der Benchmark-Wettbewerb

SpaceXAI berichtet, dass Grok 4.6 OpenAI’s GPT-5.6 Sol auf dem Artificial Analysis Intelligence Index entspricht, einem Composite von neun Benchmarks, wobei beide Modelle 61 Punkte erreichen, hinter Anthropic’s Fable 5 Max mit 62 Punkten und vor Grok 4.5 High mit 56 Punkten. Die eigene Bewertungstabelle des Unternehmens zeigt ein gemischteres Bild über einzelne Tests.

Beim DeepSWE v1.1-Software-Engineering-Benchmark erreichte Grok 4.6 65,9 %, ein Anstieg gegenüber Grok 4.5 mit 54 %, aber hinter GPT-5.6 Sol Max mit 73 %. Beim Terminal-Bench v3.0 erreichte es 26 %, ein großer Sprung von Grok 4.5 mit 15,7 %, aber deutlich hinter den etwa 34 % von GPT-5.6 Sol Max und Fable 5 Max. Es führte das Feld auf dem GDPVal-AA v2, einer Wissensarbeit-Bewertung, mit 1753 an und zeigte Gewinne bei CursorBench und FrontierCode. Die Zahlen sind die des Unternehmens, wobei Drittanbieter-Modell-Scores aus Selbstberichten oder öffentlich verfügbaren Ergebnissen stammen und noch keine unabhängige Bewertung bestätigt hat.

Der Launch findet in einem überfüllten Teil des Marktes statt. Anthropic hat seine Opus-Linie auf frontier-Intelligenz mit aggressiven Preisen ausgerichtet, und OpenAI’s GPT-5.6-Familie ist das etablierte Ziel für agente Coding. Die Strategie von SpaceXAI besteht darin, auf Preis und Verteilung sowie auf rohe Fähigkeiten zu konkurrieren: bei 2 $ pro Million Eingabetoken unterbietet Grok 4.6 viele frontier-Konkurrenten, und das Unternehmen bietet doppelte Nutzung im Rahmen von Grok Build und Cursor für die erste Woche an, um Entwickler auf das Modell zu ziehen. Neben Cursor und Grok Build ist es auch über Partner wie OpenRouter, Vercel und Cloudflare verfügbar.

Ein neues Unternehmen hinter dem Modell

Grok 4.6 ist die klarste Produkt-Erklärung seitens eines Unternehmens, das im Laufe des letzten Jahres vollständig umstrukturiert wurde.

Grok 4.6 ist das erste Flaggschiff-Modell, das den Namen SpaceXAI von Grund auf trägt, und seine Preisgestaltung, Partner-Verteilung und agente Ausrichtung zeigen, dass die Abteilung Grok als Entwickler- und Unternehmensplattform und nicht als Funktion des X-Sozialnetzwerks positioniert.

Evan Mercer ist ein künstlich intelligenter Korrespondent bei Unite.AI, der über KI-Startups, Venture-Capital und die Finanzierungsstrategien berichtet, die die nächste Generation von Technologieunternehmen prägen. Seine Berichterstattung konzentriert sich auf Innovationen in der Frühphase, Kapitalflüsse und die strategischen Entscheidungen, die Gründer und Investoren treffen, wenn KI-Unternehmen von der Konzeption bis hin zu globaler Bedeutung wachsen.

Mit einem strategischen und analytischen Blickwinkel untersucht Evan Finanzierungsrunden, Marktpositionierung und aufkommende Trends im KI-Startup-Ökosystem. Er verfolgt, wie Venture-Capital, Unternehmensinvestitionen und öffentliche Märkte mit Durchbrüchen in der künstlichen Intelligenz zusammenhängen, indem er dauerhafte Signale von kurzfristigem Hype trennt.

Artikel, die von Evan Mercer verfasst werden, sind künstlich intelligente Generierungen und werden von Unite.AIs Redaktionsteam überprüft, um Genauigkeit, Kontext und verantwortungsvolle Berichterstattung über das globale KI-Investitionslandschaft zu gewährleisten.