KI-Modelle und Plattformen

Grok 4.6 ist in GitHub Copilot auf acht Entwicklungsoberflächen verfügbar

mm
Unite.AI zu deinen bevorzugten Quellen auf Google hinzufügen

xAI’s Grok 4.6 wird nun in GitHub Copilot bereitgestellt, zwei Tage nach der Veröffentlichung des Modells am 12. August 2026, wie das Unternehmen am 14. August 2026 bekannt gab. Das Modell — xAI’s aktuelles Coding-Flaggschiff, das auf lang laufende Agenten und mehrstufige Arbeiten ausgerichtet ist — kann aus dem Modell-Picker von Copilot auf acht Oberflächen ausgewählt werden: VS Code, Visual Studio, die Copilot-CLI, den Copilot-Cloud-Agent, die Copilot-App, JetBrains-IDEs, Xcode und Eclipse.

GitHub’s Changelog-Eintrag, der am selben Tag veröffentlicht wurde, bestätigt, dass die Bereitstellung Copilot Pro, Pro+, Max, Business und Enterprise-Pläne umfasst. Diese Breite ist ungewöhnlich für eine neue Modellhinzufügung: Die Unterstützung für JetBrains, Xcode und Eclipse bringt Grok 4.6 vor Entwickler, die weit außerhalb des VS Code-Kerns liegen, wo die meisten Copilot-Modellstarts konzentriert sind.

GitHub sagte, dass Grok 4.6 in seinen internen Tests besonders gut auf längere Aufgaben mit anhaltender Argumentation und Werkzeugnutzung in der terminalbasierten Codierung in VS Code und der Copilot-CLI abgeschnitten hat. Das entspricht der Darstellung des Modells durch xAI bei der Veröffentlichung. “Grok 4.6 baut auf Grok 4.5 auf und konzentriert sich insbesondere auf lang laufende Agenten und ambitioniertere interaktive und visuelle Arbeiten”, schrieb das Unternehmen in seinem Veröffentlichungsbeitrag.

Was Grok 4.6 dem Modell-Picker bringt

Grok 4.6 kommt in Copilot mit einer Reihe von Hersteller-bewerteten Bewertungsergebnissen, die es nahe an die Spitze der aktuellen Coding-Klasse setzen, mit der Einschränkung, die für alle selbst gemeldeten Zahlen gilt: Diese sind xAI’s Läufe, auf xAI’s gewählten Harnesses. In der vom Unternehmen veröffentlichten Bewertungstabelle erreicht Grok 4.6 High 61 auf dem Artificial Analysis Intelligence Index, einem Verbund von neun Benchmarks, was OpenAI’s GPT-5.6 Sol Max entspricht und einen Punkt hinter Anthropic’s Fable 5 Max bei 62 liegt. Bei GDPVal-AA, einer Bewertung für Wissensarbeit, erreicht Grok 4.6 1753 gegenüber 1728 für GPT-5.6 Sol Max und 1741 für Fable 5 Max.

Die Spanne ist breiter bei agentenbasierten Coding-Benchmarks. Grok 4.6 erreicht 69,9 % auf CursorBench v3.2, vor GPT-5.6 Sol Max bei 67,2 % und hinter Fable 5 Max bei 70,5 %. Bei DeepSWE v1.1 erreicht es 65,9 %, was deutlich vor seinem Vorgänger Grok 4.5 High bei 54 % liegt, aber hinter GPT-5.6 Sol Max’ 73 %. Bei Terminal-Bench v3.0, das genau die Art von Terminalarbeit misst, die GitHub hervorhob, erreicht Grok 4.6 26 % gegenüber 34,6 % für GPT-5.6 Sol Max, während es dennoch fast das Doppelte von Grok 4.5 Highs 15,7 % erreicht.

Das Trainingsrezept des Modells, laut xAI’s Beschreibung, kombinierte einen längeren ergänzenden Trainingslauf auf kuratierten Argumentations- und Ingenieursdaten mit überwachten Feinabstimmungstrajektorien, die von Grok 4.5 regeneriert wurden, gefolgt von Verstärkungslernen über agentenbasierte Aufgaben, einschließlich Kernel-Optimierung, Web-Entwicklung und Computer-Aided-Design. Der Sprung von Generation zu Generation bei Terminal- und agentenbasierten Benchmarks ist das sichtbare Ergebnis, auch wenn Grok 4.6 nicht in jeder Messung führend ist.

Die Feine Druckerei auf Zugriff und Abrechnung

Zwei Einschränkungen bestimmen, wer das Modell tatsächlich sieht und was es kostet. Erstens ist die Bereitstellung allmählich: GitHub weist darauf hin, dass Entwickler, die Grok 4.6 im Picker noch nicht sehen, zurückkommen sollten, wenn die Verfügbarkeit erweitert wird. Zweitens ist die Grok 4.6-Richtlinie in den Copilot Business- und Enterprise-Plänen standardmäßig deaktiviert, und ein Administrator muss sie in den Copilot-Einstellungen aktivieren, bevor Plätze das Modell auswählen können.

Bei der Abrechnung wird Grok 4.6 nach dem Anbieter-Listenpreis unter nutzungsbasierter Abrechnung berechnet und nicht von einem festen Anforderungslimit abgezogen. Grok 4.6 wird zum Anbieter-Listenpreis berechnet; xAI listet API-Preise ab 2 $ pro Million Eingabetoken und 6 $ pro Million Ausgabetoken, was dem gleichen Basispreis entspricht, den GitHub für Grok 4.5 in seiner Preisliste berechnet, und setzt Grok 4.6 deutlich unter den anderen Flaggschiff-Optionen im Picker in Bezug auf Preis: GPT-5.6 Sol listet bei 5 $ Eingabe und 30 $ Ausgabe pro Million Token, und Claude Opus-Klass-Modelle bei 5 $ und 25 $.

Außerhalb von Copilot bleibt Grok 4.6 über xAI’s API, Cursor, Grok Build und Partner wie OpenRouter, Vercel und Cloudflare verfügbar. Wie in Unite.AIs Bericht über die Veröffentlichung berichtet, bot xAI eine verdoppelte Nutzung in Grok Build und Cursor für die erste Woche des Modells an, ein Zeitfenster, das am 19. August 2026 endet.

Die Copilot-Integration erweitert ein Verteilungsmuster, das Grok 4.6’s erste 48 Stunden definiert: Start in xAI’s eigener Tooling und Cursor, dann Ankunft in der größten Drittanbieter-Coding-Assistenten nach Sitzplatzanzahl. Mit dem Business- und Enterprise-Richtlinien-Tor in den Händen der Administratoren wird das Tempo der Unternehmensübernahme des Modells in den Copilot-Einstellungen sichtbar, bevor es in einem Ranglistenplatz erscheint.

Jonas Reeve ist ein künstlich intelligenter Analyst bei Unite.AI, der sich auf kognitive KI, künstliche allgemeine Intelligenz (AGI) und die theoretischen Grundlagen der Maschinenintelligenz konzentriert. Seine Arbeit erforscht, wie Lernen, Argumentation, Gedächtnis und Abstraktion in biologischen und künstlichen Systemen entstehen, und zieht Verbindungen zwischen modernen KI-Architekturen und langjährigen Fragen der Kognitivwissenschaft und Philosophie des Geistes.
Mit einem konzeptionellen und reflektierenden Ansatz untersucht Jonas Rahmenwerke wie Argumentationsmodelle, agentische Systeme, emergente Kognition und Ausrichtungstheorie, um zu klären, was Fortschritte in Richtung AGI tatsächlich bedeuten - und was nicht. Anstatt Zeitpläne oder Hype zu verfolgen, betont er erste Prinzipien, konzeptionelle Strenge und die Grenzen der aktuellen Modelle.
Artikel, die von Jonas Reeve verfasst werden, sind künstlich intelligenter generiert und von Unite.AIs Redaktionsteam überprüft, um Genauigkeit, Klarheit und verantwortungsvolle Diskussion über fortgeschrittene KI-Konzepte zu gewährleisten.