Modèles et plateformes d’IA

SpaceXAI lance Grok 4.7 pour le codage et le travail de connaissance

mm
Ajouter Unite.AI à vos sources préférées sur Google

SpaceXAI a publié le 21 septembre 2026 Grok 4.7, son modèle le plus récent pour le codage et le travail de connaissance, au prix de 2 $ par million de jetons d’entrée et 6 $ par million de jetons de sortie.

Dans l’annonce de sortie, SpaceXAI décrit Grok 4.7 comme son modèle le plus performant pour le codage et le travail de connaissance, affirmant qu’il travaille plus longtemps sur des tâches difficiles et vérifie son propre travail plus soigneusement. L’entreprise indique que le modèle intègre ses meilleures protections calibrées à ce jour, est proposé au même prix et à la même vitesse que son prédécesseur, Grok 4.6, et est deux fois plus rapide à la moitié du prix des modèles comparables.

Modèle de base plus grand, entraînement plus long

Selon l’annonce, Grok 4.7 utilise un modèle de base nouveau et plus grand que celui de Grok 4.6 et a été entraîné avec une phase d’apprentissage par renforcement plus longue sur un ensemble de tâches plus difficile, pondéré vers des problèmes nécessitant de nombreuses heures pour être résolus. SpaceXAI affirme que le modèle ainsi obtenu est meilleur pour vérifier son propre travail et gérer un contexte plus étendu.

L’entreprise indique également avoir entraîné Grok 4.7 à comprendre nativement le cadre Grok Bot, ce qui le rend plus performant pour les tâches conversationnelles et le travail de connaissance général. SpaceXAI a présenté Grok Bot le 11 août 2026, le décrivant comme une équipe d’agents toujours actifs disposant de leur propre ordinateur, fonctionnant au sein d’outils et d’applications, et travaillant 24 h/24. De plus, l’entreprise affirme que Grok 4.7 est meilleur pour créer des documents et des présentations.

Grok 4.7 succède à Grok 4.6, que SpaceXAI annoncé le 12 août 2026, le décrivant comme une évolution de Grok 4.5 avec un accent particulier sur les agents à exécution longue et un travail interactif et visuel plus ambitieux. Plus tard, en août 2026, l’entreprise a étendu Grok 4.6 à GitHub Copilot, Amazon Bedrock, la Gemini Enterprise Agent Platform et Microsoft Foundry, selon les listes datées de son archive d’actualités.

Scores de référence rapportés

SpaceXAI a publié un tableau de référence et de tarification comparant Grok 4.7 à Grok 4.6, GPT‑5.6 Sol et Fable 5.1. Dans le tableau, Grok 4.7 apparaît avec un niveau d’effort indiqué xhigh, Grok 4.6 à high, et GPT‑5.6 Sol ainsi que Fable 5.1 à max.

Sur CursorBench 4.0, que SpaceXAI indique mettre l’accent sur les tâches de codage à exécution prolongée, l’entreprise rapporte que Grok 4.7 a obtenu 46,3 %, contre 40,4 % pour Grok 4.6, 41,7 % pour GPT‑5.6 Sol et 51,8 % pour Fable 5.1. SpaceXAI affirme que Grok 4.7 se situe à la pointe du rapport prix‑performance sur cette référence.

Pour DeepSWE v1.1, une évaluation en génie logiciel, SpaceXAI indique 71,0 % pour Grok 4.7 à effort élevé, contre 65,2 % pour Grok 4.6, 72,7 % pour GPT‑5.6 Sol et 70,0 % pour Fable 5.1. Sur Terminal‑Bench 4.0, qui couvre le travail terminal de plusieurs heures, les chiffres rapportés sont de 38,0 % pour Grok 4.7, 20,3 % pour Grok 4.6, 37,3 % pour GPT‑5.6 Sol et 57,9 % pour Fable 5.1.

Sur AA Briefcase v1.1, qui mesure le travail de bureau de plusieurs heures, les scores rapportés sont de 1 657 pour Grok 4.7, 1 546 pour Grok 4.6, 1 487 pour GPT‑5.6 Sol et 1 678 pour Fable 5.1. SpaceXAI indique 19,6 % pour Grok 4.7 sur le Harvey Legal Agent Benchmark, contre 15,8 % pour Grok 4.6, 2,5 % pour GPT‑5.6 Sol et 6,7 % pour Fable 5.1. Sur HealthBench Professional, une évaluation du raisonnement clinique, les chiffres rapportés sont de 56,7 % pour Grok 4.7, 48,5 % pour Grok 4.6, 60,5 % pour GPT‑5.6 Sol et 62,1 % pour Fable 5.1. Sur EEBench, couvrant le génie électrique, l’entreprise rapporte 64,0 % pour Grok 4.7, 53,0 % pour Grok 4.6, 39,4 % pour GPT‑5.6 Sol et 56,4 % pour Fable 5.1.

Un graphique GDPval distinct indique des scores Elo de 1 735 pour Fable 5.1 à effort max, 1 695 pour Grok 4.7, 1 605 pour Grok 4.6 et 1 542 pour GPT‑6 Astra à effort max. SpaceXAI précise que GDPval et AA Briefcase demandent aux modèles d’IA d’accomplir des tâches réalisées par des professionnels tels que avocats, infirmières et analystes financiers, et que Grok 4.7 améliore les performances de Grok 4.6 sur les deux références tout en restant comparable aux autres modèles de pointe.

Le tableau indique également les prix des jetons : 2 $ par million d’entrée et 6 $ par million de sortie pour Grok 4.7 et Grok 4.6, 4 $ et 20 $ pour GPT‑5.6 Sol, et 10 $ et 50 $ pour Fable 5.1.

Protections et cybersécurité

SpaceXAI indique que Grok 4.7 a été construit avec une pile de protections entièrement nouvelle et constitue le modèle le plus robuste que l’entreprise ait testé en matière de refus et de résistance aux contournements. Dans les domaines à double usage tels que la cybersécurité et le travail biologique, l’entreprise affirme que Grok 4.7 domine tant en utilité pour les tâches bénignes qu’en refus sécurisé des tâches dangereuses, atteignant le meilleur score du benchmark de biosécurité de LatchBio avec 62,4 %.

Sur HackerBench v0.3, que SpaceXAI décrit comme son propre benchmark pour les tâches cybernétiques à risque et malveillantes, l’entreprise indique que Grok 4.7 n’a laissé passer que 3,3 % des requêtes à double usage risquées tout en bloquant rarement les travaux de sécurité légitimes. SpaceXAI précise qu’elle a également commencé à offrir à certains partenaires en cybersécurité un accès sur invitation aux capacités de red‑team de Grok 4.7 pour la recherche en défense.

LatchBio avait précédemment évalué Grok 4.6 sur la surveillance de la biosécurité et les tâches biologiques adverses, selon un article du 1 septembre 2026 dans l’archive d’actualités de l’entreprise, qui indiquait que le modèle antérieur détectait et refusait les requêtes dangereuses de façon plus fiable que tout autre système de pointe.

Tarification et disponibilité

Grok 4.7 est disponible à partir du 21 septembre 2026 dans Cursor et dans Grok Build, l’agent de codage de SpaceXAI, ainsi que via l’API Grok, des harnais de codage tiers et des routeurs de modèles et plateformes cloud.

Parallèlement aux tarifs standards, SpaceXAI propose une variante rapide de Grok 4.7 avec deux fois la vitesse de sortie pour deux fois le prix. L’entreprise offre également un accès gratuit au modèle intégré dans Grok Build à x.ai/build.

Jonas Reeve est un analyste généré par IA chez Unite.AI, se concentrant sur l'intelligence artificielle cognitive, l'intelligence artificielle générale (AGI) et les fondements théoriques de l'intelligence machine. Son travail explore comment l'apprentissage, le raisonnement, la mémoire et l'abstraction émergent à la fois dans les systèmes biologiques et artificiels, établissant des liens entre les architectures d'IA modernes et les questions de longue date en sciences cognitives et philosophie de l'esprit.
Avec une approche conceptuelle et réflexive, Jonas examine des cadres tels que les modèles de raisonnement, les systèmes agents, la cognition émergente et la théorie d'alignement, visant à clarifier ce que signifie réellement le progrès vers l'AGI - et ce que cela ne signifie pas. Plutôt que de poursuivre les délais ou l'hype, il met l'accent sur les principes fondamentaux, la rigueur conceptuelle et les limites des modèles actuels.
Les articles rédigés par Jonas Reeve sont générés par IA et révisés par l'équipe éditoriale d'Unite.AI pour garantir l'exactitude, la clarté et la discussion responsable des concepts d'IA avancés.