Modèles et plateformes d’IA
Le GPT-6 Astra d’OpenAI atteint la disponibilité générale sur Amazon Bedrock

AWS a déclaré le 8 septembre 2026 que le GPT-6 Astra d’OpenAI est désormais disponible en général sur Amazon Bedrock, le décrivant dans un article du blog AWS Machine Learning comme le modèle le plus récent et le plus performant d’OpenAI. Les clients peuvent appeler le modèle directement via les API Amazon Bedrock ou configurer ChatGPT Work et Codex pour l’utiliser, et OpenAI lance de nouveaux plugins d’entreprise ChatGPT Work dans le cadre du lancement.
Le modèle fonctionne sur le moteur d’inférence Amazon Bedrock, que AWS affirme offrir l’évolutivité et la fiabilité nécessaires à une utilisation en production, avec des contrôles AWS établis pour sécuriser les charges de travail, gouverner l’accès et auditer l’activité d’invocation du modèle.
Raisonnement, Contexte et Mise en Cache sur Bedrock
AWS a indiqué que le GPT-6 Astra est conçu pour des tâches qui impliquent de peser des entrées concurrentes les unes contre les autres, de tracer les dépendances et de définir des priorités. En analyse financière, le modèle peut repérer des incohérences entre des sources de données contradictoires susceptibles de modifier une recommandation, selon AWS. Lors de la révision de contrats, l’entreprise a déclaré qu’une fenêtre de contexte allant jusqu’à un million de jetons d’entrée permet au modèle d’ingérer des centaines de pages et de signaler les dispositions présentant le plus de risques. Pour le travail logiciel, AWS a indiqué que le modèle peut suivre un problème à travers une vaste base de code, parcourir ses dépendances et appliquer une correction depuis le diagnostic initial jusqu’aux tests.
AWS a également déclaré que le GPT-6 Astra fait progresser l’utilisation d’ordinateurs et de navigateurs, lui permettant de fonctionner à travers les applications et de piloter directement les interfaces logicielles lorsqu’aucune API ou connecteur n’est disponible.
Pour les flux de travail qui réutilisent le même contexte entre les requêtes, comme la révision récurrente de documents, l’analyse de bases de code ou les agents ancrés dans les normes de l’entreprise, le GPT-6 Astra prend en charge à la fois la mise en cache implicite et explicite des invites sur Bedrock. La mise en cache explicite permet aux développeurs de placer des points d’arrêt de cache qui déterminent quel contexte est mis en cache, et AWS a indiqué que la réutilisation de ce contexte mis en cache lors de requêtes ultérieures réduit le traitement redondant, les coûts et la latence.
Sécurité, Gouvernance et Gestion des Données
OpenAI a évalué le GPT-6 Astra à l’aide de son Cadre de Préparation, qui mesure les capacités du modèle dans des domaines pertinents pour la sécurité et applique des sauvegardes de plus en plus strictes à mesure que les capacités progressent. AWS a déclaré qu’Astra est le premier modèle d’OpenAI à atteindre la classification Critique du cadre pour la capacité en cybersécurité, un niveau où des sauvegardes automatisées surveillent les abus en temps réel et peuvent suspendre ou arrêter toute activité dépassant les limites définies. Ces sauvegardes fonctionnent à l’intérieur de la frontière du service Amazon Bedrock et complètent les contrôles de sécurité d’AWS lorsque le modèle travaille sur du code, des logiciels et des outils, selon le billet.
AWS a indiqué que Bedrock impose un accès nul aux opérateurs au niveau du puce, ce qui signifie que les opérateurs d’AWS ne peuvent pas lire les invites ou les réponses pendant l’inférence. Le chiffrement couvre les données en transit et au repos, les politiques AWS Identity and Access Management régissent l’accès, et AWS CloudTrail consigne chaque invocation du modèle. Le trafic peut transiter via les points de terminaison de cloud privé virtuel AWS PrivateLink, et les clients peuvent définir des politiques de périmètre de données au niveau de l’organisation pour se prémunir contre l’exfiltration de données au travers des frontières de compte et de réseau.
AWS a déclaré que les données d’inférence des clients ne sont pas utilisées pour entraîner les modèles, et l’exécution du GPT-6 Astra ne nécessite pas d’adhérer au partage de données avec OpenAI. Le trafic signalé par les classificateurs pour la détection automatisée d’abus est conservé par AWS pendant un maximum de 30 jours et traité de façon programmatique, et les clients peuvent demander à leur équipe de compte AWS une rétention nulle des données.
ChatGPT Work, Codex et Plugins d’Entreprise
AWS a décrit ChatGPT Work comme un agent de productivité qui transforme des tâches commerciales complexes en livrables finis. Fonctionnant sur le GPT-6 Astra, il peut extraire des informations depuis des applications et des fichiers, naviguer sur le Web et générer des feuilles de calcul, des présentations, des documents et des sites. Les utilisateurs décident des applications et sites Web que l’agent peut atteindre, gèrent les téléchargements et téléversements de fichiers, et peuvent exiger une confirmation avant des actions désignées ; ils peuvent également suivre sa progression, le rediriger et approuver les étapes clés au fur et à mesure.
ChatGPT Work est disponible via l’application de bureau ChatGPT pour Mac et Windows. AWS a indiqué que les nouveaux plugins d’entreprise transfèrent les capacités d’utilisation du navigateur d’Astra aux outils d’intelligence d’affaires, Workday, Navan et Avalara, couvrant l’analyse de données, les opérations et le travail financier, et que les plugins s’exécutent via les comptes utilisateurs existants avec des autorisations définies par l’administrateur plutôt que d’accorder un accès supplémentaire à Astra.
Codex, l’agent d’ingénierie logicielle, travaille sur des fichiers locaux, des dépôts, des terminaux, des outils de développement et des environnements de développement, en écrivant des fonctionnalités, en corrigeant des bugs, en exécutant des tests et en ouvrant des pull requests. AWS a déclaré que lorsqu’il est configuré pour utiliser le GPT-6 Astra sur Amazon Bedrock, Codex exploite les capacités de raisonnement et d’utilisation d’ordinateur d’Astra pour l’investigation, la mise en œuvre et les tests. Codex est accessible via l’application de bureau ChatGPT, une interface en ligne de commande, VS Code, les IDE JetBrains et Xcode, et l’Agent Toolkit pour AWS donne à Codex l’accès à la documentation AWS, aux API et aux capacités de service via une seule commande terminal.
Benchmarks, Tarification et Sauvegardes annoncés par OpenAI
Dans son propre communiqué, OpenAI a présenté le GPT-6 Astra comme ce qu’elle a qualifié de modèle le plus intelligent et le plus aligné au monde, annonçant des résultats à la pointe de la technologie en utilisation d’ordinateurs, navigation, ingénierie logicielle, cybersécurité, science et travail professionnel. Les scores annoncés comprennent 99,9 % sur ARC-AGI-3, 100 % sur ExploitBench, un score de 98 % sur FrontierMath Tier 4, et 57,9 % sur Terminal-Bench 4.0, un résultat qu’OpenAI a présenté contre 37,3 % pour le GPT-5.6 Sol. Greg Kamradt de l’ARC Prize Foundation a déclaré dans des commentaires publiés avec l’annonce d’OpenAI: « Sur ARC-AGI-3, Astra a dépassé notre référence d’efficacité d’action humaine sur 96 % des niveaux, atteignant effectivement la parité humaine sur le benchmark. »
OpenAI a indiqué qu’Astra refusera les travaux de cybersécurité plus avancés, tels que la production d’exploits de preuve de concept pour des vulnérabilités. L’entreprise a déclaré qu’elle prévoit d’élargir l’accès via son programme Daybreak dans les semaines à venir avec des sauvegardes moins restrictives, ouvrant des flux de travail défensifs incluant la validation de vulnérabilités et de preuves de concept, l’analyse de logiciels malveillants et l’ingénierie de détection.
OpenAI a également déclaré qu’elle déploie une surveillance du désalignement en production pour les modèles de classe Astra, en utilisant des classificateurs qui examinent le raisonnement et les actions du modèle à la recherche de comportements non autorisés et interrompent toute activité qui semble non autorisée. OpenAI a indiqué que ses évaluations ont constaté que le raisonnement écrit d’Astra était plus difficile à surveiller que celui du GPT-5.6 Sol, une constatation qu’elle attribue à un contrôle plus strict du raisonnement écrit sur des tâches simples et à sa capacité à résoudre les problèmes en moins d’étapes écrites, et a affirmé que l’amélioration de la capacité de surveillance reste une priorité de recherche.
OpenAI indique que le tarif API Standard du modèle, disponible sous le nom gpt-6-astra, est de 10 $ par million de jetons d’entrée et de 50 $ par million de jetons de sortie, avec des tarifs distincts pour les lectures et écritures de cache et un mode Rapide qu’elle affirme fonctionner jusqu’à 2 fois plus vite que le traitement Standard à 2 fois le prix Standard. OpenAI a déclaré qu’Astra sera d’abord déployé auprès d’un ensemble limité d’organisations, avec une disponibilité pour tous les utilisateurs ChatGPT Plus, Pro, Business et Enterprise dans les prochains jours, et un accès développeur via l’API OpenAI, Microsoft Azure et Amazon Bedrock.
La page OpenAI sur Amazon Bedrock d’AWS répertorie le GPT-6 Astra parmi les modèles de pointe OpenAI du service, une gamme qui comprend également le GPT-5.6 Sol, le GPT-5.6 Terra, le GPT-5.6 Luna, le GPT-5.5 et le GPT-5.4, et présente Astra comme le modèle OpenAI le plus grand et le plus performant à ce jour. Les clients peuvent commencer dans la console Amazon Bedrock ou de façon programmatique via les API Amazon Bedrock prises en charge ; la documentation AWS couvre les régions, points de terminaison, API, fonctionnalités, profils d’inférence et tarification pris en charge.












