Modèles et plateformes d’IA

OpenAI applique une mesure d’atténuation alors que des taux d’erreur élevés touchent les modèles d’API

mm
Ajouter Unite.AI à vos sources préférées sur Google

OpenAI a déclaré avoir appliqué une mesure d’atténuation et surveillait la récupération le 17 septembre 2026, après avoir identifié des taux d’erreur élevés sur ses modèles d’API dans un incident sur sa page d’état qui répertoriait 12 composants affectés de la plateforme d’API de l’entreprise.

Divulgation de l’incident et réponse

Le registre d’incident, intitulé « Nous constatons des taux d’erreur élevés sur les modèles d’API », porte une désignation d’impact de performance dégradée. Dans sa première mise à jour, horodatée à 16 h 20 (heure de l’Est) le 17 septembre 2026, OpenAI a indiqué avoir identifié que les utilisateurs rencontraient des erreurs élevées pour les services concernés et travaillait à la mise en place d’une atténuation. Dans une seconde mise à jour à 17 h 20 (heure de l’Est), qui, selon le registre, a été publiée une heure après la première, l’entreprise a déclaré : « Nous avons appliqué la mesure d’atténuation et surveillons la récupération. » Le statut de l’incident était alors indiqué comme « Monitoring ».

La page d’état principale d’OpenAI affichait une bannière « We’re currently experiencing issues » à côté de l’incident et l’a présentée comme en cours pendant une heure. La page d’historique d’état de l’entreprise répertorie le même incident sous le 17 septembre 2026, avec la mise à jour de 17 h 20 indiquant que la mesure d’atténuation avait été appliquée et que la récupération était surveillée.

Douze composants d’API répertoriés comme affectés

Le registre d’incident indique 12 composants affectés, tous au sein du groupe APIs de la page d’état d’OpenAI : Chat Completions, Responses, Fine‑tuning, Embeddings, Images, Batch, Audio, Moderations, Realtime, Files, Login et Sora. Le groupe APIs comprend au total 12 composants sur la page d’état, qui suit les services de l’entreprise par groupes distincts.

En dehors du groupe APIs, la page répertorie ChatGPT avec 15 composants, Codex avec quatre composants, FedRAMP avec un composant, et un groupe Ads Platform avec deux composants, Ads Manager et l’Ads API. Le registre d’incident du 17 septembre ne répertorie comme affectés que les composants d’API ; aucun composant de ChatGPT, Codex, FedRAMP ou Ads Platform n’apparaît dans la liste des composants affectés de l’incident.

Chiffres de disponibilité rapportés sur la page d’état

La page d’état d’OpenAI indique les chiffres de disponibilité couvrant la période juin 2026–septembre 2026. La page indique que le groupe APIs a un taux de disponibilité de 99,93 % sur ses 12 composants. Par composant, elle indique que Chat Completions, Responses, Fine‑tuning, Embeddings, Batch, Audio, Moderations, Realtime et Files affichent chacun 100 % de disponibilité, avec Images à 99,95 %, Sora à 99,97 % et Login à 99,995 %.

Pour les autres groupes, la page indique que le groupe ChatGPT a un taux de disponibilité de 99,62 % sur ses 15 composants, Codex affiche 100 % sur ses quatre composants, et FedRAMP atteint 100 % pour son unique composant. Au sein du groupe Ads Platform, l’Ads API est indiqué à 100 % de disponibilité.

OpenAI indique sur la page que ses métriques de disponibilité sont rapportées de manière agrégée sur tous les niveaux, modèles et types d’erreurs, et que la disponibilité individuelle des clients peut varier en fonction du niveau d’abonnement et du modèle ainsi que des fonctionnalités d’API utilisées.

Entrées antérieures dans l’historique d’état

La page d’historique consigne un incident distinct plus tôt le 17 septembre 2026, intitulé « Erreurs élevées affectant le mode Work de ChatGPT », mis à jour à 16 h 24 (heure de l’Est) avec la mention que tous les services impactés s’étaient entièrement rétablis. Le 16 septembre 2026, la page enregistre « Erreurs élevées dans ChatGPT Work », mis à jour à 15 h 34 et également indiqué comme entièrement rétabli.

Le 15 septembre 2026, l’historique répertorie « Erreurs élevées avec gpt-image-2.5-flare », mis à jour à 20 h 30, et « Erreurs élevées provenant de GPT-5.6 et GPT-5.6 Instant sur les forfaits payants », mis à jour à 03 h 53, chacune indiquée comme entièrement rétablie. Deux entrées apparaissent le 14 septembre 2026 : « Erreurs élevées affectant le mode Work dans ChatGPT », mis à jour à 23 h 11 et indiqué comme entièrement rétabli, et « Performance dégradée affectant l’Agents API », mis à jour à 19 h 39 avec la mention que le problème avait été résolu et que les sessions gérées traitaient les tours normalement. Une entrée du 13 septembre 2026 consigne « Taux d’erreur élevés pour Codex et ChatGPT Work », mis à jour à 23 h 57 et indiqué comme entièrement rétabli.

D’autres entrées liées aux API documentées en septembre 2026 incluent « Erreurs élevées pour GPT-5.6 Sol sur l’API » le 11 septembre, mis à jour à 07 h 21 et indiqué comme entièrement rétabli, et « Latence élevée dans l’Responses API » le 1er septembre, mis à jour à 15 h 05 avec tous les services impactés répertoriés comme entièrement rétablis.

Théo Nash est un spécialiste généré par IA chez Unite.AI, couvrant l'infrastructure IA, le calcul et les systèmes matériels qui alimentent l'intelligence artificielle moderne. Son travail se concentre sur les fondements techniques des charges de travail IA à grande échelle, notamment les centres de données, les accélérateurs, les réseaux et les piles logicielles qui les relient.
Avec une perspective analytique et axée sur l'ingénierie, Théo examine comment les progrès des GPU, du silicium personnalisé, des architectures de mémoire et des systèmes distribués permettent de nouvelles générations de modèles IA. Il prête une attention particulière aux compromis de performance, à l'efficacité énergétique, à la scalabilité et aux contraintes pratiques qui façonnent le déploiement réel de l'infrastructure IA.
Les articles rédigés par Théo Nash sont générés par IA et révisés par l'équipe éditoriale d'Unite.AI pour garantir l'exactitude technique, la clarté et la couverture responsable du paysage de calcul IA en évolution rapide.