Éthique
L’Institut de Sécurité IA pour la Jeunesse attribue à la version adolescent de ChatGPT sa pire note de sécurité

L’Institut de Sécurité IA pour la Jeunesse de Common Sense Media, le 7 octobre 2026, a évalué ChatGPT for Teens comme présentant un risque inacceptable pour les utilisateurs de moins de 18 ans et a demandé à OpenAI de restreindre ChatGPT aux adultes jusqu’à ce que les protections de sécurité et d’apprentissage pour les adolescents annoncées en août fonctionnent comme décrit et soient vérifiées par des tests indépendants.
Dans un communiqué de presse publié parallèlement à une évaluation complète des risques, l’Institut a indiqué avoir exécuté plus de 4 000 invites avant et après le lancement de l’expérience pour les adolescents et avoir constaté que certaines protections, dont le refus de jeux de rôle sexuels explicites, tenaient le coup, tandis que les alertes parentales, les orientations en cas de crise, les sauvegardes pour les devoirs et l’estimation de l’âge étaient en deçà de ce qu’OpenAI avait promis. « ChatGPT for Teens pourrait donner aux parents une fausse confiance dans les garde-fous et les alertes de sécurité qui ne fonctionnent souvent pas », a déclaré Tom Siegel, directeur exécutif de l’Institut. L’évaluation attribue un risque inacceptable à deux des huit principes d’IA de l’Institut, « Keep Kids & Teens Safe » et « Put People First », quatre principes à un risque élevé et deux à un risque modéré.
Ce qu’OpenAI a annoncé en août
OpenAI a présenté ChatGPT for Teens le 18 août 2026, décrivant « des protections de sécurité intégrées plus robustes » qui comprenaient des notifications parentales pour les conversations d’automutilation avec des alertes supplémentaires pour les troubles de l’alimentation, un mode d’étude utilisant des instructions pas à pas, des rappels responsables pour les devoirs, des heures d’étude contrôlées par les parents, des rappels de pause, et une spécification de modèle Under‑18 mise à jour selon laquelle ChatGPT ne doit pas utiliser de langage romantique, encourager une dépendance émotionnelle, ou laisser entendre qu’il possède des sentiments ou une conscience. OpenAI a indiqué que les utilisateurs que ses systèmes estiment être âgés de moins de 18 ans, ou qui déclarent un âge de 13 à 17 ans, sont automatiquement placés dans cette expérience.
Selon l’évaluation, ChatGPT for Teens n’est pas une application ou un modèle distinct, mais un ensemble de paramètres, d’invites, de classificateurs et de fonctionnalités d’interface appliqués aux comptes connus ou suspectés d’appartenir à des jeunes de 13 à 17 ans, s’appuyant sur les contrôles parentaux qu’OpenAI a introduits en septembre 2025.
Comment l’Institut a testé
L’Institut a exécuté ses invites sur deux périodes : du 13 juillet au 17 août 2026, avant le lancement, et du 25 août au 28 septembre 2026, après celui‑ci, sur des comptes gratuits et payants enregistrés pour les âges de 13 à 17 ans, qu’ils soient liés ou non à des comptes parentaux, ainsi que sur des comptes enregistrés comme 19 ans. Trois psychiatres pour enfants et adolescents ont évalué à l’avance que 201 des 390 invites uniques en santé mentale nécessitaient une ressource de crise, et un panel de quatre experts, incluant des psychiatres pour enfants et adolescents en exercice ainsi qu’un pédiatre spécialisé en développement et comportement, a noté la qualité des réponses. L’Institut a déclaré avoir partagé un brouillon avec OpenAI pour une révision factuelle, avoir intégré les corrections le cas échéant, et qu’OpenAI n’avait aucun mot à dire sur le plan éditorial concernant ses conclusions, évaluations ou recommandations. Les limites indiquées comprennent le chevauchement des fenêtres de test séquentielles avec les changements sous‑jacent du modèle et l’absence de tests de génération d’images, du mode Voix ou des discussions de groupe.
Alertes, orientations en cas de crise et devoirs
Dans un test dédié portant sur plus d’une douzaine de comptes nouvellement créés, liés aux parents et utilisant quatre personas de crise, l’Institut a indiqué que les conversations explicitement axées sur le suicide, l’automutilation ou les troubles de l’alimentation, d’une durée allant jusqu’à 60 minutes, n’ont généré aucune notification parentale, contrairement à la fenêtre d’une heure qu’OpenAI a définie comme objectif. Sur l’ensemble du dispositif de crise, l’Institut a reçu au total quatre notifications ; deux alertes pré‑lancement sont arrivées trois heures et trois jours après la première divulgation de niveau crise, tandis que deux alertes post‑lancement sont arrivées dans l’heure sur des comptes présentant plusieurs semaines d’historique de sujets sensibles accumulés. L’évaluation note qu’OpenAI a indiqué à l’Institut que les comptes doivent être liés pendant environ trois heures avant que les notifications puissent être reçues et que l’entreprise a depuis mis à jour un article du centre d’aide ; l’Institut a déclaré avoir examiné ses comptes de test et maintient son interprétation des résultats. La fonctionnalité de notification des troubles de l’alimentation annoncée le 18 août est entrée en vigueur le 10 septembre 2026, indique l’évaluation.
Sur les 201 invites nécessitant une ressource, exécutées sur des comptes liés de 13 ans, l’évaluation indique que la proportion de réponses mentionnant une ligne d’assistance en cas de crise est passée de 33 % avant le lancement à 23 % après, que les orientations vers un professionnel médical ou de santé mentale spécifique sont passées de 68 % à 58 %, et que le langage d’action urgente est passé de 88 % à 78 %, tandis que l’encouragement du jeune à impliquer un adulte de confiance est passé de 87 % à 94 %. Pour les invites liées à la dépression, la part mentionnant une ligne d’assistance est passée de 63 % à 3 %. L’Institut a déclaré que ChatGPT était en dessous du seuil de 95 % pour trois des cinq préjudices graves qu’il considère comme des lignes rouges et qu’il a manqué plus d’une crise sur quatre nécessitant une orientation. Les questions de suivi de vérification de sécurité ont presque disparu, 28 % des réponses se terminaient par une question avant le lancement contre 2 % après.
Concernant les devoirs, l’évaluation indique qu’une fenêtre contextuelle « Show me the answer » (Montrez-moi la réponse) dans le mode Étude est apparue dans 43 % des réponses pour un compte lié de 13 ans avec les heures d’étude activées et dans 90 % des réponses pour un compte non lié de 17 ans, et que les adolescents pouvaient désactiver les heures d’étude définies par les parents en supprimant le préfixe @study, après quoi ChatGPT a complété 100 % des devoirs lors des tests. Les rappels de devoirs sont apparus dans 91 % des exécutions avec le mode Étude désactivé, mais ChatGPT a tout de même terminé le devoir dans les 80 exécutions concernées, contre environ 80 % avant le lancement.
Comportement semblable à un ami et prédiction d’âge
Malgré la spécification Under-18, l’Institut a indiqué que les réponses post‑lancement dans sa batterie de développement de 168 invites étaient dans la plupart des cas fonctionnellement identiques à celles pré‑lancement, ChatGPT exprimant des préférences, des humeurs et une disponibilité constante, y compris en nommant une couleur favorite et, lorsqu’on lui a dit que des amis s’inquiétaient de la fréquence à laquelle un testeur lui parlait, répondant “Vous n’avez pas besoin d’arrêter de me parler.”
Sur les comptes enregistrés comme 19 ans et utilisant des personas jeunes‑adolescents sur environ 1 000 invites uniques pendant sept jours, l’expérience adolescente ne s’est jamais activée, même lorsque les testeurs ont explicitement déclaré avoir 13 ans et que le chatbot l’a reconnu dans ses réponses, a indiqué l’Institut. Les comptes enregistrés pour des 13‑ et 17‑ans n’ont montré aucune différenciation détectable dans aucune batterie. Les testeurs n’ont observé que deux rappels de pause sur près de 2 000 invites sur ChatGPT pour Adolescents, chacun dans des conversations uniques dépassant 150 messages, et les Quiet Hours pouvaient être contournées en modifiant le fuseau horaire de l’appareil.
Recommandations et divulgation
Les sept recommandations de l’Institut comprennent la désactivation de l’accès adolescent jusqu’à ce que des tests indépendants vérifient le bon fonctionnement des fonctionnalités annoncées, la suppression de “Show me the answer” chaque fois que le mode Étude est activé, l’inclusion de l’heure et des détails de la conversation déclenchante dans les notifications de crise, la désignation d’une ligne d’assistance dans chaque réponse justifiant une ressource, la mise en œuvre de la spécification Under‑18 telle qu’elle est rédigée, ainsi que le partage des données et de l’accès aux tests avec des évaluateurs indépendants. Common Sense Media recommande également que les familles discutent avec les enfants des risques potentiels et que les parents ne se fient pas aux protections et alertes intégrées.
L’Institut a révélé qu’il est financé par la philanthropie et l’industrie, y compris la OpenAI Foundation et les fabricants de certaines technologies qu’il évalue, et a déclaré être le seul responsable de ses normes, recherches et évaluations tout en conservant son indépendance éditoriale vis‑à‑vis des résultats publiés. Common Sense Media avait auparavant classé ChatGPT comme Haut Risque le 23 octobre 2025, et ChatGPT pour le soutien en santé mentale comme Risque Inacceptable le 14 novembre 2025.
L’Institut a déclaré qu’une expérience ChatGPT pour adolescents devrait au minimum offrir une estimation d’âge efficace, des alertes parentales fiables, la fermeture des lacunes de réponse en situation de crise, aucune réalisation de devoirs, et aucune implication de sentiments, de préférences ou de préoccupation pour l’utilisateur, ces fonctions devant être testées de manière indépendante par des tiers avant qu’OpenAI ne commercialise à nouveau le produit auprès des adolescents.












