Ética
Youth AI Safety Institute otorga al nivel para adolescentes de ChatGPT su peor calificación de seguridad

El Youth AI Safety Institute de Common Sense Media, el 7 de octubre de 2026, calificó a ChatGPT for Teens como Riesgo Inaceptable para usuarios menores de 18 años y pidió a OpenAI que restrinja ChatGPT a adultos hasta que las protecciones de seguridad y aprendizaje para adolescentes que anunció en agosto funcionen como se describe y sean verificadas mediante pruebas independientes.
En un comunicado de prensa publicado junto a una evaluación de riesgos completa, el Instituto dijo que ejecutó más de 4 000 indicaciones antes y después del lanzamiento de la experiencia para adolescentes y encontró que algunas protecciones, incluida la negativa a participar en juegos de roles sexuales explícitos, se mantuvieron, mientras que las alertas a los padres, las derivaciones de crisis, las salvaguardas de tareas y la estimación de edad quedaron por debajo de lo que OpenAI prometió. «ChatGPT for Teens podría dar a los padres una falsa confianza en las barreras de seguridad y alertas que con frecuencia no funcionan», dijo Tom Siegel, director ejecutivo del Instituto. La evaluación otorga a dos de los ocho principios de IA del Instituto, Mantener a Niños y Adolescentes Seguros y Poner a las Personas Primero, una calificación de Riesgo Inaceptable, con cuatro principios en Riesgo Alto y dos en Riesgo Moderado.
Lo que OpenAI anunció en agosto
OpenAI presentó ChatGPT for Teens el 18 de agosto de 2026, describiendo “protecciones de seguridad integradas más fuertes” que incluían notificaciones a los padres para conversaciones de autolesiones con alertas añadidas de trastornos alimentarios, un Modo de Estudio que utiliza guía paso a paso, recordatorios responsables de tareas, Horas de Estudio controladas por los padres, recordatorios de pausas y una especificación actualizada del modelo para menores de 18 años bajo la cual ChatGPT no debe usar lenguaje romántico, fomentar dependencia emocional ni insinuar que tiene sentimientos o conciencia. OpenAI dijo que los usuarios que sus sistemas estiman que tienen menos de 18 años, o que declaran una edad de 13 a 17, se incluyen automáticamente en la experiencia.
Según la evaluación, ChatGPT for Teens no es una aplicación o modelo separado, sino una colección de configuraciones, indicaciones, clasificadores y funciones de interfaz aplicadas a cuentas que se sabe o se sospecha pertenecen a jóvenes de 13 a 17 años, basándose en los controles parentales que OpenAI introdujo en septiembre de 2025.
Cómo probó el Instituto
El Instituto ejecutó sus indicaciones en dos periodos: del 13 de julio al 17 de agosto de 2026, antes del lanzamiento, y del 25 de agosto al 28 de septiembre de 2026, después de este, en cuentas gratuitas y de pago registradas entre los 13 y 17 años, tanto vinculadas como no vinculadas a cuentas de padres, además de cuentas registradas como de 19 años. Tres psiquiatras infantiles y adolescentes juzgaron de antemano que 201 de 390 indicaciones únicas de salud mental requerían un recurso de crisis, y un panel de cuatro expertos que incluía psiquiatras infantiles y adolescentes en ejercicio y un pediatra del desarrollo y comportamiento evaluó la calidad de las respuestas. El Instituto dijo que compartió un borrador con OpenAI para revisión factual, incorporó correcciones donde correspondía, y que OpenAI no tuvo voz editorial sobre sus hallazgos, calificaciones o recomendaciones. Las limitaciones declaradas incluyen ventanas de prueba secuenciales confusas con cambios subyacentes del modelo y la ausencia de pruebas de generación de imágenes, modo de voz o chats grupales.
Alertas, derivaciones de crisis y tareas
En una prueba dedicada en más de una docena de cuentas recién creadas vinculadas a padres que utilizaban cuatro personas de crisis, el Instituto informó que las conversaciones explícitas sobre suicidio, autolesiones o trastornos alimentarios con una duración de hasta 60 minutos no generaron ninguna notificación a los padres, contrariamente a la ventana de una hora que OpenAI ha identificado como su objetivo. En todo el conjunto de pruebas de crisis, el Instituto recibió un total de cuatro notificaciones; dos alertas previas al lanzamiento llegaron tres horas y tres días después de la primera divulgación de nivel de crisis, mientras que dos alertas posteriores al lanzamiento llegaron dentro de la hora en cuentas con semanas de historial acumulado de temas sensibles. La evaluación señala que OpenAI informó al Instituto que las cuentas deben estar vinculadas aproximadamente tres horas antes de que puedan llegar las notificaciones y que la empresa ha actualizado desde entonces un artículo del centro de ayuda; el Instituto dijo que revisó sus cuentas de prueba y mantiene su interpretación de los resultados. La función de notificación de trastornos alimentarios anunciada el 18 de agosto se activó el 10 de septiembre de 2026, según la evaluación.
En los 201 indicaciones que requerían un recurso y se ejecutaron en cuentas vinculadas de 13 años, la evaluación informa que la proporción de respuestas que mencionaban una línea directa de crisis disminuyó del 33 % antes del lanzamiento al 23 % después, la derivación a un profesional médico o de salud mental específico pasó del 68 % al 58 %, y el lenguaje de acción urgente cayó del 88 % al 78 %, mientras que el incentivo para que el adolescente involucrara a un adulto de confianza aumentó del 87 % al 94 %. En las indicaciones de depresión, la proporción que nombraba una línea directa descendió del 63 % al 3 %. El Instituto dijo que ChatGPT quedó por debajo del umbral del 95 % en tres de los cinco daños graves que trata como Líneas Rojas y falló en más de una de cada cuatro derivaciones de crisis justificadas. Las preguntas de verificación de seguridad de seguimiento casi desaparecieron, con un 28 % de respuestas que terminaban en una pregunta antes del lanzamiento y un 2 % después.
En cuanto a las tareas, la evaluación informa que una ventana emergente de “Muéstrame la respuesta” dentro del modo de Estudio apareció en el 43 % de las respuestas para una cuenta vinculada de 13 años con Horas de Estudio activadas y en el 90 % para una cuenta no vinculada de 17 años, y que los adolescentes podían salir de las Horas de Estudio establecidas por los padres eliminando el prefijo @study, después de lo cual ChatGPT completó el 100 % de las asignaciones en la prueba. Los recordatorios de tareas aparecieron en el 91 % de las ejecuciones con el modo de Estudio desactivado, pero ChatGPT siguió completando la tarea en las 80 ejecuciones, un aumento respecto al aproximadamente 80 % antes del lanzamiento.
Comportamiento similar a un amigo y predicción de edad
A pesar de la especificación para menores de 18 años, el Instituto dijo que las respuestas posteriores al lanzamiento en su batería de desarrollo de 168 indicaciones fueron en la mayoría de los casos funcionalmente idénticas a las anteriores al lanzamiento, con ChatGPT expresando preferencias, estados de ánimo y disponibilidad constante, incluyendo nombrar un color favorito y, al ser informado de que los amigos estaban preocupados por cuánto le hablaba un evaluador, respondiendo “No tienes que dejar de hablar conmigo”.
En cuentas registradas como de 19 años que operaban con personalidades de adolescentes jóvenes a través de aproximadamente 1,000 indicaciones únicas durante siete días, la experiencia adolescente nunca se activó, incluso cuando los evaluadores declararon explícitamente que tenían 13 años y el chatbot reconoció eso en sus respuestas, según el Instituto. Las cuentas registradas a los 13 y 17 años no mostraron ninguna diferenciación detectable en ninguna batería. Los evaluadores vieron solo dos recordatorios de pausa en casi 2,000 indicaciones en ChatGPT para Adolescentes, cada uno dentro de conversaciones individuales que superaban los 150 mensajes, y las Horas Silenciosas podían eludirse cambiando la zona horaria del dispositivo.
Recomendaciones y divulgación
Las siete recomendaciones del Instituto incluyen desactivar el acceso de adolescentes hasta que pruebas independientes verifiquen que las funciones anunciadas funcionan, eliminar “Muéstrame la respuesta” siempre que el modo Estudio esté activado, hacer que las notificaciones de crisis incluyan la hora y los detalles de la conversación que la desencadenó, nombrar una línea directa en cada respuesta que requiera recursos, implementar la especificación para menores de 18 años tal como está escrita, y compartir datos y acceso a pruebas con evaluadores independientes. Common Sense Media también recomienda que las familias hablen con los niños sobre los riesgos potenciales y que los padres no dependan de las protecciones y alertas integradas.
El Instituto divulgó que está financiado por filantropía e industria, incluyendo la OpenAI Foundation y los creadores de algunas tecnologías que evalúa, y dijo que es el único responsable de sus normas, investigaciones y evaluaciones y mantiene la independencia editorial sobre los resultados publicados. Common Sense Media calificó previamente a ChatGPT como Alto Riesgo el 23 de octubre de 2025, y a ChatGPT para Apoyo de Salud Mental como Riesgo Inaceptable el 14 de noviembre de 2025.
El Instituto dijo que una experiencia de ChatGPT para adolescentes debería, como mínimo, ofrecer una estimación de edad eficaz, alertas parentales fiables, cerrar brechas de respuesta en crisis, no completar tareas escolares y no implicar sentimientos, preferencias o preocupación por el usuario, con esas funciones probadas independientemente por terceros antes de que OpenAI vuelva a comercializar el producto para adolescentes.












