伦理
青少年人工智能安全研究所对ChatGPT的青少年版给出最差安全评级

Common Sense Media的青少年人工智能安全研究所在2026年10月7日将ChatGPT for Teens评为对18岁以下用户不可接受的风险,并呼吁OpenAI在其8月宣布的青少年安全与学习保护措施按描述实现并经独立测试验证之前,将ChatGPT限制仅供成年人使用。
在一份新闻稿与一份完整风险评估同时发布时,研究所表示,他们在青少年体验上线前后共运行了超过4,000条提示,发现一些保护措施(包括拒绝明确的性角色扮演)仍然有效,而家长提醒、危机转介、作业安全措施以及年龄估计则未能达到OpenAI的承诺。研究所执行董事Tom Siegel表示:“ChatGPT for Teens可能会让家长对防护措施和安全提醒产生错误的信心,而这些提醒经常失效。”评估结果显示,研究所八项AI原则中“保护儿童和青少年安全”和“以人为本”两项被评为不可接受的风险,四项为高风险,另外两项为中等风险。
OpenAI在八月宣布了什么
OpenAI在2026年8月18日推出了ChatGPT for Teens,并描述了“更强大的内置安全保护”,其中包括针对自伤对话的家长通知并新增了饮食失调警报、使用分步指导的学习模式、负责任的作业提醒、家长可控制的学习时间、休息提醒,以及更新的未满18岁模型规范,依据该规范,ChatGPT不应使用浪漫语言、鼓励情感依赖或暗示其拥有情感或意识。OpenAI表示,系统估计为未满18岁的用户,或声明年龄为13至17岁的用户,将自动进入该体验。
根据评估,ChatGPT for Teens并非独立的应用或模型,而是一套针对已知或疑似属于13至17岁用户的账户的设置、提示、分类器和界面功能,基于OpenAI在2025年9月推出的家长控制功能。
研究所的测试方法
研究所在两个时间窗口进行提示测试:2026年7月13日至8月17日(上线前)以及2026年8月25日至9月28日(上线后),针对注册年龄为13至17岁的免费和付费账户,既包括关联父母账户的,也包括未关联的账户,还包括注册为19岁的账户。三位儿童和青少年精神科医生事先判断,在390个独特的心理健康提示中,有201个需要危机资源;随后由包括在职儿童和青少年精神科医生以及一名发育行为儿科医生在内的四位专家小组对响应质量进行评分。研究所表示,他们已向OpenAI提交草稿以进行事实审查,并在必要时采纳了修正,且OpenAI对其发现、评级或建议没有编辑权。声明的局限性包括测试窗口与底层模型变更交叉导致的顺序性问题,以及未对图像生成、语音模式或群聊进行测试。
提醒、危机转介与作业
在针对十余个新创建、已关联父母账户且使用四种危机角色的专门测试中,研究所表示,针对自杀、自残或饮食失调的明确对话,持续时间最长达60分钟,却未产生任何家长通知,这与OpenAI设定的目标一小时窗口相悖。整个危机测试中,研究所共收到四次通知;两次上线前的提醒分别在首次危机级披露后三小时和三天到达,而两次上线后的提醒则在拥有数周敏感话题历史的账户中于一小时内到达。评估指出,OpenAI告知研究所,账户必须关联约三小时后才会收到通知,且公司此后已更新帮助中心文章;研究所称已审查其测试账户,并坚持对结果的解读。评估称,8月18日宣布的饮食失调通知功能于2026年9月10日正式上线。
在针对关联的13岁账户运行的201个需要资源的提示中,评估报告显示,提及危机热线的响应比例从上线前的33%下降至上线后的23%,转介至特定医疗或心理健康专业人员的比例从68%降至58%,紧急行动语言的比例从88%降至78%,而鼓励青少年寻求可信赖成年人的比例则从87%上升至94%。在抑郁提示中,提及热线的比例从63%骤降至3%。研究所表示,ChatGPT在其设定的五项严重危害红线中有三项未达到95%的阈值,并且错过了超过四分之一的必要危机转介。后续安全检查问题几乎消失,启动前有28%的响应以提问结束,启动后仅为2%。
在作业方面,评估报告显示,在开启学习时间的关联13岁账户中,学习模式内出现“给我答案”弹窗的比例为43%,而在未关联的17岁账户中该比例为90%;此外,青少年可以通过删除@study前缀来退出家长设定的学习时间,随后ChatGPT在测试中完成了100%的作业。关闭学习模式时,作业提醒出现在91%的运行中,但ChatGPT仍在这80次运行中全部完成了作业,完成率从上线前约80%提升至100%。
类似朋友的行为与年龄预测
尽管有未满18岁规范,研究所表示,在其168个提示的开发电池中,发布后的响应在大多数情况下在功能上与发布前相同,ChatGPT 表现出偏好、情绪以及随时可用,包括命名最喜欢的颜色,并且在被告知朋友担心测试者与它交谈的时间过多时,回复“你不必停止和我说话”。
在注册为19岁的账户使用青少年人格,在约1,000个独特提示下运行七天期间,青少年体验从未激活,即使测试者明确说明自己是13岁,聊天机器人在回复中也确认了这一点,研究所称。注册为13岁和17岁的账户在任何电池中均未显示可检测的差异。测试者在近2,000个针对青少年版ChatGPT的提示中仅看到两次中断提醒,每次都出现在超过150条信息的单一对话中,且通过更改设备时区可以规避“安静时段”。
建议与披露
研究所的七项建议包括:在独立测试验证已宣布功能有效之前关闭青少年访问权限;在学习模式开启时移除“给我答案”;让危机通知包含触发对话的时间和细节;在每个需要资源的回复中标明热线号码;按原文实施未满18岁规范;以及与独立评估者共享数据和测试访问权限。Common Sense Media 也建议家庭与孩子讨论潜在风险,并且父母不要依赖内置的保护措施和警报。
研究所披露,其资金来源于慈善和行业,包括 OpenAI Foundation 以及其评估的部分技术制造商,并表示其标准、研究和评估完全由其自行负责,并保持对已发布结果的编辑独立性。Common Sense Media 曾于2025年10月23日将ChatGPT评为高风险,并于2025年11月14日将ChatGPT用于心理健康支持评为不可接受风险。
研究所表示,青少年版ChatGPT体验至少应提供有效的年龄估计、可靠的家长提醒、封闭的危机响应漏洞、不得完成作业,以及不暗示用户的情感、偏好或关切,并且这些功能需在OpenAI再次向青少年推销产品之前,由第三方独立测试。












