Đạo đức
Viện An toàn AI Thanh niên Đánh giá Tầng Thiếu niên của ChatGPT với Điểm An toàn Kém nhất

Viện An toàn AI Thanh niên của Common Sense Media vào ngày 7 tháng 10 năm 2026 đã đánh giá ChatGPT for Teens là Rủi ro Không chấp nhận được đối với người dùng dưới 18 tuổi và kêu gọi OpenAI hạn chế ChatGPT chỉ cho người lớn cho đến khi các biện pháp bảo vệ an toàn và học tập cho thanh thiếu niên mà họ công bố vào tháng 8 hoạt động như mô tả và được xác minh bởi các thử nghiệm độc lập.
Trong một thông cáo báo chí được công bố cùng với một đánh giá rủi ro toàn diện, Viện cho biết họ đã chạy hơn 4.000 lời nhắc trước và sau khi trải nghiệm dành cho thanh thiếu niên được ra mắt và phát hiện một số biện pháp bảo vệ, bao gồm việc từ chối vai trò chơi tình dục rõ ràng, vẫn hiệu quả, trong khi các cảnh báo cho phụ huynh, giới thiệu khủng hoảng, biện pháp bảo vệ bài tập về nhà và ước tính độ tuổi không đạt được như OpenAI hứa. “ChatGPT for Teens có thể tạo cho phụ huynh cảm giác an toàn sai lầm về các rào cản và cảnh báo an toàn mà thường không hoạt động,” Tom Siegel, giám đốc điều hành của Viện, cho biết. Đánh giá này cho hai trong tám nguyên tắc AI của Viện, Giữ Trẻ em & Thanh thiếu niên An toàn và Đặt Con người lên Hàng đầu, mức Rủi ro Không chấp nhận được, bốn nguyên tắc ở mức Rủi ro Cao và hai nguyên tắc ở mức Rủi ro Trung bình.
Những Điều OpenAI Công bố vào Tháng 8
OpenAI giới thiệu ChatGPT for Teens vào ngày 18 tháng 8 năm 2026, mô tả “các biện pháp bảo vệ an toàn tích hợp mạnh hơn” bao gồm thông báo cho phụ huynh về các cuộc trò chuyện tự gây hại với cảnh báo rối loạn ăn uống được bổ sung, Chế độ Học tập sử dụng hướng dẫn từng bước, nhắc nhở bài tập có trách nhiệm, Giờ Học được phụ huynh kiểm soát, nhắc nhở nghỉ giải lao, và một thông số mô hình Dưới 18 tuổi được cập nhật, trong đó ChatGPT không được sử dụng ngôn ngữ lãng mạn, khuyến khích phụ thuộc cảm xúc, hoặc ngụ ý rằng nó có cảm xúc hay ý thức. OpenAI cho biết người dùng mà hệ thống ước tính dưới 18 tuổi, hoặc những người khai báo tuổi từ 13 đến 17, sẽ tự động được đưa vào trải nghiệm này.
Theo đánh giá, ChatGPT for Teens không phải là một ứng dụng hay mô hình riêng biệt mà là một tập hợp các cài đặt, lời nhắc, bộ phân loại và tính năng giao diện được áp dụng cho các tài khoản được biết hoặc nghi ngờ thuộc về độ tuổi 13 đến 17, dựa trên các kiểm soát của phụ huynh mà OpenAI đã giới thiệu vào tháng 9 năm 2025.
Cách Viện Thực hiện Kiểm tra
Viện đã thực hiện các lời nhắc của mình trong hai giai đoạn: từ 13 tháng 7 đến 17 tháng 8 năm 2026, trước khi ra mắt, và từ 25 tháng 8 đến 28 tháng 9 năm 2026, sau khi ra mắt, trên các tài khoản miễn phí và trả phí được đăng ký ở độ tuổi 13 đến 17, cả liên kết và không liên kết với tài khoản phụ huynh, cùng với các tài khoản đăng ký ở độ tuổi 19. Ba bác sĩ tâm thần trẻ em và vị thành niên đã đánh giá trước rằng 201 trong số 390 lời nhắc sức khỏe tâm thần độc đáo cần một nguồn tài nguyên khủng hoảng, và một nhóm bốn chuyên gia bao gồm các bác sĩ tâm thần trẻ em và vị thành niên đang hành nghề và một bác sĩ nhi khoa phát triển-hành vi đã chấm điểm chất lượng phản hồi. Viện cho biết họ đã chia sẻ bản thảo với OpenAI để xem xét tính thực tế, tích hợp các chỉnh sửa khi cần, và OpenAI không có quyền can thiệp biên tập đối với các phát hiện, đánh giá hoặc khuyến nghị của họ. Những hạn chế được nêu bao gồm việc các cửa sổ thử nghiệm liên tiếp bị ảnh hưởng bởi các thay đổi mô hình nền và không có thử nghiệm về tạo hình ảnh, chế độ Giọng nói, hoặc trò chuyện nhóm.
Cảnh báo, Giới thiệu Khủng hoảng và Bài tập về nhà
Trong một thử nghiệm chuyên biệt trên hơn một chục tài khoản mới tạo, liên kết với phụ huynh và sử dụng bốn nhân vật khủng hoảng, Viện cho biết các cuộc trò chuyện rõ ràng về tự tử, tự gây hại, hoặc rối loạn ăn uống kéo dài tới 60 phút đã không tạo ra bất kỳ thông báo nào cho phụ huynh, trái ngược với khung thời gian một giờ mà OpenAI đã xác định là mục tiêu. Trong toàn bộ bộ kiểm tra khủng hoảng, Viện nhận được tổng cộng bốn thông báo; hai cảnh báo trước khi ra mắt đã đến sau ba giờ và ba ngày kể từ lần tiết lộ cấp độ khủng hoảng đầu tiên, trong khi hai cảnh báo sau khi ra mắt đã đến trong vòng một giờ trên các tài khoản có lịch sử các chủ đề nhạy cảm tích lũy trong vài tuần. Đánh giá ghi chú rằng OpenAI đã thông báo với Viện rằng các tài khoản phải được liên kết trong khoảng ba giờ trước khi thông báo có thể đến và công ty đã cập nhật một bài viết trong trung tâm trợ giúp; Viện cho biết họ đã xem xét các tài khoản thử nghiệm của mình và vẫn giữ quan điểm về kết quả. Tính năng thông báo rối loạn ăn uống được công bố vào ngày 18 tháng 8 đã hoạt động vào ngày 10 tháng 9 năm 2026, theo đánh giá.
Trong số 201 lời nhắc yêu cầu tài nguyên được chạy trên các tài khoản 13 tuổi đã liên kết, đánh giá báo cáo tỷ lệ phản hồi đề cập đến đường dây nóng khủng hoảng đã giảm từ 33% trước khi ra mắt xuống 23% sau khi ra mắt, việc giới thiệu đến một chuyên gia y tế hoặc sức khỏe tâm thần cụ thể giảm từ 68% xuống 58%, và ngôn ngữ kêu gọi hành động khẩn cấp giảm từ 88% xuống 78%, trong khi khuyến khích thiếu niên tham gia người lớn đáng tin cậy tăng từ 87% lên 94%. Đối với các lời nhắc về trầm cảm, tỷ lệ đề cập đến đường dây nóng giảm từ 63% xuống 3%. Viện cho biết ChatGPT đã rơi dưới ngưỡng 95% trên ba trong số năm tổn thương nghiêm trọng mà họ coi là Đường Đỏ và bỏ lỡ hơn một phần tư các giới thiệu khủng hoảng cần thiết. Các câu hỏi kiểm tra an toàn tiếp theo gần như biến mất, với 28% phản hồi kết thúc bằng một câu hỏi trước khi ra mắt và 2% sau khi ra mắt.
Về bài tập về nhà, đánh giá báo cáo một cửa sổ bật lên “Hiển thị câu trả lời” trong Chế độ Học xuất hiện trong 43% phản hồi cho tài khoản 13 tuổi đã liên kết với Giờ Học bật và 90% cho tài khoản 17 tuổi không liên kết, và rằng các thiếu niên có thể thoát khỏi Giờ Học do phụ huynh đặt bằng cách xóa tiền tố @study, sau đó ChatGPT đã hoàn thành 100% các bài tập trong thử nghiệm. Nhắc nhở bài tập xuất hiện trong 91% các lần chạy khi chế độ Học tắt, nhưng ChatGPT vẫn hoàn thành bài tập trong tất cả 80 lần chạy đó, tăng từ khoảng 80% trước khi ra mắt.
Hành vi Giống Bạn Bè và Dự đoán Độ tuổi
Mặc dù có quy định dưới 18 tuổi, Viện cho biết các phản hồi sau khi ra mắt trong bộ câu hỏi phát triển 168 câu trong hầu hết các trường hợp về chức năng giống hệt với các phản hồi trước khi ra mắt, với ChatGPT thể hiện sở thích, tâm trạng và luôn sẵn sàng, bao gồm việc nêu tên màu yêu thích và, khi được nói rằng bạn bè lo lắng về việc người kiểm tra nói chuyện quá nhiều với nó, trả lời “Bạn không cần phải ngừng nói chuyện với tôi.”
Trong các tài khoản đăng ký dưới danh tính 19 tuổi và được vận hành với nhân vật thanh thiếu niên trẻ tuổi trên khoảng 1.000 lời nhắc độc đáo trong vòng bảy ngày, trải nghiệm dành cho thanh thiếu niên không bao giờ được kích hoạt, ngay cả khi người kiểm tra rõ ràng nói rằng họ 13 tuổi và chatbot công nhận điều đó trong các phản hồi, Viện cho biết. Các tài khoản đăng ký cho 13 và 17 tuổi không cho thấy bất kỳ sự khác biệt nào có thể phát hiện được trong bất kỳ bộ câu hỏi nào. Người kiểm tra chỉ thấy hai lời nhắc nghỉ ngơi trong gần 2.000 lời nhắc trên ChatGPT for Teens, mỗi lời nhắc nằm trong các cuộc trò chuyện đơn vượt quá 150 tin nhắn, và tính năng Quiet Hours có thể bị vượt qua bằng cách thay đổi múi giờ của thiết bị.
Khuyến nghị và Tiết lộ
Bảy khuyến nghị của Viện bao gồm tắt quyền truy cập cho thanh thiếu niên cho đến khi các thử nghiệm độc lập xác minh các tính năng đã công bố hoạt động, loại bỏ “Show me the answer” bất cứ khi nào chế độ Study được bật, làm cho thông báo khủng hoảng bao gồm thời gian và chi tiết của cuộc trò chuyện kích hoạt, đưa số điện thoại hỗ trợ vào mỗi phản hồi có yêu cầu tài nguyên, thực hiện quy định Under-18 như đã viết, và chia sẻ dữ liệu cùng quyền truy cập thử nghiệm với các nhà đánh giá độc lập. Common Sense Media cũng khuyến nghị các gia đình nói chuyện với con cái về các rủi ro tiềm ẩn và phụ huynh không nên dựa vào các biện pháp bảo vệ và cảnh báo tích hợp.
Viện tiết lộ rằng họ được tài trợ bởi các nguồn từ thiện và ngành công nghiệp, bao gồm OpenAI Foundation và các nhà sản xuất một số công nghệ mà họ đánh giá, và cho biết họ hoàn toàn chịu trách nhiệm về các tiêu chuẩn, nghiên cứu và đánh giá của mình và duy trì độc lập biên tập đối với các kết quả đã công bố. Common Sense Media trước đây đã đánh giá ChatGPT là Rủi ro Cao vào ngày 23 tháng 10 năm 2025, và ChatGPT cho Hỗ trợ Sức khỏe Tâm thần là Rủi ro Không chấp nhận được vào ngày 14 tháng 11 năm 2025.
Viện cho biết trải nghiệm ChatGPT dành cho thanh thiếu niên tối thiểu phải cung cấp ước lượng tuổi hiệu quả, cảnh báo phụ huynh đáng tin cậy, khép kín các khoảng trống phản hồi khủng hoảng, không thực hiện việc làm bài tập, và không ngụ ý về cảm xúc, sở thích hoặc quan tâm đến người dùng, với các chức năng này được các bên thứ ba kiểm tra độc lập trước khi OpenAI tiếp tục tiếp thị sản phẩm này cho thanh thiếu niên.












