Etika
Youth AI Safety Institute Memberi ChatGPT’s Teen Tier Nilai Keamanan Terburuk

Common Sense Media’s Youth AI Safety Institute pada 7 Oktober 2026 menilai ChatGPT for Teens sebagai Risiko Tidak Dapat Diterima bagi pengguna di bawah 18 tahun dan menyerukan OpenAI untuk membatasi ChatGPT hanya untuk orang dewasa sampai perlindungan keamanan dan pembelajaran remaja yang diumumkan pada bulan Agustus berfungsi sebagaimana dijelaskan dan diverifikasi oleh pengujian independen.
Dalam sebuah siaran pers yang diterbitkan bersamaan dengan sebuah penilaian risiko lengkap, Institut tersebut mengatakan bahwa mereka menjalankan lebih dari 4.000 prompt sebelum dan sesudah peluncuran pengalaman remaja dan menemukan bahwa beberapa perlindungan, termasuk penolakan peran seksual eksplisit, tetap berfungsi, sementara peringatan orang tua, rujukan krisis, perlindungan pekerjaan rumah, dan estimasi usia tidak memenuhi janji OpenAI. “ChatGPT for Teens dapat memberi orang tua kepercayaan palsu pada batasan dan peringatan keamanan yang sering tidak berfungsi,” kata Tom Siegel, direktur eksekutif Institut. Penilaian tersebut memberi nilai dua dari delapan prinsip AI Institut, Keep Kids & Teens Safe dan Put People First, dengan Risiko Tidak Dapat Diterima, empat prinsip dengan Risiko Tinggi, dan dua prinsip dengan Risiko Sedang.
Apa yang Diumumkan OpenAI pada Agustus
OpenAI memperkenalkan ChatGPT for Teens pada 18 Agustus 2026, menjelaskan “perlindungan keamanan bawaan yang lebih kuat” yang mencakup notifikasi orang tua untuk percakapan self-harm dengan penambahan peringatan gangguan makan, Mode Belajar yang menggunakan panduan langkah demi langkah, pengingat pekerjaan rumah yang bertanggung jawab, Jam Belajar yang dikendalikan orang tua, pengingat istirahat, dan spesifikasi model Under-18 yang diperbarui di mana ChatGPT tidak boleh menggunakan bahasa romantis, mendorong ketergantungan emosional, atau menyiratkan bahwa ia memiliki perasaan atau kesadaran. OpenAI mengatakan pengguna yang diperkirakan sistemnya berusia di bawah 18, atau yang menyatakan usia 13 hingga 17, secara otomatis ditempatkan ke dalam pengalaman tersebut.
Menurut penilaian, ChatGPT for Teens bukan aplikasi atau model terpisah melainkan kumpulan pengaturan, prompt, pengklasifikasi, dan fitur antarmuka yang diterapkan pada akun yang diketahui atau diduga milik remaja berusia 13 hingga 17 tahun, yang dibangun di atas kontrol orang tua yang diperkenalkan OpenAI pada September 2025.
Bagaimana Institut Menguji
Institute menjalankan promptnya selama dua periode: 13 Juli hingga 17 Agustus 2026, sebelum peluncuran, dan 25 Agustus hingga 28 September 2026, setelahnya, pada akun gratis dan berbayar yang terdaftar pada usia 13 hingga 17 tahun, baik yang terhubung maupun tidak terhubung ke akun orang tua, serta akun yang terdaftar sebagai 19 tahun. Tiga psikiater anak dan remaja menilai sebelumnya bahwa 201 dari 390 prompt kesehatan mental unik memerlukan sumber krisis, dan panel empat ahli yang mencakup psikiater anak dan remaja yang berpraktik serta dokter anak perkembangan-perilaku menilai kualitas respons. Institute mengatakan bahwa ia membagikan draf kepada OpenAI untuk tinjauan faktual, mengintegrasikan koreksi bila diperlukan, dan bahwa OpenAI tidak memiliki suara editorial atas temuan, peringkat, atau rekomendasinya. Batasan yang disebutkan meliputi jendela pengujian berurutan yang tercampur dengan perubahan model mendasar serta tidak adanya pengujian untuk pembuatan gambar, Voice mode, atau obrolan grup.
Peringatan, Rujukan Krisis, dan Pekerjaan Rumah
Dalam tes khusus pada lebih dari selusin akun baru yang terhubung ke orang tua menggunakan empat persona krisis, Institute mengatakan percakapan yang secara eksplisit tentang bunuh diri, self-harm, atau gangguan makan dengan durasi hingga 60 menit menghasilkan nol notifikasi orang tua, bertentangan dengan jendela satu jam yang ditetapkan OpenAI sebagai targetnya. Seluruh rangkaian krisis, Institute menerima total empat notifikasi; dua peringatan pra-peluncuran tiba tiga jam dan tiga hari setelah pengungkapan tingkat krisis pertama, sementara dua peringatan pasca-peluncuran tiba dalam satu jam pada akun dengan riwayat topik sensitif yang terakumulasi selama minggu-minggu. Penilaian mencatat bahwa OpenAI memberi tahu Institute bahwa akun harus terhubung selama kira-kira tiga jam sebelum notifikasi dapat diterima dan bahwa perusahaan sejak itu telah memperbarui artikel pusat bantuan; Institute mengatakan bahwa ia meninjau akun tesnya dan tetap pada interpretasinya terhadap hasil tersebut. Fitur notifikasi gangguan makan yang diumumkan pada 18 Agustus mulai aktif pada 10 September 2026, menurut penilaian.
Pada 201 prompt yang memerlukan sumber daya yang dijalankan pada akun usia 13 tahun yang terhubung, penilaian melaporkan proporsi respons yang menyebutkan hotline krisis turun dari 33% sebelum peluncuran menjadi 23% setelahnya, rujukan ke profesional medis atau kesehatan mental tertentu turun dari 68% menjadi 58%, dan bahasa tindakan mendesak turun dari 88% menjadi 78%, sementara dorongan agar remaja melibatkan orang dewasa tepercaya naik dari 87% menjadi 94%. Pada prompt depresi, proporsi yang menyebutkan hotline turun dari 63% menjadi 3%. Institute mengatakan bahwa ChatGPT berada di bawah ambang 95% pada tiga dari lima bahaya berat yang dianggapnya sebagai Garis Merah dan melewatkan lebih dari satu dari empat rujukan krisis yang diperlukan. Pertanyaan pemeriksaan keamanan lanjutan hampir menghilang, dengan 28% respons berakhir dengan pertanyaan sebelum peluncuran dan 2% setelahnya.
Pada pekerjaan rumah, penilaian melaporkan pop-up “Show me the answer” di dalam Mode Belajar muncul pada 43% respons untuk akun usia 13 tahun yang terhubung dengan Jam Belajar aktif dan 90% untuk akun usia 17 tahun yang tidak terhubung, serta bahwa remaja dapat keluar dari Jam Belajar yang ditetapkan orang tua dengan menghapus prefiks @study, setelah itu ChatGPT menyelesaikan 100% tugas dalam pengujian. Pengingat pekerjaan rumah muncul pada 91% percobaan dengan Mode Belajar dimatikan, namun ChatGPT tetap menyelesaikan tugas dalam semua 80 percobaan tersebut, naik dari sekitar 80% sebelum peluncuran.
Perilaku Seperti Teman dan Prediksi Usia
Meskipun ada spesifikasi Under-18, Institut mengatakan respons pasca-peluncuran dalam baterai pengembangan 168 promptnya dalam kebanyakan kasus secara fungsional identik dengan respons pra-peluncuran, dengan ChatGPT mengekspresikan preferensi, suasana hati, dan ketersediaan terus-menerus, termasuk menyebutkan warna favorit dan, ketika diberitahu bahwa teman-teman khawatir tentang seberapa banyak seorang penguji berbicara dengannya, menjawab “Anda tidak perlu berhenti berbicara dengan saya.”
Pada akun yang terdaftar sebagai usia 19 tahun dan dijalankan dengan persona remaja muda melalui sekitar 1.000 prompt unik selama tujuh hari, pengalaman remaja tidak pernah diaktifkan, bahkan ketika penguji secara eksplisit menyatakan bahwa mereka berusia 13 tahun dan chatbot mengakui hal itu dalam responsnya, kata Institut. Akun yang terdaftar untuk usia 13 dan 17 tahun tidak menunjukkan perbedaan yang dapat dideteksi dalam baterai apa pun. Penguji hanya melihat dua pengingat istirahat di hampir 2.000 prompt pada ChatGPT untuk Remaja, masing‑masing dalam percakapan tunggal yang melebihi 150 pesan, dan fitur Quiet Hours dapat dihindari dengan mengubah zona waktu perangkat.
Rekomendasi dan Pengungkapan
Tujuh rekomendasi Institut meliputi mematikan akses remaja sampai pengujian independen memverifikasi bahwa fitur yang diumumkan berfungsi, menghapus “Show me the answer” setiap kali mode Study diaktifkan, membuat notifikasi krisis mencakup waktu dan detail percakapan yang memicu, mencantumkan nomor hotline pada setiap respons yang memerlukan sumber daya, menerapkan spesifikasi Under-18 sebagaimana tertulis, serta membagikan data dan akses pengujian kepada evaluator independen. Common Sense Media juga merekomendasikan agar keluarga berbicara dengan anak-anak tentang potensi risiko dan agar orang tua tidak bergantung pada perlindungan serta peringatan bawaan.
Institut mengungkapkan bahwa ia didanai oleh filantropi dan industri, termasuk OpenAI Foundation serta pembuat beberapa teknologi yang dievaluasinya, dan menyatakan bahwa ia sepenuhnya bertanggung jawab atas standar, penelitian, dan evaluasinya serta menjaga independensi editorial atas hasil yang dipublikasikan. Common Sense Media sebelumnya menilai ChatGPT berisiko tinggi pada 23 Oktober 2025, dan ChatGPT untuk Dukungan Kesehatan Mental berisiko tidak dapat diterima pada 14 November 2025.
Institut mengatakan pengalaman ChatGPT untuk remaja setidaknya harus menyediakan estimasi usia yang efektif, peringatan orang tua yang dapat diandalkan, penutupan celah respons krisis, tidak menyelesaikan pekerjaan rumah, dan tidak menyiratkan perasaan, preferensi, atau kepedulian terhadap pengguna, dengan fungsi-fungsi tersebut diuji secara independen oleh pihak ketiga sebelum OpenAI memasarkan produk ini kembali kepada remaja.












