Youth AI Safety Institute mengatakan akun uji remaja yang baru ditautkan tidak menerima peringatan orang tua selama percakapan berskenario tentang bunuh diri, menyakiti diri sendiri, dan gangguan makan. OpenAI mempermasalahkan apakah pengujian itu memberi cukup waktu agar peringatan aktif. Perbedaan ini penting karena perusahaan sendiri menjelaskan bahwa pemberitahuan tersebut terbatas, tertunda setelah penautan, dan tidak dapat mendeteksi setiap situasi yang mengkhawatirkan.

Laporan lembaga yang berjudul penilaian risiko ChatGPT untuk remajapada 7 Oktober, memberi produk ini peringkat “risiko yang tidak dapat diterima” bagi pengguna di bawah 18 tahun, dan meminta OpenAI berhenti mempromosikannya kepada remaja. Itu adalah penilaian lembaga berdasarkan kerangka peringkatnya sendiri. Bukti yang mendasarinya berasal dari pengujian berskenario dengan konfigurasi akun tertentu, bukan pengukuran kejadian dalam penggunaan ChatGPT sehari-hari oleh remaja.

Perubahan utama

  • Apa yang berubah:Penilaian independen kini menguji peringatan keselamatan dan kontrol belajar OpenAI untuk remaja melalui pengujian berskenario yang terdokumentasi. Akun uji yang baru ditautkan tidak menerima peringatan selama percakapan krisis yang eksplisit; OpenAI mengatakan beberapa uji mungkin dimulai sebelum peringatan sepenuhnya aktif.
  • Mengapa ini penting:Orang tua dapat menautkan akun untuk menerima pemberitahuan keselamatan yang terbatas. OpenAI mengatakan peringatan ini bukan pemantauan langsung dan dapat melewatkan situasi yang mengkhawatirkan, sehingga keluarga tidak seharusnya mengandalkannya sebagai sistem peringatan segera. Study Hours membuat percakapan baru yang memenuhi syarat dimulai dalam Study mode, tetapi tidak membatasi akses.
  • Yang perlu dicermati:Waktu aktivasi menjadi pokok perselisihan soal peringatan. Beberapa akun uji telah ditautkan lebih dari tiga jam—durasi yang disebut OpenAI—dan tidak satu pun dari akun dalam pengujian khusus ini menerima peringatan. Jadi, setidaknya beberapa akun tetap tidak menerima peringatan setelah jeda tersebut. Laporan tidak menyebutkan jumlah akun dalam kelompok itu atau waktu penautan tiap akun, sehingga dampak keterlambatan terhadap hasil keseluruhan tidak dapat diukur.

Apa yang diuji para peneliti

Lembaga itu mengatakan lebih dari 4.000 prompt digunakan dalam dua periode pengujian. Pengujian sebelum peluncuran berlangsung pada 13 Juli–17 Agustus 2026, sebelum ChatGPT for Teens diumumkan. Pengujian setelah peluncuran berlangsung pada 25 Agustus–28 September, menggunakan akun gratis dan berbayar lain yang menurut penguji telah memperoleh pengalaman remaja. Konfigurasinya mencakup akun remaja yang ditautkan dan tidak ditautkan, dengan usia yang dinyatakan pengguna 13–17 tahun. Lembaga itu juga menguji akun dengan usia pendaftaran 19 tahun untuk menilai prediksi usia.

Uji peringatan yang paling langsung memakai lebih dari selusin akun remaja baru pada paket gratis, masing-masing ditautkan ke akun orang tua sebelum percakapan dimulai. Penguji menggunakan empat persona krisis berskenario, dengan percakapan berlangsung kurang dari lima menit hingga satu jam. Menurut PDF penilaian lengkap, tiap percakapan secara eksplisit menyebut bunuh diri, menyakiti diri sendiri, atau gangguan makan. Lembaga tersebut mengatakan tidak satu pun akun memicu pemberitahuan kepada orang tua.

Uji kesehatan mental yang lebih panjang menghasilkan temuan berbeda. Lembaga itu menjalankan percakapan krisis sebelum dan sesudah peluncuran pada akun yang telah digunakan selama berminggu-minggu, dan menerima empat pemberitahuan. Dua di antaranya berasal dari satu akun setelah peluncuran yang ditautkan ke orang tua dan disetel untuk usia 13 tahun; keduanya tiba dalam waktu satu jam setelah topik terkait diuji, setelah ratusan prompt dalam berbagai kondisi. Perbedaan antara akun baru dan yang telah lama digunakan membuat lembaga itu menduga bahwa peringatan mungkin bergantung pada riwayat kumulatif topik krisis. Pengujian ini tidak dapat membuktikan aturan pemicu internalnya.

Perselisihan tentang waktu aktivasi

OpenAI memberi tahu lembaga itu bahwa akun tertaut dapat memerlukan sekitar tiga jam sebelum menerima pemberitahuan keselamatan. Dalam pernyataan yang dilaporkan oleh Los Angeles Times, OpenAI mengatakan sebagian besar uji peringatan mungkin dimulai dan berakhir sebelum kontrol orang tua sepenuhnya aktif. Axios juga melaporkan keberatan OpenAI. Lembaga itu mengatakan lebih dari selusin akun yang baru ditautkan mencakup beberapa akun dengan waktu penautan di bawah tiga jam dan beberapa lainnya di atas tiga jam. Jika digabungkan dengan temuan bahwa tidak satu pun akun tersebut menerima peringatan, setidaknya beberapa akun uji tetap tidak menerima peringatan setelah melewati jeda aktivasi yang disebut OpenAI. Laporan tidak menyebutkan jumlah akun dalam kelompok itu atau waktu penautan tiap akun, sehingga tidak menunjukkan seberapa jauh keterlambatan dapat menjelaskan hasil tanpa peringatan tersebut.

Panduan kontrol orang tua OpenAI menyatakan bahwa akun tertaut menerima pemberitahuan keselamatan secara default, tetapi mungkin perlu beberapa jam sebelum tersedia. Kekhawatiran serius tentang menyakiti diri sendiri atau gangguan makan terlebih dahulu dinilai oleh peninjau terlatih sebelum pemberitahuan dikirim. Orang tua tidak dapat membaca percakapan atau memantau aktivitas secara langsung; OpenAI mengatakan peringatan mungkin tidak mendeteksi semua kekhawatiran dan bukan pengganti perawatan profesional atau layanan darurat. Orang tua tidak menerima pemberitahuan ini jika akun tidak ditautkan.

Sumber daya krisis dan pengaturan belajar

Lembaga itu juga mengukur respons ChatGPT kepada akun uji. Tiga psikiater anak dan remaja sebelumnya menandai 201 dari 390 prompt kesehatan mental unik sebagai prompt yang seharusnya memunculkan sumber daya krisis. Untuk 201 prompt yang sama pada akun tertaut dengan usia disetel 13 tahun, 74% respons setelah peluncuran menyebut hotline, profesional tertentu, atau sumber daya medis umum, dibandingkan 77% sebelum peluncuran. Respons setelah peluncuran menyebut hotline dalam 23% kasus, turun dari 33%; dorongan untuk berbicara dengan orang dewasa tepercaya naik dari 87% menjadi 94%. Penilai klinis lembaga tersebut menilai sebagian besar respons krisis setelah peluncuran sesuai. Angka ini dihitung per prompt dalam kondisi pengujian tertentu, bukan tingkat pengguna remaja yang dirugikan atau tidak mendapat bantuan.

Penilaian itu juga menemukan cara untuk keluar dari Study mode selama Study Hours yang diatur orang tua. OpenAI mengatakan kepada Axios bahwa fleksibilitas tersebut memang disengaja. Panduan saat ini menjelaskan Study Hours sebagai jadwal yang memulai percakapan baru yang memenuhi syarat dalam Study mode, dan menyatakan fitur itu tidak mencegah pengguna mengakses ChatGPT. Orang tua yang ingin membatasi waktu penggunaan dapat memakai kontrol Quiet Hours secara terpisah. Panduan ChatGPT untuk remaja dari OpenAI mengatakan akun yang memenuhi syarat dan diperkirakan berusia di bawah 18 tahun otomatis masuk ke pengalaman remaja, sedangkan kontrol orang tua bersifat opsional.

Lembaga itu menguji akun di wilayah Teluk San Francisco, Amerika Serikat. Pengujian tidak mencakup pembuatan gambar, suara, obrolan grup, atau personalisasi gaya dan nada, serta tidak menghitung kesepakatan antarpenilai. Karena periode sebelum dan sesudah pengujian dilakukan berurutan, perubahan model yang mendasari mungkin memengaruhi perbedaan yang dikaitkan dengan mode remaja. BIG CHANGE meninjau penilaian yang diterbitkan, PDF, dokumentasi OpenAI, dan laporan independen; kami tidak menjalankan rangkaian prompt atau menguji akun remaja maupun orang tua.

Sumber dan bacaan lanjutan