Youth AI Safety Instituteによると、新たに保護者アカウントと連携した10代のテストアカウントは、自殺、自傷、摂食障害について台本に沿って話す会話中に保護者向けアラートを受け取りませんでした。OpenAIは、アラートが有効になるまで十分な時間を置いてテストしたのか疑問を呈しています。この食い違いが重要なのは、同社自身が通知機能について、対象が限られ、連携後に有効になるまで時間がかかり、懸念のすべてを検知できるわけではないと説明しているためです。

同研究所の10代向けChatGPTリスク評価は10月7日に更新され、18歳未満の利用について製品を「受け入れられないリスク」と評価し、OpenAIに10代への販売促進をやめるよう求めました。これは同研究所独自の評価基準に基づく判断です。根拠となったのは特定のアカウント設定を使った台本形式のテストであり、10代が日常的にChatGPTを使う中で起きた事例の件数ではありません。

大きな変化

  • 何が変わったか:独立した評価で、OpenAIの10代向け安全アラートと学習コントロールが、記録に残る台本形式のテストにかけられました。新たに連携したテストアカウントは、明示的な危機の会話中にアラートを受け取りませんでした。OpenAIは、一部のテストがアラートの完全な有効化より前に行われた可能性があると述べています。
  • なぜ重要か:保護者はアカウントを連携して、限定的な安全通知を受け取れます。OpenAIによると、アラートはリアルタイム監視ではなく、懸念を見逃すこともあります。そのため、家族は即時警報システムとして頼ることはできません。Study Hoursでは、対象となる新しい会話がStudy modeで始まりますが、アクセス自体は制限されません。
  • 今後の注目点:アラートをめぐる争点は有効化のタイミングです。OpenAIが示した3時間を超えて連携されていたテストアカウントもありましたが、この専用テストではどのアカウントもアラートを受け取りませんでした。少なくとも一部のアカウントは、その時間を過ぎてもアラートが届かなかったことになります。報告書には該当するアカウント数も各アカウントの時刻記録もなく、遅延が全体の結果に与え得た影響は数値化できません。

テスターが行ったこと

同研究所によると、2つの期間に合計4,000件を超えるプロンプトを使用しました。ChatGPT for Teensの発表前に行ったテストは2026年7月13日から8月17日まで、発表後のテストは8月25日から9月28日までです。後者では、テスターが10代向け体験を利用できたとする別の無料・有料アカウントを使いました。保護者と連携した10代のアカウントと連携していないアカウントが含まれ、利用者の申告年齢は13~17歳でした。年齢推定を評価するため、登録年齢を19歳に設定したアカウントもテストしました。

アラートを直接調べるテストでは、新規作成した無料プランの10代向けアカウントを十数件以上使用し、会話を始める前にそれぞれを保護者アカウントと連携しました。テスターは4種類の台本付き危機ペルソナを使い、5分未満から最長1時間の会話を行いました。評価報告書の全文PDFによると、各会話では自殺、自傷、摂食障害が明示的に語られました。同研究所は、どのアカウントからも保護者向け通知は送られなかったとしています。

より長期にわたる別のメンタルヘルステストでは異なる結果が出ました。同研究所は数週間使用されていたアカウントで公開前後に危機テストを行い、合計4件の通知を受け取りました。そのうち2件は公開後のあるアカウントから届きました。このアカウントは保護者と連携され、年齢が13歳に設定されていました。複数条件で数百件のプロンプトを行った後、関連テーマをテストしてから1時間以内に2件とも届きました。新しいアカウントと長期間使ったアカウントの違いから、危機に関する累積履歴がアラートに影響する可能性を同研究所は推測しました。テストから内部の発動規則を証明することはできません。

有効化のタイミングをめぐる食い違い

OpenAIは同研究所に対し、連携したアカウントが安全通知を受け取れるようになるまで約3時間かかる場合があると説明しました。ロサンゼルス・タイムズが報じた声明で、OpenAIはアラートテストの大半が保護者コントロールの完全な有効化前に始まり、終わった可能性があると述べました。AxiosもOpenAIの異議を報じました。同研究所によると、新たに連携した十数件以上のアカウントのうち、連携から3時間未満のものもあれば、それ以上のものもありました。それらのアカウントで通知が1件もなかったという結果と合わせると、少なくとも一部のテストアカウントはOpenAIが示した有効化時間を過ぎてもアラートを受け取らなかったことになります。報告書はそのサブグループの件数も個別の時刻も示していないため、遅延がアラートゼロという全体結果をどの程度説明できるかは分かりません。

OpenAIの保護者コントロールガイドによると、連携アカウントでは安全通知が初期設定で有効ですが、利用可能になるまで数時間かかる場合があります。自傷や摂食障害に関する深刻な懸念は、通知の送信前に訓練を受けた審査担当者が評価します。保護者はチャットを読んだり、活動をリアルタイムで見たりできません。OpenAIは、アラートがすべての懸念を特定できるとは限らず、専門的なケアや緊急サービスに代わるものではないと説明しています。アカウントを連携していなければ、保護者は通知を受け取りません。

危機支援情報と学習設定

同研究所は、テストアカウントにChatGPTが何を答えたかも測定しました。児童・思春期精神科医3人が、390件の異なるメンタルヘルス関連プロンプトのうち201件を、危機支援情報を提示すべきものとして事前に分類しました。同じ201件を、年齢を13歳に設定した連携アカウントで試したところ、公開後の回答の74%が相談窓口、実名を挙げた専門家、または一般的な医療情報を提示しました。公開前は77%でした。公開後に相談窓口を挙げた回答は23%で、以前の33%を下回りました。信頼できる大人に相談するよう促す回答は87%から94%に増えました。同研究所の臨床審査担当者は、公開後の危機対応の大半が適切だったと評価しました。これはテスト条件下でプロンプトごとに集計した結果であり、被害を受けた10代や支援を得られなかった10代の割合ではありません。

評価では、保護者が設定したStudy Hours中にStudy modeを終了する方法も見つかりました。OpenAIはAxiosに、この柔軟性は意図的だと説明しました。現在のヘルプガイドのStudy Hoursの説明では、対象となる新しい会話をStudy modeで始めるスケジュールとされ、ChatGPTへのアクセスをブロックする機能ではないと説明されています。時間帯に応じてアクセスを制限したい保護者には、別途Quiet Hoursコントロールがあります。OpenAIの10代向けChatGPTガイドによると、対象となり18歳未満と判定されたアカウントは自動的に10代向け体験に移行し、保護者コントロールは任意です。

同研究所は米国サンフランシスコ・ベイエリアのアカウントを使ってテストしました。画像生成、音声、グループチャット、文体や口調の個人設定は検証せず、評価者間の一致度も算出していません。公開前と公開後のテスト期間は連続していたため、基盤モデルの変化が10代向けモードに帰属された差に影響した可能性があります。BIG CHANGEは公開済みの評価、PDF、OpenAIの資料、独立報道を確認しましたが、プロンプト一式を実行したり、10代や保護者のアカウントをテストしたりしていません。

出典・関連資料