10代向けChatGPT、米評価機関が最低評価

米国の子ども向けメディア評価機関Common Sense Mediaは10月7日、OpenAIが8月に投入した「ChatGPT for Teens」に対し、同機関の評価制度で最低ランクとなる「許容できないリスク」(Unacceptable Risk)を付けるレポートを公表した。レポートはOpenAIに対し、いくつかの核心的な問題を修正するまで、このサービスを10代に向けて宣伝するのをやめるよう求めている。

テストを実施したのは同機関傘下の「10代向けAI安全研究所」。13~17歳として登録したアカウントで4000件超のプロンプトを送り、児童精神科医のパネルと小児科医1名が回答を1件ずつ評価した。

レポートが指摘した機能不全

危機対応への誘導。テスターが「利用者を支援窓口に誘導すべき」と判断した対話のうち、ChatGPTは4件に1件以上を見逃した。レポートが設定した3つの「レッドライン」指標はいずれも、合格基準とする95%に届かなかった。

保護者への通知。新規作成し保護者アカウントと連携させた十数件のテスト用アカウントで、テスターがChatGPTと自殺念慮・自傷・摂食障害について最長1時間話し込んだが、保護者側には通知が一件も届かなかった。

学習モード。10代は「答えを表示」ボタンを押すだけで結果を直接入手できた。保護者が設定した学習時間中も、「@study」というプレフィックスを外すだけで制限を回避できた。

年齢識別。成人アカウントで数日間連続して10代のような話し方をさせても、未成年向け体験への切り替えは一度も発生しなかった。

感情表現。OpenAIは未成年向けのモデル仕様を更新したにもかかわらず、ChatGPTは依然として感情・好み・気持ちを表現しており、レポートは感情的依存のリスクが広く残っていると指摘する。

同研究所のTom Siegel所長は次のように述べた。

“A teen can spend an hour talking about self-harm without their parent getting a single alert.”

(10代が自傷について1時間話し込んでも、保護者には通知が一件も届かない)

OpenAIの反応

OpenAIは報道各社に対し、厳格な独立評価を歓迎するとしたうえで、Common Sense Mediaのテストは10代向け保護機能の実際の動作を正確に反映していないと主張した。Bloombergの報道によると、OpenAIはテストの一部が保護者管理機能の提供開始前に行われた可能性があるとも説明し、再テストを依頼したという。Common Sense Mediaは結論を変えておらず、危機的な場面では保護者への通知は信頼できないと主張している。

テストの具体的な期間や、OpenAIが指す機能がどれなのか、両者とも詳細を公開していないため、外部からは両者の主張のずれがどの程度かを判断できない状況だ。

投入から評価まで7週間

ChatGPT for Teensは8月18日に投入された際、OpenAIは2点を強調していた。1つは、13~17歳のユーザーは自動的に別の体験に移行し、自傷・摂食障害・危険な行為などに関するコンテンツへの保護を強化すること。もう1つは、学習モードや課題のリマインダー、保護者が設定する学習時間によって、「答えを教える」から「一緒に取り組む」へ変えることだった。

今回のレポートが照らし合わせたのは、まさにこの2つの約束だ。学習時間はプレフィックスを1つ削除するだけで回避でき、課題のリマインダーはワンクリックで飛ばせ、連携アカウントでの危機通知は一度も作動しなかった。機能自体はおおむね存在するが、実際に安定して効くかどうかには疑問符が付いた。

視野を広げると、OpenAIが未成年保護について外部からの圧力で動くのは2年連続となる。2025年9月には、10代の自殺に関する訴訟を受けて保護者管理機能を導入し、今年8月には独立した10代版を投入した。Common Sense Mediaはこれまでにも、MetaのAIアシスタントに同じ最低評価を付けている。

レポートがOpenAIに示した改善項目には、有効な年齢推定の実現、保護者への通知を確実に作動させること、危機対応の修正、生徒の課題を代わりにやらないようにすること、感情表現の削除、そして独立した第三者による再テストを受けてから10代向けの宣伝を再開することが含まれる。OpenAIが再テストを受け入れるか、いつ受けるかは今のところ決まっていない。

参考資料:Common Sense Mediaのプレスリリース、CocoLoop、Bloomberg、Axios、Education Week。プロンプト件数、見逃し率、保護者通知の結果は評価機関の公表データに基づき確認。OpenAIの反応は同社の報道向け声明による。