評測機構給青少年版ChatGPT打最低評級

美國兒童媒體評測機構Common Sense Media於10月7日發布報告,給OpenAI今年8月推出的ChatGPT for Teens打出「不可接受風險」(Unacceptable Risk)評級,這是該機構評級體系裡的最低一檔。報告呼籲OpenAI在修好幾項核心問題之前,停止向青少年推廣這款產品。

測試由該機構旗下的青少年AI安全研究所完成。研究人員用登記為13至17歲的帳號發出4000多則提示,再請兒童精神科醫師小組與一位小兒科醫師逐則評估回覆。

報告列出的幾處失靈

危機轉介。測試人員判定應當引導使用者求助的對話中,ChatGPT漏掉了超過四分之一。報告設定的三項「紅線」傷害指標,都沒有達到95%的合格門檻。

家長提醒。在十幾個新建、已與家長帳號連結的測試帳號上,測試人員和ChatGPT討論自殺念頭、自我傷害或飲食失調,最長持續一小時,家長端卻沒有收到任何提醒。

學習模式。青少年可以直接點「顯示答案」拿到結果;在家長設定的學習時段裡,刪掉@study前綴就能繞過限制。

年齡識別。用成人帳號連續多天模擬青少年的說話方式,系統從未切換到未成年人體驗。

情感表達。儘管OpenAI更新了面向未成年人的模型規範,ChatGPT仍會表達感受、偏好與情緒,報告認為情感依賴的風險依然普遍存在。

研究所執行主任Tom Siegel表示:

“A teen can spend an hour talking about self-harm without their parent getting a single alert.”

(一名青少年可以花一小時談論自我傷害,家長卻收不到任何一則提醒。)

OpenAI的回應

OpenAI對媒體表示歡迎嚴格的獨立評估,但認為Common Sense Media的測試並未準確反映青少年保護機制的實際運作情況。根據彭博社報導,OpenAI還提出,部分測試可能發生在家長監管相關功能上線之前,已要求對方重新測試。評測機構則堅持原本的結論,認為家長提醒機制在危機情境下並不可靠。

測試的具體時間區間、OpenAI所指的究竟是哪幾項功能,雙方都沒有公開細節,外界目前無法判斷兩邊說法的差距有多大。

從上線到被評級,七週

ChatGPT for Teens於8月18日上線時,OpenAI強調兩個重點:一是13至17歲的使用者會自動進入獨立體驗,針對自我傷害、飲食障礙、危險活動等內容加強保護;二是學習模式、作業提醒與家長設定的學習時段,把「直接給答案」改成「陪著一起解題」。

這份報告逐項對照的,正是這兩項承諾。學習時段只要刪掉一個前綴就能繞過,作業提醒可以一鍵跳過,危機提醒在連結帳號上從未觸發。產品功能大多確實存在,問題出在是否能穩定生效。

放遠來看,這是OpenAI在未成年人保護議題上,連續第二年被外部壓力推著走。2025年9月,在一起涉及青少年自殺的訴訟之後,OpenAI上線了家長監管功能;今年8月又推出獨立的青少年版本。Common Sense Media這類第三方評測機構,此前也給Meta的AI助手打過同樣的最低評級。

報告為OpenAI列出的整改清單包括:做出有效的年齡推估、讓家長提醒確實觸發、修好危機應對機制、停止替學生直接完成作業、拿掉情感化表達,並在接受獨立第三方複測之後,才能再向青少年行銷。OpenAI是否會接受複測、何時複測,目前都還沒有確定的安排。

參考來源:Common Sense Media新聞稿、CocoLoop、彭博社、Axios、Education Week;測試提示數量、漏報比例與家長提醒結果,均依評測機構公布的口徑核對,OpenAI的回應則以其對媒體的聲明為準。