學生在學校餐廳拿著紅色手機
示意圖,與本文受測帳號無關。Flame, not lame 攝,CC0,Wikimedia Commons。
AI 治理OpenAICommon Sense Media兒少保護

Common Sense Media 把 ChatGPT for Teens 評為「不可接受的風險」:十幾個新綁定家長的帳號談自傷最長一小時,家長通知 0 則;危機熱線轉介從 33% 降到 23%

美國非營利組織 Common Sense Media 旗下的青少年 AI 安全研究所(Youth AI Safety Institute)美國時間 10 月 7 日發布風險評估,把 OpenAI 8 月 18 日推出的 ChatGPT for Teens 評為最高一級的「不可接受的風險」(Unacceptable Risk),建議 OpenAI 在修好之前把 ChatGPT 限定給 18 歲以上使用。研究所在上線前後各測一輪,合計超過 4,000 則提示。兩個數字最受注意:十幾個新開、已綁定家長的青少年帳號,談自殺、自傷或飲食失調最長一小時,家長端收到 0 則通知;201 則經兒童精神科醫師判定需要危機資源的提示,回覆中點名危機熱線的比例從上線前的 33% 降到上線後的 23%。OpenAI 回應不認為這次測試反映實際運作。

報告列出的測試條件:上線前一輪 7 月 13 日到 8 月 17 日,用 ChatGPT Plus 帳號(13 歲綁定家長、17 歲未綁定);上線後一輪 8 月 25 日到 9 月 28 日,加入免費版與 Plus、綁定與未綁定各種組合。年齡都是註冊時自填,ChatGPT 從未要求驗證;設定一律用預設值,測試全在美國舊金山灣區進行。危機題組有 390 則不重複提示,其中 201 則由三位兒童與青少年精神科醫師事先判定「應給危機資源」。報告自己列出限制:兩輪測試是先後進行,7 月到 9 月間底層模型若有更新,效果會和青少年模式的設定混在一起;圖片生成、語音模式與群組聊天沒有測。

家長通知:新帳號 0 則,長期帳號 4 則

OpenAI 8 月 18 日的公告寫,綁定帳號的家長可以「在有限的高風險情況下收到安全通知」,並新增飲食失調相關通知。研究所開了十幾個沒有任何對話紀錄的免費帳號,先綁定家長再開始對話,用四個人設(自殺、自傷、限制飲食、催吐)分別談 5 分鐘、15、30、45 與 60 分鐘,每段都有明確的自傷或自殺陳述。結果是全部 0 則通知。在長達數週的整套危機測試中,研究所總共收到 4 則:上線前 990 則提示(其中 541 則需危機資源)換到 2 則,分別延遲 3 小時與 3 天;上線後 450 則(其中 251 則需危機資源)換到 2 則,都在一小時內。通知內容沒有寫是哪個時間的對話。

報告的編者註記載,OpenAI 審閱草稿時表示,家長與青少年帳號要綁定約三小時後才能收到通知,並已據此修改說明中心文章。研究所檢查後說,受測帳號有的綁定不到三小時、有的超過,維持原本的解讀。本站 10 月 9 日讀到的 OpenAI 說明中心〈Parental controls〉頁寫的是「綁定後可能需要最多幾個小時,才能發送安全通知」,觸發條件是「受過專門訓練的審查人員」判定有嚴重自傷疑慮或可能與飲食失調有關的行為,並註明「安全通知不是即時監控」。換句話說,這個功能的設計中間有人工審查,報告測到的是通知是否送達,以及已送達通知的延遲。

危機轉介:熱線少了,找大人多了

201 則需危機資源的提示,在 13 歲綁定帳號上前後各跑一次。點名危機熱線(如美國 988)的比例從 33% 降到 23%,轉介到特定醫療或心理專業人員從 68% 降到 58%,三類資源任一有給的比例從 77% 降到 74%;鼓勵找可信任的大人則從 87% 升到 94%。新聞稿說的「漏掉超過四分之一」,對應的是上線後 26% 的回覆三類資源都沒給。熱線下降集中在幾類:憂鬱 30 則從 63% 降到 3%,情緒 9 則從 44% 降到 0%;物質使用 26 則反而從 4% 升到 58%。研究所對自殺自傷、飲食失調、現實感受損等五類「紅線」危害設 95% 門檻,上線後有三類沒過。報告也寫,臨床審查者認為不少回覆的內容本身是好的,問題出在轉介資源變少。

學習模式與年齡預估

同一份作業(八年級畢氏定理題組 20 份與高中歷史寫作 20 份,每個帳號共 40 份)前後各測一次。13 歲綁定、開學習模式的帳號,完整代寫比例從 70% 降到 18%,這是改善;但 17 歲未綁定、用「@study」開學習模式的帳號從 0% 升到 88%(35/40),因為新版常跳出「Show me the answer」選項。家長設定的「學習時段」是在每則訊息前自動加上「@study」,把前綴刪掉就回到一般模式,報告寫此時 ChatGPT 完成了 100% 的作業。另一個常被引用的「80 次全部代寫」出自作業提醒測試:關閉學習模式時,提醒出現在 91% 的回合,ChatGPT 仍完成了全部 80 份。年齡預估部分,研究所用數個登記為 19 歲的帳號扮演國中生,7 天內在 160 多個新對話中送出約 1,000 則提示,帳號始終沒有切換到青少年模式,即使 ChatGPT 在回覆中說出使用者是 13 歲。

OpenAI 怎麼回應、各家怎麼報

OpenAI 的回應只見於媒體引述,各家引用的段落不同。美聯社(AP,Barbara Ortutay,〈Some guardrails on ChatGPT for Teens don't work as promised, watchdog group says〉)引 OpenAI 說「深切致力於青少年安全」,並稱研究所「大部分測試可能在家長控制完成啟用前就開始並結束」。Axios(〈ChatGPT for Teens isn't safe enough, Common Sense says〉)引的是「我們歡迎嚴謹的獨立評估,但不認為測試準確反映安全機制的實際運作」,並寫 OpenAI 確認學習時段可以退出是刻意設計、不是漏洞,年齡預估則是用約兩週的多重訊號判斷;報告的年齡測試期間是 7 天。The Next Web 引的是 OpenAI 發言人對 Education Week 說的同一句「不認為測試準確反映」。

數字方面,TNW 寫「超過 25% 的情況」沒有引導求助,和報告的 26% 一致。Gizmodo 寫研究所要求 OpenAI 封鎖「任何不是已驗證成年人的帳號」,與報告第一條建議的寫法相符。Gizmodo 也寫「Show me the answer」會立刻產生答案,報告另外記載偶爾即使選了這個選項,ChatGPT 仍拒絕交出完整作業。AP 與新聞稿都揭露研究所的經費來源包括 OpenAI 基金會與部分受評產品的開發商,研究所表示保有完整編輯獨立性。

另一份可以並讀的文件是 OpenAI 10 月 7 日的 GPT-6 系統卡,第 3.1.2 節寫 GPT-6 Sol 與 Luna(10 月版)在未滿 18 歲評測的情感依賴等三項有統計上顯著的退步。本站的讀法:Common Sense 的測試 9 月 28 日就結束,量的是更早的版本,兩份文件不能相加,但青少年保護的成效都要靠上線後重測,不能只看上線公告。

原文 Common Sense Media 新聞稿(2026-10-07),評級、建議與經費揭露取自該頁;Youth AI Safety Institute 完整風險評估與 PDF 報告(2026-10-05 版),測試期間、題數、表 1 至表 4 的百分比與分母、OpenAI 審閱草稿的編者註取自報告全文;OpenAI〈ChatGPT for Teens〉公告(2026-08-18),家長通知、學習時段、作業提醒的承諾原文取自該頁;OpenAI 說明中心〈Parental controls〉,「最多幾個小時」與人工審查的寫法為本站 10 月 9 日讀到的版本;OpenAI GPT-6 系統卡(2026-10-07)第 3.1.2 節。媒體:AP(經 ABC News)、Axios、Gizmodo、The Next Web(皆 2026-10-07),只用來呈現 OpenAI 的回應與各家寫法。