
ChatGPT for Teens 家長收到咩通知?專家話安全承諾仲欠實證
Teen 模式自動套用,危機通知仍要家長先連結帳戶
OpenAI 喺 8 月 18 日推出 ChatGPT for Teens,直接喺原有 ChatGPT 入面加入一套 13 至 17 歲體驗。官方話系統會集中幫學生學習、限制敏感內容,又會減少 ChatGPT 扮到太似真人。不過件事最值得拆嘅位,係家長實際控制到幾多,同埋出事嗰陣個通知機制係咪真係可靠。
家長控制到咩,睇唔到咩
家長同青少年連結帳戶後,可以設定 Quiet Hours 禁止指定時段使用 ChatGPT,亦可以安排 Study Hours、控制記憶功能,同埋決定對話可唔可以用嚟訓練模型。家長睇唔到對話內容、聊天紀錄或者即時活動;安全通知亦唔會附上完整對話,只會交代風險類型同相關支援資料。青少年可以自行解除連結,家長會收到通知。
呢個設計保留咗青少年一定私隱,但亦有一個好實際嘅缺口:Teen 模式可以自動套用,家長通知就要雙方先連結帳戶。冇連結,家長收唔到警報。OpenAI 向 Engadget 承認,現階段通知只會送畀已連結帳戶嘅家長,亦冇講系統發現未連結帳戶出現飲食失調相關風險後,會採取咩額外行動。
年齡判定會睇帳戶點用
ChatGPT 會綜合用戶申報年齡、帳戶開咗幾耐、通常咩時間上線,同埋一段時間內嘅使用模式,估計帳戶持有人有冇可能未滿 18 歲。系統信心不足或者資料唔齊時,官方話會先套用較嚴格設定。成年用戶如果俾系統判錯,可以經身份驗證服務 Persona 上載自拍確認年齡。
問題係 OpenAI 暫時冇公開呢套系統嘅誤判率同漏判率。Common Sense Media 嘅 Robbie Torney 指出,自動判定遠遠未能認出所有青少年;用戶亦可能用假年齡、未登入狀態或者其他方法繞過。至於系統處理廣東話時,認唔認得出青少年身份同情緒暗示,現有公開資料未有交代。現階段唔適合當佢係穩陣嘅年齡閘門。
保護範圍多咗,成效要另計
按 OpenAI 嘅說法,Teen 模式會加強處理自殘、暴力、危險挑戰、極端節食、身體形象、露骨內容,同埋帶有浪漫或性意味嘅角色扮演。更新後嘅規則亦要求 ChatGPT 避免向青少年講浪漫說話、鼓勵情感依賴,或者暗示自己有感情同意識。飲食失調相關對話亦納入家長通知範圍,但 OpenAI 冇向 Engadget 提供清晰觸發例子,只話涉及嚴重自我傷害風險嘅內容可能發出警報。
OpenAI 向 Engadget 表示,系統標記嘅內容會先交由全職員工審核,目標係喺用戶發出 prompt 後一小時內通知家長。呢個承諾幾進取,連官方支援頁都提醒,通知唔係即時監察,亦未必捉到每個風險。Common Sense Media 喺 2025 年測試舊版家長通知時,即使對話明確提到自殺或自殘,警報仍試過等 24 至超過 48 小時,有啲情況直頭冇收到。
新版安全成效仍待獨立測試
Youth AI Safety Institute 認為,按年齡提供較嚴格體驗方向合理,但佢哋仲未完成新版 ChatGPT for Teens 嘅獨立測試。呢間機構早前將 ChatGPT 對青少年嘅整體風險評為『High Risk』;如果當精神健康支援工具用,風險評級就係『Unacceptable Risk』。測試亦發現,聊天拉長之後,安全界線容易鬆動,模型溫暖又順住用戶講嘅語氣,可能令人高估佢處理情緒問題嘅能力。
對家長嚟講,現階段較穩陣嘅用法仍然係把 ChatGPT 當學習同創作工具,預先同仔女講清楚使用界線。情緒困擾、自殘、飲食失調或者其他精神健康問題,唔應該靠家長通知功能兜底。下一步要睇 OpenAI 會唔會公開年齡判定、漏報率、通知速度同不同語言環境嘅測試結果,亦要等獨立機構完成新版評估。
參考來源
- Engadget — Child safety experts are skeptical of OpenAI's ChatGPT for Teens — original report
- Our approach to age prediction — OpenAI 官方解釋年齡判定會參考嘅訊號、預設保護同誤判後驗證方法
- Managing parental controls in ChatGPT — 核對帳戶連結、Quiet Hours、通知內容、私隱限制同解除連結安排
- What we still need to know about the new ChatGPT for Teens — Youth AI Safety Institute 列出新版仍待獨立測試嘅年齡判定、通知同情感依賴問題
- Common Sense Media Report Finds ChatGPT and Sora Pose Risks to Teens Despite Safety Features — 提供舊版 ChatGPT 風險評級、長對話安全表現同家長通知延誤測試結果
本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。







