
研究話 AI 安慰人有時贏真人,優勢其實來自講得出具體下一步
五組實驗比較文字回應,結果只適用於日常、非臨床情境
ChatGPT 愈講愈似一個隨時得閒、又識得接住你情緒嘅朋友,心情差時搵佢傾兩句,已經係好實際嘅使用場景。TechNews 科技新報報道一項英國研究,指 AI 寫嘅安慰訊息喺部分情境獲得高過真人回應嘅評價。呢個結果幾吸引,不過睇清楚研究設計,佢比較緊嘅係幾段文字點樣回應一個虛構處境,範圍比「AI 安慰人叻過人類」窄得多。
五組實驗實際測咗啲咩
曼徹斯特大學同杜倫大學團隊做咗三項研究、合共五組實驗,總樣本係 1,233 人。第一組先收集 279 名參加者面對升職落空、合租屋企一片混亂、簡報觀眾突然增加等情境時會點安慰人,再叫 ChatGPT-4o、Claude 3.5 Sonnet 同 Gemini 1.5 Pro回應其中八個情境。團隊分析各種策略後,發現 ChatGPT-4o 嘅模式最接近人類,Claude 同人類寫法嘅差距就較大。
之後幾組實驗冇逐條比較所有真人同三個模型嘅原始答案。研究員整合常見策略,製作「人類樣板」同以 ChatGPT-4o 生成嘅「AI 樣板」,再畀另一批參加者閱讀及評分。換句話講,結果主要反映經整理嘅代表性文字有幾有效,證明唔到任何人打開 ChatGPT、Gemini 或 Claude,都必定會得到同樣質素嘅支援。
「安慰得好」包含幾種唔同結果
喺憤怒情境,AI 樣板回應確實較容易令人平靜,亦得到較高支援度評分;悲傷情境就冇穩定優勢。恐懼方面要再小心:參加者覺得部分 AI 訊息較有支援感,但研究摘要清楚寫明,其中一組實驗冇量到恐懼本身明顯下降。所以「AI 更懂安撫恐懼」講得太盡,覺得段文字貼心,同實際情緒有冇轉變係兩個量度。
研究已於 2026 年 7 月 23 日喺美國心理學會期刊《Emotion》網上刊出,唔再只係預印本;OSF 仍保留可公開查閱嘅版本。論文亦主動收窄結論:實驗只涵蓋日常、非臨床困擾,受試者主要評估短篇英文文字,冇測試長期對話、真實人際關係、治療成效或者文化差異,當中亦冇香港樣本。
具體下一步點解咁有用
團隊試過加入或刪走承認情緒嘅句子,結果單靠「明白你點解唔開心」呢類表達,未能解釋 AI 點解獲得較高評分。去到最後兩組實驗,研究員改為控制訊息有冇具體可行建議,例如呼吸節奏、點樣同室友開口、整理下次爭取升職要補邊項能力。就算每段訊息都統一到 57 個英文字,有具體建議嘅回應仍然得到較高支援度評分。;憤怒同悲傷情境嘅偏 η² 分別係 .205 同 .221。
呢個結果幾合理。人情緒亂嗰陣,空泛鼓勵通常好難接落去;一個細、清楚、即刻做到嘅步驟,可以減少要自行拆解問題嘅負擔。不過研究同樣顯示,來源本身冇穩定主效應,即係真人只要提供同樣具體嘅方向,支援度評分一樣會提高。AI 嘅優勢較似輸出穩定、肯逐步寫清楚,研究冇證明模型理解當事人,亦冇證明佢具備人類同理心。
ChatGPT 仍然唔係治療師
情緒支援去到妄想、自傷、躁狂、長期抑鬱或即時危機,錯一句建議可以好大件事。聊天模型可能答錯、過度認同用戶,又可能令人慢慢依賴佢,連 OpenAI 自己都把精神健康危機、迎合用戶同情感依賴列入安全風險。AI 可以幫手整理感受、列出可以考慮嘅下一步,但診斷、治療同危機介入要交畀真人專業支援。
如果你或身邊嘅人有傷害自己或他人嘅念頭,唔好等 chatbot 判斷風險;喺香港可以致電 24 小時「情緒通」18111,出現即時危險就打 999 或直接去急症室。呢項研究最實用嘅啟示,係安慰人嗰陣講清楚一個可行下一步,但真人陪伴同跟進仍然唔少得。
參考來源
- TechNews 科技新報 — 不再只會說「我懂你」,英國研究:AI 提供具體行動指引安撫效果超越人類 — original report
- 《Emotion》:A Digital Shoulder to Cry On — 同行評審期刊版本,確認研究已正式刊出、各組樣本數同結論限制
- PsyArXiv/OSF 預印本與研究材料 — 查閱完整方法、模型版本、情境、統計結果同實驗材料
- OpenAI:Strengthening ChatGPT’s responses in sensitive conversations — 模型供應商對精神健康危機、自傷同情感依賴風險嘅官方說明
- 香港衞生署:「情緒通」18111精神健康支援熱線 — 確認香港 24 小時精神健康支援電話及 WhatsApp 服務
本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。







