AI Safety2026-09-24
OpenAI Blog
OpenAI 發表 MentalHealthBench,替 AI 心理健康對話打分數
OpenAI 推出 MentalHealthBench,這是一套新的評測標準,用來衡量 AI 系統在貼近真實的心理健康對話中,究竟多有幫助、又多安全。這套工具在專家參與下開發,聚焦於通用評測容易忽略細微差異的敏感情境。MentalHealthBench 不只測試事實知識或語言流暢度,而是檢視模型是否以適切的支持回應、是否避免給出有害建議,以及能否辨識出應該鼓勵使用者尋求專業協助的時機。
這套評測同時衡量支持性與風險。這種雙軌設計很重要,因為一段回應可能聽起來很有同理心,實際上卻給出危險指引;也可能過度保守,無法提供有用的協助。MentalHealthBench 提供一套結構化方法,能跨各種艱難對話測試模型,包括處於痛苦、困惑或脆弱狀態的時刻。它的用意是幫開發者在部署前找出弱點,並長期追蹤進展。
這次發布反映外界日益關注人們如何用 AI 尋求心理健康支持。Chatbot 隨時可用,又讓人感覺保有隱私,對無法立即取得心理師或危機服務的使用者來說很有吸引力。但它們不能取代受過訓練的專業人員,一旦在嚴重情境中處理失當,就可能造成傷害。像 MentalHealthBench 這樣的評測標準,目標就是讓這些限制變得更容易衡量。
它們也帶出更廣泛的責任問題:如果模型被部署在與健康相關的情境中,應該要求什麼樣的安全水準?企業該如何處理危機狀況、隱私,以及轉介至真人照護?MentalHealthBench 沒有回答所有政策問題,但為研究人員與監管機關提供了共同的參考點。隨著 AI 更深入日常生活,能兼顧同理心、準確度與風險意識的評測,將是打造「支持人而不誤導、不危害人」的系統的關鍵。