AI Safety2026-09-24OpenAI Blog

OpenAI发布MentalHealthBench:测AI在心理对话里靠不靠谱

OpenAI推出了MentalHealthBench,这是一个新的基准测试,用来衡量AI系统在贴近现实的心理健康对话中,究竟有多有用、又有多安全。该工具在开发过程中吸纳了专家的意见,聚焦那些用通用评测方式会被漏掉的关键细节。 它不只测试事实知识或语言流畅度,而是考察模型是否给出恰当的支持、是否避免有害建议,以及能否识别出该鼓励用户去寻求专业帮助的时刻。这个基准同时评估支持性和风险两个方面。这种双重视角很重要:一段回答可能听起来很共情,实际却给出了危险的建议;也可能出于谨慎,结果完全帮不上忙。 MentalHealthBench提供了一套结构化的方法,用来测试模型在困难对话中的表现,包括用户处于痛苦、困惑或脆弱状态的时刻。它的目的是帮助开发者在部署前发现弱点,并长期跟踪进展。 这次发布也反映出一种日益增长的担忧:人们正在用AI来获取心理健康支持。聊天机器人随时可用,而且让人感觉私密,对那些无法立刻找到治疗师或危机服务的人来说很有吸引力。但它们不能替代受过训练的专业人士,一旦在严重情况下处理不当,就可能造成伤害。像MentalHealthBench这样的基准,目标就是让这些局限变得更可测量。 它们也引出了更广泛的责任问题。如果一个模型被部署在健康相关的场景里,应该要求多高的安全水平?公司该如何处理危机情况、隐私问题,以及把问题升级转交给人类照护?MentalHealthBench并不能回答所有政策层面的问题,但它给研究者和监管者提供了一个共同的参照点。随着AI更深地融入日常生活,把共情、准确性和风险意识结合起来的评测,对于构建既能支持人、又不会误导或危害人的系统,将变得至关重要。

相关资讯