OpenAI推出心理健康对话评估基准MentalHealthBench,推动AI心理支持安全标准化
#AI照护与医疗科技 时间2026-09-24 05:40:02
文/IAICA.NGO®
OpenAI近日发布MentalHealthBench,一个专门用于评估人工智能系统在心理健康对话任务中表现的新基准。该基准旨在填补AI心理支持领域缺乏统一评价标准的空白,为开发者、临床研究者和监管机构提供可量化的参考框架。
MentalHealthBench由OpenAI联合多个医疗机构共同开发,团队成员包括精神科医生、临床社会工作者和有真实心理困扰经历的服务使用者。他们共同设计了数百个高风险对话场景,涵盖焦虑、抑郁、成瘾、自伤等二十余个心理主题,并依据严重程度分层。每个场景均附有专家审核的参考回应,要求模型在情感支持、证据干预和安全边界之间取得平衡。研究还设计了多轮对话树机制,并给每个场景标注危险信号,如是否涉及自伤计划、是否有即时脱险方法,以检验模型识别危机的能力。
评价维度不止语义准确性。安全性指标考察模型能否识别危机并引导求助;共情指标考察温暖、尊重和积极倾听;知识克制指标防止模型越界诊断或开方。评分采用自动与人工双重机制:自动指标包括安全违规率、共情言语特征、证据引用合理性;人工审阅关注整体沟通质量和文化敏感度。最终榜单公布不同模型的分维度得分,便于针对性优化。
此前,通用大模型面对情绪困扰时往往给出笼统安慰,甚至不经意强化负面认知。研究显示,共情缺陷的回答可能加剧求助者孤独感。MentalHealthBench将临床级场景带入评估流程,促使开发者在发布前充分测试心理风险。
心理健康服务全球需求快速增长。世界卫生组织指出,全球约每八人中就有一人患有精神或神经发育障碍,而专业治疗师数量远不能满足需要。生成式AI凭借全天候、低门槛特点,被视为服务供给的重要补充。但风险与潜力并存。多项研究曾发现主流AI机器人在涉及自伤、虐待等话题时可能给出危险建议,提醒行业不能仅凭通用测试得分判断其适合心理干预。
iaica.com.cn 指出,这类基准的出现标志着AI心理健康研究从追求对话流畅性转向对临床安全性的系统审视,但任何技术评估框架都无法完全替代人类治疗师的专业判断和伦理责任。
从产业生态看,MentalHealthBench不仅用于实验室研究,心理数字疗法公司、健康科技团队、医院宣教系统和基层心理热线都可能据此筛选更安全的对话模型。同时,它也为监管提供可操作参考。随着多地讨论AI医疗设备审查标准,一个公开透明、可复用的心理安全基准有助于消除信息不对称,促进行业自律。
中国也在开展类似探索。多家机构推出面向情感对话的中文评测集,将多轮共情、情绪支持、危机服务纳入模拟场景。国内大模型产品也设置了拒绝诊断性话题的策略。但不同基准之间缺乏互认,限制了跨系统、跨地域的成果比较。国际协作有助于形成更一致的安全对话评估语言。
当然,该基准存在局限。它依赖预置场景和专家标注,难以覆盖所有文化背景下的表达方式;评估结果也不等于真实长期互动效果。文化敏感性、方言使用、家庭关系等变量复杂,静态基准无法穷尽。未来应结合动态红队测试、联邦学习本地化评估以及真实用户持续追踪。
AI在心理支持中的角色应当被准确限定。它更适合作为早期筛查、情绪疏导、心理健康教育和分担治疗师工作量的辅助工具,而非独立进行诊断或危机干预。MentalHealthBench的价值在于帮助开发者明确边界,让AI在能力范围内发挥作用。
总体而言,OpenAI推出MentalHealthBench是AI心理健康领域的一次基础性加固。它呼应了全球对可信AI的需求,也为AI照护系统的安全落地提供了重要参照。随着更多机构参与共建,心理健康AI有望从能回答走向会负责,在尊重人性和科学规范的前提下,服务更多需要心理支持的人。
评论
0 条登录后才可以发表评论。
立即登录