💬 观点OpenAI
Introducing MentalHealthBench — OpenAI 发布心理健康对话评测基准,关注 AI 在敏感场景中的有用性与安全性
OpenAI 发布心理健康对话评测基准,关注 AI 在敏感场景中的有用性与安全性。
2026-09-23原文
本文为要点摘要,完整细节以原文为准。
- MentalHealthBench 是什么:OpenAI 推出一个由专家参与设计的基准,用于评估 AI 在真实心理健康对话中的回复是否既有帮助又安全。对 agent 开发者而言,这意味着敏感领域的评测需要引入领域专家标准,而非仅靠通用指标。
- 评测对象是对话场景:基准覆盖 realistic mental health conversations,而非单轮问答。这提示工具链需要支持多轮、情境化的评测流程,才能暴露模型在高风险对话中的问题。
- 有用性与安全性并重:基准同时衡量 helpful 和 safe 两个维度。对开发者来说,安全对齐不能以牺牲有用性为代价,二者需在评测中同时被追踪。
原文:Introducing MentalHealthBench · 作者 OpenAI