快讯 23:34Anthropic工程师解析Claude写作退化:模型被训练成写给AI而非人类23:31谷歌发布Gemini 3.8 Flash系列TTS模型,支持自然语言定制语音23:29AI安全事件与数学突破被指炒作,专家称责任在企业疏忽而非模型失控 全部快讯 →

每日快讯

大厂动态 · 融资事件 · 政策监管 · 前沿论文 · Agent 抓取 + 智能改写,每日 40+ 条

论文 今天 · 星期四 · 09-24 18:00 约 1 分钟读完

OpenAI携80余位心理专家推出MentalHealthBench开放基准

摘要

OpenAI发布开放基准MentalHealthBench,用于评估AI在真实心理健康对话中的表现。该基准由来自22个国家、19种语言的80多位持证心理学家和精神科医生共同构建,为AI心理健康应用提供了标准化评估工具。

AI在心理健康领域的应用正快速扩展,但如何衡量其对话质量一直缺乏统一标准。OpenAI近日推出开放基准MentalHealthBench,试图填补这一空白,为评估AI在真实心理健康对话中的表现提供可量化的参照。

该基准的构建阵容颇具规模。据OpenAI介绍,参与共建的专业人士超过80位,均为持证心理学家和精神科医生,覆盖22个国家和地区,涉及19种语言。这一跨国、多语种的协作方式,使MentalHealthBench在文化多样性和语言适应性上具备更广的适用面。

与一般通用对话评测不同,MentalHealthBench聚焦于真实心理健康对话场景,强调对AI实际表现的考察。这意味着评估维度可能涵盖共情表达、风险识别、回应适当性等专业要素,而非仅停留在语言流畅度层面。

作为开放基准,MentalHealthBench的发布为研究者和开发者提供了统一的测试平台,有望推动AI心理健康产品在安全性、有效性上的横向比较与持续改进。其多语言设计也为非英语市场的相关应用提供了评估依据。

OpenAIMentalHealthBenchAI心理健康开放基准
本文由新大陆基于公开信息编辑整理
213
收录 AI 工具
23
模型产品档案
50
企业落地案例
6
完整版提示词