OpenAI携80余位心理专家推出MentalHealthBench开放基准
摘要
OpenAI发布开放基准MentalHealthBench,用于评估AI在真实心理健康对话中的表现。该基准由来自22个国家、19种语言的80多位持证心理学家和精神科医生共同构建,为AI心理健康应用提供了标准化评估工具。
AI在心理健康领域的应用正快速扩展,但如何衡量其对话质量一直缺乏统一标准。OpenAI近日推出开放基准MentalHealthBench,试图填补这一空白,为评估AI在真实心理健康对话中的表现提供可量化的参照。
该基准的构建阵容颇具规模。据OpenAI介绍,参与共建的专业人士超过80位,均为持证心理学家和精神科医生,覆盖22个国家和地区,涉及19种语言。这一跨国、多语种的协作方式,使MentalHealthBench在文化多样性和语言适应性上具备更广的适用面。
与一般通用对话评测不同,MentalHealthBench聚焦于真实心理健康对话场景,强调对AI实际表现的考察。这意味着评估维度可能涵盖共情表达、风险识别、回应适当性等专业要素,而非仅停留在语言流畅度层面。
作为开放基准,MentalHealthBench的发布为研究者和开发者提供了统一的测试平台,有望推动AI心理健康产品在安全性、有效性上的横向比较与持续改进。其多语言设计也为非英语市场的相关应用提供了评估依据。
本文由新大陆基于公开信息编辑整理
信息来源:AIHOT AIHOT原文 ↗