OpenAI 发布 MentalHealthBench 基准 评估 AI 心理健康对话能力

该基准涵盖成人、青少年、照护者及临床专业人员等场景,对话涉及非急性、高危及紧急情况等不同严重程度,并覆盖 19 种语言。每次对话由至少三位专家审查,仅当所有专家均认可的标准方被纳入最终基准。OpenAI 表示,除基准发布外,公司已增强 ChatGPT 回应敏感对话的能力,扩大危机资源获取渠道,并新增受信任联系人功能。

原文连接