品玩9月30日讯,OpenAI正式发布MentalHealthBench,一项由来自22个国家/地区的80余名持证心理健康专家共同制定的开放基准,用于评估AI在真实心理健康对话中能否提供实用且安全的回应。
该基准涵盖成人、青少年、照护者及临床专业人员等场景,对话涉及非急性、高危及紧急情况等不同严重程度,并覆盖19种语言。
专家为每段合成对话制定详细评分标准,各项权重介于-10至+10之间,正分奖励有益行为,负分惩罚有害行为。每次对话由至少三位专家审查,仅当所有专家均认可的标准方被纳入最终基准。OpenAI表示,除基准发布外,公司已增强ChatGPT回应敏感对话的能力,扩大危机资源获取渠道,并新增受信任联系人功能。



