心理健康对话评估基准 MentalHealthBench 正式发布
MentalHealthBench 是一项由专业人士参与制定的新型评估基准,专门用于评测人工智能在真实心理健康对话场景中生成回复的有效性与安全性。该基准针对高敏感度的人机心理交互需求,为检验大模型在心理健康支持场景下的临床安全界限和实用价值提供了标准化评估工具,有助于推动垂直领域 AI 的安全对齐。
MentalHealthBench 是一项由专业人士参与制定的新型评估基准,专门用于评测人工智能在真实心理健康对话场景中生成回复的有效性与安全性。该基准针对高敏感度的人机心理交互需求,为检验大模型在心理健康支持场景下的临床安全界限和实用价值提供了标准化评估工具,有助于推动垂直领域 AI 的安全对齐。
OpenAI近日阐述了针对前沿模型及其安全防护措施开展严谨、安全且独立的第三方AI安全评估的核心优先事项与基本原则。该框架旨在规范外部机构对尖端人工智能系统的审查流程,提升评估的专业性、独立性与安全性,为行业建立可信赖的第三方模型评测与风险审查标准提供指导。
OpenAI 宣布正与一个独立的“数学与人工智能咨询小组”展开合作。该咨询小组将为新兴人工智能技术成果的审核、科学评估以及对外传播提供专业指导,旨在确保数学及 AI 交叉领域前沿研究成果的严谨性与有效交流。
OpenAI近日概述了建立共享全球人工智能标准的路径,呼吁各方在模型评测、报告机制和治理框架上展开协调合作,以提升前沿AI系统的安全性与可靠性。该倡议旨在通过统一的评估准则与监管框架,有效应对下一阶段AI技术快速发展带来的潜在风险,推动全球范围内的AI安全生态建设与协作。