AIDC
DC AI 热点

全部 AI 动态

9月23日2026-09-23
OpenAI 官方动态✦ 精选AI 评分 65/10018:00

心理健康对话评估基准 MentalHealthBench 正式发布

MentalHealthBench 是一项由专业人士参与制定的新型评估基准,专门用于评测人工智能在真实心理健康对话场景中生成回复的有效性与安全性。该基准针对高敏感度的人机心理交互需求,为检验大模型在心理健康支持场景下的临床安全界限和实用价值提供了标准化评估工具,有助于推动垂直领域 AI 的安全对齐。

阅读原文 ↗推荐理由:填补了心理健康高危场景下专家级 AI 安全与有效性评测基准的空缺。# 安全# 评测# 大模型# 对齐
9月22日2026-09-22
OpenAI 官方动态✦ 精选AI 评分 75/10008:00

OpenAI发布有效第三方AI安全评估的优先事项与原则

OpenAI近日阐述了针对前沿模型及其安全防护措施开展严谨、安全且独立的第三方AI安全评估的核心优先事项与基本原则。该框架旨在规范外部机构对尖端人工智能系统的审查流程,提升评估的专业性、独立性与安全性,为行业建立可信赖的第三方模型评测与风险审查标准提供指导。

阅读原文 ↗推荐理由:OpenAI提出前沿模型第三方安全评估原则,对AI行业治理与外部安全审计标准具有重要参考意义。# OpenAI# 安全# 评测# 治理# 大模型
9月21日2026-09-21
OpenAI 官方动态✦ 精选AI 评分 60/10020:00

OpenAI 携手数学与人工智能咨询小组指导新兴成果评审

OpenAI 宣布正与一个独立的“数学与人工智能咨询小组”展开合作。该咨询小组将为新兴人工智能技术成果的审核、科学评估以及对外传播提供专业指导,旨在确保数学及 AI 交叉领域前沿研究成果的严谨性与有效交流。

阅读原文 ↗推荐理由:OpenAI 引入独立专家咨询机制规范数学与前沿 AI 成果的同行评审与对外传播。# OpenAI# 治理# 评测# 大模型
OpenAI 官方动态✦ 精选AI 评分 75/10018:00

OpenAI提出构建下一阶段全球AI标准,呼吁加强协同评测与治理

OpenAI近日概述了建立共享全球人工智能标准的路径,呼吁各方在模型评测、报告机制和治理框架上展开协调合作,以提升前沿AI系统的安全性与可靠性。该倡议旨在通过统一的评估准则与监管框架,有效应对下一阶段AI技术快速发展带来的潜在风险,推动全球范围内的AI安全生态建设与协作。

阅读原文 ↗推荐理由:OpenAI倡导建立全球统一的AI安全评测与治理标准,对推动行业合规与安全生态建设具有指导意义。# OpenAI# 安全# 治理# 评测