AIDC
DC AI 热点

全部 AI 动态

9月25日2026-09-25
arXiv 人工智能✦ 精选AI 评分 72/10012:00

人机协同假设检验:基于成本感知的AI筛选评分与序贯人工复核机制

该研究针对大语言模型作为低成本评审员在统计推断中的局限性展开探讨。研究指出,AI评估往往存在偏差和噪声,而严谨的假设检验必须明确控制第一类和第二类错误。为此,论文提出了一种人机协同的假设检验方案,结合成本感知的AI选择性评分与序贯人工核验升级机制,旨在满足严格统计推断有效性与错误率控制的前提下,最大限度降低整体评估成本。

阅读原文 ↗推荐理由:针对LLM作为评估员的噪声与偏差问题,提出了兼顾统计严谨性与成本效益的人机协同检验方法。# 大模型# LLM-as-a-Judge# 假设检验# 人机协同# 统计推断
Claude 官方博客(网页)✦ 精选AI 评分 78/100收录 07:49

Claude 整合 Cowork 与聊天功能:向 Pro 和 Max 用户推出统一协作体验

Anthropic 宣布将 Claude Cowork 与常规聊天(Chat)功能正式整合为统一的 Claude 体验,即日起向 Pro 和 Max 付费订阅用户推出。该功能强化了人机协同的工作流模式,用户只需交付具体任务,Claude 即可自主推进并执行相关工作,同时由用户保留最终确认与决策权,进一步模糊了传统对话与复杂智能体任务执行的界限。

阅读原文 ↗推荐理由:Claude 将任务协同与日常聊天合二为一,反映了主流大模型应用向全流程智能体协作演进的趋势。另有 1 家信源报道# Claude# Anthropic# 智能体# 人机协同# 产品更新
Claude 官方博客(网页)✦ 精选AI 评分 65/100收录 07:49

医疗机构如何利用 Claude 构建人机协同智能体团队

文章介绍了 Insight Health、Tennr 以及 Medallion 等医疗健康机构如何应用 Anthropic 的 Claude 构建“人机协同”(human-agent)团队。这些机构通过将 AI 智能体融入实际医疗业务流程中,探索了人工与智能化工具协同工作的新模式,推动了智能体技术在医疗健康垂直领域的落地应用。

阅读原文 ↗推荐理由:展示了 Claude 在医疗健康垂直场景中构建人机协同智能体团队的典型落地案例。# Claude# 医疗健康# 智能体# 人机协同# 应用案例
9月24日2026-09-24
arXiv 自然语言处理✦ 精选AI 评分 70/10012:00

利用跨LLM分歧引导专家参与:大规模数据标注编码本的高效修订方法

针对大规模文本标注中编码规范(Codebook)构建耗时漫长的问题,该研究提出利用大语言模型(LLM)加速这一流程。方法通过在早期将编码本应用于数据,筛选出多个LLM之间存在显著分歧的疑难样本,从而精准引导专家介入并提供针对性反馈。研究探讨了多种专家反馈形式,包括直接编辑由跨模型分歧驱动生成的修改方案,以及解答模型争议问题等,有效提升了人机协同标注与规范迭代的效率。

阅读原文 ↗推荐理由:提出通过跨模型分歧精准定位边界案例并调度专家精力,为大模型时代的大规模数据标注工程提供了新范式。# 大模型# 数据标注# 人机协同# 标注规范# 主动学习