AIDC
DC AI 热点

全部 AI 动态

9月25日2026-09-25
arXiv 自然语言处理✦ 精选AI 评分 78/10012:00

连续扩散语言模型推理突破:ELF-REG将连续扩散架构扩展至数学与代码任务

该研究针对全连续扩散语言模型(dLM)在复杂推理任务中落后于自回归(AR)模型的难题,提出了ELF-REG架构。研究团队将嵌入语言流(ELF)拓展至GSM8K、MATH-500、HumanEval等数学与代码基准,并引入结合表征对齐与纠缠的机制(REPA+REG),通过冻结的AR教师模型监督中间去噪步骤,有效提升了连续扩散模型并行解码与复杂逻辑推理的扩展能力。

阅读原文 ↗推荐理由:探索了利用连续扩散模型替代自回归架构解决复杂推理与代码生成的前沿方向,具有较高的学术创新价值。# 扩散语言模型# 非自回归# 模型架构# 数学推理# AI编程
arXiv 自然语言处理✦ 精选AI 评分 70/10012:00

大语言模型编程研究:究竟是在修复错误还是在重新编写代码?

大语言模型(LLM)已广泛应用于编程解题与缺陷修复,但现有研究通常将解题能力与修复能力独立评估,忽略了二者之间的关联。本研究重点探讨LLM在修复含错代码时相较于人类补丁的偏差程度,并验证模型是否存在倾向于直接生成全新解法而非局部修复的偏差。为此,研究团队构建了包含约3000次编程提交的数据集,系统分析模型修复缺陷的实际机制。

阅读原文 ↗推荐理由:通过实证分析揭示了代码大模型在程序修复中倾向重构还是修补的行为特征,对代码模型评估具启发意义。# 大模型# AI编程# 程序修复# 经验研究# 软件工程