AIDC
← 返回全部动态
arXiv 自然语言处理AI 评分 70/10009月25日 12:00

大语言模型编程研究:究竟是在修复错误还是在重新编写代码?

大语言模型(LLM)已广泛应用于编程解题与缺陷修复,但现有研究通常将解题能力与修复能力独立评估,忽略了二者之间的关联。本研究重点探讨LLM在修复含错代码时相较于人类补丁的偏差程度,并验证模型是否存在倾向于直接生成全新解法而非局部修复的偏差。为此,研究团队构建了包含约3000次编程提交的数据集,系统分析模型修复缺陷的实际机制。

推荐理由通过实证分析揭示了代码大模型在程序修复中倾向重构还是修补的行为特征,对代码模型评估具启发意义。

原标题:Large Language Models for Programming: Actually Fixing or Reimplementing Incorrect Code?

阅读 arXiv 自然语言处理 原文 ↗