arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

共收录 12165 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 程序修复 545 篇

1712.03854 2021-11-12 cs.SE 70%

Ultra-Large Repair Search Space with Automatically Mined Templates: the Cardumen Mode of Astor

Matias Martinez, Martin Monperrus

专题命中 程序修复 :program repair(abstract);repository(abstract);分类 cs.SE

Journal ref Proceedings of the International Symposium on Search Based Software Engineering, 2018

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.00156 2021-03-02 cs.SE 70%

Extracting Concise Bug-Fixing Patches from Human-Written Patches in Version Control Systems

Yanjie Jiang, Hui Liu, Nan Niu, Lu Zhang, Yamin Hu

专题命中 程序修复 :program repair(abstract);repository(abstract);分类 cs.SE

Comments ICSE 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17450 2026-07-03 cs.SE cs.AI cs.CL cs.CR 版本更新 67%

ContraFix: Skill-Enhanced Contrastive Runtime Analysis for Vulnerability Repair

ContraFix:通过差分运行时证据和技能重用进行代理漏洞修复

Simiao Liu, Fang Liu, Peiding Wang, Taichuan Li, Yinghao Zhu, Xiaoli Lian, Li Zhang

机构 * Beihang University(北京航空航天大学) The University of Hong Kong(香港大学)

专题命中 程序修复 :repository(abstract);分类 cs.SE、cs.CL、cs.AI

AI总结 本文提出ContraFix框架,通过差分运行时证据和可重用的修复技能,解决大型语言模型代理在自动漏洞修复中的语义误解问题,实现了在SEC-Bench和PatchEval上的高准确率。

Comments Code: https://figshare.com/s/f173c78e44bca88ebaea

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01892 2026-02-03 cs.LG cs.AI cs.SE cs.SY eess.SY 67%

DiTOX: Fault Detection and Localization in the ONNX Optimizer

DiTOX:ONNX优化器中的故障检测与定位

Nikolaos Louloudakis, Ajitha Rajan

机构 * University of Edinburgh(爱丁堡大学)

专题命中 程序修复 :repository(abstract);分类 cs.SE、cs.AI、cs.LG

AI总结 DiTOX通过差分测试和故障定位技术,发现ONNX优化器中15个问题,揭示了优化器在不同任务中的正确性问题。

Comments 13 pages, 2 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03930 2025-10-07 cs.LG cs.AI cs.CL 67%

LLM Chemistry Estimation for Multi-LLM Recommendation

Huascar Sanchez, Briland Hitaj

机构 * Computer Science Laboratory(计算机科学实验室) SRI International(SRI国际)

专题命中 程序修复 :program repair(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 20 pages, 5 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.18750 2025-09-30 cs.SE cs.AI cs.LG 67%

Order Matters! An Empirical Study on Large Language Models' Input Order Bias in Software Fault Localization

Md Nakhla Rafi, Dong Jae Kim, Tse-Hsun Chen, Shaowei Wang

机构 * Software Performance, Analysis, \ Reliability (SPEAR) Lab\ University Montreal Canada DePaul University Chicago USA University of Manitoba Winnipeg Canada Software Performance, Analysis, \ Reliability (SPEAR) Lab\ University DePaul University University of Manitoba

专题命中 程序修复 :program repair(abstract);分类 cs.SE、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.14175 2025-05-01 cs.SE cs.AI cs.CY cs.PL 67%

InvAASTCluster: On Applying Invariant-Based Program Clustering to Introductory Programming Assignments

Pedro Orvalho, Mikoláš Janota, Vasco Manquinho

机构 * INESC-ID Instituto Superior Técnico(理工学院) Universidade de Lisboa(里斯本大学) CIIRC Czech Technical University in Prague(布拉格捷克技术大学)

专题命中 程序修复 :program repair(abstract);分类 cs.SE、cs.AI、cs.PL

Comments 31 pages, 21 Figures, 5 Tables. Accepted for publication at the Journal of Systems and Software. GitHub repo: https://github.com/pmorvalho/InvAASTCluster

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07693 2025-03-12 cs.AI cs.LG cs.NE cs.SE 67%

Fully Autonomous Programming using Iterative Multi-Agent Debugging with Large Language Models

Anastasiia Grishina, Vadim Liventsev, Aki Härmä, Leon Moonen

专题命中 程序修复 :program synthesis(abstract);分类 cs.SE、cs.AI、cs.LG

Comments Accepted for publication in ACM Trans. Evol. Learn. Optim., February 2025. arXiv admin note: text overlap with arXiv:2304.10423

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.19055 2024-07-30 cs.SE cs.AI cs.LG 67%

Effective Large Language Model Debugging with Best-first Tree Search

Jialin Song, Jonathan Raiman, Bryan Catanzaro

专题命中 程序修复 :code generation(abstract);分类 cs.SE、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.04621 2024-06-07 cs.SE cs.AI cs.CL 67%

DebugBench: Evaluating Debugging Capability of Large Language Models

Runchu Tian, Yining Ye, Yujia Qin, Xin Cong, Yankai Lin, Yinxu Pan, Yesai Wu, Haotian Hui, Weichuan Liu, Zhiyuan Liu, Maosong Sun

专题命中 程序修复 :code generation(abstract);分类 cs.SE、cs.CL、cs.AI

Comments Accepted as Findings of ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.02213 2024-05-16 cs.SE cs.AI cs.LG 67%

Automatic Programming: Large Language Models and Beyond

Michael R. Lyu, Baishakhi Ray, Abhik Roychoudhury, Shin Hwei Tan, Patanamon Thongtanunam

专题命中 程序修复 :program repair(abstract);分类 cs.SE、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.13291 2024-02-26 cs.CR cs.LG cs.PL cs.SE 67%

DeepCode AI Fix: Fixing Security Vulnerabilities with Large Language Models

Berkay Berabi, Alexey Gronskiy, Veselin Raychev, Gishor Sivanrupan, Victor Chibotaru, Martin Vechev

专题命中 程序修复 :program repair(abstract);分类 cs.SE、cs.LG、cs.PL

Comments 26 pages, 13 figures (v2, small fix in author affiliations)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.19813 2023-12-11 cs.SE cs.AI cs.LG cs.NE 67%

Enhancing Genetic Improvement Mutations Using Large Language Models

Alexander E. I. Brownlee, James Callan, Karine Even-Mendoza, Alina Geiger, Carol Hanna, Justyna Petke, Federica Sarro, Dominik Sobania

专题命中 程序修复 :program repair(abstract);分类 cs.SE、cs.AI、cs.LG

Comments Accepted for publication at the Symposium on Search-Based Software Engineering (SSBSE) 2023

Journal ref Arcaini, P., Yue, T., Fredericks, E.M. (eds) Search-Based Software Engineering. SSBSE 2023. Lecture Notes in Computer Science, vol 14415. Springer, Cham

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.00714 2023-12-04 cs.CR 67%

Zipr: A High-Impact, Robust, Open-source, Multi-platform, Static Binary Rewriter

Jason D. Hiser, Anh Nguyen-Tuong, Jack W. Davidson

专题命中 程序修复 :program repair(abstract);repository(abstract)

Comments 5 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.13014 2023-08-01 cs.SE cs.AI cs.LG 67%

Graph Neural Networks For Mapping Variables Between Programs -- Extended Version

Pedro Orvalho, Jelle Piepenbrock, Mikoláš Janota, Vasco Manquinho

专题命中 程序修复 :program repair(abstract);分类 cs.SE、cs.AI、cs.LG

Comments Extended version of "Graph Neural Networks For Mapping Variables Between Programs", paper accepted at ECAI 2023. Github: https://github.com/pmorvalho/ecai23-GNNs-for-mapping-variables-between-programs. 11 pages, 5 figures, 4 tables and 3 listings

详情

展开后加载摘要…

URL PDF HTML 收藏
1906.10502 2021-09-24 cs.SE cs.LG cs.PL stat.ML 67%

SampleFix: Learning to Generate Functionally Diverse Fixes

Hossein Hajipour, Apratim Bhattacharyya, Cristian-Alexandru Staicu, Mario Fritz

专题命中 程序修复 :program repair(abstract);分类 cs.SE、cs.LG、cs.PL

Comments 15 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2008.10707 2020-09-02 cs.SE cs.LG cs.PL 67%

Patching as Translation: the Data and the Metaphor

Yangruibo Ding, Baishakhi Ray, Premkumar Devanbu, Vincent J. Hellendoorn

专题命中 程序修复 :program repair(abstract);分类 cs.SE、cs.LG、cs.PL

详情

展开后加载摘要…

URL PDF HTML 收藏
1911.01205 2019-11-05 cs.LG cs.AI cs.SE stat.ML 67%

Learning to Fix Build Errors with Graph2Diff Neural Networks

Daniel Tarlow, Subhodeep Moitra, Andrew Rice, Zimin Chen, Pierre-Antoine Manzagol, Charles Sutton, Edward Aftandilian

专题命中 程序修复 :program repair(abstract);分类 cs.SE、cs.AI、cs.LG

Comments Submitted for review on Aug 23, 2019

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13138 2026-08-06 cs.SE cs.CR cs.LG 版本更新 62%

A Comprehensive Evaluation of Code Language Models for Security Patch Detection

以代码为中心的漏洞修复提交检测:一个统一的基准和实证研究

Nils Loose, Joseph Bienhüls, Kristoffer Hempel, Felix Mächtle, Thomas Eisenbarth

机构 * University of Lübeck(吕贝克大学) University of Lübeck Institute for IT Security(吕贝克大学信息安全部)

专题命中 程序修复 :repository(abstract);分类 cs.SE、cs.LG

AI总结 本文通过统一框架评估了基于代码语言模型的漏洞修复提交检测,发现仅依赖代码变更无法让模型获得可转移的安全相关代码理解,且在去除提交信息后,增加内过程语义上下文也无法使模型关注代码变更,性能受数据分布和时间分割影响显著。

Comments Accepted at ASE26

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02967 2026-08-05 cs.SE cs.AI 新提交 62%

HyperFL: Query-Adaptive Representation Learning for Software Fault Localization

HyperFL:面向软件故障定位的查询自适应表示学习

Shuai Shao, Yiming Zeng, Yu Zhao, Tingting Yu

专题命中 程序修复 :program repair(abstract);分类 cs.SE、cs.AI

AI总结 HyperFL是面向软件故障定位的查询自适应表示学习框架,通过轻量级超网络生成查询特定LoRA参数,在真实基准上较SweRank实现检索性能显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02695 2026-08-05 cs.CR cs.LG cs.SE 新提交 62%

Stylometric Defenses Against Author Impersonation in Software Repositories

针对软件仓库中作者冒充的风格计量防御

Leonid Ravich, Michael Fire

专题命中 程序修复 :repository(abstract);分类 cs.SE、cs.LG

AI总结 本研究提出基于跨模态Transformer的补丁级风格计量防御,结合流式异常检测器,在真实供应链事件中高效检测软件仓库的作者冒充行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29422 2026-08-03 cs.SE cs.AI cs.CR 新提交 62%

AgenticRepair: Multi-Faceted Program Context Engineering for Agentic Vulnerability Repair

AgenticRepair:面向智能体漏洞修复的多维度程序上下文工程

Michael Fu, Qiyue Mei, Patanamon Thongtanunam, Kla Tantithamthavorn

专题命中 程序修复 :program repair(abstract);分类 cs.SE、cs.AI

AI总结 针对现有智能体漏洞修复方法缺乏多维度程序上下文工程的问题,提出AgenticRepair框架,协调三个LLM子智能体构建三类上下文,在SEC-Bench上取得73%的修复成功率,显著优于基线。

Comments Under Review at IEEE TSE

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28871 2026-08-03 cs.SE cs.AI 新提交 62%

Validation Evidence in LLM Repair Agents: How Much of What Passes Actually Tests the Bug?

LLM修复智能体中的验证证据:通过的测试究竟在多大程度上能检验缺陷?

Xiaonan Xu, Wenjing Wu

专题命中 程序修复 :program repair(abstract);分类 cs.SE、cs.AI

AI总结 本研究以BSG-VA方法分析LLM修复智能体的验证证据,发现近半数阳性测试无缺陷区分信息,缺陷对比反馈可减少证据不足的部署,其效果幅度仍需进一步验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22580 2026-08-03 cs.SE cs.AI 版本更新 62%

RePaCA: Leveraging Reasoning Large Language Models for Static Automated Patch Correctness Assessment

RePaCA:利用推理型大语言模型实现静态自动化补丁正确性评估

Marcos Fuster-Pena, David de-Fitero-Dominguez, Antonio Garcia-Cabot, Eva Garcia-Lopez

专题命中 程序修复 :program repair(abstract);分类 cs.SE、cs.AI

AI总结 RePaCA是利用推理型大语言模型的静态APCA技术,经强化学习微调后在Defects4J测试集上达83.1%准确率,泛化能力优于现有方法,可准确识别过拟合补丁并提升可解释性。

Comments Final published version in the Neurocomputing journal. Volume 701, 7 November 2026, 134583. DOI: https://doi.org/10.1016/j.neucom.2026.134583

Journal ref Neurocomputing (7 November 2026), Volume 701, 134583

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19843 2026-07-23 cs.SE cs.AI 新提交 62%

Beyond Fail-to-Pass: Iterative Hardening of Co-Generated Bug Reproduction Tests and Fixes

超越未通过测试:协同生成的错误重现测试与修复的迭代强化

Yuhao Tan, Zhibang Yang, Fangkai Yang, Yuan Yao, Yu Kang, Lu Wang, Pu Zhao, Xin Zhang, Xiaoxing Ma, Qingwei Lin, Saravan Rajmohan, Dongmei Zhang

机构 * Nanjing University(南京大学) Peking University(北京大学) Microsoft(微软公司)

专题命中 程序修复 :program repair(abstract);分类 cs.SE、cs.AI

AI总结 研究自动化程序修复中错误重现测试问题,指出仅用未通过到通过标准不足。提出CoHarden框架,先生成测试再迭代强化测试与修复,实验证明该框架在解决率等方面优于现有基线。

Comments 29 pages, 5 figures, preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13111 2026-07-16 cs.SE cs.AI 新提交 62%

SemaDiff: Identifying Semantic-Changing Commits with Generated Code and Tests

SemaDiff:使用生成的代码和测试识别语义变化的提交

Maha Ayub, Michael Konstantinou, Ahmed Khanfir, Nikolaos Tsantalis, Mike Papadakis

机构 * SnT, University of Luxembourg(卢森堡大学SnT分校) RIADI, ENSI, University of Manouba(突尼斯曼努巴大学RIADI与ENSI分校) Concordia University(康科德大学)

专题命中 程序修复 :repository(abstract);分类 cs.SE、cs.AI

AI总结 研究软件仓库挖掘中区分语义保留与变化提交的问题,提出SemaDiff方法,通过行为分析、生成额外调用方法及依赖类等,实现对提交的语义判断,实验表明该方法能较准确地区分,语义变化提交检测精度高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04232 2026-07-07 cs.SE cs.CL 新提交 62%

Teaching Code LLMs to Reason with Intermediate Formal Specifications

使用中间形式规范训练代码语言模型进行推理

Minh Le-Anh, Cuong Chi Le, Tien N. Nguyen

机构 * FPT Software AI Center(FPT软件人工智能中心) University of Texas at Dallas(德克萨斯大学达拉斯分校) Hanoi Univ. of Science and Tech.(河内科学技术大学) Texas, USA(得克萨斯州,美国) Hanoi, Vietnam(河内,越南)

专题命中 程序修复 :program repair(abstract);分类 cs.SE、cs.CL

AI总结 研究可执行检查点规范生成,介绍SpecCoder框架从多种程序学习,能选正确规范拒错误执行。引入HumanExec基准测试,实验表明其提升了检查点规范质量及下游正确性推理和修复能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.20412 2026-07-07 cs.SE cs.AI cs.OS 版本更新 62%

kAgent: An execution-guided crash resolution agent for the Linux kernel

kAgent:一种用于Linux内核的执行引导式崩溃修复代理

Alex Mathai, Chenxi Huang, Suwei Ma, Jihwan Kim, Hailie Mitchell, Aleksandr Nogikh, Petros Maniatis, Franjo Ivančić, Junfeng Yang, Baishakhi Ray

机构 * Department of Computer Science, Columbia University(哥伦比亚大学计算机科学系) Google Inc.(谷歌公司) Google DeepMind(谷歌DeepMind)

专题命中 程序修复 :program repair(abstract);分类 cs.SE、cs.AI

AI总结 研究针对Linux内核崩溃修复难题,以内核开发者修复方式为灵感构建kAgent及支持工具栈,通过检查日志等步骤修复崩溃,消融特性定量分析,评估显示其能有效修复多种崩溃。

Comments Accepted to ICML, 2026; in the Deep Learning for Code Workshop. This paper was previously circulated as "CrashFixer"

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22647 2026-06-23 cs.CR cs.LG cs.SE 新提交 62%

RAVEN: Agentic RAG for Automated Vulnerability Repair

RAVEN:用于自动化漏洞修复的智能体检索增强生成框架

Varun Gadey, Zijie Liu, Alexandra Dmitrienko

机构 * University of Duisburg-Essen(杜伊斯堡- Essen大学)

专题命中 程序修复 :repository(abstract);分类 cs.SE、cs.LG

AI总结 提出RAVEN框架,集成智能体RAG管道与可控迭代修复,利用开源LLM实现跨类型、跨语言的自动化漏洞修复,在160个真实CVE上达到83.13%修复成功率。

Comments 17 Pages, 4 figures. Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08717 2026-06-08 cs.SE cs.AI 版本更新 62%

Debugging the Debuggers: Failure-Anchored Structured Recovery for Software Engineering Agents

调试调试器:面向软件工程智能体的失败锚定结构化恢复

Chenyu Zhao, Shenglin Zhang, Yihang Lin, Wenwei Gu, Zhimin Chen, Yongqian Sun, Dan Pei, Chetan Bansal, Saravan Rajmohan, Minghua Ma

机构 * Nankai University(南开大学) Tsinghua University(清华大学) Microsoft(微软)

专题命中 程序修复 :repository(abstract);分类 cs.SE、cs.AI

AI总结 提出PROBE框架,通过遥测层、诊断层和指导门将运行时证据转化为结构化恢复指导,在代码修复、工作流恢复等场景中诊断准确率65.37%,恢复率21.79%。

详情

展开后加载摘要…

URL PDF HTML 收藏