arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

共收录 12165 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 测试生成 296 篇

2607.08983 2026-07-13 cs.SE cs.AI 新提交 81%

SCATE: Learning to Supervise Coding Agents for Cost-Effective Test Generation

SCATE:学习监督编码代理以实现经济高效的测试生成

Sijia Gu, Noor Nashid, Ali Mesbah

机构 * University of British Columbia(不列颠哥伦比亚大学)

专题命中 测试生成 :coding agent(title,abstract);分类 cs.SE、cs.AI

AI总结 研究针对编码代理惰性生成致代码覆盖不足问题,提出SCATE框架,将监督设为上下文博弈问题,依覆盖和可测试性指标选测试动作,集成不同编码代理,相比基线和其他方法有更高覆盖,能动态优化代理优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16299 2026-05-22 cs.SE cs.AI 81%

ACE: Self-Evolving LLM Coding Framework via Adversarial Unit Test Generation and Preference Optimization

ACE:通过对抗性单元测试生成和偏好优化的自进化LLM编码框架

Yixu Huang, Xinglei Yu, Zhongyu Wei

机构 * School of Data Science Fudan University(数据科学学院 复旦大学)

专题命中 测试生成 :unit test generation(title);code generation(abstract);分类 cs.SE、cs.AI

AI总结 本文提出ACE框架,通过基于求解器-对抗架构的执行中心监督,实现自进化代码生成,无需真实代码或外部奖励模型,实验表明其在CodeContests、MBPP和LiveCodeBench上均优于现有求解器-验证器基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06556 2026-04-08 cs.SE cs.CL 81%

MultiFileTest: A Multi-File-Level LLM Unit Test Generation Benchmark and Impact of Error Fixing Mechanisms

MultiFileTest:一个多文件级LLM单元测试生成基准及错误修复机制的影响

Yibo Wang, Congying Xia, Wenting Zhao, Jiangshu Du, Chunyu Miao, Zhongfen Deng, Philip S. Yu, Chen Xing

机构 * University of Illinois Chicago(伊利诺伊大学芝加哥分校) Salesforce Research(Salesforce研究院) Scale AI

专题命中 测试生成 :unit test generation(title,abstract);分类 cs.SE、cs.CL

AI总结 本文提出MultiFileTest基准,评估多文件级代码的单元测试生成性能,发现前沿LLM表现一般,且存在执行及级联错误,进一步评估了错误修复机制的效果。

Comments Published at ACL 2026 (Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22210 2026-03-03 cs.SE cs.AI 81%

LSPRAG: LSP-Guided RAG for Language-Agnostic Real-Time Unit Test Generation

LSPRAG: 语言无关的实时单元测试生成中的LSP引导RAG

Gwihwan Go, Quan Zhang, Chijin Zhou, Zhao Wei, Yu Jiang

机构 * Tsinghua University(清华大学) East China Normal University(华东师范大学) Tencent(腾讯)

专题命中 测试生成 :unit test generation(title,abstract);分类 cs.SE、cs.AI

AI总结 LSPRAG通过利用语言服务器协议实现实时语言无关单元测试生成,显著提高了测试覆盖率。

Comments 13pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16671 2026-02-19 cs.SE cs.AI 81%

SPARC: Scenario Planning and Reasoning for Automated C Unit Test Generation

SPARC:面向自动化C单元测试生成的场景规划与推理

Jaid Monwar Chowdhury, Chi-An Fu, Reyhaneh Jabbarvand

机构 * Bangladesh University of Engineering and Technology(孟加拉工程科技大学) National Taiwan University(台湾国立大学) University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 测试生成 :unit test generation(title,abstract);分类 cs.SE、cs.AI

AI总结 SPARC通过神经符号方法和场景规划,提升C语言单元测试生成的覆盖率和代码质量,显著优于传统方法。

Comments 9 pages, 6 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24975 2026-02-12 cs.SE cs.CL 81%

DiffuTester: Accelerating Unit Test Generation for Diffusion LLMs via Mining Structural Pattern

DiffuTester: 通过挖掘结构模式加速扩散大语言模型的单元测试生成

Lekang Yang, Yuetong Liu, Yitong Zhang, Jia Li

机构 * College of AI, Tsinghua University(清华大学人工智能学院) School of Software, Beihang University(北航软件学院) School of Computer Science and Engineering, Beihang University(北航计算机科学与工程学院)

专题命中 测试生成 :unit test generation(title,abstract);分类 cs.SE、cs.CL

AI总结 DiffuTester通过挖掘结构模式提升扩散大语言模型在单元测试生成中的效率,实现高质量测试用例生成。

Comments Update format and add some experimental results

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10860 2025-11-17 cs.DC cs.AI cs.SE 81%

HPCAgentTester: A Multi-Agent LLM Approach for Enhanced HPC Unit Test Generation

Rabimba Karanjai, Lei Xu, Weidong Shi

机构 * University Of Houston(德克萨斯大学休斯顿分校) Kent State University(肯特州立大学)

专题命中 测试生成 :unit test generation(title,abstract);分类 cs.SE、cs.AI

Comments Accepted in AIWare 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23812 2025-10-14 cs.SE cs.AI 81%

Navigating the Labyrinth: Path-Sensitive Unit Test Generation with Large Language Models

Dianshu Liao, Xin Yin, Shidong Pan, Chao Ni, Zhenchang Xing, Xiaoyu Sun

机构 * The State Key Laboratory of Blockchain and Data Security, Zhejiang University(区块链与数据安全国家重点实验室,浙江大学)

专题命中 测试生成 :unit test generation(title,abstract);分类 cs.SE、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01994 2025-10-03 cs.SE cs.AI 81%

Clarifying Semantics of In-Context Examples for Unit Test Generation

Chen Yang, Lin Yang, Ziqi Wang, Dong Wang, Jianyi Zhou, Junjie Chen

机构 * College of Intelligence and Computing, Tianjin University, Tianjin, China(智能与计算学院,天津大学,天津,中国) Huawei Cloud Computing Technologies Co., Ltd., Beijing, China(华为云计算技术有限公司,北京,中国)

专题命中 测试生成 :unit test generation(title,abstract);分类 cs.SE、cs.AI

Comments accepted in the research track of ASE 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00408 2025-08-04 cs.SE cs.CL 81%

Benchmarking LLMs for Unit Test Generation from Real-World Functions

Dong Huang, Jie M. Zhang, Mark Harman, Qianru Zhang, Mingzhe Du, See-Kiong Ng

机构 * National University of Singapore(新加坡国立大学) King's College London(伦敦国王学院) University College London(伦敦大学学院) The University of Cambridge(剑桥大学)

专题命中 测试生成 :unit test generation(title,abstract);分类 cs.SE、cs.CL

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11559 2025-06-16 cs.SE cs.AI 81%

Leveraging GPT-4 for Vulnerability-Witnessing Unit Test Generation

Gábor Antal, Dénes Bán, Martin Isztin, Rudolf Ferenc, Péter Hegedűs

专题命中 测试生成 :unit test generation(title,abstract);分类 cs.SE、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15286 2025-04-23 cs.SE cs.AI 81%

CUBETESTERAI: Automated JUnit Test Generation using the LLaMA Model

Daniele Gorla, Shivam Kumar, Pietro Nicolaus Roselli Lorenzini, Alireza Alipourfaz

机构 * University of Rome La Sapienza(罗马大学)

专题命中 测试生成 :unit test generation(title,abstract);分类 cs.SE、cs.AI

Comments Accepted to ICST 2025 Industry Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05394 2025-03-10 cs.SE cs.AI 81%

Static Program Analysis Guided LLM Based Unit Test Generation

Sujoy Roychowdhury, Giriprasad Sridhara, A K Raghavan, Joy Bose, Sourav Mazumdar, Hamender Singh, Srinivasan Bajji Sugumaran, Ricardo Britto

专题命中 测试生成 :unit test generation(title,abstract);分类 cs.SE、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.02368 2025-01-07 cs.SE cs.LG 81%

Reinforcement Learning from Automatic Feedback for High-Quality Unit Test Generation

Benjamin Steenhoek, Michele Tufano, Neel Sundaresan, Alexey Svyatkovskiy

专题命中 测试生成 :unit test generation(title);code generation(abstract);分类 cs.SE、cs.LG

Comments Accepted to DeepTest 2025 (ICSE Workshop). Previously this version appeared as arXiv:2412.14308 which was submitted as a new work by accident

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08343 2024-08-23 cs.SE cs.AI 81%

API-guided Dataset Synthesis to Finetune Large Code Models

Zongjie Li, Daoyuan Wu, Shuai Wang, Zhendong Su

专题命中 测试生成 :code model(title,abstract);分类 cs.SE、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.08033 2024-08-01 cs.SE cs.AI 81%

Domain Adaptation for Code Model-based Unit Test Case Generation

Jiho Shin, Sepehr Hashtroudi, Hadi Hemmati, Song Wang

专题命中 测试生成 :code model(title,abstract);分类 cs.SE、cs.AI

Comments 11 pages + reference. Accepted in ACM SIGSOFT International Symposium on Software Testing and Analysis (ISSTA) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.10622 2024-02-14 cs.SE cs.AI 81%

Unit Test Generation using Generative AI : A Comparative Performance Analysis of Autogeneration Tools

Shreya Bhatia, Tarushi Gandhi, Dhruv Kumar, Pankaj Jalote

专题命中 测试生成 :unit test generation(title,abstract);分类 cs.SE、cs.AI

Comments Accepted to LLM4Code @ ICSE 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.06527 2023-12-12 cs.SE cs.AI 81%

An Empirical Evaluation of Using Large Language Models for Automated Unit Test Generation

Max Schäfer, Sarah Nadi, Aryaz Eghbali, Frank Tip

专题命中 测试生成 :unit test generation(title,abstract);分类 cs.SE、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.13575 2021-10-27 cs.SE cs.AI cs.NE 81%

Automated Support for Unit Test Generation: A Tutorial Book Chapter

Afonso Fontes, Gregory Gay, Francisco Gomes de Oliveira Neto, Robert Feldt

专题命中 测试生成 :unit test generation(title,abstract);分类 cs.SE、cs.AI

Comments This is a preprint of a chapter from the upcoming book, "Optimising the Software Development Process with Artificial Intelligence" (Springer, 2022)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23509 2026-08-04 cs.SE 版本更新 79%

Uncovering Business Logic Bugs via Semantics-Driven Unit Test Generation

通过语义驱动的单元测试生成揭示业务逻辑错误

Chen Yang, Junjie Chen

专题命中 测试生成 :unit test generation(title,abstract);分类 cs.SE

AI总结 本文提出SeGa方法,通过语义知识库生成单元测试以发现业务逻辑错误,实验显示其在检测错误数量和精度提升方面优于现有技术。

Comments Accepted in the Research Track of ISSTA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19682 2026-07-23 cs.SE 新提交 79%

Context Matters: Improving the Practical Reliability of LLM-Based Unit Test Generation

上下文很重要:提高基于大语言模型的单元测试生成的实际可靠性

Junjie Chen, Ziqi Wang, Lin Yang, Chen Yang, Xiao Chu, Jianyi Zhou, Guangtai Liang, Qianxiang Wang, Dong Wang

专题命中 测试生成 :unit test generation(title,abstract);分类 cs.SE

AI总结 研究基于大语言模型的单元测试生成在实际应用中的问题,提出上下文感知工作流程CATGen,通过明确依赖、稳定框架、静态分析等改进设计,经评估在实际项目和基准测试中提升编译成功率与覆盖率,减少生成时间和消耗。

Comments 23 pages, 5 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11573 2026-07-14 cs.SE 新提交 79%

Knowledge-Guided Synthetic Bug Feedback for LLM-Based Unit Test Generation

基于知识的合成错误反馈用于基于大语言模型的单元测试生成

Ziheng Wang, Maike Li, Chen Zhi

专题命中 测试生成 :unit test generation(title,abstract);分类 cs.SE

AI总结 研究如何将历史真实错误机制转化为可执行反馈目标用于基于大语言模型的单元测试生成,提出相应框架,在Defects4J任务上评估,结果显示该机制引导的合成错误反馈能提高真实错误检测率,是引导测试的有效方式。

Comments 12 pages, 7 figures, 6 tables. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.01477 2026-07-09 cs.SE 版本更新 79%

Combining Type Inference and Automated Unit Test Generation for Python

结合Python的类型推断与自动单元测试生成

Lukas Krodinger, Stephan Lukasczyk, Gordon Fraser

专题命中 测试生成 :unit test generation(title,abstract);分类 cs.SE

AI总结 研究针对Python动态类型语言缺乏类型信息阻碍单元测试生成的问题,通过在Pynguin框架扩展类型跟踪,利用测试执行提取类型信息,实现推断参数类型、记录返回值类型并增加代码覆盖率,提升了分支覆盖率和变异分数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14224 2026-06-05 cs.SE 79%

Knowledge Matters: Injecting Project and Testing Knowledge into LLM-based Unit Test Generation

知识很重要:将项目和测试知识注入基于大语言模型的单元测试生成

Anji Li, Mingwei Liu, Zhenxi Chen, Zheng Pei, Zike Li, Dekun Dai, Yanlin Wang, Zibin Zheng

专题命中 测试生成 :unit test generation(title,abstract);分类 cs.SE

AI总结 本文提出KTester框架,通过整合项目特定知识和测试领域知识,提升基于大语言模型的单元测试生成能力,实验表明其在多个关键指标上优于现有方法,提高了测试通过率和覆盖率,且生成的测试更易读易维护。

Comments Accepted at the 48th International Conference on Software Engineering(ICSE 2026),13 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10868 2026-06-01 cs.LG 79%

Go-UT-Bench: A Fine-Tuning Dataset for LLM-Based Unit Test Generation in Go

Go-UT-Bench:用于基于LLM的Go语言单元测试生成的微调数据集

Yashshi Pipalani, Hritik Raj, Rajat Ghosh, Vaishnavi Bhargava, Debojyoti Dutta

机构 * Nutanix

专题命中 测试生成 :unit test generation(title,abstract);分类 cs.LG

AI总结 针对代码LLM训练数据不平衡问题,提出Go-UT-Bench数据集(5264对代码与单元测试),通过微调提升模型在Go语言单元测试生成任务上的性能,在超过75%的基准任务上优于基础模型。

Comments 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25285 2026-05-26 cs.SE 79%

PR-Aware Automated Unit Test Generation: Challenges and Opportunities

PR感知的自动化单元测试生成:挑战与机遇

Vahid Haratian, Atakan Akar, Berk Çakar, Eray Tüzün

专题命中 测试生成 :unit test generation(title);code generation(abstract);分类 cs.SE

AI总结 本研究评估了EvoSuite和GPT-4o在拉取请求(PR)级别生成测试用例的能力,发现两者均难以有效生成捕获变更的测试,但EvoSuite优于GPT-4o,并指出智能体代码生成方法具有潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02943 2026-03-27 cs.SE 79%

Hallucination to Consensus: Multi-Agent LLMs for End-to-End JUnit Test Generation

幻觉到共识:多智能体LLM用于端到端JUnit测试生成

Qinghua Xu, Guancheng Wang, Lionel Briand, Kui Liu

专题命中 测试生成 :unit test generation(title,abstract);分类 cs.SE

AI总结 本文提出CANDOR框架,通过多智能体协作生成Java单元测试,利用共识策略减少幻觉并提升Oracle准确性,实验表明其在代码覆盖率和突变得分上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03181 2026-02-04 cs.SE 79%

Synthesizing File-Level Data for Unit Test Generation with Chain-of-Thoughts via Self-Debugging

通过自我调试合成文件级数据用于单元测试生成的链式思考

Ziyue Hua, Tianyu Chen, Yeyun Gong, Shuai Lu, Peng Cheng, Qinglin Zhu, Yibo He, Yingjie Fu, Wenpin Jiao, Wei Yang, Tao Xie

专题命中 测试生成 :unit test generation(title);repository(abstract);分类 cs.SE

AI总结 通过自我调试合成文件级数据用于单元测试生成,提升测试生成质量与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21382 2026-01-01 cs.SE 79%

Large Language Models for Unit Test Generation: Achievements, Challenges, and Opportunities

大语言模型用于单元测试生成:成就、挑战与机遇

Bei Chu, Yang Feng, Kui Liu, Zhaoqiang Guo, Yichi Zhang, Hange Shi, Zifan Nan, Baowen Xu

专题命中 测试生成 :unit test generation(title,abstract);分类 cs.SE

AI总结 大语言模型在单元测试生成中展现出优势,但面临语义理解不足和标准化不足等挑战,未来需发展自主测试代理与混合系统。

Comments 27 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02318 2025-10-03 cs.SE 79%

Reflective Unit Test Generation for Precise Type Error Detection with Large Language Models

Chen Yang, Ziqi Wang, Yanjie Jiang, Lin Yang, Yuteng Zheng, Jianyi Zhou, Junjie Chen

专题命中 测试生成 :unit test generation(title,abstract);分类 cs.SE

Comments accepted in the research track of ASE 2025

详情

展开后加载摘要…

URL PDF HTML 收藏