arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

共收录 4122 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码生成 4122 篇

2605.16561 2026-05-19 cs.PL cs.CR 70%

Compile-time Security Analysis and Optimization of Sensitive String Producers

编译时敏感字符串生成器的安全分析与优化

Mike Samuel, Tom Palmer, Shaw Summa, Robert Grayson

专题命中 代码生成 :code generation(abstract);coding agent(abstract);分类 cs.PL

AI总结 本文提出一种通用安全内容编译框架,通过扩展内容语言并整合到通用编程语言中,减少安全与不安全惯用法的词法距离,提升运行性能并提供开发者面向的诊断信息。

Comments 10 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06464 2026-05-12 cs.SE 70%

To What Extent Does Agent-generated Code Require Maintenance? An Empirical Study

代理生成的代码需要多少维护?一项实证研究

Shota Sawada, Tatsuya Shirai, Yutaro Kashiwa, Ken'ichi Yamaguchi, Hiroshi Iwata, Hajimu Iida

专题命中 代码生成 :code generation(abstract);coding agent(abstract);分类 cs.SE

AI总结 研究通过分析AI生成与人工编写代码的维护情况,发现AI代码维护频率较低,主要修改类型为功能扩展,而人工代码则以修复bug为主,人类开发者主导了大部分维护工作。

Comments 6 pages, 2 figures, 2 tables. Accepted at the 30th International Conference on Evaluation and Assessment in Software Engineering (EASE 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18165 2026-04-30 cs.AI cs.CL cs.LG cs.SE 70%

Saber: An Efficient Sampling with Adaptive Acceleration and Backtracking Enhanced Remasking for Diffusion Language Model

Saber: 一种高效的采样方法,具有自适应加速和回溯增强的重新遮蔽,用于扩散语言模型

Yihong Dong, Zhaoyu Ma, Xue Jiang, Zhiyuan Fan, Jiaru Qian, Yongmin Li, Jianha Xiao, Zhi Jin, Rongyu Cao, Binhua Li, Fei Huang, Yongbin Li, Ge Li

机构 * School of Computer Science, Peking University(北京大学计算机科学系) Tongyi Lab, Alibaba Group(阿里云实验室)

专题命中 代码生成 :code generation(abstract);分类 cs.SE、cs.CL、cs.AI

AI总结 本文提出Saber算法,通过动态调整每步未遮蔽令牌数量和回溯机制提升代码生成的推理速度和输出质量,实验显示在多个基准上Pass@1准确率提升1.9%,推理速度提升251.4%。

Comments Accepted to ACL 2026 (main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10516 2026-04-28 cs.CL 70%

Structure-Grounded Knowledge Retrieval via Code Dependencies for Multi-Step Data Reasoning

通过代码依赖关系进行结构化知识检索以实现多步数据推理

Xinyi Huang

机构 * Simon Fraser University(西蒙弗雷泽大学)

专题命中 代码生成 :code generation(abstract);coding agent(abstract);分类 cs.CL

AI总结 本文提出SGKR框架,通过函数调用依赖关系构建图结构,提升多步数据推理任务中知识检索的准确性与相关性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17330 2026-04-14 cs.SE 70%

Agentic Verification of Software Systems

软件系统的代理验证

Haoxin Tu, Huan Zhao, Yahui Song, Mehtab Zafar, Ruijie Meng, Abhik Roychoudhury

专题命中 代码生成 :code generation(abstract);coding agent(abstract);分类 cs.SE

AI总结 本文提出AutoRocq代理,通过与Rocq定理证明器协作实现程序验证,采用迭代优化提升证明质量,实验显示在SV-COMP和Linux内核模块上具有良好的自动验证效果。

Comments Camera-ready version appeared in the Proceedings of the ACM International Conference on the Foundations of Software Engineering (FSE 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.09664 2026-04-08 cs.SE cs.AI cs.CL cs.PL 70%

CodeMind: Evaluating Large Language Models for Code Reasoning

CodeMind: 评估大型语言模型的代码推理能力

Changshu Liu, Yang Chen, Reyhaneh Jabbarvand

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 代码生成 :code generation(abstract);分类 cs.SE、cs.CL、cs.AI

AI总结 本文提出CodeMind框架,通过独立执行推理、规范推理和动态语义推理任务评估LLM的代码推理能力,发现LLM在处理复杂代码时性能下降,且bug修复性能与代码推理任务无关。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27646 2026-03-31 cs.CL hep-lat hep-ph physics.comp-ph physics.optics 70%

PRBench: End-to-end Paper Reproduction in Physics Research

PRBench: 物理研究中的端到端论文复现

Shi Qiu, Junyi Deng, Yiwei Deng, Haoran Dong, Jieyu Fu, Mao Li, Zeyu Li, Zhaolong Zhang, Huiwen Zheng, Leidong Bao, Anqi Lv, Zihan Mo, Yadi Niu, Yiyang Peng, Yu Tian, Yili Wang, Ziyu Wang, Zi-Yu Wang, Jiashen Wei, Liuheng Wu, Aoran Xue, Leyi Yang, Guanglu Yuan, Xiarui Zhan, Jingjun Zhang, Zifan Zheng, Pengfei Liu, Linrui Zhen, Kaiyang Li, Qichang Li, Ziheng Zhou, Guo-En Nian, Yunwei Xiao, Qing-Hong Cao, Linjie Dai, Xu Feng, Peng Gao, Ying Gu, Chang Liu, Jia Liu, Ming-xing Luo, Yan-Qing Ma, Liang-You Peng, Huichao Song, Shufeng Wang, Chenxu Wang, Tao Wang, Yi-Nan Wang, Chengyin Wu, Pengwei Zhao, Hua Xing Zhu

机构 * School of Physics, Peking University(北京大学物理学院) Beijing Computational Science Research Center(北京计算科学研究中心)

专题命中 代码生成 :code generation(abstract);coding agent(abstract);分类 cs.CL

AI总结 PRBench通过30个物理领域专家任务评估AI在复现科学论文中的能力,发现现有模型在数据准确性和代码正确性上表现不佳,揭示了系统性失败模式。

Comments 17 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13170 2026-03-24 cs.CL 70%

Putting on the Thinking Hats: A Survey on Chain of Thought Fine-tuning from the Perspective of Human Reasoning Mechanism

戴上思考帽子:从人类推理机制视角对链式思考微调的综述

Xiaoshu Chen, Sihang Zhou, Ke Liang, Duanyang Yuan, Haoyuan Chen, Xiaoyu Sun, Lingyuan Meng, Xinwang Liu

机构 * College of Computer Science and Technology, National University of Defense Technology(计算机科学与技术学院,国防科技大学) College of Intelligence Science and Technology, National University of Defense Technology(智能科学与技术学院,国防科技大学)

专题命中 代码生成 :code generation(abstract);repository(abstract);分类 cs.CL

AI总结 本文从人类推理机制角度综述了链式思考微调,分析其通过六顶思考帽子框架分类方法,并探讨未来研究方向及现有数据集与模型表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20795 2026-03-23 cs.CL 70%

Test-Time Alignment for Large Language Models via Textual Model Predictive Control

通过文本模型预测控制对大型语言模型进行测试时对齐

Kuang-Da Wang, Teng-Ruei Chen, Yu Heng Hung, Guo-Xun Ko, Shuoyang Ding, Yueh-Hua Wu, Yu-Chiang Frank Wang, Chao-Han Huck Yang, Wen-Chih Peng, Ping-Chun Hsieh

机构 * National Yang Ming Chiao Tung University NVIDIA National Taiwan University

专题命中 代码生成 :code generation(abstract);program synthesis(abstract);分类 cs.CL

AI总结 本文提出TMPC方法,通过文本模型预测控制解决测试时对齐问题,通过分层强化学习原理改进生成过程,提升不同任务的性能。

Comments Accepted for ICLR 2026. Project page: https://rl-bandits-lab.github.io/TMPC/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13201 2026-03-17 q-bio.GN cs.AI cs.MA 70%

Benchmarking LLM-based agents for single-cell omics analysis

对基于大语言模型的代理在单细胞组学分析中的性能评估

Yang Liu, Lu Zhou, Xiawei Du, Ruikun He, Xuguang Zhang, Rongbo Shen, Yixue Li

专题命中 代码生成 :code generation(abstract);program synthesis(abstract);分类 cs.AI

AI总结 本文提出一个评估系统,用于严格评估代理在单细胞组学分析中的能力,发现Grok3-beta在测试框架中表现最佳,多代理框架通过角色分工提升协作与执行效率。

Comments please see clear figures in this version. 6 main figures; 13 supplementary figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11139 2026-03-16 cs.LG 70%

H2LooP Spark Preview: Continual Pretraining of Large Language Models for Low-Level Embedded Systems Code

H2LooP Spark Preview:为低级嵌入式系统代码进行大语言模型的持续预训练

Amit Singh, Vedant Nipane, Pulkit Agrawal, Jatin Kishnani, Sairanjan Mishra

机构 * H2LooP.ai

专题命中 代码生成 :code generation(abstract);repository(abstract);分类 cs.LG

AI总结 本文提出H2LooP Spark Preview,通过持续预训练方法,利用BF16 LoRA技术将OLMo-3-7B模型适应于嵌入式系统领域,显著降低困惑度并提升代码生成性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11226 2026-03-13 cs.SE 70%

ExecVerify: White-Box RL with Verifiable Stepwise Rewards for Code Execution Reasoning

ExecVerify: 带可验证逐步奖励的白盒强化学习用于代码执行推理

Lingxiao Tang, He Ye, Zhaoyang Chu, Muyang Ye, Zhongxin Liu, Xiaoxue Ren, Lingfeng Bao

专题命中 代码生成 :code generation(abstract);program synthesis(abstract);分类 cs.SE

AI总结 ExecVerify通过可验证的白盒奖励提升代码执行推理和生成性能

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07412 2026-02-10 cs.SE 70%

Forecasting Developer Environments with GenAI: A Research Perspective

用生成式人工智能预测开发者环境:一种研究视角

Raula Gaikovina Kula, Christoph Treude, Xing Hu, Sebastian Baltes, Earl T. Barr, Kelly Blincoe, Fabio Calefato, Junjie Chen, Marc Cheong, Youmei Fan, Daniel M. German, Marco Gerosa, Jin L. C. Guo, Shinpei Hayashi, Robert Hirschfeld, Reid Holmes, Yintong Huo, Takashi Kobayashi, Michele Lanza, Zhongxin Liu, Olivier Nourry, Nicole Novielli, Denys Poshyvanyk, Shinobu Saito, Kazumasa Shimari, Igor Steinmacher, Mairieli Wessel, Markus Wagner, Annie Vella, Laurie Williams, Xin Xia

专题命中 代码生成 :code generation(abstract);program repair(abstract);分类 cs.SE

AI总结 本文探讨了生成式人工智能对集成开发环境的影响,通过专家讨论提出四个研究主题,旨在探索GenAI在软件工程中的应用与挑战。

Comments IDE Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02563 2026-02-10 cs.SE cs.CL cs.LG cs.PL 70%

Compressed code: the hidden effects of quantization and distillation on programming tokens

压缩代码:量化和知识蒸馏对编程令牌的隐藏影响

Viacheslav Siniaev, Iaroslav Chelombitko, Aleksey Komissarov

机构 * National Sun Yat-Sen University(国立中山大学) DataSpike aglabx Neapolis University(尼apolis大学)

专题命中 代码生成 :code generation(abstract);分类 cs.SE、cs.CL、cs.LG

AI总结 本文研究了量化和知识蒸馏对编程令牌的影响,通过分析令牌表示揭示了代码生成质量的优化方法和关键因素。

Comments 18 pages, 1 figure and 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12014 2026-02-09 cs.CL cs.AI cs.LG cs.SE 70%

code_transformed: The Influence of Large Language Models on Code

code_transformed: 大型语言模型对代码的影响

Yuliang Xu, Siming Huang, Mingmeng Geng, Yao Wan, Xuanhua Shi, Dongping Chen

机构 * Huazhong University of Science and Technology(华中科技大学) École normale supérieure - Université PSL(巴黎高等师范学院-巴黎大学) Laboratoire LATTICE(LATTICE实验室) International School for Advanced Studies (SISSA)(国际先进研究学院(SISSA))

专题命中 代码生成 :code generation(abstract);分类 cs.SE、cs.CL、cs.AI

AI总结 本文研究了大型语言模型对代码风格的影响,通过分析GitHub仓库中的代码,发现命名规范、复杂性等指标的变化,揭示LLMs对现实编程实践的深远影响。

Comments EACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20112 2026-01-29 cs.SE 70%

Usage, Effects and Requirements for AI Coding Assistants in the Enterprise: An Empirical Study

企业中AI编码助手的使用、影响与需求:一项实证研究

Maja Vukovic, Rangeet Pan, Tin Kam Ho, Rahul Krishna, Raju Pavuluri, Michele Merler

专题命中 代码生成 :code generation(abstract);program repair(abstract);分类 cs.SE

AI总结 本文通过实证研究探讨了企业中AI编码助手的使用情况、影响及需求,分析了其在软件工程流程中的作用及用户需求。

Comments To appear in the 3rd International Workshop on Large Language Models For Code, co-located at ICSE, Rio de Janeiro, Brazil, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03008 2026-01-27 cs.CL cs.AI cs.PL cs.SE 70%

MoSE: Hierarchical Self-Distillation Enhances Early Layer Embeddings

MoSE:分层自蒸馏增强早期层嵌入

Andrea Gurioli, Federico Pennino, João Monteiro, Maurizio Gabbrielli

机构 * Apple(苹果公司)

专题命中 代码生成 :repository(abstract);分类 cs.SE、cs.CL、cs.AI

AI总结 MoSE通过自蒸馏机制增强早期层嵌入,实现代码检索与分类任务中的性能与准确性的平衡。

Comments Accepted in the AAAI 2026 Main Technical Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12399 2025-12-23 cs.AI 70%

A Survey of Vibe Coding with Large Language Models

基于大语言模型的Vibe编码调研

Yuyao Ge, Lingrui Mei, Zenghao Duan, Tianhao Li, Yujia Zheng, Yiwei Wang, Lexin Wang, Jiayu Yao, Tianyu Liu, Yujun Cai, Baolong Bi, Fangda Guo, Jiafeng Guo, Shenghua Liu, Xueqi Cheng

机构 * Institute of Computing Technology Chinese Academy of Sciences(中国科学院计算技术研究所) Duke University(杜克大学) University of California Merced(加州大学默塞德分校) Peking University(北京大学) University of Queensland(昆士兰大学)

专题命中 代码生成 :code generation(abstract);coding agent(abstract);分类 cs.AI

AI总结 本文调研了基于大语言模型的Vibe编码方法,系统分析了其理论基础和五个开发模型,揭示了上下文工程与协作模式对成功的关键作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04355 2025-12-05 cs.DC cs.AI cs.PF 70%

Counting Without Running: Evaluating LLMs' Reasoning About Code Complexity

无需运行即可计数:评估LLM对代码复杂度的推理能力

Gregory Bolet, Giorgis Georgakoudis, Konstantinos Parasyris, Harshitha Menon, Niranjan Hasabnis, Kirk W. Cameron, Gal Oren

专题命中 代码生成 :code generation(abstract);repository(abstract);分类 cs.AI

AI总结 本文提出gpuFLOPBench基准测试,评估LLM在无需运行代码的情况下预测CUDA内核FLOP计数的能力,揭示现有代码助手在硬件特定微码效应方面的局限性。

Comments 13 pages, 6 figures, MLSys 2026 Submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07506 2025-12-04 cs.DC cs.AI cs.CL cs.LG cs.SE 70%

Astra: A Multi-Agent System for GPU Kernel Performance Optimization

Astra:一种用于GPU内核性能优化的多智能体系统

Anjiang Wei, Tianran Sun, Yogesh Seenichamy, Hang Song, Anne Ouyang, Azalia Mirhoseini, Ke Wang, Alex Aiken

机构 * Stanford University(斯坦福大学) Shanghai Jiao Tong University(上海交通大学) Nanjing University(南京大学)

专题命中 代码生成 :code generation(abstract);分类 cs.SE、cs.CL、cs.AI

AI总结 Astra是首个基于LLM的多智能体系统,用于优化GPU内核性能,通过协作生成高效内核并实现显著加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16092 2025-11-21 cs.SE 70%

The Future of Development Environments with AI Foundation Models: NII Shonan Meeting 222 Report

人工智能基础模型对未来开发环境的未来影响:NII Shonan会议222报告

Xing Hu, Raula Gaikovina Kula, Christoph Treude

专题命中 代码生成 :code generation(abstract);program repair(abstract);分类 cs.SE

AI总结 人工智能基础模型对开发环境的影响及未来发展方向,通过专家讨论探讨其在软件工程和人机交互中的挑战与机遇。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21432 2025-11-04 cs.CR cs.SE 70%

RepoMark: A Data-Usage Auditing Framework for Code Large Language Models

Wenjie Qu, Yuguang Zhou, Bo Wang, Yuexin Li, Lionel Z. Wang, Jinyuan Jia, Jiaheng Zhang

专题命中 代码生成 :code generation(abstract);repository(abstract);分类 cs.SE

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06606 2025-10-09 cs.SE 70%

Beyond More Context: How Granularity and Order Drive Code Completion Quality

Uswat Yusuf, Genevieve Caumartin, Diego Elias Costa

专题命中 代码生成 :code generation(abstract);repository(abstract);分类 cs.SE

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00015 2025-10-03 cs.CL 70%

Design and Application of Multimodal Large Language Model Based System for End to End Automation of Accident Dataset Generation

MD Thamed Bin Zaman Chowdhury, Moazzem Hossain

专题命中 代码生成 :code generation(abstract);repository(abstract);分类 cs.CL

Comments This paper is accepted for presentation in TRB annual meeting 2026. The version presented here is the preprint version before peer review process

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20182 2025-09-25 cs.AR cs.AI 70%

Automated Multi-Agent Workflows for RTL Design

Amulya Bhattaram, Janani Ramamoorthy, Ranit Gupta, Diana Marculescu, Dimitrios Stamoulis

机构 * Chandra Family Department of Electrical and Computer Engineering(查克拉家族电子与计算机工程系)

专题命中 代码生成 :code generation(abstract);program synthesis(abstract);分类 cs.AI

Comments Accepted: ML for Systems Workshop NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15283 2025-09-22 cs.SE cs.AI cs.LG cs.PL 70%

Evaluating the Limitations of Local LLMs in Solving Complex Programming Challenges

Kadin Matotek, Heather Cassel, Md Amiruzzaman, Linh B. Ngo

专题命中 代码生成 :code generation(abstract);分类 cs.SE、cs.AI、cs.LG

Comments Comments: 16 pages, 3 figures, 8 tables, accepted to CCSC Eastern 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11126 2025-09-16 cs.SE 70%

AI Agentic Programming: A Survey of Techniques, Challenges, and Opportunities

Huanting Wang, Jingzhi Gong, Huawei Zhang, Jie Xu, Zheng Wang

专题命中 代码生成 :code generation(abstract);coding agent(abstract);分类 cs.SE

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08847 2025-09-12 cs.AI cs.CL cs.LG cs.SE 70%

Automated Unity Game Template Generation from GDDs via NLP and Multi-Modal LLMs

Amna Hassan

机构 * UET Taxila(塔希尔大学工程学院)

专题命中 代码生成 :code generation(abstract);分类 cs.SE、cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08088 2025-09-11 cs.AI cs.MA 70%

EnvX: Agentize Everything with Agentic AI

Linyao Chen, Zimian Peng, Yingxuan Yang, Yikun Wang, Wenzheng Tom Tang, Hiroki H. Kobayashi, Weinan Zhang

机构 * EnvX Team(EnvX团队) Shanghai Innovation Institute(上海创新研究院) Shanghai Jiao Tong University(上海交通大学) The University of Tokyo(东京大学) Zhejiang University(浙江大学) Fudan University(复旦大学)

专题命中 代码生成 :code generation(abstract);repository(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.17681 2025-08-13 cs.PL 70%

Synthesizing JSON Schema Transformers

Jack Stanek, Daniel Killough

专题命中 代码生成 :code generation(abstract);program synthesis(abstract);分类 cs.PL

详情

展开后加载摘要…

URL PDF HTML 收藏