arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

共收录 12259 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码生成 4132 篇

2604.09952 2026-04-14 cs.LG 79%

SLM Finetuning for Natural Language to Domain Specific Code Generation in Production

为生产环境中的自然语言到领域特定代码生成进行SLM微调

Renjini R. Nair, Damian K. Kowalczyk, Marco Gaudesi, Chhaya Methani

专题命中 代码生成 :code generation(title,abstract);分类 cs.LG

AI总结 本文研究了通过微调小型语言模型提升自然语言到领域代码生成的性能与效率,展示了在生产环境中优于大模型的延迟和成本效益。

Comments 11 pages (including appendix), 5 tables, 1 figure. Submitted to arXiv as a preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08715 2026-04-14 cs.AR cs.CL 79%

VeriInteresting: An Empirical Study of Model Prompt Interactions in Verilog Code Generation

VeriInteresting:关于Verilog代码生成中模型提示交互的实证研究

Luca Collini, Andrew Hennesee, Patrick Yubeaton, Siddharth Garg, Ramesh Karri

专题命中 代码生成 :code generation(title,abstract);分类 cs.CL

AI总结 本文通过实证研究探讨了在Verilog代码生成中模型推理、专业化和提示工程策略的交互影响,评估了多种大小模型在不同提示设计下的表现,揭示了模型类别对结构化提示和优化的响应模式。

Comments Submitted for peer review

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09515 2026-04-13 cs.SE 79%

When LLMs Lag Behind: Knowledge Conflicts from Evolving APIs in Code Generation

当LLM落后时:来自演进API的代码生成中的知识冲突

Ahmed Nusayer Ashik, Shaowei Wang, Tse-Hsun Chen, Muhammad Asaduzzaman, Yuan Tian

专题命中 代码生成 :code generation(title,abstract);分类 cs.SE

AI总结 本文研究了API演变对LLM代码生成的影响,发现缺乏全面文档时LLM难以优先处理外部上下文,执行率仅42.55%,而结构化文档和大模型规模可提升至66.36%,但推理策略如Self-Reflection可进一步提升11%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09442 2026-04-13 cs.CL 79%

UIPress: Bringing Optical Token Compression to UI-to-Code Generation

UIPress:将光学令牌压缩引入UI到代码生成

Dasen Dai, Shuoqi Li, Ronghao Chen, Huacan Wang, Biao Wu, Qizhen Lan

机构 * The Chinese University of Hong Kong(香港中文大学) Peking University(北京大学) University of Chinese Academy of Sciences(中国科学院大学) University of Technology Sydney(悉尼科技大学)

专题命中 代码生成 :code generation(title,abstract);分类 cs.CL

AI总结 本文提出UIPress,一种轻量级学习压缩模块,通过结合深度可分离卷积、元素引导的空间重加权和Transformer细化,将UI截图的视觉令牌从约6700压缩到256,结合LoRA实现表示差距桥接,提升效率并优于现有方法。

Comments 10 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06079 2026-04-08 cs.CV cs.AI 79%

Scientific Graphics Program Synthesis via Dual Self-Consistency Reinforcement Learning

通过双自一致性强化学习实现科学图形程序合成

Juekai Lin, Yun Zhu, Honglin Lin, Sijing Li, Tianwei Lin, Zheng Liu, Xiaoyang Wang, Wenqiao Zhang, Lijun Wu

机构 * Zhejiang University(浙江大学) Shanghai Artificial Intelligence Laboratory, OpenDataLab(上海人工智能实验室,OpenDataLab) Shanghai Jiao Tong University(上海交通大学) Peking University(北京大学)

专题命中 代码生成 :program synthesis(title,abstract);分类 cs.AI

AI总结 本文提出双自一致性强化学习框架,结合高质量数据集和多维基准,提升科学图形到可编辑TikZ代码的转换能力,实现视觉与结构的高精度优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05839 2026-04-08 cs.AI 79%

Vision-Guided Iterative Refinement for Frontend Code Generation

基于视觉引导的前端代码生成迭代精修

Hannah Sansford, Derek H. C. Law, Wei Liu, Abhishek Tripathi, Niresh Agarwal, Gerrit J. J. van den Burg

机构 * School of Mathematics, University of Bristol, UK(英国布里斯托大学数学学院) Amazon AGI(亚马逊AGI)

专题命中 代码生成 :code generation(title,abstract);分类 cs.AI

AI总结 本文提出一种全自动的批评者循环框架,利用视觉语言模型提供结构化反馈以指导代码生成的迭代优化,实验证明其在前端开发中能显著提升代码质量。

Comments Accepted at ICLR 2026 Workshop on AI with Recursive Self-Improvement

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05514 2026-04-08 cs.AI 79%

OmniDiagram: Advancing Unified Diagram Code Generation via Visual Interrogation Reward

OmniDiagram:通过视觉 interrogation 奖励推进统一图代码生成

Haoyue Yang, Xuanle Zhao, Xuexin Liu, Feibang Jiang, Yao Zhu

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) Zhejiang University(浙江大学)

专题命中 代码生成 :code generation(title,abstract);分类 cs.AI

AI总结 本文提出OmniDiagram统一框架,结合多种图代码语言和任务定义,引入视觉反馈策略Viva,通过生成方法奖励视觉结构,无需人工标注数据,实验表明其在图代码生成基准上达到新状态。

Comments Accepted to ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03587 2026-04-07 cs.CR cs.AI 79%

SecPI: Secure Code Generation with Reasoning Models via Security Reasoning Internalization

SecPI: 通过安全推理内化实现安全代码生成

Hao Wang, Niels Mündler, Mark Vero, Jingxuan He, Dawn Song, Martin Vechev

机构 * University of California, Berkeley(加州大学伯克利分校) ETH Zurich(苏黎世联邦理工学院)

专题命中 代码生成 :code generation(title,abstract);分类 cs.AI

AI总结 SecPI通过内化结构化安全推理,使推理模型在无需安全指令的情况下生成安全代码,经验证在多个安全基准测试中显著提升代码功能正确性和安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02776 2026-04-06 cs.SE 79%

Evaluating the Environmental Impact of using SLMs and Prompt Engineering for Code Generation

评估使用SLMs和提示工程进行代码生成的环境影响

Md Afif Al Mamun, Sayan Nath, Gias Uddin, Novarun Deb

专题命中 代码生成 :code generation(title,abstract);分类 cs.SE

AI总结 本文研究了基于SLMs的代码生成中不同提示策略对准确性和可持续性的影响,发现可持续性与准确性脱钩,提示工程可实现环保与性能的平衡。

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02580 2026-04-06 cs.LG 79%

VoxelCodeBench: Benchmarking 3D World Modeling Through Code Generation

VoxelCodeBench:通过代码生成进行3D世界建模的基准测试

Yan Zheng, Florian Bordes

机构 * FAIR at Meta(Meta FAIR) The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 代码生成 :code generation(title,abstract);分类 cs.LG

AI总结 本文提出VoxelCodeBench基准,通过代码生成评估3D空间推理能力,发现生成可执行代码易,但生成空间正确输出难,尤其在几何构造和多物体组合上挑战大。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.19108 2026-04-06 cs.SE 79%

A Multi-Language Perspective on the Robustness of LLM Code Generation

多语言视角下的大型语言模型代码生成鲁棒性研究

Fazle Rabbi, Zishuo Ding, Jinqiu Yang

专题命中 代码生成 :code generation(title,abstract);分类 cs.SE

AI总结 本文从多语言角度评估了代码生成模型的鲁棒性,通过扰动文档字符串、函数名、语法和格式等关键提示部分,发现不同语言和扰动类型对模型性能影响不同,且增大模型规模并不能显著提升鲁棒性。

Comments 50 pages, 10 figures, 16 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01600 2026-04-03 cs.AI 79%

MM-ReCoder: Advancing Chart-to-Code Generation with Reinforcement Learning and Self-Correction

MM-ReCoder:通过强化学习和自我校正推进图表到代码生成

Zitian Tang, Xu Zhang, Jianbo Yuan, Yang Zou, Varad Gunjal, Songyao Jiang, Davide Modolo

机构 * Brown University(布朗大学) Amazon AGI(亚马逊AGI)

专题命中 代码生成 :code generation(title,abstract);分类 cs.AI

AI总结 MM-ReCoder通过强化学习和自我校正机制提升图表到代码生成能力,其两阶段多轮自我校正策略基于Group Relative Policy Optimization,提升代码准确性和可执行性。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01226 2026-04-03 cs.CV cs.SE 79%

DOne: Decoupling Structure and Rendering for High-Fidelity Design-to-Code Generation

DOne:解耦结构与渲染以实现高保真设计到代码生成

Xinhao Huang, Jinke Yu, Wenhao Xu, Zeyi Wen, Ying Zhou, Junzhuo Liu, Junhao Ji, Zulong Chen

机构 * HKUST (Guangzhou)(香港科技大学(广州)) Alibaba Group(阿里巴巴集团) HKUST(香港科技大学) University of Electronic Science(电子科技大学) Zhejiang Lab(之江实验室)

专题命中 代码生成 :code generation(title,abstract);分类 cs.SE

AI总结 DOne通过解耦结构理解与元素渲染,提升设计到代码生成的高保真度,通过布局分割模块、混合元素检索器和模式引导生成范式,克服了现有方法在结构与细节协调上的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19347 2026-03-31 cs.AR cs.LG 79%

Exploring the Agentic Frontier of Verilog Code Generation

探索Verilog代码生成的代理前沿

Patrick Yubeaton, Siddharth Garg, Chinmay Hegde

机构 * New York University Tandon School of Engineering(纽约大学坦登工程学院)

专题命中 代码生成 :code generation(title,abstract);分类 cs.LG

AI总结 本文系统评估了代理LLM在Verilog生成中的影响,通过CVDP基准测试,分析了结构化提示和工具设计对性能的影响,并比较了开源与闭源模型的性能差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09701 2026-03-31 cs.SE 79%

An Empirical Study of Interaction Smells in Multi-Turn Human-LLM Collaborative Code Generation

多轮人-大语言模型协作代码生成中交互恶臭的实证研究

Binquan Zhang, Li Zhang, Lin Shi, Song Wang, Yuwei Qian, Linhui Zhao, Fang Liu, An Fu, Yida Ye

专题命中 代码生成 :code generation(title,abstract);分类 cs.SE

AI总结 本文通过分析真实用户-大语言模型交互数据,揭示多轮协作代码生成中的交互恶臭现象,提出InCE框架以提升交互质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26091 2026-03-30 cs.SE 79%

Search-Induced Issues in Web-Augmented LLM Code Generation: Detecting and Repairing Error-Inducing Pages

网页增强型大语言模型代码生成中的搜索诱导问题:检测与修复误导页面

Guoqing Wang, Zeyu Sun, Xiaofei Xie, Yizhou Chen, Yanchao Tan, Yifan Zhao, Dan Hao

专题命中 代码生成 :code generation(title,abstract);分类 cs.SE

AI总结 本文研究了网页增强型LLM代码生成中因误导页面导致的搜索诱导问题,提出Sherlock框架用于检测、调试和修复问题页面,提升系统可靠性。

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22717 2026-03-25 cs.CR cs.SE 79%

Does Teaming-Up LLMs Improve Secure Code Generation? A Comprehensive Evaluation with Multi-LLMSecCodeEval

多模型协同是否能提升安全代码生成?基于多LLMSecCodeEval的全面评估

Bushra Sabir, Shigang Liu, Seung Ick Jang, Sharif Abuadbba, Yansong Gao, Kristen Moore, SangCheol Kim, Hyoungshick Kim, Surya Nepal

专题命中 代码生成 :code generation(title,abstract);分类 cs.SE

AI总结 本文通过多LLMSecCodeEval框架评估多模型协同对安全代码生成的影响,发现混合策略在安全性能上表现最佳,而模型规模并非安全保障的关键因素。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22184 2026-03-24 cs.LG quant-ph 79%

Revisiting Quantum Code Generation: Where Should Domain Knowledge Live?

重新审视量子代码生成:领域知识应该在哪里居住?

Oscar Novo, Oscar Bastidas-Jossa, Alberto Calvo, Antonio Peris, Carlos Kuchkovsky

机构 * Quantum Computing Research, QCentroid(量子计算研究,QCentroid)

专题命中 代码生成 :code generation(title,abstract);分类 cs.LG

AI总结 研究比较了Qiskit代码生成中不同专精策略,发现通用LLM在零样本和检索增强设置下表现更优,结合执行反馈代理可提升性能,表明无需领域微调即可实现更灵活的量子软件开发。

Comments Submitted to Quantum Machine Intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16526 2026-03-18 cs.AI 79%

Exploring different approaches to customize language models for domain-specific text-to-code generation

探索不同方法以定制语言模型用于领域特定的文本到代码生成

Luís Freire, Fernanda A. Andaló, Nicki Skafte Detlefsen

机构 * Technical University of Denmark(丹麦技术大学) The LEGO Group(乐高集团)

专题命中 代码生成 :code generation(title,abstract);分类 cs.AI

AI总结 本文探讨了如何通过合成数据集定制小型语言模型用于领域特定的代码生成,比较了少样本提示、检索增强生成和LoRA微调三种方法,发现LoRA在准确性和领域对齐上表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16158 2026-03-18 cs.LG 79%

Execution-Grounded Credit Assignment for GRPO in Code Generation

基于执行的信用分配用于代码生成中的GRPO

Abhijit Kumar, Natalya Kumar, Shikhar Gupta

机构 * ICLR 2026 Workshop on Scaling Post-Training for LLMs (SPOT)(ICLR 2026 工作组:扩大训练后大语言模型(SPOT))

专题命中 代码生成 :code generation(title,abstract);分类 cs.LG

AI总结 本文提出基于执行的信用分配方法EGCA,通过执行轨迹局部化GRPO更新,提升代码生成的单元测试通过率,实验表明在HumanEval和MBPP数据集上效果优于GRPO。

Comments Accepted at SPOT ICLR 2026 (https://openreview.net/forum?id=nqkVB5EVXJ)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14837 2026-03-18 cs.CV cs.AI 79%

Improved Iterative Refinement for Chart-to-Code Generation via Structured Instruction

改进的图表到代码生成的迭代细化方法:基于结构化指令

Chengzhi Xu, Yuyang Wang, Lai Wei, Lichao Sun, Weiran Huang

机构 * School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院) Shanghai Innovation Institute(上海创新研究院) Lehigh University(莱特大学) MIFA Lab(MIFA实验室)

专题命中 代码生成 :code generation(title,abstract);分类 cs.AI

AI总结 本文提出基于结构化指令的ChartIR方法,通过区分视觉理解和代码翻译任务,提升图表到代码生成的性能,实验显示在Qwen2-VL和GPT-4o上表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13587 2026-03-17 cs.AI cs.CV 79%

Breaking the SFT Plateau: Multimodal Structured Reinforcement Learning for Chart-to-Code Generation

突破SFT平台:面向图表到代码生成的多模态结构强化学习

Lei Chen, Xuanle Zhao, Zhixiong Zeng, Jing Huang, Liming Zheng, Yufeng Zhong, Lin Ma

专题命中 代码生成 :code generation(title,abstract);分类 cs.AI

AI总结 本文提出多模态结构强化学习(MSRL)以突破SFT平台,通过大规模实验构建最大训练语料库,并采用双阶段课程训练策略,提升图表到代码生成的高阶指标。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05278 2026-03-06 cs.SE 79%

A framework for assessing the capabilities of code generation of constraint domain-specific languages with large language models

一种评估大语言模型生成约束领域特定语言代码能力的框架

David Delgado, Lola Burgueño, Robert Clarisó

专题命中 代码生成 :code generation(title,abstract);分类 cs.SE

AI总结 本文提出一种评估框架,用于评估大语言模型生成约束领域特定语言代码的能力,发现LLMs在Python上的表现优于OCL和Alloy,并探讨了改进代码生成的方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01345 2026-03-03 cs.SE 79%

PymooLab: An Open-Source Visual Analytics Framework for Multi-Objective Optimization using LLM-Based Code Generation and MCDM

PymooLab: 一个基于LLM代码生成和MCDM的多目标优化开源可视化分析框架

Thiago Santos, Sebastiao Xavier, Luiz Gustavo de Oliveira Carneiro, Gustavo de Souza

专题命中 代码生成 :code generation(title,abstract);分类 cs.SE

AI总结 PymooLab通过LLM辅助代码生成和MCDM工具,为多目标优化提供可视化分析框架,提升领域专家的可操作性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17203 2026-02-26 cs.DB cs.LG 79%

High-Fidelity And Complex Test Data Generation For Google SQL Code Generation Services

高保真与复杂测试数据生成用于谷歌SQL代码生成服务

Shivasankari Kannan, Yeounoh Chung, Amita Gondi, Tristan Swadell, Fatma Ozcan

机构 * Google(谷歌)

专题命中 代码生成 :code generation(title,abstract);分类 cs.LG

AI总结 本文提出利用LLM生成高保真测试数据,以提高复杂SQL代码生成服务的测试覆盖率和语义准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19276 2026-02-24 cs.SE 79%

ComUICoder: Component-based Reusable UI Code Generation for Complex Websites via Semantic Segmentation and Element-wise Feedback

ComUICoder:基于语义分割和元素反馈的组件式可重用UI代码生成用于复杂网站

Jingyu Xiao, Jiantong Qin, Shuoqi Li, Man Ho Lam, Yuxuan Wan, Jen-tse Huang, Yintong Huo, Michael R. Lyu

专题命中 代码生成 :code generation(title,abstract);分类 cs.SE

AI总结 ComUICoder通过语义分割和元素反馈技术,提升复杂网站中可重用UI代码的生成质量与重用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20334 2026-02-19 cs.SE 79%

Comment Traps: How Defective Commented-out Code Augment Defects in AI-Assisted Code Generation

评论陷阱:缺陷评论代码如何增强AI辅助代码生成中的缺陷

Yuan Huang, Yukang Zhou, Xiangping Chen, Zibin Zheng

专题命中 代码生成 :code generation(title,abstract);分类 cs.SE

AI总结 本研究探讨了缺陷注释代码如何影响AI编码助手生成缺陷代码,发现其生成缺陷率高达58.17%,并指出需提升AI编码助手的鲁棒性与安全性。

Comments Accepted to the The ACM International Conference on the Foundations of Software Engineering (FSE) (FSE 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15228 2026-02-18 cs.SE 79%

An Empirical Study on the Effects of System Prompts in Instruction-Tuned Models for Code Generation

对指令微调模型在代码生成中系统提示效果的实证研究

Zaiyu Cheng, Antonio Mastropaolo

专题命中 代码生成 :code generation(title,abstract);分类 cs.SE

AI总结 本研究探讨了系统提示对代码生成模型性能的影响,发现提示具体性与模型规模、编程语言等因素相关,且不同语言对提示敏感性存在差异。

Comments 34 pages, 12 tables, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14054 2026-02-17 cs.CL 79%

LogitsCoder: Towards Efficient Chain-of-Thought Path Search via Logits Preference Decoding for Code Generation

LogitsCoder:通过logits偏好解码实现高效的思维链搜索以提升代码生成

Jizheng Chen, Weiming Zhang, Xinyi Dai, Weiwen Liu, Kounianhua Du, Yasheng Wang, Ruiming Tang, Yong Yu, Weinan Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Huawei Noah’s Ark Lab Shanghai(华为诺亚实验室)

专题命中 代码生成 :code generation(title,abstract);分类 cs.CL

AI总结 LogitsCoder通过logit级控制机制提升代码生成的推理效率和质量,实现高效且有效的思维链搜索。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12049 2026-02-13 cs.LG 79%

Improving HPC Code Generation Capability of LLMs via Online Reinforcement Learning with Real-Machine Benchmark Rewards

通过实时强化学习与真实机器基准奖励提升LLM的HPC代码生成能力

Ryo Mikasa, Shun-ichiro Hayashi, Daichi Mukunoki, Tetsuya Hoshino, Takahiro Katagiri

机构 * Department of Computer Science, Nagoya University(名古屋大学计算机科学系) Graduate School of Informatics, Nagoya University(名古屋大学信息科学研究生院) Information Technology Center, Nagoya University(名古屋大学信息技术中心)

专题命中 代码生成 :code generation(title,abstract);分类 cs.LG

AI总结 本研究通过实时强化学习与真实机器基准奖励提升LLM在HPC领域的代码生成能力。

详情

展开后加载摘要…

URL PDF HTML 收藏