arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

共收录 4132 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码生成 4132 篇

2601.06160 2026-04-30 cs.AI 57%

Student Guides Teacher: Weak-to-Strong Inference via Spectral Orthogonal Exploration

学生指导教师:通过频谱正交探索实现弱到强推断

Dayu Wang, Jiaye Yang, Weikang Li, Jiahui Liang, Yang Li, Deguo Xia, Jizhou Huang

机构 * Baidu Inc.(百度公司) Nanyang Technological University(南洋理工大学)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 本文提出Spectral Orthogonal Exploration框架,通过正交探针引入语义异质性推理信号,提升数学推理任务的准确率和采样效率。

Comments Accepted to ACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25521 2026-04-29 cs.AI 57%

Automated Adversarial Collaboration for Advancing Theory Building in the Cognitive Sciences

自动化对抗协作促进认知科学理论构建

Suyog Chandramouli, George Kachergis, Akshay Jagadish

机构 * Department of Psychology, Princeton University(普林斯顿大学心理学系) Department of Psychology, Stanford University(斯坦福大学心理学系) Princeton AI Lab, Princeton University(普林斯顿大学人工智能实验室)

专题命中 代码生成 :program synthesis(abstract);分类 cs.AI

AI总结 本文提出自动化对抗协作框架,通过闭环模拟验证认知科学理论 adjudication,展示了在噪声环境下恢复真实理论的可行性。

Comments 2 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25419 2026-04-29 cs.AI 57%

JURY-RL: Votes Propose, Proofs Dispose for Label-Free RLVR

JURY-RL: 选票提议,证明判定用于无标签的RLVR

Xinjie Chen, Biao Fu, Jing Wu, Guoxin Chen, Xinggao Liu, Dayiheng Liu, Minpeng Liao

机构 * Zhejiang University, Hangzhou, China(浙江大学,杭州,中国) Tongyi Lab, Alibaba Group, Hangzhou, China(通义实验室,阿里巴巴集团,杭州,中国)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 JURY-RL提出一种无标签RLVR框架,通过模型回放提议候选答案,形式验证器判定是否可获正奖,从而稳定训练并提升数学推理性能。

Comments Preprint. 32 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23892 2026-04-28 cs.PF cs.SE 57%

Optimas: An Intelligent Analytics-Informed Generative AI Framework for Performance Optimization

Optimas: 一种基于智能分析的生成式AI框架,用于性能优化

Mohammad Zaeed, Tanzima Z. Islam, Vladimir Indic

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 Optimas通过多代理工作流构建的端到端生成式AI框架,实现了自动化代码优化,通过性能诊断映射到文献支持的代码转换,提升了代码正确性和性能效率。

Comments 11 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23623 2026-04-28 cs.AI 57%

Tandem: Riding Together with Large and Small Language Models for Efficient Reasoning

Tandem: 大小语言模型协同以实现高效的推理

Zichuan Fu, Xian Wu, Guojing Li, Yejing Wang, Yijun Chen, Zihao Zhao, Yixuan Luo, Hanyu Yan, Yefeng Zheng, Xiangyu Zhao

机构 * City University of Hong Kong(香港城市大学) Tencent Jarvis Lab(腾讯Jarvis实验室) Renmin University of China(中国人民大学) Westlake University(西湖大学)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 Tandem通过结合大语言模型和小语言模型,减少计算成本并提升推理质量,实验表明其在数学推理和代码生成任务中性能优越。

Comments ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23580 2026-04-28 cs.RO cs.AI 57%

PhysCodeBench: Benchmarking Physics-Aware Symbolic Simulation of 3D Scenes via Self-Corrective Multi-Agent Refinement

PhysCodeBench: 通过自校正多代理细化进行3D场景的物理感知符号模拟基准测试

Tianyidan Xie, Peiyu Wang, Yuyi Qian, Yuxuan Wang, Rui Ma, Ying Tai, Song Wu, Qian Wang, Lanjun Wang, Zili Yi

机构 * Nanjing University(南京大学) Skywork AI Jilin University(吉林大学) JIUTIAN Research(JIUTIAN研究院) Tianjin University(天津大学)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 本文提出PhysCodeBench,首个评估物理感知符号模拟的基准,包含700个手动构建的样本,通过自校正多代理框架SMRF实现67.7分的性能,优于现有模型31.4分。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06428 2026-04-24 cs.LG 57%

BackPlay: Head-Only Look-Back Self-Correction for Diffusion Language Models

BackPlay:用于扩散语言模型的头部-only回溯自校正

Liming Liu, Binxuan Huang, Zixuan Zhang, Xin Liu, Bing Yin, Tuo Zhao

机构 * Amazon(亚马逊)

专题命中 代码生成 :code generation(abstract);分类 cs.LG

AI总结 BackPlay通过在冻结的生成器上训练轻量级校正头,改进多token解码下的生成质量,利用回溯校正机制减少错误积累。

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19926 2026-04-23 cs.AI 57%

CreativeGame:Toward Mechanic-Aware Creative Game Generation

CreativeGame:迈向机制感知的创意游戏生成

Hongnan Ma, Han Wang, Shenglin Wang, Tieyue Yin, Yiwei Shi, Yucong Huang, Yingtian Zou, Muning Wen, Mengyue Yang

机构 * University of Bristol(布里斯托大学) Shanghai Jiao Tong University(上海交通大学) Shandong University(山东大学) Nanjing University(南京大学) Sreal AI Project(Sreal AI项目)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 本文提出CreativeGame系统,通过机制感知规划循环和跨版本经验积累,实现迭代式HTML5游戏生成,支持可解释的版本间进化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20835 2026-04-23 cs.CL 57%

Parallel-SFT: Improving Zero-Shot Cross-Programming-Language Transfer for Code RL

并行SFT:改进代码RL的零样本跨编程语言转移

Zhaofeng Wu, Shiqi Wang, Boya Peng, Anuj Goyal, Melanie Kambadur, Sebastian Ruder, Yoon Kim, Chloe Bi

机构 * Meta Superintelligence Labs(Meta超智能实验室) MIT(麻省理工学院)

专题命中 代码生成 :code generation(abstract);分类 cs.CL

AI总结 本文提出零样本跨编程语言转移任务,通过并行SFT策略提升代码RL在不同语言间的迁移能力,发现通用化SFT初始化能提升模型泛化性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20507 2026-04-23 cs.PL 57%

Automatic Code and Test Generation of Smart Contracts from Coordination Models

从协调模型自动生成智能合约的代码和测试

Elvis Konjoh Selabi, Maurizio Murgia, António Ravara, Emilio Tuosto

专题命中 代码生成 :code generation(abstract);分类 cs.PL

AI总结 本文提出一种形式化方法,用于指定和实现分布式系统中的去中心化协调,聚焦于智能合约。通过动态角色、数据驱动的转换和外部协调接口,实现对去中心化流程的高层推理,并展示了一个支持形式化模型验证、Solidity代码生成和自动化测试合成的工具链。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19247 2026-04-22 cs.HC cs.MA cs.SE 57%

BONSAI: A Mixed-Initiative Workspace for Human-AI Co-Development of Visual Analytics Applications

BONSAI:一种混合初始化的工作空间,用于人机协同开发可视化分析应用

Thilo Spinner, Matthias Miller, Fabian Sperrle-Roth, Mennatallah El-Assady

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 BONSAI通过模块化四层架构和四阶段开发流程,结合人类和AI开发者的自主性,实现高效可视化分析应用的开发与重构。

Comments 9 pages paper, 2 pages references, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19142 2026-04-22 cs.SE cs.CY 57%

Towards More Empathic Programming Environments: An Experimental Empathic AI-Enhanced IDE

迈向更富有同理心的编程环境:一项实验性同理心增强的IDE

Justin Rainier Go, Kurt Christian Andaya, Roemer Gabriel Caliboso, Aaron Daniel Go, Jocelynn Cu

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 本文通过对比实验探讨同理心增强IDE对初学者编程学习的影响,发现虽无显著差异,但同理心响应在错误纠正中更具帮助性。

Comments Accepted for oral presentation at Philippine Computing Science Congress 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18593 2026-04-22 cs.PL 57%

HELIX: Verified compilation of cyber-physical control systems to LLVM IR

HELIX:将网络物理控制系统验证性编译为LLVM IR

Vadim Zaliva, Yannick Zakowski, Ilia Zaichuk, Valerii Huhnin, Calvin Beck, Irene Yoon, Steve Zdancewic

专题命中 代码生成 :code generation(abstract);分类 cs.PL

AI总结 HELIX通过代数变换将高性能量算转换为LLVM IR,结合形式化验证确保代码正确性,展示从数学描述到高效实现的全过程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14164 2026-04-22 cs.CL 57%

How to Fine-Tune a Reasoning Model? A Teacher-Student Cooperation Framework to Synthesize Student-Consistent SFT Data

如何微调一个推理模型?一种教师-学生合作框架来合成学生一致的SFT数据

Zixian Huang, Kaichen Yang, Xu Huang, Feiyang Hao, Qiming Ge, Bowen Li, He Du, Kai Chen, Qipeng Guo

机构 * Shanghai AI Laboratory(上海人工智能实验室) Dalian University of Technology(大连理工大学) Nanjing University(南京大学)

专题命中 代码生成 :code generation(abstract);分类 cs.CL

AI总结 本文提出TESSY框架,通过交替生成风格和非风格标记,解决教师生成数据与学生分布之间的风格差异问题,提升推理模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01375 2026-04-22 cs.AI 57%

RIFT: A RubrIc Failure Mode Taxonomy and Automated Diagnostics

RIFT:一种基于Rubric的故障模式分类和自动诊断

Zhengyang Qi, Charles Dickens, Derek Pham, Amanda Dsouza, Armin Parchami, Frederic Sala, Paroma Varma

机构 * Snorkel AI University of Wisconsin–Madison(威斯康星大学麦迪逊分校)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 本文提出RIFT框架,通过系统化分类rubric的故障模式,提升评估的可靠性与有效性,通过人类标注和自动指标验证了其一致性与实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17989 2026-04-21 cs.AI 57%

AIT Academy: Cultivating the Complete Agent with a Confucian Three-Domain Curriculum

AIT Academy:通过儒家三领域课程培养完整智能体

Jiaqi Li, Lvyang Zhang, Yang Zhao, Wen Lu, Lidong Zhai

机构 * Institute of Information Engineering, Chinese Academy of Sciences, Beijing, China(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences, Beijing, China(中国科学院大学网络安全学院)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 本文提出AIT Academy框架,通过儒家三领域课程培养完整智能体,实验显示多领域视角在安全意识校准中有诊断价值。

Comments 11 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02264 2026-04-21 cs.CL 57%

CoDial: Interpretable Task-Oriented Dialogue Systems Through Dialogue Flow Alignment

通过对话流程对齐构建可解释的任务导向对话系统:CoDial

Radin Shayanfar, Chu Fei Luo, Rohan Bhambhoria, Samuel Dahan, Xiaodan Zhu

机构 * Department of Electrical and Computer Engineering & Ingenuity Labs, Queen’s University(电气与计算机工程系及Ingenuity实验室,女王大学) Conflict Analytics Lab, Queen’s University(冲突分析实验室,女王大学) Cornell Law School(康奈尔法学院) Vector Institute for AI(人工智能向量研究所)

专题命中 代码生成 :code generation(abstract);分类 cs.CL

AI总结 CoDial通过将预定义任务 schema 转换为结构化异构图并生成程序化 LLM 防御代码,实现对话策略的高效可解释对齐,提升任务导向对话系统的泛化能力与可解释性。

Comments Accepted to ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17696 2026-04-21 cs.AI 57%

Stratagem: Learning Transferable Reasoning via Trajectory-Modulated Game Self-Play

战略:通过轨迹调节的游戏自我对战学习可转移的推理

Xiachong Feng, Deyi Yin, Xiaocheng Feng, Yi Jiang, Libo Qin, Yangfan Ye, Lei Huang, Weitao Ma, Qiming Li, Yuxuan Gu, Bing Qin, Lingpeng Kong

机构 * The University of Hong Kong(香港大学) Harbin Institute of Technology(哈尔滨工业大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 本文提出STRATAGEM,通过轨迹调节游戏自我对战学习可转移的推理,解决领域特定性和上下文停滞问题,提升数学推理和代码生成等任务的性能。

Comments ACL 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17351 2026-04-21 cs.AI 57%

SOCIA-EVO: Automated Simulator Construction via Dual-Anchored Bi-Level Optimization

SOCIA-EVO: 通过双锚点双层优化实现自动模拟器构建

Yuncheng Hua, Sion Weatherhead, Mehdi Jafari, Hao Xue, Flora D. Salim

机构 * School of Computer Science and Engineering, University of New South Wales(新南威尔士大学计算机科学与工程学院)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 本文提出SOCIA-EVO框架,通过双锚点双层优化解决长周期LLM代理中的上下文漂移和优化不稳定问题,生成统计上与观测数据一致的模拟器。

Comments This paper has been accepted to the ACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15485 2026-04-20 cs.SE 57%

LLM4C2Rust: Large Language Models for Automated Memory-Safe Code Transpilation

LLM4C2Rust: 利用大型语言模型实现自动内存安全代码转译

Sarah Bedell, Nazanin Siavash, Armin Moin

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 本文提出基于检索增强生成的框架,利用大型语言模型与小型语言模型结合,实现C/C++到Rust的转译,提升内存安全性。实验表明该方法能有效提高代码正确性和安全性,减少原始指针解引用和不安全类型转换。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15375 2026-04-20 cs.AR cs.AI cs.CR 57%

VeriCWEty: Embedding enabled Line-Level CWE Detection in Verilog

VeriCWEty: 基于嵌入的RTL代码中行级CWE检测

Prithwish Basu Roy, Zeng Wang, Anatolii Chuvashlov, Weihua Xiao, Johann Knechtel, Ozgur Sinanoglu, Ramesh Karri

机构 * NYU Tandon School of Engineering(纽约大学Tandon工程学院) NYU Abu Dhabi Center for Cyber Security(纽约大学阿布扎赫德分校网络安全中心)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 本文提出一种基于嵌入的RTL代码中行级CWE检测框架,通过高精度识别常见CWE并定位行级漏洞,达到89%的CWE识别精度和96%的行级漏洞检测准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15001 2026-04-20 cs.AI 57%

COEVO: Co-Evolutionary Framework for Joint Functional Correctness and PPA Optimization in LLM-Based RTL Generation

COEVO:用于LLM基于RTL生成中功能正确性与PPA优化的联合进化框架

Heng Ping, Peiyu Zhang, Shixuan Li, Wei Yang, Anzhe Cheng, Shukai Duan, Xiaole Zhang, Paul Bogdan

机构 * University of Southern California(南加州大学)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 本文提出COEVO框架,通过联合优化功能正确性与PPA,在单个进化循环中统一两者目标,提升RTL生成效率与性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20633 2026-04-20 cs.AI 57%

Seed1.8 Model Card: Towards Generalized Real-World Agency

Seed1.8 模型卡:迈向通用的现实世界代理

Bytedance Seed

机构 * Bytedance Seed(字节跳动Seed)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 Seed1.8 模型旨在实现通用的现实世界代理能力,支持多轮交互、工具使用和多步骤执行,同时保持大语言模型和视觉语言性能,并提供统一的代理接口。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13092 2026-04-16 cs.SE 57%

PlanCompiler: A Deterministic Compilation Architecture for Structured Multi-Step LLM Pipelines

PlanCompiler:一种确定性编译架构用于结构化多步骤LLM流水线

Pranav Harikumar

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 PlanCompiler通过类型节点注册表、静态图验证和确定性编译分离规划与执行,提升结构化LLM流水线的可靠性与效率,实现高成功率和成本效益。

Comments 31 pages, 1 figure, 7 tables, includes appendices and reproduction details

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13062 2026-04-16 cs.CL 57%

Mathematical Reasoning Enhanced LLM for Formula Derivation: A Case Study on Fiber NLI Modellin

增强数学推理的LLM用于公式推导:光纤非线性干扰建模的案例研究

Yao Zhang, Yuchen Song, Xiao Luo, Shengnan Li, Xiaotian Jiang, Min Zhang, Danshi Wang

专题命中 代码生成 :code generation(abstract);分类 cs.CL

AI总结 本文提出一种增强数学推理的生成AI方法,用于光学通信公式推导,聚焦光纤非线性干扰建模,通过结构化提示引导LLM推导出已知闭式ISRS GN表达式并推导出适用于多段C和C+L波段传输的新近似式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05056 2026-04-16 cs.LG 57%

Modeling Student Learning with 3.8 Million Program Traces

用380万条程序轨迹建模学生学习

Alexis Ross, Megha Srivastava, Jeremiah Blanchard, Jacob Andreas

机构 * MIT CSAIL(麻省理工学院计算机科学与人工智能实验室) Stanford University(斯坦福大学) University of Florida(佛罗里达大学)

专题命中 代码生成 :code generation(abstract);分类 cs.LG

AI总结 本文通过分析380万条程序轨迹,探讨训练语言模型以理解学生编程行为及学习过程,发现基于真实轨迹的模型能更准确预测学生行为并生成更正确的代码。

Comments Accepted to 27th International Conference on AI in Education (AIED 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15671 2026-04-16 cs.SE 57%

BugScope: Learn to Find Bugs Like Human

BugScope: 像人类一样学习查找错误

Jinyao Guo, Chengpeng Wang, Dominic Deluca, Jinjie Liu, Zhuo Zhang, Xiangyu Zhang

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 BugScope通过模仿人类审计员学习特定错误模式的方式,提出了一种基于三个步骤的代码审计框架,实现了87%的F1分数,优于现有工具。

Comments 22 pages, 3 figures, 10 tables, 4 listings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12898 2026-04-15 cs.AI math.CO 57%

BEAM: Bi-level Memory-adaptive Algorithmic Evolution for LLM-Powered Heuristic Design

BEAM:基于LLM的双层记忆自适应算法进化用于启发式设计

Chuyang Xiang, Yichen Wei, Jiale Ma, Handing Wang, Junchi Yan

机构 * IEEE

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 BEAM通过双层优化方法,结合遗传算法和MCTS,改进LLM驱动的启发式设计,有效提升复杂代码生成效率,实验显示在CVRP混合算法设计中优化差距减少37.84%。

Comments 24 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12253 2026-04-15 cs.PL 57%

The Search for Constrained Random Generators

寻找受限随机生成器

Harrison Goldstein, Hila Peleg, Cassia Torczon, Daniel Sainati, Leonidas Lampropoulos, Benjamin C. Pierce

专题命中 代码生成 :program synthesis(abstract);分类 cs.PL

AI总结 本文提出利用演绎程序合成思想,通过生成器的指称语义设计出自动合成正确生成器的规则,解决属性驱动测试中的受限随机生成问题,提升测试用例的有效性。

Comments Published at PLDI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12214 2026-04-15 cs.SE 57%

Structural Anchors and Reasoning Fragility:Understanding CoT Robustness in LLM4Code

结构锚点与推理脆弱性:理解LLM4Code中的CoT鲁棒性

Yang Liu, Da Song, Armstrong Foundjem, Heng Li, Foutse Khomh

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 本文研究了CoT提示在LLM4Code中的鲁棒性,通过系统扰动分析发现其性能依赖于模型家族、任务结构和提示明确性,并识别出三种轨迹变形模式。

详情

展开后加载摘要…

URL PDF HTML 收藏