arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

共收录 12165 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码生成 4106 篇

2512.08951 2025-12-11 cs.NE cs.AI cs.GR 57%

AI Co-Artist: A LLM-Powered Framework for Interactive GLSL Shader Animation Evolution

AI共艺术家:一种基于大语言模型的交互式GLSL着色器动画进化的框架

Kamer Ali Yuksel, Hassan Sawaf

机构 * aiXplain Inc.(aiXplain公司)

专题命中 代码生成 :program synthesis(abstract);分类 cs.AI

AI总结 AI Co-Artist利用大语言模型降低GLSL着色器创作门槛,通过直观交互实现视觉艺术的进化与生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08266 2025-12-10 cs.SE 57%

Token Sugar: Making Source Code Sweeter for LLMs through Token-Efficient Shorthand

Token Sugar:通过高效的token缩写使源代码更甜

Zhensu Sun, Chengran Yang, Xiaoning Du, Zhou Yang, Li Li, David Lo

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 Token Sugar通过高效的token缩写减少源代码的token数量,提升LLM在代码生成中的效率和性能。

Comments Accepted by ASE'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08213 2025-12-10 cs.SE 57%

Secure or Suspect? Investigating Package Hallucinations of Shell Command in Original and Quantized LLMs

安全还是可疑?探究原始和量化LLM生成的shell命令中的包幻觉

Md Nazmul Haque, Elizabeth Lin, Lawrence Arkoh, Biruk Tadesse, Bowen Xu

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 研究探讨量化对LLM生成Go包中包幻觉和安全风险的影响,发现量化降低精度会增加幻觉率和漏洞风险,揭示LLM生成依赖项的系统性错误模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06442 2025-12-09 cs.PL 57%

Nice to Meet You: Synthesizing Practical MLIR Abstract Transformers

Nice to Meet You: 合成实用MLIR抽象转换器

Xuanyu Peng, Dominic Kennedy, Yuyou Fan, Ben Greenman, John Regehr, Loris D'Antoni

专题命中 代码生成 :program synthesis(abstract);分类 cs.PL

AI总结 NiceToMeetYou通过批量自动化合成准确且高效的MLIR抽象转换器,提升编译器的精度和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04478 2025-12-09 cs.AI cs.GT econ.TH 57%

Matching Markets Meet LLMs: Algorithmic Reasoning with Ranked Preferences

匹配市场与大语言模型:基于排名偏好的算法推理

Hadi Hosseini, Samarth Khanna, Ronak Singh

机构 * Penn State University(宾夕法尼亚州立大学)

专题命中 代码生成 :program synthesis(abstract);分类 cs.AI

AI总结 本文研究了大语言模型在处理基于排名偏好的匹配市场问题时的局限性,发现其在解决大规模不稳定性方面存在不足,并探讨了参数高效微调对小规模市场的效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12723 2025-12-05 cs.CL 57%

On-Policy Optimization with Group Equivalent Preference for Multi-Programming Language Understanding

基于组等价偏好的多编程语言理解的在线优化

Haoyuan Wu, Rui Ming, Jilong Gao, Hangyu Zhao, Xueyi Chen, Yikai Yang, Haisheng Zheng, Zhuolun He, Bei Yu

机构 * The Chinese University of Hong Kong(香港中文大学) ChatEDA Tech(ChatEDA科技)

专题命中 代码生成 :code generation(abstract);分类 cs.CL

AI总结 本文提出OORL框架和GEPO方法,通过代码翻译任务提升LLMs对多编程语言代码功能的理解和跨语言关系的认知。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04555 2025-12-05 cs.CL 57%

ADAPT: Learning Task Mixtures for Budget-Constrained Instruction Tuning

ADAPT:为预算受限的指令微调学习任务混合

Pritam Kadasi, Abhishek Upperwal, Mayank SIngh

机构 * Lingo Research Group, Indian Institute of Technology Gandhinagar(林戈研究组,印度理工学院冈德hinagar分校) Soket AI(Soket人工智能)

专题命中 代码生成 :code generation(abstract);分类 cs.CL

AI总结 ADAPT通过学习任务采样比例优化预算受限的指令微调,提升下游任务性能并更高效地分配训练资源。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19051 2025-12-05 cs.CV cs.AI cs.MM 57%

Multimodal Markup Document Models for Graphic Design Completion

多模态标记文档模型用于图形设计完成

Kotaro Kikuchi, Ukyo Honda, Naoto Inoue, Mayu Otani, Edgar Simo-Serra, Kota Yamaguchi

机构 * Waseda University(早稻田大学)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 MarkupDM是一种多模态标记文档模型,通过统一处理图形设计任务,实现文本、图像和属性值的完成,展示了其在设计自动化中的广泛适用性。

Comments Accepted by ACM Multimedia 2025, Project page: https://cyberagentailab.github.io/MarkupDM/

Journal ref Proceedings of the 33rd ACM International Conference on Multimedia. 2025. p.11022-11031

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03272 2025-12-04 cs.AI 57%

When Do Symbolic Solvers Enhance Reasoning in Large Language Models?

符号求解器在大语言模型中增强推理何时有效?

Zhiyuan He, Dingmin Wang

机构 * University College London(伦敦大学学院) University of Oxford(牛津大学)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 本文研究符号求解器如何在大语言模型中增强推理,发现其在需要有限隐式推理但具有充足搜索空间的问题中表现优异,尤其在约束满足问题中提升显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02874 2025-12-03 cs.CL 57%

Think in Parallel, Answer as One: Logit Averaging for Open-Ended Reasoning

并行思考,一答为终:用于开放性推理的Logit平均

Haonan Wang, Chao Du, Kenji Kawaguchi, Tianyu Pang

机构 * National University of Singapore(新加坡国立大学) Sea AI Lab(Sea AI实验室)

专题命中 代码生成 :code generation(abstract);分类 cs.CL

AI总结 ThinkMerge通过并行推理轨迹的logit平均提升开放式推理性能,适用于代码生成和网络深度研究等任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02812 2025-12-03 cs.AI 57%

Enhancing Automated Paper Reproduction via Prompt-Free Collaborative Agents

通过无提示协作代理增强自动论文复现

Zijie Lin, Qilin Cai, Liang Shen, Mingjun Xiao

机构 * University of Science and Technology of China(中国科学技术大学) Meituan(美团)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 本文提出一种无提示协作代理框架,通过验证和细化代理提升论文到代码生成的准确性和完整性,实验显示性能提升约15%和13%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02337 2025-12-03 cs.LG 57%

SpecPV: Improving Self-Speculative Decoding for Long-Context Generation via Partial Verification

SpecPV:通过部分验证改进长上下文生成的自我推测解码

Zhendong Tan, Xingjun Zhang, Chaoyi Hu, Junjie Peng, Kun Xia

机构 * School of Computer Science and Technology, Xi'an Jiaotong University, Xi'an, China(计算机科学与技术学院,西安交通大学,西安,中国)

专题命中 代码生成 :code generation(abstract);分类 cs.LG

AI总结 SpecPV通过部分验证和周期性完整验证提升长上下文生成效率,实现6倍解码加速

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20793 2025-12-02 cs.CV cs.AI 57%

Rendering-Aware Reinforcement Learning for Vector Graphics Generation

面向渲染的强化学习用于矢量图形生成

Juan A. Rodriguez, Haotian Zhang, Abhay Puri, Aarash Feizi, Rishav Pramanik, Pascal Wichmann, Arnab Mondal, Mohammad Reza Samsami, Rabiul Awal, Perouz Taslakian, Spandana Gella, Sai Rajeswar, David Vazquez, Christopher Pal, Marco Pedersoli

机构 * ServiceNow Research(ServiceNow研究机构) Mila ÉTS Montréal(蒙特利尔ÉTS) Polytechnique Montréal(蒙特利尔Polytechnique) Columbia University(哥伦比亚大学) Stony Brook University(石溪大学) Apple(苹果公司) Google Research(谷歌研究) Canada CIFAR AI Chair(加拿大CIFAR人工智能主席) McGill University(麦吉尔大学)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 本文提出RLRF方法,通过利用渲染反馈提升自回归VLMs中SVG生成的准确性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.02203 2025-12-02 cs.AI 57%

GraphIC: A Graph-Based In-Context Example Retrieval Model for Multi-Step Reasoning

GraphIC: 一种基于图的上下文示例检索模型用于多步推理

Jiale Fu, Yaqing Wang, Simeng Han, Jiaming Fan, Xu Yang

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 GraphIC是一种基于图的上下文示例检索模型,通过推理意识的表示和专门相似性度量提升LLM在多步推理中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00214 2025-12-02 cs.CL 57%

Towards Corpus-Grounded Agentic LLMs for Multilingual Grammatical Analysis

迈向基于语料库的代理LLM用于多语言语法分析

Matej Klemen, Tjaša Arčon, Luka Terčon, Marko Robnik-Šikonja, Kaja Dobrovoljc

机构 * University of Ljubljana, Faculty of Computer and Information Science(卢布尔雅那大学计算机与信息科学学院) University of Ljubljana, Faculty of Arts(卢布尔雅那大学艺术学院) Jožef Stefan Institute(乔塞夫·斯塔芬研究所)

专题命中 代码生成 :code generation(abstract);分类 cs.CL

AI总结 本文提出基于语料库的代理LLM框架,用于多语言语法分析,通过数据驱动推理提升语法探究的可解释性和扩展性。

Comments Pre-print, submission under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20656 2025-11-27 cs.HC cs.AI 57%

Context-Aware Visual Prompting: Automating Geospatial Web Dashboards with Large Language Models and Agent Self-Validation for Decision Support

基于上下文的视觉提示:利用大语言模型和代理自我验证自动化地理空间网络看板

Haowen Xu, Jose Tupayachi, Xiao-Ying Yu

机构 * Computational Urban Sciences Group, Oak Ridge National Laboratory(计算城市科学组,橡树岭国家实验室) Materials Science and Technology Division, Oak Ridge National Laboratory(材料科学与技术 division,橡树岭国家实验室) Industrial and Systems Engineering, The University of Tennessee, Knoxville(工业与系统工程,田纳西大学, Knoxville)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 本文提出基于大语言模型和代理自我验证的地理空间看板自动化框架,通过上下文感知视觉提示提升风险分析和决策支持的可视化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18964 2025-11-25 cs.AI 57%

Synthesizing Visual Concepts as Vision-Language Programs

合成视觉概念作为视觉-语言程序

Antonia Wüst, Wolfgang Stammer, Hikaru Shindo, Lukas Helff, Devendra Singh Dhami, Kristian Kersting

专题命中 代码生成 :program synthesis(abstract);分类 cs.AI

AI总结 本研究提出视觉-语言程序(VLP),结合视觉模型的感知灵活性与程序合成的系统推理能力,通过生成结构化视觉描述并编译成神经符号程序,提升复杂逻辑推理任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18867 2025-11-25 cs.SE 57%

VecIntrinBench: Benchmarking Cross-Architecture Intrinsic Code Migration for RISC-V Vector

VecIntrinBench: 跨架构内在代码迁移的RISC-V向量基准测试

Liutong Han, Chu Kang, Mingjie Xing, Yanjun Wu

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 VecIntrinBench是首个评估RISC-V向量扩展内在代码迁移能力的基准,包含50个函数级任务,通过标量、RVV、Arm Neon和x86内在函数进行测试,揭示LLM在代码迁移中的表现及优化方向。

Comments 5 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18597 2025-11-25 cs.CL 57%

Toward Trustworthy Difficulty Assessments: Large Language Models as Judges in Programming and Synthetic Tasks

迈向可信的难度评估:大型语言模型作为编程和合成任务的裁判

H. M. Shadman Tabib, Jaber Ahmed Deedar

机构 * Department of Computer Science, Bangladesh University of Engineering and Technology(计算机科学系,孟加拉国工程与技术大学)

专题命中 代码生成 :code generation(abstract);分类 cs.CL

AI总结 本文研究了大型语言模型在评估编程问题难度时的可靠性,发现LightGBM在准确性上显著优于GPT-4o,揭示了模型在处理数字约束方面的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18405 2025-11-25 cs.AI cs.HC cs.IR 57%

A Multimodal Conversational Agent for Tabular Data Analysis

面向表格数据分析的多模态对话代理

Mohammad Nour Al Awad, Sergey Ivanov, Olga Tikhonova, Ivan Khodnenko

机构 * ITMO University(ITMO大学)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 Talk2Data是一种多模态对话代理,通过语音和文本交互实现表格数据分析,结合LLM、ASR、代码生成和TTS技术,提供多轮对话和可验证计算。

Comments \c{opyright} 2025 IEEE. Personal use of this material is permitted. Permission from IEEE must be obtained for all other uses

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17876 2025-11-25 cs.AI 57%

Training Emergent Joint Associations: A Reinforcement Learning Approach to Creative Thinking in Language Models

训练涌现的联合关联:一种基于强化学习的创造性思维方法用于语言模型

Mukul Singh, Ananya Singha, Aishni Parab, Pronita Mehrotra, Sumit Gulwani

机构 * Microsoft, USA(微软公司) Microsoft, India(微软公司) University of California, Los Angeles, USA(加州大学洛杉矶分校) MindAntix

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 本文提出了一种基于强化学习的框架,通过增强语言模型的关联性思维能力,提升其在故事创作、代码生成和数据可视化等任务中的原创性和灵活性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17683 2025-11-25 cs.CY cs.AI 57%

Datacenters in the Desert: Feasibility and Sustainability of LLM Inference in the Middle East

沙漠中的数据中心:中东地区大型语言模型推理的可行性与可持续性

Lara Hassan, Mohamed ElZeftawy, Abdulrahman Mahmoud

机构 * Department of Computer Science(计算机科学系) MBZUAI(马斯克大学人工智能研究所)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 本文研究了在中东沙漠地区部署大型语言模型推理数据中心的可行性与可持续性,通过实证分析能耗和碳足迹,评估不同地理区域的气候意识AI部署策略。

Comments 3 pages, 1 figure

Journal ref DCEE-2025@ISCA-2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23535 2025-11-25 cs.SE 57%

Comparative Analysis of the Code Generated by Popular Large Language Models (LLMs) for MISRA C++ Compliance

对流行大语言模型生成的代码在MISRA C++合规性方面的比较分析

Malik Muhammad Umer

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 本文比较了多种大语言模型生成的C++代码在MISRA C++合规性上的表现,发现ChatGPT在合规性上表现最佳,而其他模型存在不同程度的违规问题。

Journal ref in IEEE Access, vol. 13, pp. 194815-194831, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10949 2025-11-17 cs.MA cs.AI 57%

Exposing Weak Links in Multi-Agent Systems under Adversarial Prompting

Nirmit Arora, Sathvik Joel, Ishan Kavathekar, Palak, Rohan Gandhi, Yash Pandya, Tanuja Ganu, Aditya Kanade, Akshay Nambi

机构 * Microsoft Research(微软研究院)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

Comments 10 pages, 3 figures. Code available at https://github.com/microsoft/SafeAgents

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09880 2025-11-14 cs.CL cs.CR 57%

EnchTable: Unified Safety Alignment Transfer in Fine-tuned Large Language Models

Jialin Wu, Kecen Li, Zhicong Huang, Xinfeng Li, Xiaofeng Wang, Cheng Hong

机构 * Ant Group(蚂蚁集团) Nanyang Technological University(南洋理工大学)

专题命中 代码生成 :code generation(abstract);分类 cs.CL

Comments Accepted by IEEE Symposium on Security and Privacy (S&P) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09804 2025-11-14 cs.AI 57%

SlideBot: A Multi-Agent Framework for Generating Informative, Reliable, Multi-Modal Presentations

Eric Xie, Danielle Waterfield, Michael Kennedy, Aidong Zhang

专题命中 代码生成 :code generation(abstract);分类 cs.AI

Comments 32 pages, 14 figures, accepted into EAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09092 2025-11-13 cs.AI math.OC 57%

OR-R1: Automating Modeling and Solving of Operations Research Optimization Problem via Test-Time Reinforcement Learning

Zezhen Ding, Zhen Tan, Jiheng Zhang, Tianlong Chen

专题命中 代码生成 :code generation(abstract);分类 cs.AI

Comments 9 pages, 5 figures, AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01634 2025-11-13 cs.CR cs.AI 57%

Prompt Injection as an Emerging Threat: Evaluating the Resilience of Large Language Models

Daniyal Ganiuly, Assel Smaiyl

专题命中 代码生成 :code generation(abstract);分类 cs.AI

Comments 10 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02609 2025-11-12 cs.SE 57%

RedCodeAgent: Automatic Red-teaming Agent against Diverse Code Agents

Chengquan Guo, Chulin Xie, Yu Yang, Zhaorun Chen, Zinan Lin, Xander Davies, Yarin Gal, Dawn Song, Bo Li

专题命中 代码生成 :code generation(abstract);分类 cs.SE

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12006 2025-11-12 cs.AI 57%

SOCIA-$\nabla$: Textual Gradient Meets Multi-Agent Orchestration for Automated Simulator Generation

Yuncheng Hua, Sion Weatherhead, Mehdi Jafari, Hao Xue, Flora D. Salim

机构 * School of Computer Science Engineering, University of New South Wales(计算机科学工程学院,新南威尔士大学)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

Comments 11 pages, 1 figure, 2 tables. The paper is under review

详情

展开后加载摘要…

URL PDF HTML 收藏