arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

2025-12-09 至 2025-12-09 共收录 19 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码生成 6 篇

2510.19296 2025-12-09 cs.LG cs.AR cs.PL 81%

QiMeng-SALV: Signal-Aware Learning for Verilog Code Generation

QiMeng-SALV:面向Verilog代码生成的信号感知学习

Yang Zhang, Rui Zhang, Jiaming Guo, Lei Huang, Di Huang, Yunpu Zhao, Shuyao Cheng, Pengwei Jin, Chongxiao Li, Zidong Du, Xing Hu, Qi Guo, Yunji Chen

机构 * State Key Lab of Processors, Institute of Computing Technology, CAS(处理器国家重点实验室,计算技术研究所,中国科学院) University of Chinese Academy of Sciences(中国科学院大学) University of Science and Technology of China(中国科学技术大学)

专题命中 代码生成 :code generation(title,abstract);分类 cs.LG、cs.PL

AI总结 QiMeng-SALV通过信号感知学习提升Verilog代码生成的准确性与性能,采用信号级优化解决功能奖励不足问题。

Comments Accepted to NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.20964 2025-12-09 cs.CL cs.AI cs.OS cs.PL cs.SE 77%

OSVBench: Benchmarking LLMs on Specification Generation Tasks for Operating System Verification

OSVBench:用于操作系统验证的大型语言模型规范生成基准测试

Shangyu Li, Juyong Jiang, Tiancheng Zhao, Jiasi Shen

专题命中 代码生成 :code generation(abstract);program synthesis(abstract);分类 cs.SE、cs.CL、cs.AI

AI总结 OSVBench通过长上下文任务评估LLMs在操作系统验证中的规范生成能力,揭示现有模型在复杂代码生成任务中的性能差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07666 2025-12-09 cs.CL cs.SE 62%

Bridging Code Graphs and Large Language Models for Better Code Understanding

连接代码图与大型语言模型以实现更好的代码理解

Zeqi Chen, Zhaoyang Chu, Yi Gui, Feng Guo, Yao Wan, Chuan Shi

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Huazhong University of Science and Technology(华中科技大学)

专题命中 代码生成 :code generation(abstract);分类 cs.SE、cs.CL

AI总结 CGBridge通过引入外部Bridge模块,提升LLMs对代码结构语义的理解,显著提高代码生成和翻译任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06678 2025-12-09 cs.LG cs.AI 62%

GradientSpace: Unsupervised Data Clustering for Improved Instruction Tuning

GradientSpace: 无监督数据聚类以提升指令微调

Shrihari Sridharan, Deepak Ravikumar, Anand Raghunathan, Kaushik Roy

专题命中 代码生成 :code generation(abstract);分类 cs.AI、cs.LG

AI总结 GradientSpace通过直接在梯度空间中聚类样本,提升指令微调效果,减少推理延迟并提高准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06442 2025-12-09 cs.PL 57%

Nice to Meet You: Synthesizing Practical MLIR Abstract Transformers

Nice to Meet You: 合成实用MLIR抽象转换器

Xuanyu Peng, Dominic Kennedy, Yuyou Fan, Ben Greenman, John Regehr, Loris D'Antoni

专题命中 代码生成 :program synthesis(abstract);分类 cs.PL

AI总结 NiceToMeetYou通过批量自动化合成准确且高效的MLIR抽象转换器,提升编译器的精度和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04478 2025-12-09 cs.AI cs.GT econ.TH 57%

Matching Markets Meet LLMs: Algorithmic Reasoning with Ranked Preferences

匹配市场与大语言模型:基于排名偏好的算法推理

Hadi Hosseini, Samarth Khanna, Ronak Singh

机构 * Penn State University(宾夕法尼亚州立大学)

专题命中 代码生成 :program synthesis(abstract);分类 cs.AI

AI总结 本文研究了大语言模型在处理基于排名偏好的匹配市场问题时的局限性,发现其在解决大规模不稳定性方面存在不足,并探讨了参数高效微调对小规模市场的效果。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 3 篇

2509.23045 2025-12-09 cs.AI cs.CL cs.SE 67%

Kimi-Dev: Agentless Training as Skill Prior for SWE-Agents

Kimi-Dev:无代理训练作为SWE-代理的技能先验

Zonghan Yang, Shengjie Wang, Kelin Fu, Wenyang He, Weimin Xiong, Yibo Liu, Yibo Miao, Bofei Gao, Yejie Wang, Yingwei Ma, Yanhao Li, Yue Liu, Zhenxing Hu, Kaitai Zhang, Shuyi Wang, Huarong Chen, Flood Sung, Yang Liu, Yang Gao, Zhilin Yang, Tianyu Liu

机构 * Moonshot AI THU(清华大学) PKU(北京大学) UCAS(中国科学技术大学) BUPT(北京邮电大学) NUS(新加坡国立大学)

专题命中 软件智能体 :coding agent(abstract);分类 cs.SE、cs.CL、cs.AI

AI总结 Kimi-Dev通过无代理训练生成技能先验,使SWE-代理在SWE-bench Verified上取得60.4%的优异成绩,并通过额外SFT适应达到48.6%的pass@1,与Claude 3.5 Sonnet相当。

Comments 68 pages. GitHub repo at https://github.com/MoonshotAI/Kimi-Dev

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18538 2025-12-09 cs.SE cs.CL 62%

From Code Foundation Models to Agents and Applications: A Comprehensive Survey and Practical Guide to Code Intelligence

从代码基础模型到代理与应用:全面综述与代码智能的实用指南

Jian Yang, Xianglong Liu, Weifeng Lv, Ken Deng, Shawn Guo, Lin Jing, Yizhi Li, Shark Liu, Xianzhen Luo, Yuyu Luo, Changzai Pan, Ensheng Shi, Yingshui Tan, Renshuai Tao, Jiajun Wu, Xianjie Wu, Zhenhe Wu, Daoguang Zan, Chenchen Zhang, Wei Zhang, He Zhu, Terry Yue Zhuo, Kerui Cao, Xianfu Cheng, Jun Dong, Shengjie Fang, Zhiwei Fei, Xiangyuan Guan, Qipeng Guo, Zhiguang Han, Joseph James, Tianqi Luo, Renyuan Li, Yuhang Li, Yiming Liang, Congnan Liu, Jiaheng Liu, Qian Liu, Ruitong Liu, Tyler Loakman, Xiangxin Meng, Chuang Peng, Tianhao Peng, Jiajun Shi, Mingjie Tang, Boyang Wang, Haowen Wang, Yunli Wang, Fanglin Xu, Zihan Xu, Fei Yuan, Ge Zhang, Jiayi Zhang, Xinhao Zhang, Wangchunshu Zhou, Hualei Zhu, King Zhu, Bryan Dai, Aishan Liu, Zhoujun Li, Chenghua Lin, Tianyu Liu, Chao Peng, Kai Shen, Libo Qin, Shuangyong Song, Zizheng Zhan, Jiajun Zhang, Jie Zhang, Zhaoxiang Zhang, Bo Zheng

专题命中 软件智能体 :coding agent(abstract);分类 cs.SE、cs.CL

AI总结 本文综述了代码基础模型到代理的应用,分析了代码LLM的完整生命周期,并通过实验探讨了其性能优化与实际应用中的挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06031 2025-12-09 physics.flu-dyn cs.LG physics.comp-ph 57%

Multi-resolution Physics-Aware Recurrent Convolutional Neural Network for Complex Flows

多分辨率物理感知递归卷积神经网络用于复杂流体

Xinlun Cheng, Joseph Choi, H. S. Udaykumar, Stephen Baek

机构 * School of Data Science, University of Virginia(数据科学学院,弗吉尼亚大学) Department of Mechanical Engineering, University of Iowa(机械工程系,爱荷华大学) Department of Mechanical and Aerospace Engineering, University of Virginia(机械与航空航天工程系,弗吉尼亚大学)

专题命中 软件智能体 :repository(abstract);分类 cs.LG

AI总结 MRPARCv2通过多分辨率架构和物理约束提升复杂流体模拟精度与效率,显著优于单分辨率模型。

Journal ref APL Mach. Learn. 3, 046110 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 程序修复 1 篇

2506.14683 2025-12-09 cs.SE cs.AI 62%

Unified Software Engineering Agent as AI Software Engineer

统一软件工程代理作为AI软件工程师

Leonhard Applis, Yuntong Zhang, Shanchao Liang, Nan Jiang, Lin Tan, Abhik Roychoudhury

机构 * National University of Singapore(新加坡国立大学) Purdue University(普渡大学)

专题命中 程序修复 :repository(abstract);分类 cs.SE、cs.AI

AI总结 本文提出统一软件工程代理USEagent,旨在通过协调多种能力提升软件开发效率,通过USEbench验证其效果,发现其在复杂任务中表现优于现有代理。

Comments Leonhard Applis and Yuntong Zhang contributed equally to this work. To appear in ICSE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 代码评测 2 篇

2512.07186 2025-12-09 cs.CV cs.AI 57%

START: Spatial and Textual Learning for Chart Understanding

START: 空间与文本学习用于图表理解

Zhuoming Liu, Xiaofeng Gao, Feiyang Niu, Qiaozi Gao, Liu Liu, Robinson Piramuthu

机构 * University of Wisconsin-Madison(威斯康星大学麦迪逊分校) Amazon AGI(亚马逊人工智能实验室) MIT(麻省理工学院)

专题命中 代码评测 :code generation(abstract);分类 cs.AI

AI总结 START通过空间与文本学习提升图表理解能力,引入图表元素定位和图表到代码生成,增强多模态大语言模型对图表结构和数据细节的理解。

Comments WACV2026 Camera Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06248 2025-12-09 cs.SE 57%

CFCEval: Evaluating Security Aspects in Code Generated by Large Language Models

CFCEval: 评估大型语言模型生成代码的安全性方面

Cheng Cheng, Jinqiu Yang

专题命中 代码评测 :code generation(abstract);分类 cs.SE

AI总结 CFCEval通过引入MLVBench和ELRM指标,有效评估大型语言模型生成代码的质量与安全性,提升代码评估的准确性和全面性。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 仓库级理解 7 篇

2512.07022 2025-12-09 cs.SE cs.AI cs.IR 76%

Reformulate, Retrieve, Localize: Agents for Repository-Level Bug Localization

重新表述、检索、局部化:用于仓库级缺陷定位的代理

Genevieve Caumartin, Glaucia Melo

机构 * Concordia University(康科迪亚大学) Toronto Metropolitan University(多伦多 Metropolitan 大学)

专题命中 仓库级理解 :repository(title);分类 cs.SE、cs.AI

AI总结 本文提出利用LLM代理通过查询重新表述和摘要改进仓库级缺陷定位,实现更高效的文件级定位性能。

Comments Accepted at BoatSE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06991 2025-12-09 cs.CL cs.AI 62%

Prompting-in-a-Series: Psychology-Informed Contents and Embeddings for Personality Recognition With Decoder-Only Models

Prompting-in-a-Series: 基于心理启发内容与嵌入的个性识别解码器-only模型

Jing Jie Tan, Ban-Hoe Kwan, Danny Wee-Kiat Ng, Yan-Chai Hum, Anissa Mokraoui, Shih-Yu Lo

机构 * Laboratoire de traitement et transport de l'information, Université Sorbonne Paris Nord, France(信息处理与传输实验室,索邦巴黎北大学,法国) Institute of Communication Studies, National Yang Ming Chiao Tung University, Taiwan(传播学研究所,国立阳明交通大学,台湾)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI

AI总结 PICEPR通过心理启发内容与嵌入技术,提升解码器-only模型在个性识别中的性能,实现5-15%的提升。

Comments 16 pages

Journal ref IEEE Transactions on Computational Social Systems, pages 1-15, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.18886 2025-12-09 cs.LG cs.AI 62%

A Survey on Diffusion Models for Time Series and Spatio-Temporal Data

时间序列和时空数据扩散模型综述

Yiyuan Yang, Ming Jin, Haomin Wen, Chaoli Zhang, Yuxuan Liang, Lintao Ma, Yi Wang, Chenghao Liu, Bin Yang, Zenglin Xu, Shirui Pan, Qingsong Wen

机构 * University of Oxford(牛津大学) Griffith University(格里菲斯大学) Carnegie Mellon University(卡内基梅隆大学) Zhejiang Normal University(浙江师范大学) Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) The University of Hong Kong(香港大学) Salesforce Research(Salesforce研究) East China Normal University(东华大学) Fudan University(复旦大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI、cs.LG

AI总结 本文综述了扩散模型在时间序列和时空数据中的应用,系统梳理了模型类别、任务类型及实际应用场景,为后续研究提供基础。

Comments Accepted by ACM Computing Surveys; 37 pages; Github Repo: https://github.com/yyysjz1997/Awesome-TimeSeries-SpatioTemporal-Diffusion-Model

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05757 2025-12-09 cs.AI 57%

Hyperbolic Large Language Models

双曲大语言模型

Sarang Patil, Zeyong Zhang, Yiran Huang, Tengfei Ma, Mengjia Xu

机构 * Department of Data Science, New Jersey Institute of Technology(数据科学系,新泽西理工学院) Department of Biomedical Informatics, Stony Brook University(生物医学信息学系,石溪大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 本文提出双曲大语言模型,通过双曲几何提升语义表示学习和多尺度推理能力。

Comments 27 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06239 2025-12-09 cs.CL 57%

LOCUS: A System and Method for Low-Cost Customization for Universal Specialization

LOCUS:一种低成本定制化用于通用特化的系统和方法

Dhanasekar Sundararaman, Keying Li, Wayne Xiong, Aashna Garg

机构 * Microsoft(微软)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL

AI总结 LOCUS通过低成本定制化方法,在通用特化任务中实现高效模型训练,优于GPT-4o并显著降低计算成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06001 2025-12-09 physics.ed-ph cs.CL 57%

Small Language Models Reshape Higher Education: Courses, Textbooks, and Teaching

小型语言模型重塑高等教育:课程、教材和教学

Jian Zhang, Jia Shao

专题命中 仓库级理解 :repository(abstract);分类 cs.CL

AI总结 本研究利用小型语言模型重新设计大气物理课程,通过构建高维向量库实现教学资源的动态化与智能化,推动教育模式的变革。

Comments in Chinese language

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06888 2025-12-09 cs.CV 50%

Overcoming Small Data Limitations in Video-Based Infant Respiration Estimation

克服基于视频的婴儿呼吸估计中小数据限制

Liyang Song, Hardik Bishnoi, Sai Kumar Reddy Manne, Sarah Ostadabbas, Briana J. Taylor, Michael Wan

机构 * Northeastern University(东北大学)

专题命中 仓库级理解 :repository(abstract)

AI总结 本文提出了一种基于视频的婴儿呼吸估计方法,通过引入新的标注数据集和可重复的处理流程,解决了小数据限制问题,并建立了相关基准。

详情

展开后加载摘要…

URL PDF HTML 收藏