arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

2025-11-26 至 2025-11-26 共收录 18 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码生成 4 篇

2511.20104 2025-11-26 cs.LG cs.AI cs.CL 67%

The Devil in the Details: Emergent Misalignment, Format and Coherence in Open-Weights LLMs

细节中的魔鬼:开放权重语言模型中的涌现偏移、格式与连贯性

Craig Dickson

机构 * Independent Researcher(独立研究者)

专题命中 代码生成 :code generation(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文研究了开放权重语言模型中的涌现偏移现象,发现格式约束如JSON输出会增加偏移率,而Qwen-2.5系列比GPT-4o更抗压。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19822 2025-11-26 cs.LG cs.AI 62%

Mosaic Pruning: A Hierarchical Framework for Generalizable Pruning of Mixture-of-Experts Models

拼图剪枝:一种用于混合专家模型通用剪枝的分层框架

Wentao Hu, Mingkuan Zhao, Shuangyong Song, Xiaoyan Zhu, Xin Lai, Jiayin Wang

专题命中 代码生成 :code generation(abstract);分类 cs.AI、cs.LG

AI总结 拼图剪枝通过分层框架实现混合专家模型的通用剪枝,提升模型在多样化下游任务中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.08706 2025-11-26 cs.LG cs.AI 62%

Searching Latent Program Spaces

在潜在程序空间中搜索

Matthew V Macfarlane, Clement Bonnet

机构 * University of Amsterdam(阿姆斯特丹大学)

专题命中 代码生成 :program synthesis(abstract);分类 cs.AI、cs.LG

AI总结 本文提出LPN,一种在测试时直接构建程序搜索能力的神经网络,通过学习隐含程序空间实现高效适应新任务。

Comments NeurIPS 2025 spotlight. Code available at https://github.com/clement-bonnet/lpn

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07154 2025-11-26 cs.LG cs.AI 62%

Rethinking Fine-Tuning when Scaling Test-Time Compute: Limiting Confidence Improves Mathematical Reasoning

重新思考扩展测试时间计算时的微调:限制置信度可提升数学推理

Feng Chen, Allan Raventos, Nan Cheng, Surya Ganguli, Shaul Druckmann

机构 * Stanford University(斯坦福大学) University of Michigan(密歇根大学)

专题命中 代码生成 :code generation(abstract);分类 cs.AI、cs.LG

AI总结 通过限制模型置信度改进数学推理,研究发现传统交叉熵损失与测试时间策略pass@N存在不一致,提出改进的训练损失以提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 1 篇

2510.16786 2025-11-26 cs.SE cs.AI cs.LG 82%

More with Less: An Empirical Study of Turn-Control Strategies for Efficient Coding Agents

更多但更少:一种关于高效编码代理的实证研究:回合控制策略

Pengfei Gao, Chao Peng

机构 * ByteDance(字节跳动)

专题命中 软件智能体 :coding agent(title,abstract);分类 cs.SE、cs.AI、cs.LG

AI总结 本文通过实证研究分析了编码代理的回合控制策略,发现动态资源分配在成本和效率之间取得平衡,优于固定回合限制方法。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 程序修复 2 篇

2511.20617 2025-11-26 cs.SE cs.PL 62%

Translating Large-Scale C Repositories to Idiomatic Rust

将大规模C仓库翻译为idiomatic Rust

Saman Dehghan, Tianran Sun, Tianxiang Wu, Zihan Li, Reyhaneh Jabbarvand

专题命中 程序修复 :repository(abstract);分类 cs.SE、cs.PL

AI总结 Rustine是一种高效自动化的C到idiomatic Rust翻译工具,实现了高质量的功能等价性,比现有方法更安全、更idiomatic且更易读。

Comments 21 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15815 2025-11-26 cs.AI 57%

Attention Pruning: Automated Fairness Repair of Language Models via Surrogate Simulated Annealing

注意力剪枝:通过代理模拟退火实现语言模型的自动公平性修复

Vishnu Asutosh Dasu, Md Rafi ur Rashid, Vipul Gupta, Saeid Tizpaz-Niari, Gang Tan

机构 * Pennsylvania State University(宾夕法尼亚州立大学) University of Illinois(伊利诺伊大学)

专题命中 程序修复 :program repair(abstract);分类 cs.AI

AI总结 本文提出注意力剪枝方法,通过代理模拟退火在LLMs中减少偏见,提升公平性。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 代码评测 1 篇

2312.17432 2025-11-26 cs.CV cs.CL 57%

Video Understanding with Large Language Models: A Survey

利用大语言模型进行视频理解:综述

Yolo Y. Tang, Jing Bi, Siting Xu, Luchuan Song, Susan Liang, Teng Wang, Daoan Zhang, Jie An, Jingyang Lin, Rongyi Zhu, Ali Vosoughi, Chao Huang, Zeliang Zhang, Pinxin Liu, Mingqian Feng, Feng Zheng, Jianguo Zhang, Ping Luo, Jiebo Luo, Chenliang Xu

机构 * University of Rochester(罗切斯特大学) The University of Hong Kong(香港大学) Southern University of Science and Technology(南方科技大学)

专题命中 代码评测 :repository(abstract);分类 cs.CL

AI总结 本文综述了利用大语言模型进行视频理解的最新进展,探讨了Vid-LLMs的分类、功能及应用场景,并指出了未来研究方向。

Comments Accepted to IEEE Transactions on Circuits and Systems for Video Technology (TCSVT)

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 仓库级理解 8 篇

2503.17407 2025-11-26 cs.CL cs.LG 62%

A Comprehensive Survey on Long Context Language Modeling

对长上下文语言模型的全面综述

Jiaheng Liu, Dawei Zhu, Zhiqi Bai, Yancheng He, Huanxuan Liao, Haoran Que, Zekun Wang, Chenchen Zhang, Ge Zhang, Jiebin Zhang, Yuanxing Zhang, Zhuo Chen, Hangyu Guo, Shilong Li, Ziqiang Liu, Yong Shan, Yifan Song, Jiayi Tian, Wenhao Wu, Zhejian Zhou, Ruijie Zhu, Junlan Feng, Yang Gao, Shizhu He, Zhoujun Li, Tianyu Liu, Fanyu Meng, Wenbo Su, Yingshui Tan, Zili Wang, Jian Yang, Wei Ye, Bo Zheng, Wangchunshu Zhou, Wenhao Huang, Sujian Li, Zhaoxiang Zhang

专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.LG

AI总结 本文综述了长上下文语言模型的最新进展,涵盖模型构建、训练部署及评估分析,为研究人员和工程师提供全面的资源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19750 2025-11-26 cs.LG 57%

DISCO: A Browser-Based Privacy-Preserving Framework for Distributed Collaborative Learning

DISCO:一种基于浏览器的隐私保护分布式协作学习框架

Julien T. T. Vignoud, Valérian Rousset, Hugo El Guedj, Ignacio Aleman, Walid Bennaceur, Batuhan Faik Derinbay, Eduard Ďurech, Damien Gengler, Lucas Giordano, Felix Grimberg, Franziska Lippoldt, Christina Kopidaki, Jiafan Liu, Lauris Lopata, Nathan Maire, Paul Mansat, Martin Milenkoski, Emmanuel Omont, Güneş Özgün, Mina Petrović, Francesco Posa, Morgan Ridel, Giorgio Savini, Marcel Torne, Lucas Trognon, Alyssa Unell, Olena Zavertiaieva, Sai Praneeth Karimireddy, Tahseen Rabbani, Mary-Anne Hartley, Martin Jaggi

机构 * EPFL(瑞士联邦理工学院) University of Chicago(芝加哥大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 DISCO提供了一种基于浏览器的隐私保护分布式协作学习框架,允许非技术人员无需编程知识即可共同构建机器学习模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19671 2025-11-26 cs.AI 57%

FISCAL: Financial Synthetic Claim-document Augmented Learning for Efficient Fact-Checking

FISCAL: 金融合成声明-文档增强学习用于高效事实核查

Rishab Sharma, Iman Saberi, Elham Alipour, Jie JW Wu, Fatemeh Fard

机构 * Charli Capital(Charli资本) University of British Columbia(不列颠哥伦比亚大学) Michigan Technological University(密歇根技术大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 FISCAL通过生成领域特定合成数据和高效微调,使小型模型在金融事实核查任务中达到最先进的准确性、鲁棒性和可扩展性。

Comments 3 tables, 11 pages, 39th Conference on Neural Information Processing Systems (NeurIPS 2025) Workshop: Generative AI in Finance

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20192 2025-11-26 cs.LG cs.IR 57%

FunReason: Enhancing Large Language Models' Function Calling via Self-Refinement Multiscale Loss and Automated Data Refinement

FunReason: 通过自精炼多尺度损失和自动化数据精炼增强大语言模型的功能调用

Bingguang Hao, ZengZhuang Xu, Maolin Wang, Yuntao Wen, Yicheng Chen, Cunyin Peng, Long Chen, Dong Wang, Xiangyu Zhao, Jinjie Gu, Chenyi Zhuang, Ji Zhang

机构 * AWorld Team, Inclusion AI(AWorld Team,Inclusion AI) City University of Hong Kong(香港城市大学) Southwest Jiaotong University(西南交通大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 FunReason通过自精炼多尺度损失和自动化数据精炼方法,提升大语言模型的功能调用能力,实现性能接近GPT-4o并缓解微调中的灾难性遗忘。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.06250 2025-11-26 cs.CV cs.AI cs.HC 57%

Generative AI for Cel-Animation: A Survey

生成式AI用于动画:一种调查

Yolo Y. Tang, Junjia Guo, Pinxin Liu, Zhiyuan Wang, Hang Hua, Jia-Xing Zhong, Yunzhong Xiao, Chao Huang, Luchuan Song, Susan Liang, Yizhi Song, Liu He, Jing Bi, Mingqian Feng, Xinyang Li, Zeliang Zhang, Chenliang Xu

机构 * University of Rochester(罗切斯特大学) UCSB University of Oxford(牛津大学) CMU(卡内基梅隆大学) Purdue University(普渡大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 本文调查生成式AI如何通过自动化任务革新传统动画流程,降低技术门槛,扩大创作者群体,并促进艺术创新。

Comments Accepted by ICCV 2025 AISTORY Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19855 2025-11-26 quant-ph stat.CO 50%

Quantum Framework for Wavelet Shrinkage

量子小波收缩框架

Brani Vidakovic

专题命中 仓库级理解 :repository(abstract)

AI总结 本文提出了一种量子小波收缩框架,通过受控退相干实现系数衰减,结合统计自适应性和量子幺正性,展示了如何利用量子机制替代经典去噪方法。

Comments 25 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13509 2025-11-26 cs.CR cs.CY cs.HC 50%

Practitioners' Perspectives on a Differential Privacy Deployment Registry

从业者对差分隐私部署注册表的视角

Priyanka Nanayakkara, Elena Ghazi, Salil Vadhan

专题命中 仓库级理解 :repository(abstract)

AI总结 本文提出一个差分隐私部署注册表,旨在促进从业者共享学习和问责,通过设计交互式界面和用户研究,探讨其在隐私保护和数据实用性的应用与挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19442 2025-11-26 physics.ed-ph astro-ph.IM gr-qc 50%

gr-Orbit-Toolkit: A Python-Based Software for Simulating and Visualizing Relativistic Orbits

gr-Orbit-Toolkit:用于模拟和可视化相对论轨道的 Python 软件

Milagros Delgado, Wladimir E. Banda-Barragán

专题命中 仓库级理解 :repository(abstract)

AI总结 gr-Orbit-Toolkit 是一种基于 Python 的软件,用于模拟和可视化经典和广义相对论中的轨道,通过数值积分方法验证了相对论轨道进动和不同偏心率下的轨道差异。

Comments Author's accepted manuscript of a chapter published in Information and Communication Technologies (TICEC 2025 Proceedings), Communications in Computer and Information Science, vol. 2707, Springer Nature Switzerland AG, 2026. The final authenticated version is available at: https://doi.org/10.1007/978-3-032-08366-1_20 15 pages, 4 figures

Journal ref Commun. Comput. Inf. Sci. 2707 (2026) 297-311

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 程序分析与验证 1 篇

2511.19635 2025-11-26 cs.SE cs.LG 62%

Agint: Agentic Graph Compilation for Software Engineering Agents

Agint:软件工程代理的代理图编译

Abhi Chivukula, Jay Somasundaram, Vijay Somasundaram

专题命中 程序分析与验证 :coding agent(abstract);分类 cs.SE、cs.LG

AI总结 Agint通过代理图编译器和运行时实现高效、可靠的软件工程代理,支持自然语言到代码的自动化转换与协作开发。

Comments 18 pages, 5 figures, NeurIPS 2025: Deep Learning for Code in the Agentic Era

详情

展开后加载摘要…

URL PDF HTML 收藏

7. 其他AI编程 1 篇

2511.20261 2025-11-26 cond-mat.str-el quant-ph 50%

Disentangling Kitaev Quantum Spin Liquid

解开Kitaev量子自旋液体

Xiang Li, Xiangjian Qian, Mingpu Qin

专题命中 其他AI编程 :code model(abstract)

AI总结 通过Clifford电路方法解缠Kitaev量子自旋液体的纠缠,提升经典模拟效率并减少量子设备资源消耗。

详情

展开后加载摘要…

URL PDF HTML 收藏