arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

共收录 3953 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 仓库级理解 3953 篇

0810.0372 2009-12-01 cs.PL cs.OS 61%

Optimizing Binary Code Produced by Valgrind (Project Report on Virtual Execution Environments Course - AVExe)

Filipe Cabecinhas, Nuno Lopes, Renato Crisostomo, Luis Veiga

专题命中 仓库级理解 :code generation(abstract,comments);分类 cs.PL

Comments Technical report from INESC-ID Lisboa describing optimizations to code generation of the Valgring execution environment. Work developed in the context of a Virtual Execution Environments course (AVExe) at IST/Technical university of Lisbon

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22928 2026-08-25 cs.PL cs.CR 新提交 57%

When Can Agents Safely Checkpoint, Fork, Restore, and Merge? Exact Checking for Execution Edits

智能体何时能安全地进行检查点、分叉、恢复与合并?执行编辑的精确检查

Yusheng Zheng, Xiaoyu Song, Yanpeng Hu, Lebin Cheng, Yuxi Huang, Wei Zhang

专题命中 仓库级理解 :repository(abstract);分类 cs.PL

AI总结 该研究针对智能体的检查点、分叉等执行编辑操作,提出一种精确判定编辑安全性的算法,通过形式化方法验证,相关成果已在 Lean 中实现并开源。

Comments 24 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22215 2026-08-25 cs.CL 新提交 57%

Dual-Layer Agentic Memory with Fast Write Routing and Slow Consolidation

带有快速写入路由与慢速整合的双层智能体记忆

Wenzhi Li, Dong Nie, Rui Lan, Tongtong Lyu, Peiyao Wang, Lingzi Hong, Weihang Pan, Boyuan Pan, Yao Hu

机构 * Zhejiang University(浙江大学) Xiaohongshu(小红书) University of North Texas(北得克萨斯大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL

AI总结 该研究针对LLM智能体动态环境下的记忆管理问题,提出双层智能体记忆框架,通过成本感知路由与周期性整合实现高效记忆处理,在保留高检索性能的同时减少冗余。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22045 2026-08-25 cs.HC cs.AI 新提交 57%

Multi-Agent Discovery and Resource-Aware Autonomous Exploration of Scientific Datasets

科学数据集的多智能体发现与资源感知自主探索

Aashish Panta, Hugo Lee, Giorgio Scorzelli, Kyongsik Yun, Valerio Pascucci

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 针对单个研究者难以发现探索大规模科学数据集的问题,提出WebVisus多智能体系统,可基于自然语言问题启动自主智能体,适配资源探索数据集并完成案例验证。

Comments 10 pages, 4 figures, 1 table. To appear in 2026 IEEE eScience Proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21884 2026-08-25 cs.SE 新提交 57%

Loop Engineering: Building Blocks, Adoption, and Impact

循环工程:构建模块、采用情况及影响

Jai Lal Lulla, Vahram Nersesyan, Seyedmoein Mohsenimofidi, Christoph Treude, Sebastian Baltes

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 本文对新兴循环工程领域开展探索性研究,分析其构建模块、开源项目采用情况,挖掘36710个仓库发现217个存在自主智能体循环,并规划了智能体自主层级的对照研究。

Comments 10 pages, 2 tables, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04537 2026-08-25 cs.SE 57%

ICCheck: A Portable, Language-Agnostic Tool for Synchronizing Code Clones

ICCheck:一种跨语言、可移植的代码克隆同步工具

Motoki Abe, Shinpei Hayashi

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 ICCheck 是一种跨语言、可移植的代码克隆同步工具,通过现有无语言依赖的克隆搜索技术,结合 Git 仓库实现,能够在多种编程语言和开发环境中检测并建议同步代码克隆的修改。

Comments Accepted manuscript in Science of Computer Programming

Journal ref Science of Computer Programming, 252(103472):1-10, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18644 2026-08-25 cs.SE 57%

Modeling and Recovering Hierarchical Structural Architectures of ROS 2 Systems from Code and Launch Configurations using LLM-based Agents

基于LLM代理的ROS 2系统层次结构架构建模与恢复

Mohamed Benchat, Dominique Briechle, Raj Chanchad, Mitbhai Chauhan, Meet Chavda, Ruidi He, Dhruv Jajadiya, Dhruv Kapadiya, Nidhiben Kaswala, Daniel Osterholz, Andreas Rausch, Meng Zhang

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 本文提出基于UML的ROS 2系统层次结构架构建模方法,并结合LLM代理实现从代码和配置文件中自动化恢复架构模型,提升系统可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09716 2026-08-25 cs.CL 版本更新 57%

Opportunities and Challenges of Natural Language Processing for Low-Resource Senegalese Languages in Social Science Research

自然语言处理在塞内加尔语言社会科学研究中的机遇与挑战

Derguene Mbaye, Tatiana D. P. Mbengue, Madoune R. Seye, Moussa Diallo, Mamadou L. Ndiaye, Dimitri S. Adjanohoun, Cheikh S. Wade, Djiby Sow, Jean-Claude B. Munyaka, Jerome Chenal

机构 * Polytechnic School (ESP)(多科技术校) Gaston Berger University (UGB)(加斯顿-伯杰大学) Federal Institute of Technology Lausanne (EPFL)(洛桑联邦理工学院)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL

AI总结 本文探讨了自然语言处理在塞内加尔六种语言社会科学研究中的机遇与挑战,提出构建可持续的NLP生态系统,强调伦理治理与跨学科合作。

Comments 45 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05813 2026-08-25 cs.SE 版本更新 57%

An Empirical Study of Java Code Improvements Based on Stack Overflow Answer Edits

基于Stack Overflow回答编辑的Java代码改进实证研究

In-on Wiratsin, Chaiyong Ragkhitwetsagul, Matheus Paixao, Denis De Sousa, Pongpop Lapvikai, Peter Haddawy

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 本研究通过分析Stack Overflow的Java回答编辑,识别可改进的开源Java代码,发现近7%的采纳回答有多次修订,近半数编辑代码可应用于开源项目,11个bug修复方案被接受。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20637 2026-08-24 cs.CR cs.AI 新提交 57%

ARQ: Agentic CodeQL Query Refinement for C/C++ Vulnerability Detection

ARQ:用于C/C++漏洞检测的智能CodeQL查询优化框架

Chunyi Wang, Yunfei Ke, Junfeng Yang, Yun-Yun Tsai, Penghui Li

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 本文提出ARQ智能框架,利用合成C/C++程序的执行证据和LLM优化CodeQL查询,无需标注数据等,优化后查询的真阳性最多提升119.8%,还修复了长期悬而未决的问题并发现新漏洞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20343 2026-08-24 cs.LG stat.AP 新提交 57%

Bankruptcy Prediction via Hybrid Resampling and Stacking Ensemble Techniques with Explainable Artificial Intelligence (XAI)-Driven Analysis

结合可解释人工智能(XAI)分析的混合重采样与堆叠集成技术的破产预测

Obu-Amoah Ampomah, Edmund Fosu Agyemang, Kofi Acheampong, Louis Agyekum, Enock Adu Bonsu, Eric Nyarko

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 本研究提出整合多技术的破产预测框架,在不平衡金融数据中优化少数类检测,经实验验证了模型性能,可助力财务困境企业的早期预警系统建设。

Comments 24 pages, 7 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18822 2026-08-20 cs.SE 新提交 57%

Contract-Aware Rescue of a Drifted Isabelle Development: The Double-Tank Case Study

感知契约的漂移Isabelle开发修复:双水箱案例研究

Jim Woodcock, Gabriel Leite, Augusto Sampaio, Ran Wei

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 针对Isabelle开发漂移问题,以双水箱控制器案例为研究对象,用CAPRI工具重构修复了10个义务,完成部分验证工作,为交互式定理证明器的开发维护提供了实践参考。

Comments 15 pages. Submitted to Formal Methods for Autonomous Systems 2026 (FMAS 2026). Reproducibility artefact: DOI 10.5281/zenodo.21981425

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19522 2026-08-20 cs.LG 版本更新 57%

Contrasting Cost-Agnostic and Cost-Sensitive Losses under Limited Model Capacity via $\mathcal H$-consistency

有限模型容量下基于$\boldsymbol{\textit{\textit{\textbf{H}}}}$-一致性的成本无关与成本敏感损失对比

Jessica Finocchiaro, Sanket Shah, Milind Tambe

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 本文针对有限模型容量场景,通过$\boldsymbol{\textit{\textit{\textbf{H}}}}$-一致性建立了成本无关与成本敏感损失的性能差距,在UCI分类数据集上验证了该差距的存在,解释了成本敏感方法提升性能的理论成因。

Comments Significant update from version 1

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17159 2026-08-19 cs.SE cs.CR cs.DL 新提交 57%

A Multi-Surface Consistency Audit of Software Citation Metadata

软件引用元数据的多表面一致性审计

Pengyin Shan

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 本文对117个开源研究型软件项目的多达7个机器可读元数据表面进行审计,发现83.9%的项目存在核心字段冲突,多数冲突源于表面描述的是软件论文而非软件本身,同时发布了审计相关资源。

Comments 10 pages, 2 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17760 2026-08-19 cs.IT cs.AI eess.SP math.IT 新提交 57%

Learnware for CSI Feedback: Scene-specific Small Models Can Do Big

用于CSI反馈的学习件:特定场景的小型模型可发挥大作用

Xiangyi Li, Jiajia Guo, Chao-Kai Wen, Xin Geng, Shi Jin, Zhi-Hua Zhou

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 针对6G CSI反馈的模型泛化与场景性能权衡问题,提出基于学习件的模型仓库框架,可高效检索匹配的预训练模型,在LOS/NLOS场景下性能优于通用模型,减少训练开销并增强隐私。

Comments This work has been accepted by IEEE Transactions on Wireless Communications. Copyright may be transferred without notice, after which this version may no longer be accessible

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15209 2026-08-19 cs.CL 版本更新 57%

Expanding the Lexicon of Ge'ez Based African Languages: A Comparative Study of Amharic and Tigrinya

扩展基于吉兹语的非洲语言词汇:阿姆哈拉语和提格雷尼亚语的比较研究

Hailay Kidu Teklehaymanot, Debela Desalegn Yadeta, Wolfgang Nejdl

专题命中 仓库级理解 :repository(abstract);分类 cs.CL

AI总结 针对低资源非拉丁脚本语言表现不佳问题,提出VEXMLM。通过训练特定语言分词器扩展XLM - R词汇并初始化嵌入,分两阶段训练,在多种任务上评估。贡献为定制程序、两阶段策略及多语言评估,提升了相关语言任务性能。

Comments 13 pages , 7 tables , 2 figurs

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16262 2026-08-18 cs.SE 新提交 57%

Implicit, Yet Impactful: Understanding Hidden Dependencies in Java Projects

隐式却影响重大:理解Java项目中的隐藏依赖关系

Lyuye Zhang, Chengwei Liu, Fangyuan Zhang, Yiran Zhang, Yuan Zhou, Yang Liu

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 本研究针对Java项目的隐式依赖问题,构建含1157个库、19812个版本及972个模块的数据集,量化其影响并分析应对措施,为开源生态系统提供解决方案。

Comments 13 pages, ASE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16112 2026-08-18 cs.SE 新提交 57%

Strategic Technical Debt: A Real Options Approach to Early-Stage Software Experimentation

策略性技术债务:早期软件实验的实物期权方法

Rashid Azarang, Mohammad Reza Azarang Esfandiari

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 本文将早期软件实验中刻意产生的技术债务视为看涨期权,明确策略性与有毒债务的边界,构建序贯模型得出关键结论,并开展两项预注册实证检验。

Comments 25 pages, 4 figures. Pre-registered empirical program: OSF bs3cr (EP3'), rvx5t (EP-Pi)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15881 2026-08-18 cs.LG cs.CE 新提交 57%

Deploying Frontier Agentic Technology in MOOSEnger, a Multiphysics-Capable AI Assistant

在多物理场AI助手MOOSEnger中部署前沿智能体技术

Zaid Abulawi, Mengnan Li, Guillaume Giudicelli, Yang Liu, Cody Permann

机构 * Texas A&M University (TAMU)(德克萨斯农工大学) Idaho National Laboratory (INL)(爱达荷国家实验室)

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 本研究为面向MOOSE框架的AI智能体MOOSEnger扩展本地托管模型管控层,经多类工程任务测试,MOOSEnger-GPT-5.2成功率达90%,凸显智能体管控层对多物理场仿真的支撑价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15102 2026-08-18 cs.CL 新提交 57%

A Declarative-Procedural Perspective on Expert Routing in Bilingual Mixture-of-Experts Language Models

双语混合专家语言模型中专家路由的声明式-过程式视角

Amrit Gopinath, Raghul, Durairaj Thenmozhi

机构 * Sri Sivasubramaniya Nadar College of Engineering(斯里·西瓦苏布拉马尼亚·纳达尔工程学院) Shiv Nadar University Chennai(钦奈希夫·纳达尔大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL

AI总结 该研究探究双语MoE语言模型的专家路由是否形成语言结构,对比课程学习与无课程训练的模型,发现无课程模型专业化更强但依赖随机种子,课程模型路由更均衡,揭示MoE路由可出现可解释语言组织。

Comments 15 pages, 6 figures, 12 tables (including appendix)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28850 2026-08-18 cs.LG q-fin.CP 版本更新 57%

Representation Signatures and Risk-Feedback Alignment in LLM Trading Agents

表示签名与LLM交易智能体中的风险反馈对齐

Weicheng Xue

机构 * Virginia Tech(弗吉尼亚理工大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 通过TradeArena测试平台研究LLM交易智能体在金融决策中的行为对齐与表示动态,发现故障前表示签名(规划嵌入漂移、流形有效秩收缩)并验证风险反馈作为外部对齐信号的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.10023 2026-08-18 cs.LG 版本更新 57%

Model Inversion Attacks: A Survey of Approaches and Countermeasures

模型反演攻击:方法与对策综述

Zhanke Zhou, Jianing Zhu, Fengfei Yu, Xuan Li, Xiong Peng, Tongliang Liu, Bo Han

机构 * Hong Kong Baptist University(香港 Baptist 大学) The University of Sydney(悉尼大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 本综述针对模型反演攻击,综合分析其在多领域的有效性及神经网络的脆弱性,对比攻击与防御的多维度要素,明确建模与优化挑战并维护相关研究知识库。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.00971 2026-08-18 cs.CV cs.AI 版本更新 57%

MiniGPT-Reverse-Designing: Predicting Image Adjustments Utilizing MiniGPT-4

MiniGPT-反向设计:利用MiniGPT-4预测图像调整

Vahid Azizi, Fatemeh Koochaki

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 本文通过扩展和微调MiniGPT-4,使其可应用于给定源图像、编辑后图像及可选文本描述来预测图像编辑操作与参数的反向设计任务,验证了现成VLMs在复杂多模态任务中的可扩展性。

Comments 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14377 2026-08-17 cs.CL cs.CV 新提交 57%

A Survey of Large Models in Sports

体育领域的大模型综述

Yichen Xu, Jianzhe Ma, Chuhan Wang, Zhonghao Cao, Liangyu Chen, Wenxuan Wang, Qin Jin

机构 * Renmin University of China(中国人民大学) Sichuan University(四川大学) Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL

AI总结 该文综述体育领域大模型的任务应用、数据集基准,分析挑战与未来方向,为大模型驱动的体育智能研究与发展提供基础。

Comments 36 pages, 4 figures, 6 tables. Accepted to Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12610 2026-08-14 cs.AI 新提交 57%

@skills: Attention is all you have

@skills:你所需的全部注意力

Li Yin, Zhi Li, Zhan Shi, Haoran Zhang, Haebin Seong, Zhangyang, Wang

机构 * SylphAI(西尔菲人工智能公司) The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 针对当前智能体技能安装模式下触发槽位稀缺的问题,提出@skills开放协议,分离技能的内容、持久化与自动触发功能,无需安装即可使用技能,通过Git管理实现灵活适配,搭配免费技能 hub 提供搜索等功能,减少安装、提升使用效率。

Comments 7 pages main, 23 pages in total with appendix, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11755 2026-08-13 cs.SD cs.CL 新提交 57%

MuseCritic: Learning Multi-Aspect Song Rewards through Natural-Language Aesthetic Critiques

MuseCritic:通过自然语言审美评论学习多维度歌曲奖励

Jiabao Zhuang, Changhao Jiang, Hanchen Wang, Jiahao Chen, Zhixiong Yang, Zhenghao Xiang, Yifei Cao, Jiajun Sun, Hui Li, Ming Zhang, Tao Ji, Tao Gui, Qi Zhang, Xuanjing Huang

机构 * Fudan University(复旦大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL

AI总结 本研究提出MUSECRITIC半标量奖励模型,通过两阶段训练生成多维度自然语言评论预测歌曲奖励,在SongEval、Music Arena等数据集上效果优于现有方法,结合GRPO还提升了Muse-0.6B的多项审美指标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.05286 2026-08-13 cs.SE 57%

Deep Learning Methods for Software Requirement Classification: A Performance Study on the PURE dataset

Fatemeh Khayashi, Behnaz Jamasb, Reza Akbari, Pirooz Shamsinejadbabaki

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11036 2026-08-12 cs.CL 新提交 57%

myMediWhisper: Construction of Burmese Medical Speech Corpus and Whisper Fine-Tuning for Clinical Dialogue ASR

myMediWhisper:缅甸医疗语音语料库的构建及面向临床对话自动语音识别的Whisper微调

Ye Kyaw Thu, Ye Bhone Lin, Thura Aung, Htet Arkar, Myat Oo Swe, Thet Htet San, Min Thiha Tun, Thazin Myint Oo, Thepchai Supnithi

机构 * National Electronics and Computer Technology Center (NECTEC)(国家电子与计算机技术中心) King Mongkut’s University of Technology Thonburi(国王蒙固科技大学吞武里分校) King Mongkut’s Institute of Technology Ladkrabang(国王蒙固科技学院叻甲邦分校)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL

AI总结 本研究构建28小时缅甸医疗语音语料库,通过全微调(FFT)和带LoRA的PEFT微调Whisper,提升其在医疗对话ASR中的性能,最优模型WER达23.44%,优于更大的通用领域微调模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09181 2026-08-11 cs.SE cs.CR 新提交 57%

Memoir: Learning, Verifying, and Evolving False-Positive Memories for Static Application Security Testing Tools

Memoir:针对静态应用安全测试工具的误报记忆学习、验证与演化

Shenyuan Guan, Qiaodan Hou, Yanjun Chen, Xincheng Wen, Jia Feng, Keke Lian, Cuiyun Gao

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 本研究针对SAST工具的误报问题,提出Memoir框架,通过构建与演化语义记忆实现误报识别,在CWE-Bench-Java上表现优异,且记忆库可跨工具泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08453 2026-08-11 cs.AI cs.CR 新提交 57%

What Keeps Agent Skills from Being Reusable? Evidence from 138K SKILL.md Files

是什么阻碍了智能体技能的可复用性?来自13.8万个SKILL.md文件的证据

Chi Zhang, Yimin Liu, Xinze Chen, Ping Ji

机构 * The Graduate Center, City University of New York(纽约城市大学研究生中心) The Ohio State University(俄亥俄州立大学) Hunter College, City University of New York(纽约城市大学亨特学院)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 本研究通过分析13.8万个SKILL.md文件,发现91.8%的Agent Skills存在可复用性相关缺陷,主要为打包问题,验证了路由元数据对检索可靠性的影响,并提出了结合规范提示等的质量保证生成工作流。

Comments 11 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏