arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

共收录 12259 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 仓库级理解 3967 篇

2304.14773 2023-05-01 cs.CV cs.AI 61%

Synergy of Machine and Deep Learning Models for Multi-Painter Recognition

Vassilis Lyberatos, Paraskevi-Antonia Theofilou, Jason Liartis, Georgios Siolas

专题命中 仓库级理解 :repository(abstract,comments);分类 cs.AI

Comments Github Repository: https://github.com/jliartis/art-recognition

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.06732 2023-04-11 cs.LG cs.CY 61%

Equal Improvability: A New Fairness Notion Considering the Long-term Impact

Ozgur Guldogan, Yuchen Zeng, Jy-yong Sohn, Ramtin Pedarsani, Kangwook Lee

专题命中 仓库级理解 :repository(abstract,comments);分类 cs.LG

Comments Codes are available in a GitHub repository, see https://github.com/guldoganozgur/ei_fairness. ICLR 2023 Poster. 31 pages, 10 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.05870 2022-07-14 cs.LG cs.NE physics.app-ph 61%

RcTorch: a PyTorch Reservoir Computing Package with Automated Hyper-Parameter Optimization

Hayden Joy, Marios Mattheakis, Pavlos Protopapas

专题命中 仓库级理解 :repository(abstract,comments);分类 cs.LG

Comments 18 pages, 12 figures, and 43 citations. GitHub repository and documentation information included and linked

详情

展开后加载摘要…

URL PDF HTML 收藏
1802.07756 2018-08-07 stat.ML cs.LG 61%

Determining the best classifier for predicting the value of a boolean field on a blood donor database using genetic algorithms

Ritabrata Maiti

专题命中 仓库级理解 :repository(abstract,comments);分类 cs.LG

Comments GitHub Repository here: https://github.com/ritabratamaiti/Blooddonorprediction

详情

展开后加载摘要…

URL PDF HTML 收藏
1308.2410 2013-08-13 cs.SE cs.HC stat.ML 61%

Collective Mind: cleaning up the research and experimentation mess in computer engineering using crowdsourcing, big data and machine learning

Grigori Fursin

专题命中 仓库级理解 :repository(abstract,comments);分类 cs.SE

Comments I started drafting this document at the beginning of the development of the 3rd version of plugin-based cTuning infrastructure and repository (aka Collective Mind) to systematize and crowdsource program and architecture auto-tuning; (2013)

详情

展开后加载摘要…

URL PDF HTML 收藏
0810.0372 2009-12-01 cs.PL cs.OS 61%

Optimizing Binary Code Produced by Valgrind (Project Report on Virtual Execution Environments Course - AVExe)

Filipe Cabecinhas, Nuno Lopes, Renato Crisostomo, Luis Veiga

专题命中 仓库级理解 :code generation(abstract,comments);分类 cs.PL

Comments Technical report from INESC-ID Lisboa describing optimizations to code generation of the Valgring execution environment. Work developed in the context of a Virtual Execution Environments course (AVExe) at IST/Technical university of Lisbon

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27125 2026-08-28 cs.SE 新提交 57%

AROMA+: A Study of Factors Affecting Reproducible Builds in the Maven Ecosystem

AROMA+:Maven生态系统中影响可复现构建的因素研究

Mehdi Keshani, Amirhossein Rahmati, Mohammad Hossein Aref, Abbas Heydarnoori

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 本研究针对Maven生态系统可复现构建研究不足的问题,开发工具AROMA+自动获取相关信息,准确率达99.8%,实现32%软件包自动可复现,贡献部分软件包至Reproducible Central并公开数据集与工具。

Comments Extended version of a paper accepted at FSE 2024 (ACM International Conference on the Foundations of Software Engineering). Currently under review at Empirical Software Engineering (Springer)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27100 2026-08-28 cs.SE 新提交 57%

Mutation Testing for Reproducibility Safeguards in Machine Learning Research Software: An Empirical Study

机器学习研究软件中用于可复现性保障的突变测试:一项实证研究

Ilya Shulepov

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 本研究以MLReproMutate为工具,对39个机器学习研究仓库开展实证研究,发现现有验证工作流仅能检测8.7%的可复现性相关突变,提出可复现性导向的突变测试作为补充评估方式。

Comments 27 pages. Software and frozen empirical artifacts available at https://doi.org/10.5281/zenodo.22126120

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21884 2026-08-28 cs.SE 版本更新 57%

Loop Engineering: Building Blocks, Adoption, and Impact

循环工程:构建模块、采用情况及影响

Jai Lal Lulla, Vahram Nersesyan, Seyedmoein Mohsenimofidi, Christoph Treude, Sebastian Baltes

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 本文对新兴循环工程领域开展探索性研究,分析其构建模块、开源项目采用情况,挖掘36710个仓库发现217个存在自主智能体循环,并规划了智能体自主层级的对照研究。

Comments 10 pages, 2 tables, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09156 2026-08-27 cs.LG 版本更新 57%

Activation Steering Transfer to Agents: One Gain Ratio Does Not Identify Potency and Efficacy

存在但重新缩放:加法激活引导的聊天到智能体的转移

Lucas Pinto

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 研究加法激活引导从聊天到智能体的转移,通过匹配信息设计进行研究,发现转移真实但重新缩放,确定了加法特定机制,定位了重新缩放位置,指出智能体部署对引导拒绝绕过影响不可预测。

Comments v2 changes the estimand from a gain ratio to a curve location and supersedes v1's coupling-distribution reading. 40 pages, 7 figures, 5 tables. Includes an errata section correcting v1's public record. Code and pre-registrations: github.com/digdoug/steering-dose-reparametrization

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23754 2026-08-26 cs.SE 新提交 57%

Enhancing Bug Report Templates in the TianoCore UEFI Firmware Development Community

增强TianoCore UEFI固件开发社区中的漏洞报告模板

Laura Baird, Neelesh Reddybattula, Nazanin Siavash, Terrance E. Boult, Armin Moin

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 本研究针对TianoCore核心项目EDK II,通过分析漏洞数据发现关键信息缺失问题,拟在GitHub Issues的漏洞报告模板中新增字段,计划经开发者反馈调整及A/B测试验证,以优化UEFI固件漏洞分类与解决流程。

Comments ACM International Workshop on Firmware Testing and Analysis (FTA) 2026, Co-located with ISSTA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12634 2026-08-26 cs.AI 版本更新 57%

Atomic Units of X: The Compression Layer of Intelligence

X的原子单位:智能的压缩层

Sachin Dev Duggal, Pradyumna Swarnalatha Ramanna, Alexandros Vassiliades

机构 * SeKondBrain AI Labs(第二大脑人工智能实验室)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 该论文提出将智能视为原子压缩与组合复用过程的理论框架,借助多学科证据阐述原子单位概念,给出压缩演算等核心方法,为设计自进化知识系统奠基,为智能相关多方面提供统一视角。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22928 2026-08-25 cs.PL cs.CR 新提交 57%

When Can Agents Safely Checkpoint, Fork, Restore, and Merge? Exact Checking for Execution Edits

智能体何时能安全地进行检查点、分叉、恢复与合并?执行编辑的精确检查

Yusheng Zheng, Xiaoyu Song, Yanpeng Hu, Lebin Cheng, Yuxi Huang, Wei Zhang

专题命中 仓库级理解 :repository(abstract);分类 cs.PL

AI总结 该研究针对智能体的检查点、分叉等执行编辑操作,提出一种精确判定编辑安全性的算法,通过形式化方法验证,相关成果已在 Lean 中实现并开源。

Comments 24 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22215 2026-08-25 cs.CL 新提交 57%

Dual-Layer Agentic Memory with Fast Write Routing and Slow Consolidation

带有快速写入路由与慢速整合的双层智能体记忆

Wenzhi Li, Dong Nie, Rui Lan, Tongtong Lyu, Peiyao Wang, Lingzi Hong, Weihang Pan, Boyuan Pan, Yao Hu

机构 * Zhejiang University(浙江大学) Xiaohongshu(小红书) University of North Texas(北得克萨斯大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL

AI总结 该研究针对LLM智能体动态环境下的记忆管理问题,提出双层智能体记忆框架,通过成本感知路由与周期性整合实现高效记忆处理,在保留高检索性能的同时减少冗余。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22045 2026-08-25 cs.HC cs.AI 新提交 57%

Multi-Agent Discovery and Resource-Aware Autonomous Exploration of Scientific Datasets

科学数据集的多智能体发现与资源感知自主探索

Aashish Panta, Hugo Lee, Giorgio Scorzelli, Kyongsik Yun, Valerio Pascucci

机构 * University of Utah(犹他大学) Jet Propulsion Laboratory, Caltech(加州理工学院喷气推进实验室)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 针对单个研究者难以发现探索大规模科学数据集的问题,提出WebVisus多智能体系统,可基于自然语言问题启动自主智能体,适配资源探索数据集并完成案例验证。

Comments 10 pages, 4 figures, 1 table. To appear in 2026 IEEE eScience Proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04537 2026-08-25 cs.SE 57%

ICCheck: A Portable, Language-Agnostic Tool for Synchronizing Code Clones

ICCheck:一种跨语言、可移植的代码克隆同步工具

Motoki Abe, Shinpei Hayashi

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 ICCheck 是一种跨语言、可移植的代码克隆同步工具,通过现有无语言依赖的克隆搜索技术,结合 Git 仓库实现,能够在多种编程语言和开发环境中检测并建议同步代码克隆的修改。

Comments Accepted manuscript in Science of Computer Programming

Journal ref Science of Computer Programming, 252(103472):1-10, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18644 2026-08-25 cs.SE 57%

Modeling and Recovering Hierarchical Structural Architectures of ROS 2 Systems from Code and Launch Configurations using LLM-based Agents

基于LLM代理的ROS 2系统层次结构架构建模与恢复

Mohamed Benchat, Dominique Briechle, Raj Chanchad, Mitbhai Chauhan, Meet Chavda, Ruidi He, Dhruv Jajadiya, Dhruv Kapadiya, Nidhiben Kaswala, Daniel Osterholz, Andreas Rausch, Meng Zhang

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 本文提出基于UML的ROS 2系统层次结构架构建模方法,并结合LLM代理实现从代码和配置文件中自动化恢复架构模型,提升系统可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09716 2026-08-25 cs.CL 版本更新 57%

Opportunities and Challenges of Natural Language Processing for Low-Resource Senegalese Languages in Social Science Research

自然语言处理在塞内加尔语言社会科学研究中的机遇与挑战

Derguene Mbaye, Tatiana D. P. Mbengue, Madoune R. Seye, Moussa Diallo, Mamadou L. Ndiaye, Dimitri S. Adjanohoun, Cheikh S. Wade, Djiby Sow, Jean-Claude B. Munyaka, Jerome Chenal

机构 * Polytechnic School (ESP)(多科技术校) Gaston Berger University (UGB)(加斯顿-伯杰大学) Federal Institute of Technology Lausanne (EPFL)(洛桑联邦理工学院)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL

AI总结 本文探讨了自然语言处理在塞内加尔六种语言社会科学研究中的机遇与挑战,提出构建可持续的NLP生态系统,强调伦理治理与跨学科合作。

Comments 45 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05813 2026-08-25 cs.SE 版本更新 57%

An Empirical Study of Java Code Improvements Based on Stack Overflow Answer Edits

基于Stack Overflow回答编辑的Java代码改进实证研究

In-on Wiratsin, Chaiyong Ragkhitwetsagul, Matheus Paixao, Denis De Sousa, Pongpop Lapvikai, Peter Haddawy

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 本研究通过分析Stack Overflow的Java回答编辑,识别可改进的开源Java代码,发现近7%的采纳回答有多次修订,近半数编辑代码可应用于开源项目,11个bug修复方案被接受。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20637 2026-08-24 cs.CR cs.AI 新提交 57%

ARQ: Agentic CodeQL Query Refinement for C/C++ Vulnerability Detection

ARQ:用于C/C++漏洞检测的智能CodeQL查询优化框架

Chunyi Wang, Yunfei Ke, Junfeng Yang, Yun-Yun Tsai, Penghui Li

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 本文提出ARQ智能框架,利用合成C/C++程序的执行证据和LLM优化CodeQL查询,无需标注数据等,优化后查询的真阳性最多提升119.8%,还修复了长期悬而未决的问题并发现新漏洞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20343 2026-08-24 cs.LG stat.AP 新提交 57%

Bankruptcy Prediction via Hybrid Resampling and Stacking Ensemble Techniques with Explainable Artificial Intelligence (XAI)-Driven Analysis

结合可解释人工智能(XAI)分析的混合重采样与堆叠集成技术的破产预测

Obu-Amoah Ampomah, Edmund Fosu Agyemang, Kofi Acheampong, Louis Agyekum, Enock Adu Bonsu, Eric Nyarko

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 本研究提出整合多技术的破产预测框架,在不平衡金融数据中优化少数类检测,经实验验证了模型性能,可助力财务困境企业的早期预警系统建设。

Comments 24 pages, 7 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18822 2026-08-20 cs.SE 新提交 57%

Contract-Aware Rescue of a Drifted Isabelle Development: The Double-Tank Case Study

感知契约的漂移Isabelle开发修复:双水箱案例研究

Jim Woodcock, Gabriel Leite, Augusto Sampaio, Ran Wei

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 针对Isabelle开发漂移问题,以双水箱控制器案例为研究对象,用CAPRI工具重构修复了10个义务,完成部分验证工作,为交互式定理证明器的开发维护提供了实践参考。

Comments 15 pages. Submitted to Formal Methods for Autonomous Systems 2026 (FMAS 2026). Reproducibility artefact: DOI 10.5281/zenodo.21981425

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19522 2026-08-20 cs.LG 版本更新 57%

Contrasting Cost-Agnostic and Cost-Sensitive Losses under Limited Model Capacity via $\mathcal H$-consistency

有限模型容量下基于$\boldsymbol{\textit{\textit{\textbf{H}}}}$-一致性的成本无关与成本敏感损失对比

Jessica Finocchiaro, Sanket Shah, Milind Tambe

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 本文针对有限模型容量场景,通过$\boldsymbol{\textit{\textit{\textbf{H}}}}$-一致性建立了成本无关与成本敏感损失的性能差距,在UCI分类数据集上验证了该差距的存在,解释了成本敏感方法提升性能的理论成因。

Comments Significant update from version 1

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17159 2026-08-19 cs.SE cs.CR cs.DL 新提交 57%

A Multi-Surface Consistency Audit of Software Citation Metadata

软件引用元数据的多表面一致性审计

Pengyin Shan

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 本文对117个开源研究型软件项目的多达7个机器可读元数据表面进行审计,发现83.9%的项目存在核心字段冲突,多数冲突源于表面描述的是软件论文而非软件本身,同时发布了审计相关资源。

Comments 10 pages, 2 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17760 2026-08-19 cs.IT cs.AI eess.SP math.IT 新提交 57%

Learnware for CSI Feedback: Scene-specific Small Models Can Do Big

用于CSI反馈的学习件:特定场景的小型模型可发挥大作用

Xiangyi Li, Jiajia Guo, Chao-Kai Wen, Xin Geng, Shi Jin, Zhi-Hua Zhou

机构 * Southeast University(东南大学) The Hong Kong University of Science and Technology(香港科技大学) National Sun Yat-sen University(国立中山大学) Nanjing University(南京大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 针对6G CSI反馈的模型泛化与场景性能权衡问题,提出基于学习件的模型仓库框架,可高效检索匹配的预训练模型,在LOS/NLOS场景下性能优于通用模型,减少训练开销并增强隐私。

Comments This work has been accepted by IEEE Transactions on Wireless Communications. Copyright may be transferred without notice, after which this version may no longer be accessible

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15209 2026-08-19 cs.CL 版本更新 57%

Expanding the Lexicon of Ge'ez Based African Languages: A Comparative Study of Amharic and Tigrinya

扩展基于吉兹语的非洲语言词汇:阿姆哈拉语和提格雷尼亚语的比较研究

Hailay Kidu Teklehaymanot, Debela Desalegn Yadeta, Wolfgang Nejdl

专题命中 仓库级理解 :repository(abstract);分类 cs.CL

AI总结 针对低资源非拉丁脚本语言表现不佳问题,提出VEXMLM。通过训练特定语言分词器扩展XLM - R词汇并初始化嵌入,分两阶段训练,在多种任务上评估。贡献为定制程序、两阶段策略及多语言评估,提升了相关语言任务性能。

Comments 13 pages , 7 tables , 2 figurs

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16262 2026-08-18 cs.SE 新提交 57%

Implicit, Yet Impactful: Understanding Hidden Dependencies in Java Projects

隐式却影响重大:理解Java项目中的隐藏依赖关系

Lyuye Zhang, Chengwei Liu, Fangyuan Zhang, Yiran Zhang, Yuan Zhou, Yang Liu

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 本研究针对Java项目的隐式依赖问题,构建含1157个库、19812个版本及972个模块的数据集,量化其影响并分析应对措施,为开源生态系统提供解决方案。

Comments 13 pages, ASE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16112 2026-08-18 cs.SE 新提交 57%

Strategic Technical Debt: A Real Options Approach to Early-Stage Software Experimentation

策略性技术债务:早期软件实验的实物期权方法

Rashid Azarang, Mohammad Reza Azarang Esfandiari

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 本文将早期软件实验中刻意产生的技术债务视为看涨期权,明确策略性与有毒债务的边界,构建序贯模型得出关键结论,并开展两项预注册实证检验。

Comments 25 pages, 4 figures. Pre-registered empirical program: OSF bs3cr (EP3'), rvx5t (EP-Pi)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15881 2026-08-18 cs.LG cs.CE 新提交 57%

Deploying Frontier Agentic Technology in MOOSEnger, a Multiphysics-Capable AI Assistant

在多物理场AI助手MOOSEnger中部署前沿智能体技术

Zaid Abulawi, Mengnan Li, Guillaume Giudicelli, Yang Liu, Cody Permann

机构 * Texas A&M University (TAMU)(德克萨斯农工大学) Idaho National Laboratory (INL)(爱达荷国家实验室)

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 本研究为面向MOOSE框架的AI智能体MOOSEnger扩展本地托管模型管控层,经多类工程任务测试,MOOSEnger-GPT-5.2成功率达90%,凸显智能体管控层对多物理场仿真的支撑价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15102 2026-08-18 cs.CL 新提交 57%

A Declarative-Procedural Perspective on Expert Routing in Bilingual Mixture-of-Experts Language Models

双语混合专家语言模型中专家路由的声明式-过程式视角

Amrit Gopinath, Raghul, Durairaj Thenmozhi

机构 * Sri Sivasubramaniya Nadar College of Engineering(斯里·西瓦苏布拉马尼亚·纳达尔工程学院) Shiv Nadar University Chennai(钦奈希夫·纳达尔大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL

AI总结 该研究探究双语MoE语言模型的专家路由是否形成语言结构,对比课程学习与无课程训练的模型,发现无课程模型专业化更强但依赖随机种子,课程模型路由更均衡,揭示MoE路由可出现可解释语言组织。

Comments 15 pages, 6 figures, 12 tables (including appendix)

详情

展开后加载摘要…

URL PDF HTML 收藏