arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

共收录 3953 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 仓库级理解 3953 篇

2606.28120 2026-08-11 cs.DL cs.SE cs.SI 版本更新 57%

The Reciprocal Impact of Science and Software: A Cross-Corpus Analysis of How Research Shapes Software and Software Enables Research

科学与软件的相互影响:跨语料库分析研究如何塑造软件以及软件如何赋能研究

Audris Mockus

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 通过构建包含6980万条边的跨语料库图,链接软件仓库与学术文献,分析科学对软件的影响(如可重复性工具)和软件对科学的影响(如机器学习基础设施),发现直接引用稀疏且依赖复用与引用计数的相关性较弱。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22758 2026-08-11 cs.AI 版本更新 57%

AutoRefine: Compiling Trajectories into Validated Typed Agent Artifacts

AutoRefine: 从轨迹到可重用的专业知识为连续LLM代理优化

Libin Qiu, Zhirong Gao, Junfu Chen, Yuhang Ye, Liangyu Li, Weizhi Huang, Xiaobo Xue, Wenkai Qiu, Shuo Tang

机构 * alibaba(阿里巴巴集团)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 AutoRefine通过提取和维护双重形式的经验模式,提升连续LLM代理的知识积累与维护效率,实现98.4%的准确率提升。

Comments 7 pages, 2 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07901 2026-08-11 cs.GT cs.AI cs.CY cs.MA econ.TH 版本更新 57%

The Theory of Strategic Evolution: Games with Endogenous Players and the Seven Laws of Strategic Replicators

战略进化理论:具有内生参与者和战略复制者的博弈

Kevin Vallier

机构 * Institute of American Constitutional Thought and Leadership(美国宪法思想与领导力研究所) University of Toledo(托莱多大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 本文提出战略进化理论,引入具有内生参与者的博弈,定义进化稳定智能分布,通过跨层增益矩阵构建战略层层次结构,证明相关封闭性及定理,可用于分析人工智能部署动态等,揭示人格工程问题及稳定多智能体系统的宪法约束。

Comments 171 pages. Formalized in Lean 4 with Mathlib: 240 theorems in the elaborated environment, 141 audited headline results, cold-compiling from a clean checkout with zero custom axioms. Source, theorem-by-theorem contract, and reproducible axiom audit: https://github.com/selfreferencing/TSE_Formal. Companion to Agentic Capital

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09062 2026-08-11 cs.CV cs.LG 版本更新 57%

SIP: Site in Pieces- A Dataset of Disaggregated Construction-Phase 3D Scans for Semantic Segmentation and Scene Understanding

SIP: 构建阶段碎片化3D扫描数据集——用于语义分割和场景理解

Seongyong Kim, Yong Kwon Cho

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 SIP数据集通过碎片化3D扫描反映施工现场实际约束,为建筑场景的语义分割和理解提供高质量基准数据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25637 2026-08-10 cs.DL cs.AI cs.SI 版本更新 57%

F(AI)2R: Who Did What, and Who Checked? Verifiable AI Provenance as an Executable Skill

F(AI)2R:谁做了什么,谁进行了检查?可验证的人工智能溯源作为一项可执行技能

Florian Krebs

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 研究将F(AI)2R实验的溯源模型扩展为aiprov,涵盖任何含人工智能工件。方法被打包为可执行技能,由人工智能代理操作,能解析操作员身份,把关图一致性并发布论文版本,以自身为例展示溯源记录。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.15790 2026-08-10 cs.LG stat.ML 版本更新 57%

Certified Interpolation Oversampling: Per-Instance Safety Guarantees for Imbalanced Learning

带安全认证的插值过采样:不平衡学习中针对单个样本的安全保证

Pankaj Yadav, Vivek Vijay

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 本文提出带安全认证的插值过采样(CISO)框架,为不平衡学习生成带安全属性的样本,在多数据集实验中表现与SMOTE相当且无评估失败,揭示了保真度与安全的连续权衡关系。

Comments 39 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05938 2026-08-07 cs.CV cs.LG 新提交 57%

MirrorNet: Can Medical Image Anonymization Really Protect Patient Identity?

MirrorNet:医学图像匿名化真的能保护患者身份吗?

Attila Simkó

机构 * Umeå University(于默奥大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 本研究提出MirrorNet模型,通过耦合循环一致变分自编码器发现去标识化医学扫描仍可识别患者,建议将其作为生物识别数据管理,相关代码与模型已公开。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05253 2026-08-07 cs.LG 新提交 57%

Beyond Rotations: AuroOFT for Expressive Quantized Orthogonal Fine-Tuning

超越旋转:用于表达性量化正交微调的AuroOFT

Yue Han, Dianlin Wang

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 该研究针对量化正交微调(qoft)的线性正交变换局限,提出AuroOFT方法,在保留qoft稳定分支的基础上附加零起点门控低秩非线性残差,在Qwen2.5设置上提升性能并减少可训练参数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05250 2026-08-07 cs.LG 新提交 57%

Beyond Full-Model Rollback: AuroSFT for Adapter-State Multi-Task Fine-Tuning

超越全模型回滚:用于适配器状态多任务监督微调的AuroSFT

Yue Han, Ziniu Liu

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 针对多任务SFT的全模型回滚成本高的问题,提出参数高效框架AuroSFT,将状态转为可合并的适配器状态,在保留骨干网络的比较中平均准确率达61.36%,优于msft的59.85%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04661 2026-08-07 cs.SE 版本更新 57%

An Exploratory Study of Agent Plans for Agentic AI Coding Tools in Open-Source Software

面向开源软件中智能体式AI编码工具的智能体计划探索性研究

Muhammad Auwal Abubakar, Seyedmoein Mohsenimofidi, Jai Lal Lulla, Jie M. Zhang, Christoph Treude, Sebastian Baltes, Matthias Galster

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 本文通过筛选36710个GitHub仓库识别出85个Markdown智能体计划文件,研究其支持的软件工程工作类型与提供的执行指导,明确其是研究人-智能体工作流任务意图的丰富工件。

Comments 14 pages, 2 figures, 4 tables. Accepted at the 20th International Symposium on Empirical Software Engineering and Measurement (ESEM 2026), Emerging Results, Vision, and Reflection Papers Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04459 2026-08-06 cs.SE 新提交 57%

AdaptAgent: A Multi-agent, Domain-Guided Reasoning Framework for Code Adaptation

AdaptAgent:一种用于代码适配的多智能体、领域引导推理框架

Xiaokai Rong, Hridya Dhulipala, Aashish Yadavally, Tien N. Nguyen

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 本研究提出AdaptAgent框架,通过分工的多智能体实现代码适配,在真实数据集上的语义正确性优于强基线,各智能体对适配效果均有重要作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20861 2026-08-06 cs.AI 57%

Fuzzy numbers revisited: operations on extensional fuzzy numbers

Krzysztof Siminski

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

Comments 33 pages, 62 references

Journal ref Fuzzy Sets and Systems, Volume 544, 2026,

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02599 2026-08-04 eess.SY cs.AI cs.SY 新提交 57%

Bridging Artificial Intelligence and Power Systems Education Using a Hands-On Executable Framework

使用可执行实践框架搭建人工智能与电力系统教育的桥梁

Junjie Yin, Buxin She, Xinyu Feng, Fangxing, Li

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 本文提出可执行实践框架,通过渐进式模块降低电力系统AI入门门槛,经IEEE网络研讨会验证,可满足跨学科学习者对电力专用AI实践课程的需求。

Comments 10 pages, 10 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08645 2026-08-04 cs.CL 版本更新 57%

Quick on the Uptake: Eliciting Implicit Intents from Human Demonstrations for Personalized Mobile-Use Agents

快速响应:从人类演示中提取隐含意图以构建个性化移动使用代理

Zheng Wu, Heyuan Huang, Yanjia Yang, Yuanyi Song, Xingyu Lou, Weiwen Liu, Weinan Zhang, Jun Wang, Zhuosheng Zhang

机构 * School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学与工程学院) OPPO Research Institute(OPPO研究院)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL

AI总结 本文提出IFRAgent框架,通过分析显式和隐式意图流,提升移动代理对人类意图的对齐率和任务完成率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22935 2026-08-04 cs.CR cs.SE 版本更新 57%

SPFinder: Improving the Context Length and Scalability for Tracing Known Vulnerability Patches

SPFinder:提升已知漏洞补丁追踪的上下文长度与可扩展性

Jiangrui Zheng, Xueqing Liu, Guanqun Yang, Siyan Wen, Qiushi Liu, Xiaoyin Wang

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 SPFinder是一种用于追踪已知漏洞补丁的可扩展检索框架,通过分层嵌入和三阶段检索解决长上下文与可扩展性问题,在多数据集评估中优于现有方法,可实用关联CVE补丁。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18062 2026-08-04 cs.SE 版本更新 57%

An Empirical Study of Complexity, Heterogeneity, and Compliance of GitHub Actions Workflows

GitHub Actions工作流的复杂性、异质性与合规性的实证研究

Edward Abrokwah, Taher A. Ghaleb

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 本研究分析Java、Python、C++仓库的GitHub Actions工作流,量化其复杂性、异质性与合规性,发现工作流设计依赖生态惯例,为该领域提供了可复现的实证基准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08913 2026-08-03 cs.LG stat.ML 版本更新 57%

GEMSS: A Variational Method for Discovering Multiple Sparse Solutions in Classification and Regression Problems

GEMSS: 一种用于在分类和回归问题中发现多个稀疏解的变分贝叶斯方法

Kateřina Henclová, Václav Šmídl

机构 * Faculty of Electrical Engineering, Czech Technical University(捷克技术大学电子工程系)

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 提出GEMSS算法,利用结构化spike-and-slab先验、高斯混合近似后验和Jaccard惩罚,通过变分推断同时发现多个多样化的稀疏特征组合,在128个实验和3个真实数据集上优于对比方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27913 2026-07-31 cs.LG 新提交 57%

S-CEReBrO: Breaking the Memory Barrier in Continuous EEG Monitoring

S-CEReBrO:突破连续脑电图监测中的内存瓶颈

Glenn Anta Bucagu, Thorir Mar Ingolfsson, Yawei Li, Luca Benini

机构 * ETH Zurich(苏黎世联邦理工学院) Nanyang Technological University(南洋理工大学) University of Bologna(博洛尼亚大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 该研究针对连续EEG监测中Transformer架构的内存瓶颈,提出S-CEReBrO架构,通过窗口交替注意力实现内存恒定,在EEG下游任务中性能领先且效率提升。

Comments This is the pre-rebuttal version of a paper accepted at MICCAI 2026. The camera-ready version will be posted following the embargo

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23597 2026-07-30 cs.CR cs.CL 版本更新 57%

HiTMS: A High-Throughput Multi-Stream Linguistic Steganography Framework

HiTMS:一个高通量多流语言隐写框架

Ruiyi Yan, Zhongliang Yang, Yugo Murawaki

专题命中 仓库级理解 :repository(abstract);分类 cs.CL

AI总结 HiTMS针对现有语言隐写术单流方案的局限,提出在多轮交互响应中分配秘密,通过批处理调用提高吞吐量,用自描述框架和密钥派生调度保证可恢复性,实验显示其速度提升且降低隐写分析器AUROC,并发增加时吞吐量持续提高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02184 2026-07-30 cs.DL cs.LG 版本更新 57%

The Ghost Couple: Correlated LLM Name Priors and Their Haunting of the Web and Academic Publishing

幽灵搭档:相关的大语言模型姓名先验及其对网络和学术出版的困扰

Michał Brzozowski, Neo Christopher Chung

机构 * Samsung AI Center(三星人工智能中心) University of Warsaw(华沙大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 研究发现大语言模型生成虚构专家姓名时会产生相关性强的角色组合,这些组合具有模型家族特异性,并在Zenodo等平台造成大量幽灵作者记录,影响学术出版。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07851 2026-07-30 cs.SE 版本更新 57%

Uncovering Scientific Software Sustainability through Community Engagement and Software Quality Metrics

通过社区参与和软件质量指标揭示科学软件的可持续性

Sharif Ahmed, Addi Malviya Thakur, Gregory R. Watson, Nasir U. Eisty

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 该研究针对科学开源软件长期维持的挑战,以GitHub上的十个知名Sci-OSS项目为对象,结合社区参与与软件质量指标,提出新颖可视化技术及相关分析方法,为相关人员提供了软件可持续性的关键见解。

Comments Accepted for publication in IEEE Computing in Science & Engineering

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25141 2026-07-29 cs.SE cs.LO cs.SY eess.SY 新提交 57%

Specification-Driven DevOps for Multi-Service Environments

多服务环境下基于规范驱动的DevOps

Oleg Grynets, Kyrylo Fursov, Vasyl Lyashkevych, Volodymyr Veres

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 研究探讨前沿大语言模型能否利用存储库内容为多服务应用生成配置,通过对三个异构存储库评估发现生成环境虽能运行,但有遗漏,进而区分功能正确性与部署意图保真度并得出最小显式部署规范。

Comments 25 pages, 8 figures, 15 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25437 2026-07-29 cs.SE quant-ph 新提交 57%

Repositories, Contributors, and Continuity: An Empirical Study of Foundational Quantum Software

存储库、贡献者与连续性:基础量子软件的实证研究

Vincent Gierisch, Nicole Hoess, Ralf Ramsauer, Wolfgang Mauerer

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 研究量子软件生态系统中概念和影响如何跨存储库边界持续存在,运用实证软件工程技术分析基础量子软件存储库,结合跨库活动与贡献者关系研究社区演变,发现多种发展路径并提供实证视角。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14429 2026-07-29 cs.DL cs.AI cs.CY cs.ET 版本更新 57%

Measuring the State of Open Science in Transportation Using Large Language Models

利用大型语言模型衡量交通运输领域开放科学的状态

Junyi Ji, Ruth Lu, Linda Belkessa, Liming Wang, Silvia Varotto, Yongqi Dong, Nicolas Saunier, Mostafa Ameli, Gregory S. Macfarlane, Bahman Madadi, Cathy Wu

机构 * Massachusetts Institute of Technology(麻省理工学院) Vanderbilt University(范德比大学) Portland State University(波特兰州立大学) Delft University of Technology(代尔夫特理工大学) Brigham Young University(Brigham Young 大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 本文利用大型语言模型自动评估交通研究中数据和代码的开放科学实践,发现仅有少数论文共享代码或数据,揭示了开放科学与传统学术指标之间的不一致,需通过结构性干预促进实践改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24512 2026-07-28 cs.AI cs.DL 新提交 57%

Making Mathematical Knowledge Explainable, Accessible and Interoperable Through Large Language Model Integration

通过大语言模型集成使数学知识可解释、可访问和可互操作

Jan Range, Björn Schembera, Dominik Göddeke

机构 * Stuttgart Center for Simulation Science (SC SimTech), University of Stuttgart(斯图加特大学斯图加特模拟科学中心 (SC SimTech)) Institute of Applied Analysis and Numerical Simulation, University of Stuttgart(斯图加特大学应用分析与数值模拟研究所)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 研究旨在解决数学模型文档不符合FAIR原则及访问难等问题,通过模型上下文协议(MCP)服务器将大语言模型与MathModDB集成,实现基于认知的LLM使用,提高可解释性、可访问性并简化互操作性,通过用例展示了集成优势。

Comments Preprint submitted to 6th Wikidata Workshop@ISWC

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04678 2026-07-28 cs.LG 版本更新 57%

Nearly Tight Bounds for Cross-Learning Contextual Bandits with Graphical Feedback

具有图形反馈的交叉学习上下文博弈的近似紧界

Ruiyuan Huang, Zengfeng Huang

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 研究具有图形反馈的交叉学习上下文博弈,在遗忘对抗损失模型下,针对强可观测图给出肯定答案,算法通过隔离无自环动作、悲观校正等实现\(\widetilde O(\sqrt{\alpha T})\)期望遗憾,实验展示相关好处及缩放。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21885 2026-07-27 cs.LG cs.NA eess.SP math.NA 新提交 57%

Remedying Coarsening-Based GNN Training under Heterophily via Adaptive Complementary Enhancement

通过自适应互补增强修复异质性下基于粗化的图神经网络训练

Guoming Li, Jian Yang, Xukun Wang, Zixiao Wang, Shangsong Liang, Yifan Chen

机构 * Hong Kong Baptist University(香港浸会大学) Renmin University of China(中国人民大学) Chinese Academy of Sciences(中国科学院) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) Sun Yat-sen University(中山大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 研究基于粗化的GNN训练在异构图上性能下降问题,提出自适应互补增强(ACE)策略,通过重新整合粗化丢弃信息、应用正则化及不确定性加权,在异构图基准上提升性能,同构图上保持竞争力且计算开销小。

Comments Accepted at the 42nd Conference on Uncertainty in Artificial Intelligence, UAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21187 2026-07-27 cs.SE 版本更新 57%

Change Impact Recommendation for JavaScript: Lessons from History and Runtime Analysis

JavaScript变更影响推荐:来自历史和运行时分析的教训

Sadjad Tavakoli, Saba Alimadadi

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 针对JavaScript动态特性导致的依赖推断难题,通过结合历史共变模式挖掘和动态依赖分析,提出混合方法Caprese,实验表明两种信号互补,混合推荐效果更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20328 2026-07-23 cs.DL cs.AI 新提交 57%

Understanding Generative AI-mediated User Engagement with Academic Library Resources

理解生成式人工智能介导的用户对学术图书馆资源的参与度

Hae Min Kim, Stacy Stanislaw

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 该研究利用2023年8月至2025年10月网络分析,实证分析生成式人工智能介导用户对学术图书馆资源的参与度,发现流量显著增加,确定主要驱动平台,指出用户访问机构知识库情况,表明需持续分析及战略应对人工智能格局。

Comments This is the accepted manuscript. The final published version will appear in College & Research Libraries, May 2027

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20277 2026-07-23 cs.LG 新提交 57%

Interpretable Fuzzy Rule-Based Regression Extension for Ex-Fuzzy Library

用于Ex-Fuzzy库的可解释模糊规则基回归扩展

Cayan Deniz Kucuktopana, Javier Fumanal-Idocin, Richard Pitts, Javier Andreu-Perez

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 研究针对安全关键等领域机器学习模型需可解释性的问题,为Ex-Fuzzy库提出回归扩展,采用基于模糊C均值聚类的目标感知分区初始化策略,在十个数据集上评估,高斯分区表现优,提供了透明且有竞争力的黑盒回归替代方案。

Journal ref IEEE International Conference on Fuzzy Systems (FUZZ-IEEE), IEEE World Congress on Computational Intelligence (WCCI), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏