arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

共收录 178 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 仓库级理解 178 篇

2607.17147 2026-07-21 cs.CR cs.CL 新提交 57%

SlotGuard: Stop Oversharing Private Local Context in LLM Agent Transcri

SlotGuard:阻止大语言模型代理转录中过度共享私有本地上下文

Haocheng Xia, Yongjoo Park

机构 * Siebel School of Computing(计算机科学系) Data Science, University of Illinois Urbana-Champaign(数据科学,伊利诺伊大学厄巴纳-香槟分校)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL

AI总结 研究大语言模型代理转录本隐私泄露问题,提出SlotGuard方法,通过重写结构绑定、替换机密值、链接跨轮引用等操作隐藏敏感数据,在保持代理性能的同时大幅降低凭证泄漏率。

Comments ICML 2026 AIWILD

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13021 2026-07-15 cs.SE 新提交 57%

Software Supply Chains are Dead: Use-Case-Oriented Regeneration

软件供应链已死:面向用例的再生

Tanmay Singla, James C. Davis

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 研究现代软件开发中构建与复用权衡因软件供应链攻击及生成式人工智能而改变,提出面向用例的再生范式,评估智能工作流程,通过对180个存储库-依赖对测量,证明该方法可行,推动软件采购向可验证的特定于存储库的代码合成发展。

Comments [ESEM'26-ERVR] Proceedings of the 20th International Symposium on Empirical Software Engineering and Measurement (ESEM 2026 Emerging Results, Vision, and Reflection Papers)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12301 2026-07-15 cs.SE cs.MA 新提交 57%

XScientist: A Git-Like Research Protocol for Long-Running Autonomous Scientific Discovery

XScientist:用于长期自主科学发现的类似Git的研究协议

Jixiang Luo

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 研究针对自主研究系统的问题,提出XScientist这一类似Git的研究协议和操作系统,核心方法是将运行视为可移植工件并导出相关协议,主要贡献是使自主科学从单次演示走向可重现、可审查和可分叉的研究基础设施。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10712 2026-07-14 cs.CR cs.AI cs.DL 新提交 57%

Distributed Denial of Science: How Indirect Data Poisoning of AI Systems Can Industrialize Scientific Fraud

分布式科学否认:人工智能系统的间接数据投毒如何使科学欺诈产业化

Bálint Gyevnár, Atoosa Kasirzadeh, Nihar B. Shah

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 研究探讨人工智能时代科学欺诈新形式,即间接数据投毒。对手 corrupt 开放数据集上传,使自主研究代理处理后传播欺诈。通过多话题、多系统实验发现投毒成功率高而检测率低。提出科学家角色和数据溯源审计措施,后者可有效降低攻击成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09876 2026-07-14 cs.CV cs.AI q-bio.NC q-bio.QM 新提交 57%

Prompting-MammAlps: Fine-Grained Text-to-Video Retrieval for Camera-Trap Data

Prompting-MammAlps:用于相机陷阱数据的细粒度文本到视频检索

Valentin Gabeff, Baptiste Maquignaz, Jennifer Shan, Sepideh Mamooler, Gencer Sumbul, Blair Costelloe, Devis Tuia, Alexander Mathis

机构 * Ecole Polytechnique Fédérale de Lausanne (EPFL)(洛桑联邦理工学院) Max Planck Institute of Animal Behavior(马克斯·普朗克动物行为研究所) University of Konstanz(康斯坦茨大学)

专题命中 仓库级理解 :coding agent(abstract);分类 cs.AI

AI总结 针对相机陷阱数据自动检索视频的难题,提出Prompting-MammAlps基准及细粒度可解释TVR方法,训练视觉变压器并结合大语言模型处理查询,在基准测试中取得较好成绩,优于零样本VLM。

Comments Accepted at ECCV 2026; Project page: https://cnai.epfl.ch/prompting-mammalps

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06820 2026-07-09 cs.AI 新提交 57%

Evaluating SageMath-Augmented LLM Agents for Computational and Experimental Mathematics

评估用于计算和实验数学的SageMath增强型大语言模型智能体

Pavel Snopov, German Magai

机构 * The Sage Developers(Sage开发者团队)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 研究聚焦AI在数学领域进展,提出结合大语言模型推理与SageMath反馈的智能体设置,改进RealMath基准。实验表明该设置能提升模型性能,缩小模型差距,CAS增强型智能体在计算探索上有潜力,朝自动猜想发现迈进。

Comments 37 pages, 16 figures, accepted to 3rd AI for Math Workshop at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06258 2026-07-08 cs.CL 新提交 57%

Early Language Learning via Spreading Activation and Category Exploration in Complex Networks

通过复杂网络中的扩散激活和类别探索进行早期语言学习

Salvatore Citraro

机构 * National Research Council (CNR)(国家研究理事会)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL

AI总结 研究儿童词汇习得在语义和词汇类别上是否不均衡,将早期语言学习建模为基于图的搜索,由扩散激活和类别探索驱动,用多种资源评估模型在四种语言上的性能,发现扩散激活表现更好,揭示词汇发展与激活动态及约束的关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04948 2026-07-07 cs.SE 新提交 57%

Using Process Mining to Generate AI Agents from Software Engineering Process Records

利用过程挖掘从软件工程过程记录生成人工智能代理

Saimir Bala, Fabiana Fournier, Lior Limonad, Andreas Metzger

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 研究如何在软件工程中结合人工智能代理,面临代理粒度和关注点分离难题。通过过程挖掘,用软件库事件日志发现特定项目代理角色,生成规范与实现,并进行测试和用户研究验证效果。

Comments To be published at the 24th International Conference on Business Process Management (BPM 2026), Process Technology Forum

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03220 2026-07-07 cs.CR cs.AI 新提交 57%

CONTRA: Red-Teaming Configurations of Personalizable Agents

CONTRA:可个性化代理的红队配置

Jonathan Nöther, Adish Singla, Goran Radanovic

机构 * Max Planck Institute for Software Systems(马克斯·普朗克软件研究所)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 探讨代理配置与执行危险行为风险的关系,提出CONTRA算法,通过推理评估良性但危险的配置发现导致恶意行为的代理配置,构建数据集分析发现多数技能有恶意配置,CONTRA能成功识别部分危险配置。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01609 2026-07-03 cs.LG 新提交 57%

SINA: A Fully Automated Circuit Schematic Image to Netlist Generator Using Artificial Intelligence

SINA: 一种使用人工智能的全自动电路原理图图像到网表生成器

Saoud Aldowaish, Yashwanth Karumanchi, Kai-Chen Chiang, Mohammed Ayman Habib, Finn Murphy, Rishen Cao, Morteza Fayazi

机构 * The Department of Electrical and Computer Engineering, University of Utah(犹他大学电气与计算机工程系) The Department of Electrical, Computer & Energy Engineering, University of Colorado Boulder(科罗拉多大学博尔德分校电气、计算机与能源工程系)

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 提出SINA,一种全自动开源流水线,集成深度学习、连通分量标记、OCR和视觉语言模型,实现从电路原理图图像到网表的转换,在IC和PCB级别均达到96.67%的生成准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01494 2026-07-03 cs.SE cs.ET cs.HC cs.SI 新提交 57%

Insights from GitHub Community on the Matter Standard: Developer Perspectives and Challenges

GitHub社区对Matter标准的洞察:开发者视角与挑战

Muhammad Hassan, Carl Gunter, Susan Landau, Masooda Bashir

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 通过分析GitHub上超过13,000个议题,识别出Matter标准在测试、互操作性、开发及平台网络方面的四大挑战,为改进测试基础设施和跨厂商指南提供机会。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26979 2026-07-03 cs.SE 新提交 57%

How Much Static Structure Do Code Agents Need? A Study of Deterministic Anchoring

代码智能体需要多少静态结构?关于确定性锚定的研究

Zhihao Lin, Mingyi Zhou, Yizhuo Yang, Li Li

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 研究轻量级静态分析(如调用图、继承层次)作为确定性锚定,通过注入结构注释提高代码智能体导航的可复现性和稳定性,发现锚定效果依赖粒度与仓库特性。

Comments Accepted to the ACM SIGSOFT International Symposium on Software Testing and Analysis (ISSTA 2026). 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00185 2026-07-02 cs.CL 新提交 57%

Structural Pattern Mining in Inka Khipus: Unsupervised Clustering, Provenance Classification, and a Computational Validation of the Santa Valley Match

印加奇普中的结构模式挖掘:无监督聚类、来源分类及圣谷匹配的计算验证

Maria Contreras

机构 * Universidad Peruana de Ciencias Aplicadas (UPC)(秘鲁应用科技大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL

AI总结 提出可复现的机器学习流程,对619个奇普进行无监督聚类(轮廓系数0.769)和监督来源分类(F1=0.86),并独立验证了圣谷奇普的recto/verso结构。

Comments 10 pages, 4 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31354 2026-07-01 cs.SE 新提交 57%

Mutating the "Immutable": A Large-Scale Study of Git Tag Alterations

改变“不可变”:Git 标签变更的大规模研究

Solal Rapaport, Laurent Pautet, Samuel Tardieu, Stefano Zacchiroli, Théo Zimmermann

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 通过分析3.284亿软件仓库,发现1020万次标签变更影响18.9万仓库,并与Nixpkgs交叉验证表明标签变更导致可重现构建失败,建议使用加密提交哈希固定依赖并建立审计日志。

Journal ref 2026 ACM Conference on Reproducibility and Replicability, Jul 2026, Delft, Netherlands

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22593 2026-07-01 cs.SE cs.CR 新提交 57%

On Good Authority: Release-Authority Measurement for Registry-Mediated Package Ecosystems

论良好权威:注册中心中介的包生态系统的发布权威度量

Igor Santos-Grueiro

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 提出一种前驱感知的发布权威记录,通过比较发布路径证据(发布者、仓库、工作流、来源、签名、中介)识别策略触发的发布路径不连续性,经npm等五个生态系统的审计样本验证,触发策略可有效筛选需审查的发布。

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27386 2026-06-29 cs.DL cs.AI 新提交 57%

Agentic Publication Protocol: An Attempt to Modernize Scientific Publication

Agentic Publication Protocol:科学出版现代化的一次尝试

Sirui Lu, Xiao-Liang Qi

机构 * Max-Planck-Institut für Quantenoptik(马克斯·普朗克量子光学研究所) Munich Center for Quantum Science and Technology(慕尼黑量子科学与技术中心) Leinweber Institute for Theoretical Physics(莱因韦伯理论物理研究所)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 提出Agentic Publication Protocol(APP),一种将论文与代码、数据、环境信息及智能体指令打包的轻量级仓库格式,使未来研究者能直接使用操作知识。

Comments 16 pages, 5 figures and 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27041 2026-06-26 cs.LO cs.PL 新提交 57%

Formalizing a Many-Sorted Hybrid Polyadic Modal Logic in Lean

在Lean中形式化多类混合多模态逻辑

Andrei-Alexandru Oltean, Bogdan Macovei, Ioana Leuştean

专题命中 仓库级理解 :repository(abstract);分类 cs.PL

AI总结 本文在Lean中形式化了一个多类签名和多模态算子的混合模态逻辑,提供DSL用于定义语言和协议,并证明了其可靠性定理,展示了在代码验证、BAN逻辑和S5系统中的应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27055 2026-06-26 astro-ph.EP astro-ph.IM astro-ph.SR cs.CG cs.SE 新提交 57%

Solarsystem: A Validated Lightweight Python Package for Planetary Positions and Solar-Lunar Event Calculations

Solarsystem: 一个经过验证的轻量级Python包,用于行星位置和太阳-月球事件计算

Ioannis Nasios

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 本文介绍solarsystem,一个轻量级、无依赖的Python包,使用解析模型计算行星位置和太阳-月球事件,经JPL DE440星历验证,平均经度偏差0.44角分,纬度偏差0.16角分。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23984 2026-06-24 cs.SE 新提交 57%

Domain-Driven Design in Practice: A Mining Study of Maintenance and Evolution in Open-Source Repositories

领域驱动设计实践:开源仓库中维护与演化的挖掘研究

Weixing Zhang, Bowen Jiang, Yuhong Fu, Haowei Cheng, Mario Herb, Anne Koziolek

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 通过挖掘GitHub仓库,研究领域驱动设计战术构建块的分布、演化及其对软件维护质量的影响,量化边界上下文违规的规模与维护关联。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23329 2026-06-23 cs.SE 新提交 57%

Generate with CodeXHug: A Dataset to Enhance Model Cards with Code Usage Patterns

Generate with CodeXHug: 一个增强模型卡片代码使用模式的数据集

Stefano Palombo, Claudio Di Sipio, Juri Di Rocco, Davide Di Ruscio

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 提出CodeXHug数据集,从HuggingFace和GitHub收集预训练模型及其代码使用模式,通过统计分析和聚类提取代表性代码模式,以支持开发者理解和使用PTMs。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21787 2026-06-23 cs.SE 新提交 57%

Towards Imputation of Pre-Trained Language Model Metadata using Semantic Fingerprinting

基于语义指纹的预训练语言模型元数据插补方法

Adekunle Ajibode, Oussama Ben Sghaier, Keheliya Gallaba, Bram Adams, Ahmed E. Hassan

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 提出语义指纹(SemFin)方法,利用Hugging Face配置文件和仓库标签自动插补缺失的PTLM元数据并重建模型谱系,在317,133个模型上相比基线提升预测准确率最高31.4%,并成功处理16.6%的孤立模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20966 2026-06-23 cs.SE 新提交 57%

Beyond the Grave: An Empirical Study of Dormancy and Revival in Scientific Open-Source Software

超越坟墓:科学开源软件休眠与复兴的实证研究

Addi Malviya Thakur, Bogdan Vasilescu, Audris Mockus

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 通过分析SciCat语料库中2984个休眠后复兴的项目,发现52.5%的休眠原因无法从仓库证据中确定,非持续性复兴是持续性复兴的2.14倍,生命周期原型比复兴机制更能预测可持续性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17858 2026-06-17 cs.LG 新提交 57%

Meta-classification of one-class classification models using ranking correlation and nearest neighbor

使用排序相关性和最近邻的一类分类模型的元分类

Toshitaka Hayashi, Hamido Fujita, Dalibor Cimr, Richard Cimler, Jitka Kühnová

机构 * Faculty of Science, University of Hradec Kralove(赫拉德茨-克拉洛韦大学理学院) Malaysia-Japan International Institute of Technology (MJIIT), Universiti Teknologi Malaysia(马来西亚-日本国际技术学院,马来西亚理工大学) Regional Research Center, Iwate Prefectural University(岩手县立大学区域研究中心)

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 提出用排序相关性和最近邻对一类分类模型进行元分类,实验表明能高精度区分数据集、算法和超参数,本质是数据集分类。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17628 2026-06-17 cs.CL 新提交 57%

OPD-Evolver: Cultivating Holistic Agent Evolver via On-Policy Distillation

OPD-Evolver:通过在线策略蒸馏培养整体智能体进化器

Guibin Zhang, Xun Xu, Yanwei Yue, Zikun Su, Wangchunshu Zhou, Xiaobin Hu, Shuicheng Yan

机构 * LV-NUS Lab(林文实验室) FDU(福建大学) PKU(北京大学) Bytedance Inc.(字节跳动公司)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL

AI总结 提出OPD-Evolver框架,通过快慢双循环和在线策略自蒸馏,使智能体学会选择、使用、编写和维护经验,在多个基准上超越现有方法,并让小模型挑战大模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18032 2026-06-17 math.NA cs.LG cs.NA physics.comp-ph 新提交 57%

INI-VPINN: A Variational Physics-Informed Neural Network with Implicit Neumann and Interface Handling for Multi-Material Domains with Geometric Singularities

INI-VPINN:一种隐式处理纽曼边界和界面的变分物理信息神经网络,适用于具有几何奇异性的多材料域

Shayan Dodge, Alessandro Formisano, Sami Barmada

机构 * DESTeC University of Pisa(DESTeC 帕尔米斯大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 提出一种新的弱形式物理信息神经网络INI-VPINN,通过隐式处理纽曼边界和界面条件,无需额外损失项或多子域网络,在多材料问题中实现更高精度和更快收敛。

Comments Preprint version. Under peer review. Code available at: https://github.com/ShayanDodge/INI-VPINN

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15783 2026-06-16 cs.CL 新提交 57%

ttda704 at SemEval-2026 Task 4: Modeling Narrative Structures via Pseudonymization and Multi-View Sentence Alignment

ttda704 在 SemEval-2026 任务 4:通过假名化和多视角句子对齐建模叙事结构

Tai Tran Tan, An Dinh Thien

机构 * University of Information Technology, Ho Chi Minh City, Vietnam(胡志明市信息技术大学) Vietnam National University, Ho Chi Minh City, Vietnam(越南国立大学胡志明市分校)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL

AI总结 提出基于对比学习和微调句子变换器的叙事相似度方法,包括单视角(智能层冻结)和多视角(主题/情节/结局投影头+自监督对齐)两条流水线,在合成数据上训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13295 2026-06-16 stat.ML cs.LG stat.ME 新提交 57%

Simultaneous Latent Budget Trees for Stratified Classification

用于分层分类的同时潜在预算树

Simultaneous Latent Budget Trees for Stratified Classification Cristian Buoncompagni, Stefano Pellegrino, Giulia Vannucci, Raffaele Dubbioso, Roberta Siciliano

机构 * Department of Physics, University of Naples Federico II(物理系,那不勒斯费德里科二世大学) Department of Electrical Engineering and Information Technologies, University of Naples Federico II(电气工程与信息科技系,那不勒斯费德里科二世大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 提出同时潜在预算树框架,通过模型驱动的分裂规则处理分层因素,实现可解释分类,并应用于肌萎缩侧索硬化症性别差异分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14616 2026-06-15 cs.SE 新提交 57%

GitHub Template Repositories: Served Domains, Maintenance, and Practitioner Guidelines

GitHub 模板仓库:服务领域、维护与从业者指南

Leuson Da Silva, Altaf Allah Abbassi, Imen Trabelsi, Paulo Borba, Foutse Khomh

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 通过对五种主流编程语言的 GitHub 模板仓库进行大规模实证研究,分析了模板的服务领域、维护特征及质量问题,并提出了设计和管理模板的实用指南。

Comments 12 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13392 2026-06-15 cs.AI 新提交 57%

MiniMax Sparse Attention

MiniMax 稀疏注意力

Xunhao Lai, Weiqi Xu, Yufeng Yang, Qiaorui Chen, Yang Xu, Lunbin Zeng, Xiaolong Li, Haohai Sun, Haichao Zhu, Vito Zhang, Jinkai Hu, Jiayao Li, Rui Gao, Zekun Li, Songquan Zhu, Jingkai Zhou, Pengyu Zhao

机构 * MiniMax Peking University(北京大学) NVIDIA(英伟达) Zhejiang University(浙江大学) Huazhong University of Science and Technology(华中科技大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 提出 MiniMax 稀疏注意力(MSA),一种基于分组查询注意力的块级稀疏注意力机制,通过轻量索引分支选择 Top-k 键值块,实现高效长上下文处理,在 109B 模型上以 1M 上下文减少 28.4 倍注意力计算,并带来 14.2 倍预填充和 7.6 倍解码加速。

Comments 30 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12040 2026-06-12 cs.AI cs.GR 新提交 57%

A Lightweight Multi-Agent Framework for Automated Concrete Barrier Design

一种用于自动混凝土护栏设计的轻量级多智能体框架

Wanting Wang, Xiye Ma, Yuyang He, Minghui Cheng, Ran Cao

机构 * College of Civil Engineering, Hunan University(湖南大学土木工程学院) Department of Civil and Architectural Engineering, University of Miami(迈阿密大学土木与建筑系) School of Architecture, University of Miami(迈阿密大学建筑学院)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 提出基于AutoGen的“生成-评估-优化”闭环多智能体框架,实现混凝土护栏自动设计,准确率超98%,且8B参数轻量模型可优于631B旗舰模型。

详情

展开后加载摘要…

URL PDF HTML 收藏