arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

2026-09-01 至 2026-09-01 共收录 13 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 仓库级理解 13 篇

2608.30300 2026-09-01 cs.SE 新提交 79%

Update from Hell: Can Coding Agents Survive Hidden Breakage in Dependency Upgrades?

来自地狱的更新:编码智能体能否在依赖升级的隐藏损坏中存活?

Zijian Luo, Runzhi He, Pengfei Gao, Yu Kang, Zeqi Lin, Minghua Ma, Qingwei Lin, Saravan Rajmohan, Yongqiang Tian

专题命中 仓库级理解 :coding agent(title,abstract);分类 cs.SE

AI总结 本文推出含203项真实依赖升级任务的DEPBENCH基准,评估主流编码智能体后发现其仅解决51.2%任务,凸显当前智能体能力与软件维护需求的差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29310 2026-09-01 cs.SE cs.AI cs.CL 新提交 67%

Super Library Agent: Joint Generation and Maintenance of Multiple Applications Beyond the Single Codebase

超级库智能体:超越单一代码库的多应用联合生成与维护

Daegyu Sung, Yukyeong Lee, Geon Park, Yumin Choi, Sung Ju Hwang

专题命中 仓库级理解 :coding agent(abstract);分类 cs.SE、cs.CL、cs.AI

AI总结 针对关联应用组合维护的冗余与结构退化问题,提出超级库智能体方法,通过候选引导提取等技术,在WebGen-Bench等基准上减少冗余并避免结构退化。

Comments Findings of the Association for Computational Linguistics: EMNLP 2026. Project page: https://sbigstar0310.github.io/super-library-agent/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29615 2026-09-01 cs.MA cs.AI cs.LG 新提交 62%

Forward-Deployed Full-Stack Engineering for Autonomous Cloud MLOps

面向自主云 MLOps 的前置式全栈工程

Sagar Srinivas Sakhinana, Venkataramana Runkana

专题命中 仓库级理解 :repository(abstract);分类 cs.AI、cs.LG

AI总结 本研究提出带证据门控的多智能体框架,结合图工程等技术,在 Google Cloud Platform 实现自主云 MLOps 全栈工程,可阻止无效生命周期转换,保障任务达成验证部署或可审计失败。

Comments Nill

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29162 2026-09-01 cs.CV cs.AI cs.LG 新提交 62%

Subtraction-Based Tumor Segmentation and Lesion-Centered pCR Prediction for the MAMA-MIA Challenge

基于相减的肿瘤分割与以病灶为中心的pCR预测:MAMA-MIA挑战赛方案

Kai Geissler, Raphael Schäfer

机构 * Fraunhofer Institute for Digital Medicine MEVIS(弗劳恩霍夫数字医学梅维斯研究所)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI、cs.LG

AI总结 FME团队针对MAMA-MIA挑战赛,提出基于相减输入的nnU-Net集成肿瘤分割方法与基于病灶裁剪块的3D视频分类器集成pCR预测方法,两项任务均获第二名,为跨站点肿瘤分割及pCR预测提供了参考

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27786 2026-09-01 cs.LG cs.AI 版本更新 62%

Locality-Aware Redundancy Pruning for LLM Depth Compression

面向LLM深度压缩的局部感知冗余剪枝

Vincent-Daniel Yun, Youngrae Kim, Woosang Lim, YoungJin Heo, Minkyu Kim, Sunwoo Lee

机构 * University of Southern California(美国南加州大学) Neural Superintelligence Lab, MODULABS(MODULABS神经超级智能实验室) Seoul National University(首尔国立大学) Inha University(釜山大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI、cs.LG

AI总结 提出LoRP,一种基于表示局部性的无训练单次深度剪枝框架,通过引入表示局部性分数(RLS)来识别和剪除冗余层,在多种LLM上提升了困惑度和下游任务准确率。

Comments EMNLP 2026 Main Accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30179 2026-09-01 cs.SE cs.RO 新提交 57%

Open-Source Autonomous Driving System Analysis and Multi-Disciplinary Hardware-in-the-Loop Research Paradigm with Reinforcement-Learning Testing and Large Language Models

开源自动驾驶系统分析及结合强化学习测试与大语言模型的多学科硬件在环研究范式

Dianjing Cheng, Yike Li, Lan Yang, Shan Fang, Wenjia Niu, Xiangyu Shi, Xinyi Zhao, Yunzhe Tian, XingYu Wu, Xiaoshu Cui, Yuanwan Chen, Jialu Sun, Zhongli Wang, Biao Liu, Jiaqi Yang, Jinghui Feng, Feifei Su, Juan Du, Shuangde Fang, Yi Qian, Huiyun Li, Yuansheng Liu, Peng Sun, Mingming Wan, Nan Chen, Ruipeng Gao

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 本文针对开源自动驾驶系统实验记录分散问题,提出Apollo-on-Hongqi EV环境下的实车实验框架,结合大语言模型与强化学习测试,为相关研究提供可审查的实验基础。

Comments 33 pages, 7 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29283 2026-09-01 cs.CR cs.SE 新提交 57%

A Multi-Month Study of Git Commit Signing

Git 提交签名的数月研究

Abubakar Sadiq Shittu, John Sadik, Scott Ruoti

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 本研究对22名计算机科学专业学生开展三个月Git提交签名使用研究,发现其存在配置阻碍、难发现异常提交、对签名保障存误解等问题,指出仅简化签名不足以保障安全使用,还需配套工具与教育支持。

Comments A shortened version of this paper appears in the Proceedings of the 2026 ACM SIGSAC Conference on Computer and Communications Security (ACM CCS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28646 2026-09-01 cs.AI 新提交 57%

BiasMix-Finance: Post-Generation KYC Guardrails for LLM Portfolio Advice

BiasMix-Finance:面向LLM投资组合建议的生成后KYC护栏

Gaurav Kukreja, Parul Kukreja, Mohammed Abraar, Raj Dandekar, Rajat Dandekar, Sreedath Panat

机构 * Vizuara(维祖拉公司)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 本文提出BiasMix-Finance生成后KYC护栏流水线,含JSON模式约束、数值上限验证及凸二次规划投影,可将LLM投资组合建议违规率降至0%,并发布相关基准与代码。

Comments 18 pages, 9 figures, 8 tables. Accepted to the ICLR 2026 Financial AI (FinAI) Workshop. Code and data: https://github.com/gauravkukreja06/biasmix-finance

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28631 2026-09-01 cs.AI cs.CE cs.CY 新提交 57%

CrossAudit: A Git-Native, Cross-Vendor Audit Loop for Agentic Science

CrossAudit:面向智能体科学的原生Git跨供应商审计循环

Zhaohe Dong, Yuhao Chen

机构 * University of Cambridge(剑桥大学) University of Wisconsin–Madison(威斯康星大学麦迪逊分校)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 CrossAudit是面向智能体科学的原生Git跨供应商审计协议,通过不同供应商智能体按人类规则审计工作,试验显示不同供应商对规则解读有差异,其自身审计记录为核心证据。

Comments 19 pages, 4 figures, 3 tables, 22 references. Reference implementation, audit ledger, and experiment artefacts: https://github.com/dongzhaohe321418-lab/crossaudit

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22215 2026-09-01 cs.CL 版本更新 57%

Dual-Layer Agentic Memory with Fast Write Routing and Slow Consolidation

带有快速写入路由与慢速整合的双层智能体记忆

Wenzhi Li, Dong Nie, Rui Lan, Tongtong Lyu, Peiyao Wang, Lingzi Hong, Weihang Pan, Binbin Lin, Boyuan Pan, Yao Hu

机构 * Zhejiang University(浙江大学) Xiaohongshu(小红书) University of North Texas(北得克萨斯大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL

AI总结 该研究针对LLM智能体动态环境下的记忆管理问题,提出双层智能体记忆框架,通过成本感知路由与周期性整合实现高效记忆处理,在保留高检索性能的同时减少冗余。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09156 2026-09-01 cs.LG 版本更新 57%

Activation Steering Transfer to Agents: One Gain Ratio Does Not Identify Potency and Efficacy

存在但重新缩放:加法激活引导的聊天到智能体的转移

Lucas Pinto

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 研究加法激活引导从聊天到智能体的转移,通过匹配信息设计进行研究,发现转移真实但重新缩放,确定了加法特定机制,定位了重新缩放位置,指出智能体部署对引导拒绝绕过影响不可预测。

Comments v3 qualifies the two-sided sign claim to the primary dose grid: the sole positive cell loses CI-exclusion under the registered alpha*-trim. Also discloses the comparison set behind the overlapping-gain pair. 42 pages, 7 figures, 9 tables. Includes an errata section correcting v1's public record. Code: github.com/digdoug/steering-dose-reparametrization

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30221 2026-09-01 math.ST stat.TH 新提交 50%

Cubic-Root Gaussian Approximation under Unrestricted Covariance

无约束协方差下的立方根高斯近似

Zijun Gao, Weihan Zhang

专题命中 仓库级理解 :repository(abstract)

AI总结 该研究针对无约束协方差下高维矩形的高斯近似问题,通过两阶段插值与无秩矩阵加权高斯曲面界的方法,否定了Chernozhukov等人关于多项式维度下$n^{-1/4}$速率接近最优的推测,得出新的近似误差界为$n^{-1/3}$。

Comments 52 pages, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28764 2026-09-01 physics.ed-ph physics.class-ph physics.pop-ph 新提交 50%

Stable levitation of ring magnets: A low-cost, 3D-printed experiment on the magnetic force-distance law

环形磁铁的稳定悬浮:基于磁力-距离定律的低成本3D打印实验

M. Flores, A. Kahrs, F. Rinderknecht, Arturo C. Martí

专题命中 仓库级理解 :repository(abstract)

AI总结 该研究开发了一种低成本3D打印环形磁铁稳定悬浮实验装置,用于探究磁力与间距的定量关系,其结果与等效电流环模型吻合良好,相关设计文件已公开以支持可重复性。

详情

展开后加载摘要…

URL PDF HTML 收藏