arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 3244 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 软件智能体 3244 篇

2607.25175 2026-07-30 cs.MA 版本更新 78%

Agentic AI-enabled discovery across large-scale sleep physiology

基于智能体的人工智能助力大规模睡眠生理学研究

Rahul Thapa, Umaer Hanif, Robin Guillard, Andreas Brink-Kjaer, Adrien Specht, Matteo Saibene, Magnus Ruud Kjaer, Harrison G. Zhang, Federico Bianchi, Elisabeth Roxane M. Heremans, Eric C. Landsness, Emmanuel Mignot, James Zou

专题命中 软件智能体 :agentic(title,abstract)

AI总结 研究利用人工智能睡眠联合科学家环境,在约124,000份PSG记录上进行五个案例研究,揭示睡眠与疾病风险、临床分类及自身调节的联系,展示智能体人工智能助力大规模、多模态睡眠生理学发现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12144 2026-07-24 cs.CV cs.RO eess.IV 版本更新 78%

O3N: Omnidirectional Open-Vocabulary Occupancy Prediction for Urban Autonomous Agents

O3N: 全向开放词汇占用预测

Mengfei Duan, Hao Shi, Fei Teng, Guoqiang Zhao, Yuheng Zhang, Zhiyong Li, Kailun Yang

机构 * Hunan University(湖南大学) Zhejiang University(浙江大学)

专题命中 软件智能体 :autonomous agent(title,abstract)

AI总结 O3N通过全向感知和开放词汇方法,实现三维空间的连续表示和长距离上下文建模,提升具身智能在开放世界中的感知与建模能力。

Comments The source code will be made publicly available at https://github.com/MengfeiD/O3N

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17363 2026-07-21 physics.plasm-ph 新提交 78%

ORB5X v1.0: a performance-portable global electromagnetic gyrokinetic PIC code in C++/Kokkos built using Agentic AI

ORB5X v1.0:一个使用智能AI构建的性能可移植的全局电磁陀螺动力学PIC C++/Kokkos代码

Mohsen Sadr, Emmanuel Lanti, Alexey Mishchenko, Xin Wang, Laurent Villard

专题命中 软件智能体 :agentic(title);workflow(abstract)

AI总结 本文介绍ORB5X,它是ORB5的C++/Kokkos版本,保留了原Fortran代码的数学模型与算法,通过替换模块和数组提升性能可移植性,经测试与原代码精度相近,且能在多种设备上编译运行。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06411 2026-07-21 cs.SE cs.AI cs.CL 版本更新 78%

RuBench: A Repository-Level Agentic Coding Benchmark with Natively Authored Russian Task Specifications

RuBench:一个具有原生编写的俄语任务规范的仓库级智能编码基准测试

Evgeny Shilov

机构 * Independent Researcher(独立研究者)

专题命中 软件智能体 :agentic(title);分类 cs.AI、cs.CL、cs.SE

AI总结 RuBench 1.0是含25个俄语任务的仓库级智能编码基准测试,任务源于开源仓库修复提交,按客户请求风格编写。评估多种产品配置,报告运行结果,发现最佳配置解决78.7%任务,还发现产品替换模型问题,为智能编码评估提供新基准。

Comments 20 pages, 1 figure, 9 tables. v2 adds Round 2: Russian-market coding agents (SourceCraft CLI, Koda CLI), Antigravity with Gemini 3.1 Pro / 3.5 Flash, and Codex CLI with GPT-5.6 on the same frozen task set, plus a tool-call contamination re-audit (network + disk layers). Data, full trajectories and harness: https://github.com/eugeneshilow/rubench

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27350 2026-07-20 cs.AR 版本更新 78%

CHIA: An open-source framework for principled, agentic AI-driven hardware/software co-design research

CHIA: 一个用于原则性、智能体AI驱动的硬件/软件协同设计研究的开源框架

Angela Cui, Ferran Hermida-Rivera, Jack Toubes, Raghav Gupta, Jim Fang, Chengyi Lux Zhang, Ella Schwarz, Junha Kim, Yakun Sophia Shao, Borivoje Nikolic, Christopher W. Fletcher, Sagar Karandikar

专题命中 软件智能体 :agentic(title,abstract)

AI总结 提出CHIA开源框架,通过有向循环图表达智能体AI驱动的协同设计流程,支持多种工具集成,实现可扩展、容错的大规模协同设计研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14082 2026-07-16 quant-ph 新提交 78%

Building Shor's Algorithm in Lean: An Agentic Formalization of Quantum Attacks on RSA-2048 and P-256

在Lean中构建肖尔算法:对RSA - 2048和P - 256的量子攻击的智能形式化

Lei Zhang, Yusheng Zhao, Hongshun Yao, Xin Wang

专题命中 软件智能体 :agentic(title,abstract)

AI总结 研究在Lean中对肖尔算法及其变体进行形式化,采用智能形式化方法让软件代理分析、编写代码及修复证明,建立数学基础用于分析RSA - 2048和P - 256加密设置下的量子攻击,为量子密码分析及算法设计验证助力。

Comments 21 pages, including appendix; 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09674 2026-07-14 cs.CY 新提交 78%

From Tools to Teacher-Built Teammates: No-Code Pedagogical Plugin Authoring with LearnAdapt Agentic Studio and PedOS 1.1 Lumina

从工具到教师构建的队友:使用LearnAdapt智能工作室和PedOS 1.1 Lumina进行无代码教学插件创作

Nizam Kadir

专题命中 软件智能体 :agentic(title,abstract)

AI总结 该研究针对教师和研究人员难以定制教育AI的问题,介绍了基于PedOS 1.1 Lumina的LearnAdapt智能工作室,它能让非编码人员用英语描述学习交互,完成插件创作、安全检查等,展示了从提示到证据捕获的完整生命周期,实现从固定工具到教师构建队友的转变。

Comments 3 pages, 1 figure, Accepted into the 27th International Conference on Artificial Intelligence in Education Interactive Events Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20161 2026-06-19 cs.CV 新提交 78%

ARTEMIS: Agent-guided Reliability-aware Temporal Mask Evolution for Imperfectly Supervised Video Polyp Segmentation

ARTEMIS: 基于智能体引导的可靠性感知时间掩码演化用于不完美监督的视频息肉分割

Tong Wang, Siwen Wang, Yaolei Qi, Jinxing Zhou, Yuting He, Guanyu Yang, Yutong Xie

机构 * Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications, Southeast University, Ministry of Education(东南大学教育部新一代人工智能技术及其跨学科应用重点实验室) Mohamed bin Zayed University of Artificial Intelligence (MBZUAI)(穆罕默德·本·扎耶德人工智能大学) School of Medicine, Case Western Reserve University(凯斯西储大学医学院)

专题命中 软件智能体 :agent(title,abstract)

AI总结 提出ARTEMIS框架,利用视觉语言智能体选择可靠时间锚点,结合SAM2传播和可靠性感知鲁棒学习,从不完美监督(点、涂鸦、少量密集标签)中学习高质量视频息肉分割掩码,在多个基准上达到最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19191 2026-06-18 cs.CR 新提交 78%

PhantomSkill: Malicious Code Injection in Agent Skill Ecosystems

PhantomSkill: 代理技能生态系统中的恶意代码注入

Yu-Ting Lin, Chia-Mu Yu

专题命中 软件智能体 :agent(title,abstract)

AI总结 提出PhantomSkill攻击框架,通过VulMask技术将恶意行为隐藏在技能的辅助资源中,利用漏洞形状的实现绕过检测,在保持良性功能的同时降低警告和恶意软件检测率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15390 2026-06-16 cs.CL cs.AI cs.LG 新提交 78%

Not All Skills Help: Measuring and Repairing Agent Knowledge

并非所有技能都有用:测量与修复智能体知识

Yixuan Wang, Yiyang Zhou, Yiming Liang, Congyu Zhang, Fuxiao Liu, Jiawei Zhou, Huaxiu Yao

机构 * UNC Chapel Hill(北卡罗来纳大学教堂山分校) Purdue(普渡大学) NVIDIA(英伟达)

专题命中 软件智能体 :agent(title);分类 cs.AI、cs.CL、cs.LG

AI总结 提出ASSAY框架,通过随机掩码测量技能因果贡献,分离技能生成与筛选,在推理时抑制负面技能,显著提升LLM智能体任务完成率。

Comments 18 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09110 2026-06-09 cs.CV 新提交 78%

HDRAgent: An Agentic Framework for Multi-Exposure HDR Imaging

HDRAgent: 一种用于多曝光HDR成像的智能体框架

Weiyu Zhou, Tao Hu, Yijian Wang, Xiaogang Xu, Ruixing Wang, Qingsen Yan

机构 * School of Computer Science, Northwestern Polytechnical University(西北工业大学计算机学院) Shenzhen Research Institute, Northwestern Polytechnical University(西北工业大学深圳研究院) Zhejiang University(浙江大学) Camera Group, DJI(大疆相机部门)

专题命中 软件智能体 :agentic(title);agent(abstract)

AI总结 提出首个智能体驱动的HDR成像框架HDRAgent,通过细粒度上下文知识匹配、感知-失真反馈机制和智能体引导的生成对齐策略,自适应选择重建策略,减少复杂动态场景中的鬼影和局部伪影。

详情

展开后加载摘要…

URL PDF HTML 收藏
1706.06302 2026-06-04 econ.GN q-fin.EC 78%

Deep Learning in (and of) Agent-Based Models: A Prospectus

深度学习在基于主体的模型中的应用:前景展望

Sander van der Hoog

专题命中 软件智能体 :agent(title,abstract)

AI总结 本文探讨了将深度学习应用于经济主体模型以解决经验估计问题,介绍了多层人工神经网络和深度学习在该领域的潜力与贡献。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27547 2026-05-28 cs.MA 78%

From Task Allocation to Risk Clearing: A Unifying Interface for Mixed Human-Agent Societies

从任务分配到风险清算:混合人机社会的统一接口

Vassilis Vassiliades

专题命中 软件智能体 :agent(title,abstract)

AI总结 提出风险感知选项清算(ROC)机制,通过将风险摘要与选项结合并由中央清算所优化风险调整任务效用,实现混合人机社会中异构代理的可扩展透明协调。

Comments Presented at EMAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15606 2026-05-22 cs.AR 78%

Spec2Cov: An Agentic Framework for Code Coverage Closure of Digital Hardware Designs

Spec2Cov: 一种用于数字硬件设计代码覆盖率闭合的代理框架

Sean Lowe, Elias Hilaneh, Alma Babbit, Nakul Gopalan, Vidya Chhabria, Aman Arora

专题命中 软件智能体 :agentic(title,abstract)

AI总结 本文提出了一种基于代理框架的代码覆盖率闭合方法,利用大型语言模型和硬件仿真器的协同工作,自动迭代生成测试刺激以加速覆盖率闭合,并在不同复杂度的设计上实现了高达49%的覆盖率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15187 2026-05-15 cs.CV cs.GR cs.RO 78%

Articraft: An Agentic System for Scalable Articulated 3D Asset Generation

Articraft: 一种可扩展的拟人化3D资产生成代理系统

Matt Zhou, Ruining Li, Xiaoyang Lyu, Zhaomou Song, Zhening Huang, Chuanxia Zheng, Christian Rupprecht, Andrea Vedaldi, Shangzhe Wu

机构 * University of Cambridge(剑桥大学) University of Oxford(牛津大学) Nanyang Technological University(南洋理工大学)

专题命中 软件智能体 :agentic(title,abstract)

AI总结 本文提出Articraft代理系统,利用大语言模型生成大规模拟人化3D资产,构建了包含10000+资产的Articraft-10K数据集,应用于机器人仿真和虚拟现实等下游任务。

Comments Project page: https://articraft3d.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09594 2026-05-12 cs.CR 78%

Trust Me, Import This: Dependency Steering Attacks via Malicious Agent Skills

相信我,导入这个:通过恶意代理技能进行依赖引导攻击

Yiyong Liu, Chia-Yi Hsu, Chun-Ying Huang, Michael Backes, Rui Wen, Chia-Mu Yu

专题命中 软件智能体 :agent(title,abstract)

AI总结 研究提出依赖引导攻击,通过恶意技能引导编码代理生成恶意包,无需修改模型或数据,展示出软件供应链中的新攻击面。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08927 2026-05-12 cs.PL 78%

Quantitative Comparison of Credible Compilation and Verification In Coding Agent Compiler Development

代码代理编译器开发中可信编译与验证的定量比较

Martin Rinard

专题命中 软件智能体 :agent(title,abstract)

AI总结 本文通过首个由人类监督的验证编译器,比较了可信编译与验证两种编译验证方法的效率,发现验证需要更多开发工作量,且验证优化选择更不高效的算法,证书检查时间占主导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26482 2026-05-05 cs.CY 78%

The Buy-or-Build Decision, Revisited: How Agentic AI Changes the Economics of Enterprise Software

重新审视买或建决策:代理AI如何改变企业软件的经济学

David Klotz

专题命中 软件智能体 :agentic(title,abstract)

AI总结 本文通过结合交易成本经济学和资源基础观,重新评估AI对买或建决策的影响,揭示AI如何重塑七个核心决策因素,并提出企业应用的分类及治理结构变化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.02450 2026-04-28 cs.CV 78%

GCP: Guarded Collaborative Perception with Spatial-Temporal Aware Malicious Agent Detection

GCP: 带空间-时间感知恶意代理检测的防护协作感知

Yihang Tao, Senkang Hu, Yue Hu, Haonan An, Hangcheng Cao, Yuguang Fang

机构 * Department of Computer Science, City University of Hong Kong(香港城市大学计算机科学系) Department of Robotics, University of Michigan(密歇根大学机器人系)

专题命中 软件智能体 :agent(title,abstract)

AI总结 本文提出GCP框架,通过空间-时间感知恶意代理检测提升协作感知安全性,采用置信度加权空间一致性损失和联合空间-时间Benjamini-Hochberg检验,有效应对恶意代理攻击,实验显示在BAC攻击下AP@0.5提升34.69%。

Comments Accepted by IEEE TDSC

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06241 2026-04-09 cs.CR 78%

ZitPit: Consumer-Side Admission Control for Agentic Software Intake

ZitPit:面向代理软件摄入的消费者侧准入控制

Jepson Taylor, Chris Brousseau, Jordan Hildebrandt, Kelli Quinn

专题命中 软件智能体 :agentic(title,abstract)

AI总结 ZitPit通过严格边界控制,确保首次见到的外部工件成为持久政策事件,统一了工件准入、仓库开放状态、能力范围执行和持久政策记录,提升代理工作流的安全性。

Comments 6 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03460 2026-04-09 physics.chem-ph physics.comp-ph 78%

FermiLink: A Unified Agent Framework for Multidomain Autonomous Scientific Simulations

FermiLink:一个多领域自主科学模拟的统一代理框架

Gang Meng, Andres Felipe Bocanegra Vargas, Xinwei Ji, Federico Garcia-Gaitan, Felipe Reyes-Osorio, Jalil Varela-Manjarres, Yafei Ren, Mohammadhasan Dinpajooh, Branislav K. Nikolić, Tao E. Li

专题命中 软件智能体 :agent(title,abstract)

AI总结 FermiLink通过分离知识库与模拟工作流,实现多领域科学模拟的统一框架,能高效复现74%的科学图表并生成高质量研究成果。

Comments Simulation data available at https://www.taoeli.org/publications; source code available at Github https://github.com/TaoELi/FermiLink

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.04709 2026-03-11 q-bio.QM 78%

Forecasting and predicting stochastic agent-based model data with biologically-informed neural networks

利用生物启发式神经网络进行随机基于代理模型数据的预测与预测

John T. Nardini

专题命中 软件智能体 :agent(title,abstract)

AI总结 利用生物启发式神经网络引导的偏微分方程预测随机基于代理模型数据,提高参数空间探索效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00455 2026-03-03 cs.RO cs.SY eess.SY 78%

Test-Driven Agentic Framework for Reliable Robot Controller

基于测试驱动的代理框架用于可靠机器人控制器

Shivanshu Tripathi, Reza Akbarian Bafghi, Maziar Raissi

机构 * Department of Electrical and Computer Engineering(电气与计算机工程系) University of California, Riverside(加州大学河滨分校) Department of Mathematics(数学系) Department of Computer Science(计算机科学系) University of Colorado, Boulder(科罗拉多大学波德分校)

专题命中 软件智能体 :agentic(title,abstract)

AI总结 本文提出一种基于测试驱动的代理框架,用于生成可靠的机器人导航控制器,通过迭代优化提升控制器的可靠性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14990 2026-02-27 cs.SE cs.AI cs.LG 78%

Imitation Game: Reproducing Deep Learning Bugs Leveraging an Intelligent Agent

模仿游戏:利用智能代理重现深度学习bug

Mehil B Shah, Mohammad Masudur Rahman, Foutse Khomh

机构 * Dalhousie University(达尔豪斯大学)

专题命中 软件智能体 :agent(title);分类 cs.AI、cs.LG、cs.SE

AI总结 RepGen通过智能代理和生成-验证-改进机制,提高了深度学习bug的重现率和效率。

Comments Accepted by the 48th IEEE/ACM International Conference on Software Engineering (ICSE 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23546 2026-02-24 math.OC stat.ML 78%

Going from a Representative Agent to Counterfactuals in Combinatorial Choice

从代表性代理人到反事实的组合选择

Yanqiu Ruan, Karthyek Murthy, Karthik Natarajan

专题命中 软件智能体 :agent(title,abstract)

AI总结 本文提出了一种基于代表性代理人模型的非参数反事实推断方法,通过线性规划和混合整数凸规划解决数据一致性问题,并在合成数据上验证了其预测精度和鲁棒性。

Comments 34 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17282 2026-02-20 cs.DC cs.PF cs.SY eess.SY 78%

Visual Insights into Agentic Optimization of Pervasive Stream Processing Services

面向普及流处理服务的代理优化可视化

Boris Sedlak, Víctor Casamayor Pujol, Schahram Dustdar

专题命中 软件智能体 :agentic(title);agent(abstract)

AI总结 本研究提出了一种面向普及流处理服务的自动扩展平台,通过代理优化服务执行,提升资源利用率和系统性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10869 2026-02-12 cs.CR 78%

Agentic Knowledge Distillation: Autonomous Training of Small Language Models for SMS Threat Detection

代理知识蒸馏:自主训练小型语言模型用于短信威胁检测

Adel ElZemity, Joshua Sylvester, Budi Arief, Rogério De Lemos

专题命中 软件智能体 :agentic(title,abstract)

AI总结 本研究提出代理知识蒸馏方法,通过自主训练小型语言模型实现高效的短信威胁检测,实验显示教师LLM的选择对性能影响显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11634 2026-01-21 cs.CV 78%

When Rules Fall Short: Agent-Driven Discovery of Emerging Content Issues in Short Video Platforms

当规则不足时:基于智能体的短视频平台新兴内容问题发现

Chenghui Yu, Hongwei Wang, Junwen Chen, Zixuan Wang, Bingfeng Deng, Zhuolin Hao, Hongyu Xiong, Yang Song

机构 * TikTok Inc.(TikTok公司)

专题命中 软件智能体 :agent(title,abstract)

AI总结 本文提出基于多模态大语言模型智能体的自动问题发现方法,有效提升短视频平台新兴内容问题的发现与治理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12998 2025-12-19 cs.CV 78%

PerTouch: VLM-Driven Agent for Personalized and Semantic Image Retouching

PerTouch:基于VLM的个性化和语义图像润色代理

Zewei Chang, Zheng-Peng Duan, Jianxing Zhang, Chun-Le Guo, Siyu Liu, Hyungju Chun, Hyunhee Park, Zikun Liu, Chongyi Li

专题命中 软件智能体 :agent(title,abstract)

AI总结 PerTouch通过VLM驱动代理实现个性化和语义图像润色,结合语义替换与参数扰动机制,提升用户意图匹配与长期偏好捕捉能力。

Comments To appear at AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15642 2025-11-27 quant-ph cs.MA 78%

Navigating Quantum Missteps in Agent-Based Modeling: A Schelling Model Case Study

在基于代理的建模中导航量子失误:一个谢灵模型案例研究

C. Nico Barati, Arie Croitoru, Ross Gore, Michael Jarret, William Kennedy, Andrew Maciejunes, Maxim A. Malikov, Samuel S. Mendelson

专题命中 软件智能体 :agent(title,abstract)

AI总结 本文通过谢灵模型案例研究,指出传统ABM与量子优化框架的不兼容性,提出通过重新概念化研究问题以获得更高效的经典解决方案,并强调量子代理建模应关注结构可能性而非强制经典方法。

详情

展开后加载摘要…

URL PDF HTML 收藏