arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-03-03 至 2026-03-03 共收录 299 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 41 篇

2209.04808 2026-03-03 cs.MA math.OC 88%

Graphon Mean-Field Control for Cooperative Multi-Agent Reinforcement Learning

图论均值场控制用于协作多智能体强化学习

Yuanquan Hu, Xiaoli Wei, Junji Yan, Hengxi Zhang

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 本文提出图论均值场控制框架,用于近似具有非均匀相互作用的协作多智能体强化学习,证明其近似顺序为$\mathcal{O}(\frac{1}{\sqrt{N}})$,并展示其在可扩展性上的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00805 2026-03-03 cs.CV cs.MA 88%

NERFIFY: A Multi-Agent Framework for Turning NeRF Papers into Code

NERFIFY:一个将NeRF论文转化为代码的多智能体框架

Seemandhar Jain, Keshav Gupta, Kunal Gupta, Manmohan Chandraker

机构 * University of California, San Diego(加州大学圣地亚哥分校)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 NERFIFY通过多智能体框架将NeRF论文转化为可训练的代码,提升复现效率和质量。

Comments Accepted to CVPR 2026. Project page: https://seemandhar.github.io/NERFIFY/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23993 2026-03-03 cs.CV cs.RO 88%

Advancing Multi-agent Traffic Simulation via R1-Style Reinforcement Fine-Tuning

通过R1风格强化微调推进多智能体交通模拟

Muleilan Pei, Shaoshuai Shi, Shaojie Shen

机构 * Hong Kong University of Science and Technology(香港理工大学) Voyager Research, Didi Chuxing(Voyager研究,滴滴出行)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 SMART-R1通过R1风格强化微调提升多智能体交通模拟的现实度与性能

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07290 2026-03-03 cs.NI 88%

Multi-Agent DRL for Multi-Objective Twin Migration Routing with Workload Prediction in 6G-enabled IoV

多目标双孪迁移路由的多智能体DRL与工作负载预测

Peng Yin, Wentao Liang, Jinbo Wen, Jiawen Kang, Junlong Chen, Dusit Niyato

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 本文提出多智能体DRL方法,用于6G赋能IoV中的多目标双孪迁移路由,通过工作负载预测减少迁移延迟和丢包率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01912 2026-03-03 cs.CL cs.AI 86%

Demonstrating ViviDoc: Generating Interactive Documents through Human-Agent Collaboration

展示ViviDoc:通过人机协作生成交互式文档

Yinghao Tang, Yupeng Xie, Yingchaojie Feng, Tingfeng Lan, Wei Chen

机构 * State Key Lab of CAD&CG(CAD与CG国家重点实验室) HKUST(GZ)(香港科技大学(广州)) National University of Singapore(新加坡国立大学) University of Virginia(弗吉尼亚大学)

专题命中 多智能体 :agent(title,abstract);agentic(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 ViviDoc通过人机协作生成交互式教育文档,采用多代理流水线和文档规范提升生成质量和编辑体验。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04284 2026-03-03 cs.AI 83%

Doctor-R1: Mastering Clinical Inquiry with Experiential Agentic Reinforcement Learning

Doctor-R1:通过经验代理强化学习掌握临床探究

Yunghwei Lai, Kaiming Liu, Ziyue Wang, Weizhi Ma, Yang Liu

机构 * Dept. of Comp. Sci. & Tech., Institute for AI, Tsinghua University(计算机科学与技术系,人工智能研究院,清华大学) College of AI, Tsinghua University(人工智能学院,清华大学) Institute for AI Industry Research (AIR), Tsinghua University(人工智能产业研究院(AIR),清华大学)

专题命中 多智能体 :agentic(title);agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 Doctor-R1通过经验代理强化学习提升临床决策与患者咨询能力,实现更高效的医疗咨询和决策支持。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01755 2026-03-03 cs.NI cs.AI 79%

Federated Agentic AI for Wireless Networks: Fundamentals, Approaches, and Applications

联邦代理AI用于无线网络:基础、方法与应用

Lingyi Cai, Yu Zhang, Ruichen Zhang, Yinqiu Liu, Tao Jiang, Dusit Niyato, Wei Ni, Abbas Jamalipour

机构 * Research Center of 6G Mobile Communications, School of Cyber Science and Engineering, Huazhong University of Science and Technology(6G移动通信研究中心,信息科学与工程学院,华中科技大学) College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学) School of Engineering, Edith Cowan University(工程学院,埃迪斯·科文大学) School of Computer Science and Engineering, University of New South Wales (UNSW)(计算机科学与工程学院,新南威尔士大学) School of Electrical and Computer Engineering, University of Sydney(电气与计算机工程学院,悉尼大学) Graduate School of Information Sciences, Tohoku University(信息科学研究生院,东北大学)

专题命中 多智能体 :agentic(title,abstract);分类 cs.AI

AI总结 本文提出适用于无线网络的联邦代理AI方法,通过协作本地学习和参数共享提升无线网络的自主性和自我改进能力。

Comments 7 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01035 2026-03-03 cs.HC 75%

From Human Negotiation to Agent Negotiation: Personal Mobility Agents in Automated Traffic

从人类协商到智能体协商:个人移动智能体在自动化交通中的应用

Pascal Jansen

专题命中 多智能体 :agent(title);AI agent(comments);agentic(comments)

AI总结 本文提出个人移动智能体,通过代理用户偏好与安全规则协商交通行为,解决自动化交通中用户与系统冲突的问题。

Comments Position Paper at the CHI 2026 Workshop AutomationXP26: Agentic Automation Experiences - Rethinking the Interaction of Humans and AI Agents. April 14, 2026. Barcelona, Spain

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16411 2026-03-03 cs.CL cs.LG 73%

When Does Divide and Conquer Work for Long Context LLM? A Noise Decomposition Framework

当分治策略在长上下文LLM中何时有效?一种噪声分解框架

Zhen Xu, Shang Zhu, Jue Wang, Junlin Wang, Ben Athiwaratkun, Chi Wang, James Zou, Ce Zhang

机构 * University of Chicago(芝加哥大学) Together AI Duke University(杜克大学) Google DeepMind(谷歌DeepMind) Stanford University(斯坦福大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.CL、cs.LG

AI总结 本文提出了一种噪声分解框架,分析了长上下文LLM中分治策略的有效条件,揭示了任务噪声、模型噪声和聚合噪声的区分,并通过实验验证了多代理分块策略在处理长上下文任务中的有效性。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02668 2026-03-03 cs.AI cs.LG 73%

FAuNO: Semi-Asynchronous Federated Reinforcement Learning Framework for Task Offloading in Edge Systems

FAuNO:用于边缘系统任务卸载的半异步联邦强化学习框架

Frederico Metelo, Alexandre Oliveira, Stevo Racković, Pedro Ákos Costa, Cláudia Soares

机构 * NOVA School of Science and Technology(诺瓦科学与技术学校) Instituto Superior Técnico(理工学院)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 FAuNO通过半异步联邦强化学习框架,有效提升边缘系统任务卸载的效率和适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01076 2026-03-03 math.OC cs.AI 70%

Feasible Pairings for Decentralized Integral Controllability of Non-Square Systems

非方阵系统的去中心化积分可控性可行配对

Yuhao Tong, Steven W. Su

机构 * College of Artificial Intelligence and Big Data for Medical Sciences, Shandong First Medical University (Shandong Academy of Medical Sciences)(人工智能与大数据医学学院,山东第一医科大学(山东省医学科学院)) University of Technology Sydney(悉尼技术大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出了一种非方阵系统去中心化积分可控性的可行输入输出配对方法,通过扩展D稳定性概念并引入平方矩阵概念,建立了稳定性之间的联系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19208 2026-03-03 cs.CL 70%

DiSRouter: Distributed Self-Routing for LLM Selections

DiSRouter: 分布式自路由用于大语言模型选择

Hang Zheng, Hongshen Xu, Yongkai Lin, Shuai Fan, Lu Chen, Kai Yu

机构 * X-LANCE Lab, School of Computer Science, Shanghai Jiao Tong University, Shanghai, China(上海交通大学计算机科学系X-LANCE实验室) Shanghai Innovation Institution, Shanghai, China(上海创新机构) Jiangsu Key Lab of Language Computing, Suzhou, China(江苏省语言计算重点实验室) AISpeech Co., Ltd., Suzhou, China(AISpeech公司) Suzhou Laboratory, Suzhou, China(苏州实验室)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.CL

AI总结 DiSRouter通过分布式自路由机制,利用LLM的自我认知能力,实现更灵活、可扩展的多代理系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19933 2026-03-03 eess.SY cs.SY 67%

Edge-based Synchronization over Signed Digraphs with Multiple Leaders

基于边的有向图上含多重领导者同步问题

Pelin Sekercioglu, Angela Fontan, Dimos V. Dimarogonas

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文提出了一种基于有向图的同步方法,通过分析有符号边拉普拉斯矩阵的谱性质,实现了多领导者系统中更广泛的同步形式,包括双分共识和包容。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00682 2026-03-03 cs.CV 67%

CoLC: Communication-Efficient Collaborative Perception with LiDAR Completion

CoLC: 通信高效协同感知与激光雷达补全

Yushan Han, Hui Zhang, Qiming Xia, Yi Jin, Yidong Li

机构 * Key Laboratory of Big Data & Artificial Intelligence in Transportation, Ministry of Education(交通运输大数据与人工智能重点实验室,教育部) School of Computer Science and Technology, Beijing Jiaotong University(北京交通大学计算机科学与技术学院) Xiamen University(厦门大学)

专题命中 多智能体 :agent(abstract);autonomous agent(abstract)

AI总结 CoLC通过激光雷达补全和早期融合技术,在稀疏传输下实现高效协同感知,提升感知与通信的平衡性能。

Comments Accepted by CVPR'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00373 2026-03-03 math.OC 67%

Sparse optimal control in the Wasserstein space

在Wasserstein空间中的稀疏最优控制

Enrico Sartor, Florian Dörfler, Nicolas Lanzetti

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文研究了在Wasserstein空间中通过有限可控代理操控分布的稀疏最优控制问题,并推导了伴随系统及Pontryagin型必要条件。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04388 2026-03-03 cs.LG 57%

Learning to Orchestrate Agents in Natural Language with the Conductor

通过指挥模型学习自然语言中的代理协调

Stefan Nielsen, Edoardo Cetin, Peter Schwendeman, Qi Sun, Jinglue Xu, Yujin Tang

机构 * Sakana AI, Japan(日本Sakana AI公司) University of Michigan, USA(美国密歇根大学) Institute of Science Tokyo, Japan(日本东京科学研究所)

专题命中 多智能体 :agent(abstract);分类 cs.LG

AI总结 本文提出通过强化学习训练指挥模型,实现自然语言中代理的协调,展示其在推理基准测试中的卓越性能。

Comments To appear at the 14th International Conference on Learning Representations (ICLR 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01178 2026-03-03 cs.RO 50%

riMESA: Consensus ADMM for Real-World Collaborative SLAM

riMESA: 基于共识ADMM的现实世界协作SLAM

Daniel McGann, Michael Kaess

专题命中 多智能体 :planning(abstract)

AI总结 riMESA是一种基于共识ADMM的鲁棒增量分布式C-SLAM后端,能实时处理多机器人团队的定位与建图任务,准确度提升超过7倍。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 工作流自动化 28 篇

2508.10760 2026-03-03 q-bio.BM cs.AI 92%

FROGENT: An End-to-End Full-process Drug Design Multi-Agent System

FROGENT:一种端到端的全流程药物设计多智能体系统

Qihua Pan, Dong Xu, Qianwei Yang, Jenna Xinyi Yao, Sisi Yuan, Zexuan Zhu, Jianqiang Li, Junkai Ji

专题命中 工作流自动化 :agent(title,abstract);multi-agent(title,abstract);tool-use(abstract);planning(abstract)

AI总结 FROGENT通过多智能体系统整合药物发现全流程,利用LLM能力提升效率与准确性,减少人工干预。

Comments 37 pages, 20 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00501 2026-03-03 cs.NI cs.AI eess.SP 91%

WirelessAgent++: Automated Agentic Workflow Design and Benchmarking for Wireless Networks

WirelessAgent++: 无线网络中自主代理工作流设计与基准测试

Jingwen Tong, Zijian Li, Fang Liu, Wei Guo, Jun Zhang

机构 * College of Electronics and Information Engineering, Shenzhen University(深圳大学电子与信息工程学院) Department of Electronic and Computer Engineering, The Hong Kong University of Science and Technology(香港理工大学电子与计算机工程系)

专题命中 工作流自动化 :workflow(title,abstract);agentic(title,abstract);agent(abstract);AI agent(abstract)

AI总结 WirelessAgent++通过自动化设计无线任务代理工作流,结合MCTS算法和WirelessBench基准测试,实现了高效且稳健的无线网络代理生成。

Comments This manuscript has submitted to a possible Journal for publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00186 2026-03-03 cs.CR cs.AI cs.CL cs.LG 89%

RLShield: Practical Multi-Agent RL for Financial Cyber Defense with Attack-Surface MDPs and Real-Time Response Orchestration

RLShield: 实用的多智能体强化学习用于金融网络安全防御,结合攻击面马尔可夫决策过程与实时响应协调

Srikumar Nayak

专题命中 工作流自动化 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 RLShield 通过多智能体强化学习实现金融网络安全防御,结合攻击面马尔可夫决策过程与实时响应协调,提升网络攻击遏制效率与响应效果。

Comments 6 pages, 2 fig and 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00123 2026-03-03 cs.CV cs.AI 85%

CT-Flow: Orchestrating CT Interpretation Workflow with Model Context Protocol Servers

CT-Flow: 通过模型上下文协议服务器协调CT解释工作流

Yannian Gu, Xizhuo Zhang, Linjie Mu, Yongrui Yu, Zhongzhen Huang, Shaoting Zhang, Xiaofan Zhang

机构 * Qing Yuan Research Institute, Shanghai Jiao Tong University, Shanghai, China(清元研究院,上海交通大学,上海,中国) Shanghai Innovation Institute, Shanghai, China(上海创新研究院,上海,中国) Sensetime Research, Shanghai, China(senseTime研究院,上海,中国)

专题命中 工作流自动化 :workflow(title,abstract);tool-use(abstract);agentic(abstract);分类 cs.AI

AI总结 CT-Flow通过模型上下文协议实现3D CT解释工作流的动态协调,提升诊断准确性和工具调用效率。

Comments submitting to ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01548 2026-03-03 cs.AI cs.SE 82%

Graph-Based Self-Healing Tool Routing for Cost-Efficient LLM Agents

基于图的自愈工具路由用于成本高效的LLM代理

Neeraj Bholani

专题命中 工作流自动化 :agent(abstract);tool-use(abstract);planning(abstract);workflow(abstract)

AI总结 Self-Healing Router通过自愈路由机制在LLM代理中实现成本高效且容错的工具使用,减少LLM调用并消除沉默故障。

Comments Working paper. 27 references, 13 figures, 8 tables, pseudocode appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01647 2026-03-03 cs.CV 82%

QCAgent: An agentic framework for quality-controllable pathology report generation from whole slide image

QCAgent:一种用于从全切片图像生成质量可控病理科报告的代理框架

Rundong Wang, Wei Ba, Ying Zhou, Yingtai Li, Bowen Liu, Baizhi Wang, Yuhao Wang, Zhidong Yang, Kun Zhang, Rui Yan, S. Kevin Zhou

机构 * School of Biomedical Engineering, Division of Life Sciences Medicine, University of Science Technology of China, Hefei, Anhui, 230026, P.R. China Center for Medical Imaging, Robotics, Analytic Computing \& Learning (MIRACLE), Suzhou Institute for Advance Research, USTC, 215123, P.R. China Chinese PLA General Hospital Ninth Medical Center, China Hong Kong University of Science

专题命中 工作流自动化 :agentic(title,abstract);workflow(abstract)

AI总结 QCAgent通过引入定制批评机制和证据驱动的细化流程,实现从全切片图像生成质量可控、具有临床意义的病理科报告。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00724 2026-03-03 cs.CL 79%

RLAR: An Agentic Reward System for Multi-task Reinforcement Learning on Large Language Models

RLAR:一种用于大型语言模型多任务强化学习的代理奖励系统

Andrew Zhuoer Feng, Cunxiang Wang, Bosi Wen, Yidong Wang, Yu Luo, Hongning Wang, Minlie Huang

机构 * Tsinghua Univeristy(清华大学) Peking University(北京大学)

专题命中 工作流自动化 :agentic(title);agent(abstract);分类 cs.CL

AI总结 RLAR通过动态生成奖励函数提升大型语言模型在多任务强化学习中的性能和泛化能力。

Comments 25 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01663 2026-03-03 cs.NI 78%

Contract-based Agentic Intent Framework for Network Slicing in O-RAN

基于合同的代理意图框架用于O-RAN中的网络切片

Fransiscus Asisi Bimo, Chun-Kai Lai, Zhi-Yuan Yang, Ray-Guang Cheng

专题命中 工作流自动化 :agentic(title,abstract)

AI总结 本文提出基于合同的代理意图框架,用于O-RAN中的网络切片,通过闭环代理流水线实现确定性安全保证。

Comments 6 pages, Accepted at IEEE INFOCOM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06999 2026-03-03 cs.OH 71%

A Multiscale Workflow for Thermal Analysis of 3DI Chip Stacks

3DI芯片堆叠热分析的多尺度工作流程

Max Bloomfield, Amogh Wasti, Zongmin Yang, Matthew Galarza, Theodorian Borca-Tasciuc, Jacob Merson, Timothy Chainer, Prabudhya Roy Chowdhury, Aakrati Jain

专题命中 工作流自动化 :workflow(title)

AI总结 本研究提出了一种多尺度方法,用于高效分析3DI芯片堆叠的热特性,通过分层有限元方法提升热模拟的精度和效率。

Journal ref 2025 24th IEEE Intersociety Conference on Thermal and Thermomechanical Phenomena in Electronic Systems (ITherm)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02456 2026-03-03 cs.AI cs.CR 70%

VPI-Bench: Visual Prompt Injection Attacks for Computer-Use Agents

VPI-Bench:用于计算机使用代理的视觉提示注入攻击

Tri Cao, Bennett Lim, Yue Liu, Yuan Sui, Yuexin Li, Shumin Deng, Lin Lu, Nay Oo, Shuicheng Yan, Bryan Hooi

机构 * National University of Singapore(国立新加坡大学) Cyber Emerging Tech and R&D Co(网络安全与研发公司)

专题命中 工作流自动化 :agent(abstract);AI agent(abstract);分类 cs.AI

AI总结 本文提出VPI-Bench基准,用于评估计算机使用代理和浏览器使用代理在视觉提示注入攻击下的鲁棒性,发现当前代理在某些平台上被欺骗率达51%和100%。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02019 2026-03-03 cs.MA cs.AI cs.CE cs.LG 62%

Selection as Power: Constrained Reinforcement for Bounded Decision Authority

选择作为权力:受限强化以实现有限决策权

Jose Manuel de la Chica Rodriguez, Juan Manuel Vera Díaz

机构 * AI Lab, Grupo Santander Madrid, Spain(Grupo Santander 马德里实验室)

专题命中 工作流自动化 :agentic(abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种动态激励性选择治理框架,通过受约束的强化学习方法,在保持有限决策权的同时实现适应性改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01667 2026-03-03 cs.AI 57%

Chain-of-Context Learning: Dynamic Constraint Understanding for Multi-Task VRPs

上下文链学习:多任务VRP中的动态约束理解

Shuangchun Gui, Suyu Liu, Xuehe Wang, Zhiguang Cao

机构 * School of Computing and Information Systems, Singapore Management University, Singapore(新加坡管理大学计算机与信息学院) Guangdong Laboratory of AI and Digital Economy, Shenzhen, Guangdong, China(广东人工智能与数字经济实验室) School of Artificial Intelligence, Sun Yat-sen University, Zhuhai, Guangdong, China(中山大学人工智能学院)

专题命中 工作流自动化 :agent(abstract);分类 cs.AI

AI总结 CCL通过逐步捕捉动态上下文来改进多任务VRP中的约束理解,通过RGCR和TSNR模块实现细粒度节点适应,有效提升求解性能。

Comments This paper is accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15018 2026-03-03 cs.CV cs.AI cs.RO 57%

UrbanVerse: Scaling Urban Simulation by Watching City-Tour Videos

UrbanVerse: 通过观看城市游览视频扩大城市模拟

Mingxuan Liu, Honglin He, Elisa Ricci, Wayne Wu, Bolei Zhou

专题命中 工作流自动化 :AI agent(abstract);分类 cs.AI

AI总结 UrbanVerse 通过将众包城市游览视频转化为物理-aware 的模拟场景,实现了城市模拟的扩展,提升了城市导航中代理的泛化能力和现实任务完成效率。

Comments Accepted to ICLR 2026. Project page: https://urbanverseproject.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏