arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 93793 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 35686 篇

2512.01822 2026-03-03 cs.CL cs.AI cs.CV cs.LG cs.MA 82%

InnoGym: Benchmarking the Innovation Potential of AI Agents

InnoGym:评估AI智能体创新潜力的基准测试

Jintian Zhang, Kewei Xu, Jingsheng Zheng, Zhuoyun Yu, Yuqi Zhu, Yujie Luo, Lanning Wei, Shuofei Qiao, Lun Du, Da Zheng, Shumin Deng, Huajun Chen, Ningyu Zhang

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团) National University of Singapore(新加坡国立大学) Zhejiang University - Ant Group Joint Laboratory of Knowledge Graph(知识图谱联合实验室)

专题命中 规划决策 :AI agent(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 InnoGym通过引入性能提升和新颖性两个指标,首次系统评估AI智能体的创新潜力,揭示了创造力与有效性的平衡问题。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11428 2026-03-03 cs.CV 82%

ImagiDrive: A Unified Imagination-and-Planning Framework for Autonomous Driving

ImagiDrive: 一种用于自动驾驶的统一想象与规划框架

Jingyu Li, Bozhou Zhang, Xin Jin, Jiankang Deng, Xiatian Zhu, Li Zhang

机构 * School of Data Science, Fudan University(复旦大学数据科学学院) Shanghai Innovation Institute(上海创新研究院) Eastern Institute of Technology(技术东院) Imperial College London(伦敦帝国理工学院) University of Surrey(萨里大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 ImagiDrive通过整合视觉-语言模型和驾驶世界模型,实现自动驾驶中的统一想象与规划循环,提升场景生成和决策预测的准确性与效率。

Comments Accepted for publication in 2026 IEEE International Conference on Robotics and Automation (ICRA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06034 2026-02-26 cs.CV 82%

V-Retrver: Evidence-Driven Agentic Reasoning for Universal Multimodal Retrieval

V-Retrver: 以证据驱动的代理推理用于通用多模态检索

Dongyang Chen, Chaoyang Wang, Dezhao Su, Xi Xiao, Zeyu Zhang, Jing Xiong, Qing Li, Yuzhang Shang, Shichao Kan

机构 * Tsinghua University(清华大学) University of Central Florida(中央佛罗里达大学) Fudan University(复旦大学) The Australian National University(澳大利亚国立大学) The University of Hong Kong(香港大学) Pengcheng Laboratory(鹏城实验室) Central South University(中南大学)

专题命中 规划决策 :agentic(title,abstract);agent(abstract)

AI总结 V-Retrver通过引入证据驱动的代理推理机制,提升多模态检索的准确率和推理可靠性。

Comments Project page: https://github.com/chendy25/V-Retrver

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21087 2026-02-26 cs.CV 82%

MIRA: Multimodal Iterative Reasoning Agent for Image Editing

MIRA: 多模态迭代推理代理用于图像编辑

Ziyun Zeng, Hang Hua, Jiebo Luo

机构 * University of Rochester(罗切斯特大学) MIT-IBM Watson AI Lab(MIT-IBM沃森人工智能实验室)

专题命中 规划决策 :agent(title,abstract);tool-use(abstract)

AI总结 MIRA通过多模态迭代推理代理提升图像编辑的语义一致性和感知质量,结合自研数据集和训练流程,实现与专有系统相当的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23502 2026-02-25 cs.NI 82%

Hierarchical Decision Mamba Meets Agentic AI: A Novel Approach for RAN Slicing in 6G

分层决策Mamba遇见代理AI:一种用于6G RAN切片的新方法

Md Arafat Habib, Medhat Elsayed, Majid Bavand, Pedro Enrique Iturria Rivera, Yigit Ozcan, Melike Erol-Kantarci

专题命中 规划决策 :agentic(title,abstract);agent(abstract)

AI总结 本文提出了一种基于分层决策Mamba和大型语言模型的代理AI框架,用于6G RAN切片,通过整合自然语言理解与协调决策,提升切片性能。

Comments Accepted for publication in IEEE Networking Letters (Author's copy). Copyright belongs to IEEE

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18582 2026-02-24 cs.AI cs.CL cs.HC cs.LG 82%

Hierarchical Reward Design from Language: Enhancing Alignment of Agent Behavior with Human Specifications

基于语言的层次奖励设计:通过人类规范增强智能体行为对齐

Zhiqin Qian, Ryan Diaz, Sangwon Seo, Vaibhav Unhelkar

机构 * Rice University(里士大学)

专题命中 规划决策 :agent(title);AI agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出基于语言的层次奖励设计(HRDL)和语言到层次奖励(L2HR)方法,用于通过人类规范增强智能体行为对齐,提升AI任务完成效果和规范遵守程度。

Comments Extended version of an identically-titled paper accepted at AAMAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10116 2026-02-24 cs.CV cs.RO 82%

SAGE: Scalable Agentic 3D Scene Generation for Embodied AI

SAGE: 适用于具身人工智能的可扩展代理3D场景生成

Hongchi Xia, Xuan Li, Zhaoshuo Li, Qianli Ma, Jiashu Xu, Ming-Yu Liu, Yin Cui, Tsung-Yi Lin, Wei-Chiu Ma, Shenlong Wang, Shuran Song, Fangyin Wei

机构 * NVIDIA University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Cornell University(康奈尔大学) Stanford University(斯坦福大学)

专题命中 规划决策 :agentic(title,abstract);agent(abstract)

AI总结 SAGE通过代理框架生成可扩展的3D环境,用于具身人工智能的策略训练和泛化能力提升。

Comments Project Page: https://research.nvidia.com/labs/dir/sage/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18260 2026-02-23 cs.RO 82%

Role-Adaptive Collaborative Formation Planning for Team of Quadruped Robots in Cluttered Environments

面向 cluttered 环境的四足机器人团队角色自适应协作形成规划

Magnus Norén, Marios-Nektarios Stamatopoulos, Avijit Banerjee, George Nikolakopoulos

机构 * Robotics and Artificial Intelligence Group, Department of Computer, Electrical and Space Engineering, Lulea University of Technology(机器人与人工智能小组,计算机、电气与航天工程系,卢莱亚理工大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 本文提出了一种适用于 cluttered 环境的四足机器人团队角色自适应协作形成规划方法,通过动态角色分配和 FM2 算法实现灵活导航与稳定形成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11409 2026-02-23 cs.LG cs.AI cs.CL cs.CV 82%

Visual Planning: Let's Think Only with Images

视觉规划:只用图像来思考

Yi Xu, Chengzu Li, Han Zhou, Xingchen Wan, Caiqi Zhang, Anna Korhonen, Ivan Vulić

机构 * Language Technology Lab, University of Cambridge(剑桥大学语言技术实验室) Google(谷歌公司)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出视觉规划范式,通过图像进行推理,优于纯文本推理,在视觉导航任务中表现更优。

Comments ICLR 2026 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13868 2026-02-17 cs.NI cs.IR 82%

Agentic Assistant for 6G: Turn-based Conversations for AI-RAN Hierarchical Co-Management

6G代理助手:基于回合的对话用于AI-RAN分层协同管理

Udhaya Srinivasan, Weisi Guo

专题命中 规划决策 :agentic(title,abstract);planning(abstract)

AI总结 本文提出了一种基于回合的对话助手,用于AI-RAN的分层协同管理,通过三层架构实现高效网络管理和降低运营成本。

Comments submitted to IEEE conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25260 2026-02-17 cs.AI cs.CL cs.LG 82%

Internal Planning in Language Models: Characterizing Horizon and Branch Awareness

语言模型中的内部规划:刻画视野与分支意识

Muhammed Ustaomeroglu, Baris Askin, Gauri Joshi, Carlee Joe-Wong, Guannan Qu

机构 * Department of Electrical and Computer Engineering(电气与计算机工程系) Carnegie Mellon University(卡内基梅隆大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 研究通过分析语言模型内部计算结构,揭示规划视野与分支意识的特性,为理解模型内部动态提供通用工具。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13622 2026-02-17 cs.HC 82%

The Shadow Boss: Identifying Atomized Manipulations in Agentic Employment of XR Users using Scenario Constructions

影子老板:通过场景构建识别代理雇佣中XR用户原子化操控

Lik-Hang Lee

专题命中 规划决策 :agentic(title,abstract);AI agent(abstract)

AI总结 本文通过场景构建方法,识别代理雇佣中XR用户面临的七个关键风险,揭示AI代理对人类劳动的原子化操控问题,呼吁需以用户为中心的XR和政策干预。

Comments 28 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13577 2026-02-17 cs.RO 82%

ONRAP: Occupancy-driven Noise-Resilient Autonomous Path Planning

ONRAP:基于占用度的抗噪声自主路径规划

Faizan M. Tariq, Avinash Singh, Vipul Ramtekkar, Jovin D'sa, David Isele, Yosuke Sakamoto, Sangjae Bae

机构 * Honda Research Institute, CA, USA(本田研究院,美国加利福尼亚州) Honda Research and Development(本田研发)

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 ONRAP 提出了一种基于占用网格的抗噪声路径规划方法,结合占用流预测以生成安全可行的路径,实现实时运行并有效应对不确定环境。

Comments 8 pages, 9 figures - Presented at 2026 IEEE Intelligent Vehicles Symposium (IV)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13086 2026-02-16 cs.RO 82%

UniManip: General-Purpose Zero-Shot Robotic Manipulation with Agentic Operational Graph

UniManip: 通用目的零样本机器人操作的代理操作图

Haichao Liu, Yuanjiang Xue, Yuheng Zhou, Haoyuan Deng, Yinan Liang, Lihua Xie, Ziwei Wang

机构 * School of Electrical and Electronic Engineering, Nanyang Technological University, Singapore(南洋理工大学电子与电气工程学院) Department of Automation, Tsinghua University, China(清华大学自动化系)

专题命中 规划决策 :agentic(title,abstract);planning(abstract)

AI总结 UniManip通过双层代理操作图实现通用零样本机器人操作,结合高层任务协调与底层动态状态表示,提升无监督环境下的执行鲁棒性。

Comments 15 pages, 12 figures, 6 tables, project page: https://henryhcliu.github.io/unimanip

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08987 2026-02-13 cs.CE 82%

Rapid prediction of cardiac activation in the left ventricle with geometric deep learning: a step towards cardiac resynchronization therapy planning

基于几何深度学习的左心室心脏激活快速预测:迈向心脏再同步治疗规划的一步

Ehsan Naghavi, Haifeng Wang, Vahid Ziaei Rad, Julius Guccione, Ghassan Kassab, Vishnu Boddeti, Seungik Baek, Lik-Chuan Lee

专题命中 规划决策 :planning(title,abstract);workflow(abstract)

AI总结 本研究利用几何深度学习模型预测左心室激活时间图,以提高CRT治疗规划的精准度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09227 2026-02-11 cs.RO 82%

From Legible to Inscrutable Trajectories: (Il)legible Motion Planning Accounting for Multiple Observers

从可理解到不可理解的轨迹:考虑多个观察者的(不)可理解运动规划

Ananya Yammanuru, Maria Lusardi, Nancy M. Amato, Katherine Driggs-Campbell

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 本文提出MMLO-LMP问题,设计DUBIOUS算法,实现对不同动机观察者的轨迹可理解性与可见性限制的平衡。

Comments 17 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04333 2026-02-10 cs.CV cs.RO 82%

RAP: 3D Rasterization Augmented End-to-End Planning

RAP: 3D 像素化增强端到端规划

Lan Feng, Yang Gao, Eloi Zablocki, Quanyi Li, Wuyang Li, Sichao Liu, Matthieu Cord, Alexandre Alahi

机构 * EPFL(苏黎世联邦理工学院) Sorbonne Université(索邦大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 RAP通过3D像素化增强端到端规划,利用轻量级像素化和特征对齐实现可扩展的数据增强,提升闭环鲁棒性和长尾泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23646 2026-02-06 cs.CV 82%

Active Perception Agent for Omnimodal Audio-Video Understanding

多模态音频视频理解的主动感知代理

Keda Tao, Wenjie Du, Bohan Yu, Weiqiang Wang, Jian Liu, Huan Wang

机构 * Zhejiang University(浙江大学) Westlake University(西湖大学)

专题命中 规划决策 :agent(title,abstract);planning(abstract)

AI总结 OmniAgent通过动态规划和音频引导感知范式,实现多模态细粒度推理,无需训练即超越现有模型性能。

Comments Website:https://kd-tao.github.io/OmniAgent/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03376 2026-02-04 cs.RO cs.CV 82%

PlanTRansformer: Unified Prediction and Planning with Goal-conditioned Transformer

PlanTRansformer: 一种结合目标条件变换器的统一预测与规划

Constantin Selzer, Fabina B. Flohr

机构 * Department of Electrical Engineering and Information Technology, Intelligent Vehicles Lab (IVL), Munich University of Applied Science(电气工程与信息科技系,智能车辆实验室(IVL),慕尼黑应用科学大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 PlanTRansformer通过整合目标条件预测、动态可行性等技术,提升自动驾驶中的预测与规划性能。

Comments Submitted and accepted at IEEE IV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01756 2026-02-03 cs.CV 82%

Mind-Brush: Integrating Agentic Cognitive Search and Reasoning into Image Generation

Mind-Brush: 将代理认知搜索与推理整合到图像生成中

Jun He, Junyan Ye, Zilong Huang, Dongzhi Jiang, Chenjue Zhang, Leqi Zhu, Renrui Zhang, Xiang Zhang, Weijia Li

机构 * Sun Yat-sen University(中山大学) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) MMLab, The Chinese University of Hong Kong(香港中文大学MMLab)

专题命中 规划决策 :agentic(title,abstract);workflow(abstract)

AI总结 Mind-Brush通过整合代理认知搜索与推理,提升图像生成模型对复杂知识推理和动态适应能力,实现性能显著跃升。

Comments 36 pages, 24 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00325 2026-02-03 eess.SY cs.RO cs.SY 82%

Motion Planning with Metric Temporal Logic Using Reachability Analysis and Hybrid Zonotopes

使用可达性分析和混合容积集进行基于度量时序逻辑的运动规划

Andrew F. Thompson, Joshua A. Robbins, Jonah J. Glunt, Sean B. Brennan, Herschel C. Pangborn

专题命中 规划决策 :planning(title);agent(abstract);multi-agent(abstract)

AI总结 本文提出了一种基于可达性分析和混合容积集的运动规划方法,用于满足时间依赖任务需求,展示了其在处理动态环境和多智能体协调方面的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21504 2026-01-30 cs.RO 82%

Don't double it: Efficient Agent Prediction in Occlusions

不要双倍:遮挡中的高效代理预测

Anna Rothenhäusler, Markus Mazzola, Andreas Look, Raghu Rajan, Joschka Bödecker

专题命中 规划决策 :agent(title,abstract);planning(abstract)

AI总结 本文提出MatchInformer方法,通过整合Hungarian匹配和分离航向与运动,提升遮挡场景下的代理预测准确性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20764 2026-01-29 cs.DC cs.MA 82%

Agentic Fog: A Policy-driven Framework for Distributed Intelligence in Fog Computing

代理雾:一种基于策略的雾计算分布式智能框架

Saeed Akbar, Muhammad Waqas, Rahmat Ullah

专题命中 规划决策 :agentic(title,abstract);autonomous agent(abstract)

AI总结 本文提出了一种基于策略的雾计算框架,通过将雾节点建模为自主代理并利用势博弈理论,实现了动态环境下的高效资源管理和稳定系统收敛。

Comments 09 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18543 2026-01-29 cs.CV 82%

GenAgent: Scaling Text-to-Image Generation via Agentic Multimodal Reasoning

GenAgent:通过代理多模态推理扩展文本到图像生成

Kaixun Jiang, Yuzheng Wang, Junjie Zhou, Pandeng Li, Zhihang Liu, Chen-Wei Xie, Zhaoyu Chen, Yun Zheng, Wenqiang Zhang

机构 * Fudan University(复旦大学) Tongyi Lab(通义实验室) Nanjing University(南京大学) University of Science and Technology of China(中国科学技术大学)

专题命中 规划决策 :agentic(title,abstract);agent(abstract)

AI总结 GenAgent通过代理多模态推理提升文本到图像生成性能,采用两阶段训练策略实现自主多轮交互与任务自适应推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19593 2026-01-28 cs.CV 82%

Localized Latent Editing for Dose-Response Modeling in Botulinum Toxin Injection Planning

局部潜在编辑用于肉毒素注射计划中的剂量-反应建模

Estèphe Arnaud, Mohamed Daoudi, Pierre Guerreschi

机构 * Univ. Lille, CNRS, Centrale Lille, Institut Mines-Télécom, UMR 9189 CRIStAL(里尔大学、国家科学研究中心、Centrale Lille、Institut Mines-Télécom、UMR 9189 CRIStAL) IMT Nord Europe, Institut Mines-Télécom, Univ. Lille, Centre for Digital Systems(IMT Nord Europe、Institut Mines-Télécom、里尔大学、数字系统中心) Lille University Hospital (CHU), Department of Plastic Surgery(里尔大学医院(CHU)、整形外科部门) SATT Nord

专题命中 规划决策 :planning(title,abstract);workflow(abstract)

AI总结 本文提出了一种局部潜在编辑框架,通过剂量-反应建模实现肉毒素注射计划,利用区域特定潜在轴发现方法实现对特定面部区域的精确控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19303 2026-01-28 cs.HC cs.GR cs.MM 82%

A Collaborative Extended Reality Prototype for 3D Surgical Planning and Visualization

一种用于3D手术规划和可视化协作扩展现实原型

Shi Qiu, Ruiyang Li, Qixuan Liu, Yuqi Tong, Yue Qiu, Yinqiao Wang, Yan Li, Chi-Wing Fu, Pheng-Ann Heng

专题命中 规划决策 :planning(title,abstract);workflow(abstract)

AI总结 本文提出了一种协作扩展现实原型,用于3D手术规划和可视化,通过用户研究验证了其有效性并为未来医疗XR协作提供启示。

Comments IEEE VR 2026 Posters

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17227 2026-01-27 cs.RO 82%

Hierarchical Informative Path Planning via Graph Guidance and Trajectory Optimization

基于图引导和轨迹优化的分层信息路径规划

Avraiem Iskandar, Shamak Dutta, Kevin Murrant, Yash Vardhan Pant, Stephen L. Smith

机构 * Department of Electrical and Computer Engineering, University of Waterloo(滑铁卢大学电气与计算机工程系) National Research Council Canada(加拿大国家研究理事会)

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 本文提出一种分层信息路径规划方法,结合图引导和轨迹优化,通过分段预算分配和样条细化,实现更低的后验不确定性与更快的运行速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17915 2026-01-23 cs.MA 82%

DISPATCH -- Decentralized Informed Spatial Planning and Assignment of Tasks for Cooperative Heterogeneous Agents

DISPATCH -- 分布式知情空间规划与任务分配以实现协作异构代理

Yao Liu, Sampad Mohanty, Elizabeth Ondula, Bhaskar Krishnamachari

专题命中 规划决策 :planning(title);agent(abstract);multi-agent(abstract)

AI总结 DISPATCH提出两种算法,通过整合公平性和效率,在分布式环境下实现异构代理任务分配的公平与效率平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14601 2026-01-22 cs.CR cs.NI 82%

Holmes: An Evidence-Grounded LLM Agent for Auditable DDoS Investigation in Cloud Networks

Holmes:一种基于证据的LLM代理,用于可审计的云网络DDoS调查

Haodong Chen, Ziheng Zhang, Jinghui Jiang, Qiang Su, Qiao Xiang

专题命中 规划决策 :agent(title,abstract);workflow(abstract)

AI总结 Holmes是一种基于LLM的DDoS检测代理,通过结构化证据和可追溯的审计日志,实现云网络中可解释、可审计的DDoS调查。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.05516 2026-01-22 cs.LG cs.AI cs.CL 82%

BayesAgent: Bayesian Agentic Reasoning Under Uncertainty via Verbalized Probabilistic Graphical Modeling

BayesAgent: 通过 verbalized 概率图模型实现不确定性下的贝叶斯代理推理

Hengguan Huang, Xing Shen, Songtao Wang, Lingfa Meng, Dianbo Liu, David Alejandro Duchene, Hao Wang, Samir Bhatt

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 BayesAgent 通过 verbalized 概率图模型实现不确定性下的贝叶斯代理推理,提升置信度校准和文本生成质量。

Comments Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏