arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 35648 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 35648 篇

2603.08383 2026-03-10 cs.RO 82%

MoMaStage: Skill-State Graph Guided Planning and Closed-Loop Execution for Long-Horizon Indoor Mobile Manipulation

MoMaStage:基于技能-状态图的规划与闭环执行的长时域室内移动操作

Chenxu Li, Zixuan Chen, Yetao Li, Jiapeng Xu, Hongyu Ding, Jieqi Shi, Jing Huo, Yang Gao

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 MoMaStage通过结构化视觉-语言框架和闭环执行机制,实现长时域室内移动操作的高效规划与执行。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07824 2026-03-10 cs.RO 82%

Reasoning Knowledge-Gap in Drone Planning via LLM-based Active Elicitation

通过基于大语言模型的主动获取解决无人机规划中的推理知识缺口

Zeyu Fang, Beomyeol Yu, Cheng Liu, Zeyuan Yang, Rongqian Chen, Yuxin Lin, Mahdi Imani, Tian Lan

专题命中 规划决策 :planning(title,abstract);workflow(abstract)

AI总结 本文提出基于大语言模型的主动信息获取框架,用于解决无人机规划中的推理知识缺口问题,通过结构化知识缺口和最小化人机交互提升复杂任务的成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03362 2026-03-09 cs.RO 82%

Robustness-Aware Tool Selection and Manipulation Planning with Learned Energy-Informed Guidance

具有学习能量感知指导的鲁棒工具选择与操作规划

Yifei Dong, Yan Zhang, Sylvain Calinon, Florian T. Pokorny

机构 * division of Robotics, Perception and Learning, KTH Royal Institute of Technology(机器人、感知与学习系,皇家理工学院) Idiap Research Institute(Idiap研究机构) EPFL(瑞士联邦理工学院)

专题命中 规划决策 :planning(title,abstract);tool-use(abstract)

AI总结 本文提出了一种基于学习能量感知指导的鲁棒工具选择与操作规划方法,通过分层优化流程提升工具使用在外部干扰下的鲁棒性。

Comments IEEE International Conference on Robotics and Automation (ICRA), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03325 2026-03-05 cs.CL cs.AI cs.LG 82%

IntPro: A Proxy Agent for Context-Aware Intent Understanding via Retrieval-conditioned Inference

IntPro:一种通过检索条件推理的代理代理,用于基于情境的意图理解

Guanming Liu, Meng Wu, Peng Zhang, Yu Zhang, Yubo Shu, Xianliang Huang, Kainan Tu, Ning Gu, Liuxin Zhang, Qianying Wang, Tun Lu

机构 * Fudan University(复旦大学) Lenovo Group Ltd(联想集团有限公司)

专题命中 规划决策 :agent(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 IntPro通过检索条件推理学习适应个体用户,提升基于情境的意图理解性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22613 2026-03-04 cs.AI cs.CL cs.LG stat.ML 82%

Benefits and Pitfalls of Reinforcement Learning for Language Model Planning: A Theoretical Perspective

强化学习在语言模型规划中的利弊:一种理论视角

Siwei Wang, Yifei Shen, Haoran Sun, Shi Feng, Shang-Hua Teng, Li Dong, Yaru Hao, Wei Chen

机构 * Microsoft Research Asia(微软亚洲研究院) Peking University(北京大学) Harvard University(哈佛大学) University of Southern California(南加州大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文从理论角度分析强化学习在语言模型规划中的利弊,揭示探索的重要性及Q学习在多样性保持方面的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02514 2026-03-04 cs.HC 82%

Probing More-Than-Human Representation in Crisis Resilience Planning: An HCI Researcher Perspective

在危机韧性规划中探查超人类表征:人机交互研究者视角

Tram Thi Minh Tran, Adrian Wong, Callum Parker, Carlos Alfredo Tirado Cortes, Marius Hoggenmueller, Soojeong Yoo, Nate Zettna, Joel Fredericks

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 本文从人机交互研究者视角探讨危机韧性规划中如何通过设计探查实现非人类视角的表征,揭示了超人类表征设计中的张力与挑战。

Comments Accepted into CHI 2026 Posters track

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01822 2026-03-03 cs.CL cs.AI cs.CV cs.LG cs.MA 82%

InnoGym: Benchmarking the Innovation Potential of AI Agents

InnoGym:评估AI智能体创新潜力的基准测试

Jintian Zhang, Kewei Xu, Jingsheng Zheng, Zhuoyun Yu, Yuqi Zhu, Yujie Luo, Lanning Wei, Shuofei Qiao, Lun Du, Da Zheng, Shumin Deng, Huajun Chen, Ningyu Zhang

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团) National University of Singapore(新加坡国立大学) Zhejiang University - Ant Group Joint Laboratory of Knowledge Graph(知识图谱联合实验室)

专题命中 规划决策 :AI agent(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 InnoGym通过引入性能提升和新颖性两个指标,首次系统评估AI智能体的创新潜力,揭示了创造力与有效性的平衡问题。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11428 2026-03-03 cs.CV 82%

ImagiDrive: A Unified Imagination-and-Planning Framework for Autonomous Driving

ImagiDrive: 一种用于自动驾驶的统一想象与规划框架

Jingyu Li, Bozhou Zhang, Xin Jin, Jiankang Deng, Xiatian Zhu, Li Zhang

机构 * School of Data Science, Fudan University(复旦大学数据科学学院) Shanghai Innovation Institute(上海创新研究院) Eastern Institute of Technology(技术东院) Imperial College London(伦敦帝国理工学院) University of Surrey(萨里大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 ImagiDrive通过整合视觉-语言模型和驾驶世界模型,实现自动驾驶中的统一想象与规划循环,提升场景生成和决策预测的准确性与效率。

Comments Accepted for publication in 2026 IEEE International Conference on Robotics and Automation (ICRA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06034 2026-02-26 cs.CV 82%

V-Retrver: Evidence-Driven Agentic Reasoning for Universal Multimodal Retrieval

V-Retrver: 以证据驱动的代理推理用于通用多模态检索

Dongyang Chen, Chaoyang Wang, Dezhao Su, Xi Xiao, Zeyu Zhang, Jing Xiong, Qing Li, Yuzhang Shang, Shichao Kan

机构 * Tsinghua University(清华大学) University of Central Florida(中央佛罗里达大学) Fudan University(复旦大学) The Australian National University(澳大利亚国立大学) The University of Hong Kong(香港大学) Pengcheng Laboratory(鹏城实验室) Central South University(中南大学)

专题命中 规划决策 :agentic(title,abstract);agent(abstract)

AI总结 V-Retrver通过引入证据驱动的代理推理机制,提升多模态检索的准确率和推理可靠性。

Comments Project page: https://github.com/chendy25/V-Retrver

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21087 2026-02-26 cs.CV 82%

MIRA: Multimodal Iterative Reasoning Agent for Image Editing

MIRA: 多模态迭代推理代理用于图像编辑

Ziyun Zeng, Hang Hua, Jiebo Luo

机构 * University of Rochester(罗切斯特大学) MIT-IBM Watson AI Lab(MIT-IBM沃森人工智能实验室)

专题命中 规划决策 :agent(title,abstract);tool-use(abstract)

AI总结 MIRA通过多模态迭代推理代理提升图像编辑的语义一致性和感知质量,结合自研数据集和训练流程,实现与专有系统相当的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23502 2026-02-25 cs.NI 82%

Hierarchical Decision Mamba Meets Agentic AI: A Novel Approach for RAN Slicing in 6G

分层决策Mamba遇见代理AI:一种用于6G RAN切片的新方法

Md Arafat Habib, Medhat Elsayed, Majid Bavand, Pedro Enrique Iturria Rivera, Yigit Ozcan, Melike Erol-Kantarci

专题命中 规划决策 :agentic(title,abstract);agent(abstract)

AI总结 本文提出了一种基于分层决策Mamba和大型语言模型的代理AI框架,用于6G RAN切片,通过整合自然语言理解与协调决策,提升切片性能。

Comments Accepted for publication in IEEE Networking Letters (Author's copy). Copyright belongs to IEEE

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18582 2026-02-24 cs.AI cs.CL cs.HC cs.LG 82%

Hierarchical Reward Design from Language: Enhancing Alignment of Agent Behavior with Human Specifications

基于语言的层次奖励设计:通过人类规范增强智能体行为对齐

Zhiqin Qian, Ryan Diaz, Sangwon Seo, Vaibhav Unhelkar

机构 * Rice University(里士大学)

专题命中 规划决策 :agent(title);AI agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出基于语言的层次奖励设计(HRDL)和语言到层次奖励(L2HR)方法,用于通过人类规范增强智能体行为对齐,提升AI任务完成效果和规范遵守程度。

Comments Extended version of an identically-titled paper accepted at AAMAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10116 2026-02-24 cs.CV cs.RO 82%

SAGE: Scalable Agentic 3D Scene Generation for Embodied AI

SAGE: 适用于具身人工智能的可扩展代理3D场景生成

Hongchi Xia, Xuan Li, Zhaoshuo Li, Qianli Ma, Jiashu Xu, Ming-Yu Liu, Yin Cui, Tsung-Yi Lin, Wei-Chiu Ma, Shenlong Wang, Shuran Song, Fangyin Wei

机构 * NVIDIA University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Cornell University(康奈尔大学) Stanford University(斯坦福大学)

专题命中 规划决策 :agentic(title,abstract);agent(abstract)

AI总结 SAGE通过代理框架生成可扩展的3D环境,用于具身人工智能的策略训练和泛化能力提升。

Comments Project Page: https://research.nvidia.com/labs/dir/sage/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18260 2026-02-23 cs.RO 82%

Role-Adaptive Collaborative Formation Planning for Team of Quadruped Robots in Cluttered Environments

面向 cluttered 环境的四足机器人团队角色自适应协作形成规划

Magnus Norén, Marios-Nektarios Stamatopoulos, Avijit Banerjee, George Nikolakopoulos

机构 * Robotics and Artificial Intelligence Group, Department of Computer, Electrical and Space Engineering, Lulea University of Technology(机器人与人工智能小组,计算机、电气与航天工程系,卢莱亚理工大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 本文提出了一种适用于 cluttered 环境的四足机器人团队角色自适应协作形成规划方法,通过动态角色分配和 FM2 算法实现灵活导航与稳定形成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11409 2026-02-23 cs.LG cs.AI cs.CL cs.CV 82%

Visual Planning: Let's Think Only with Images

视觉规划:只用图像来思考

Yi Xu, Chengzu Li, Han Zhou, Xingchen Wan, Caiqi Zhang, Anna Korhonen, Ivan Vulić

机构 * Language Technology Lab, University of Cambridge(剑桥大学语言技术实验室) Google(谷歌公司)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出视觉规划范式,通过图像进行推理,优于纯文本推理,在视觉导航任务中表现更优。

Comments ICLR 2026 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13868 2026-02-17 cs.NI cs.IR 82%

Agentic Assistant for 6G: Turn-based Conversations for AI-RAN Hierarchical Co-Management

6G代理助手:基于回合的对话用于AI-RAN分层协同管理

Udhaya Srinivasan, Weisi Guo

专题命中 规划决策 :agentic(title,abstract);planning(abstract)

AI总结 本文提出了一种基于回合的对话助手,用于AI-RAN的分层协同管理,通过三层架构实现高效网络管理和降低运营成本。

Comments submitted to IEEE conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25260 2026-02-17 cs.AI cs.CL cs.LG 82%

Internal Planning in Language Models: Characterizing Horizon and Branch Awareness

语言模型中的内部规划:刻画视野与分支意识

Muhammed Ustaomeroglu, Baris Askin, Gauri Joshi, Carlee Joe-Wong, Guannan Qu

机构 * Department of Electrical and Computer Engineering(电气与计算机工程系) Carnegie Mellon University(卡内基梅隆大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 研究通过分析语言模型内部计算结构,揭示规划视野与分支意识的特性,为理解模型内部动态提供通用工具。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13622 2026-02-17 cs.HC 82%

The Shadow Boss: Identifying Atomized Manipulations in Agentic Employment of XR Users using Scenario Constructions

影子老板:通过场景构建识别代理雇佣中XR用户原子化操控

Lik-Hang Lee

专题命中 规划决策 :agentic(title,abstract);AI agent(abstract)

AI总结 本文通过场景构建方法,识别代理雇佣中XR用户面临的七个关键风险,揭示AI代理对人类劳动的原子化操控问题,呼吁需以用户为中心的XR和政策干预。

Comments 28 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13577 2026-02-17 cs.RO 82%

ONRAP: Occupancy-driven Noise-Resilient Autonomous Path Planning

ONRAP:基于占用度的抗噪声自主路径规划

Faizan M. Tariq, Avinash Singh, Vipul Ramtekkar, Jovin D'sa, David Isele, Yosuke Sakamoto, Sangjae Bae

机构 * Honda Research Institute, CA, USA(本田研究院,美国加利福尼亚州) Honda Research and Development(本田研发)

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 ONRAP 提出了一种基于占用网格的抗噪声路径规划方法,结合占用流预测以生成安全可行的路径,实现实时运行并有效应对不确定环境。

Comments 8 pages, 9 figures - Presented at 2026 IEEE Intelligent Vehicles Symposium (IV)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13086 2026-02-16 cs.RO 82%

UniManip: General-Purpose Zero-Shot Robotic Manipulation with Agentic Operational Graph

UniManip: 通用目的零样本机器人操作的代理操作图

Haichao Liu, Yuanjiang Xue, Yuheng Zhou, Haoyuan Deng, Yinan Liang, Lihua Xie, Ziwei Wang

机构 * School of Electrical and Electronic Engineering, Nanyang Technological University, Singapore(南洋理工大学电子与电气工程学院) Department of Automation, Tsinghua University, China(清华大学自动化系)

专题命中 规划决策 :agentic(title,abstract);planning(abstract)

AI总结 UniManip通过双层代理操作图实现通用零样本机器人操作,结合高层任务协调与底层动态状态表示,提升无监督环境下的执行鲁棒性。

Comments 15 pages, 12 figures, 6 tables, project page: https://henryhcliu.github.io/unimanip

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08987 2026-02-13 cs.CE 82%

Rapid prediction of cardiac activation in the left ventricle with geometric deep learning: a step towards cardiac resynchronization therapy planning

基于几何深度学习的左心室心脏激活快速预测:迈向心脏再同步治疗规划的一步

Ehsan Naghavi, Haifeng Wang, Vahid Ziaei Rad, Julius Guccione, Ghassan Kassab, Vishnu Boddeti, Seungik Baek, Lik-Chuan Lee

专题命中 规划决策 :planning(title,abstract);workflow(abstract)

AI总结 本研究利用几何深度学习模型预测左心室激活时间图,以提高CRT治疗规划的精准度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09227 2026-02-11 cs.RO 82%

From Legible to Inscrutable Trajectories: (Il)legible Motion Planning Accounting for Multiple Observers

从可理解到不可理解的轨迹:考虑多个观察者的(不)可理解运动规划

Ananya Yammanuru, Maria Lusardi, Nancy M. Amato, Katherine Driggs-Campbell

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 本文提出MMLO-LMP问题,设计DUBIOUS算法,实现对不同动机观察者的轨迹可理解性与可见性限制的平衡。

Comments 17 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04333 2026-02-10 cs.CV cs.RO 82%

RAP: 3D Rasterization Augmented End-to-End Planning

RAP: 3D 像素化增强端到端规划

Lan Feng, Yang Gao, Eloi Zablocki, Quanyi Li, Wuyang Li, Sichao Liu, Matthieu Cord, Alexandre Alahi

机构 * EPFL(苏黎世联邦理工学院) Sorbonne Université(索邦大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 RAP通过3D像素化增强端到端规划,利用轻量级像素化和特征对齐实现可扩展的数据增强,提升闭环鲁棒性和长尾泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23646 2026-02-06 cs.CV 82%

Active Perception Agent for Omnimodal Audio-Video Understanding

多模态音频视频理解的主动感知代理

Keda Tao, Wenjie Du, Bohan Yu, Weiqiang Wang, Jian Liu, Huan Wang

机构 * Zhejiang University(浙江大学) Westlake University(西湖大学)

专题命中 规划决策 :agent(title,abstract);planning(abstract)

AI总结 OmniAgent通过动态规划和音频引导感知范式,实现多模态细粒度推理,无需训练即超越现有模型性能。

Comments Website:https://kd-tao.github.io/OmniAgent/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03376 2026-02-04 cs.RO cs.CV 82%

PlanTRansformer: Unified Prediction and Planning with Goal-conditioned Transformer

PlanTRansformer: 一种结合目标条件变换器的统一预测与规划

Constantin Selzer, Fabina B. Flohr

机构 * Department of Electrical Engineering and Information Technology, Intelligent Vehicles Lab (IVL), Munich University of Applied Science(电气工程与信息科技系,智能车辆实验室(IVL),慕尼黑应用科学大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 PlanTRansformer通过整合目标条件预测、动态可行性等技术,提升自动驾驶中的预测与规划性能。

Comments Submitted and accepted at IEEE IV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01756 2026-02-03 cs.CV 82%

Mind-Brush: Integrating Agentic Cognitive Search and Reasoning into Image Generation

Mind-Brush: 将代理认知搜索与推理整合到图像生成中

Jun He, Junyan Ye, Zilong Huang, Dongzhi Jiang, Chenjue Zhang, Leqi Zhu, Renrui Zhang, Xiang Zhang, Weijia Li

机构 * Sun Yat-sen University(中山大学) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) MMLab, The Chinese University of Hong Kong(香港中文大学MMLab)

专题命中 规划决策 :agentic(title,abstract);workflow(abstract)

AI总结 Mind-Brush通过整合代理认知搜索与推理,提升图像生成模型对复杂知识推理和动态适应能力,实现性能显著跃升。

Comments 36 pages, 24 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00325 2026-02-03 eess.SY cs.RO cs.SY 82%

Motion Planning with Metric Temporal Logic Using Reachability Analysis and Hybrid Zonotopes

使用可达性分析和混合容积集进行基于度量时序逻辑的运动规划

Andrew F. Thompson, Joshua A. Robbins, Jonah J. Glunt, Sean B. Brennan, Herschel C. Pangborn

专题命中 规划决策 :planning(title);agent(abstract);multi-agent(abstract)

AI总结 本文提出了一种基于可达性分析和混合容积集的运动规划方法,用于满足时间依赖任务需求,展示了其在处理动态环境和多智能体协调方面的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21504 2026-01-30 cs.RO 82%

Don't double it: Efficient Agent Prediction in Occlusions

不要双倍:遮挡中的高效代理预测

Anna Rothenhäusler, Markus Mazzola, Andreas Look, Raghu Rajan, Joschka Bödecker

专题命中 规划决策 :agent(title,abstract);planning(abstract)

AI总结 本文提出MatchInformer方法,通过整合Hungarian匹配和分离航向与运动,提升遮挡场景下的代理预测准确性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20764 2026-01-29 cs.DC cs.MA 82%

Agentic Fog: A Policy-driven Framework for Distributed Intelligence in Fog Computing

代理雾:一种基于策略的雾计算分布式智能框架

Saeed Akbar, Muhammad Waqas, Rahmat Ullah

专题命中 规划决策 :agentic(title,abstract);autonomous agent(abstract)

AI总结 本文提出了一种基于策略的雾计算框架,通过将雾节点建模为自主代理并利用势博弈理论,实现了动态环境下的高效资源管理和稳定系统收敛。

Comments 09 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18543 2026-01-29 cs.CV 82%

GenAgent: Scaling Text-to-Image Generation via Agentic Multimodal Reasoning

GenAgent:通过代理多模态推理扩展文本到图像生成

Kaixun Jiang, Yuzheng Wang, Junjie Zhou, Pandeng Li, Zhihang Liu, Chen-Wei Xie, Zhaoyu Chen, Yun Zheng, Wenqiang Zhang

机构 * Fudan University(复旦大学) Tongyi Lab(通义实验室) Nanjing University(南京大学) University of Science and Technology of China(中国科学技术大学)

专题命中 规划决策 :agentic(title,abstract);agent(abstract)

AI总结 GenAgent通过代理多模态推理提升文本到图像生成性能,采用两阶段训练策略实现自主多轮交互与任务自适应推理。

详情

展开后加载摘要…

URL PDF HTML 收藏