arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 93944 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 35728 篇

2512.21375 2026-03-23 cs.RO cs.AI cs.SY eess.SY 79%

Safe Path Planning and Observation Quality Enhancement Strategy for Unmanned Aerial Vehicles in Water Quality Monitoring Tasks

无人机在水质监测任务中的安全路径规划与观测质量提升策略

Yuanshuang Fu, Qianyao Wang, Qihao Wang, Bonan Zhang, Jiaxin Zhao, Yiming Cao, Zhijun Li

机构 * University of Electronic Science and Technology of China(电子科技大学) North China University of Technology(华北理工大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出一种动态光照阴影干扰避障路径规划方法,通过动态预测模型和改进的IFDS算法,结合MPC框架和DFAA机制,提升无人机在复杂光照环境下的观测质量和飞行安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16931 2026-03-23 cs.AI cs.RO 79%

Multimodal Fused Learning for Solving the Generalized Traveling Salesman Problem in Robotic Task Planning

多模态融合学习用于解决机器人任务规划中的广义旅行商问题

Jiaqi Cheng, Mingfeng Fan, Xuefeng Zhang, Jingsong Liang, Yuhong Cao, Guohua Wu, Guillaume Adrien Sartoretti

机构 * Central South University(中南大学) National University of Singapore(新加坡国立大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出多模态融合学习框架,通过图和图像表示捕捉问题互补方面,生成高质量实时任务规划方案,实验表明其在各类GTSP实例中性能优于现有方法。

Comments 14 pages, 6 figures, Proceedings of the Conference on Robot Learning (CoRL 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19515 2026-03-23 cs.AI 79%

ItinBench: Benchmarking Planning Across Multiple Cognitive Dimensions with Large Language Models

ItinBench:利用大语言模型在多个认知维度上进行规划的基准测试

Tianlong Wang, Pinqiao Wang, Weili Shi, Sheng li

机构 * University of Virginia(弗吉尼亚大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出ItinBench,通过整合空间推理和传统语言推理任务,评估大语言模型在多认知维度上的规划能力,发现模型在同时处理多个维度时性能不稳定。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19429 2026-03-23 cs.AI cs.LO cs.SC 79%

When both Grounding and not Grounding are Bad -- A Partially Grounded Encoding of Planning into SAT (Extended Version)

当同时 grounding 和不 grounding 都不好 -- 一种部分 grounding 的规划到 SAT 编码(扩展版)

João Filipe, Gregor Behnke

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出一种部分 grounding 的 SAT 编码,在保持动作 lifted 的同时部分 grounding 预言,实现线性规模的规划效率,优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19257 2026-03-23 cs.CL 79%

Constraint-aware Path Planning from Natural Language Instructions Using Large Language Models

基于自然语言指令的约束感知路径规划:利用大语言模型

Dylan Shim, Minghan Wei

专题命中 规划决策 :planning(title,abstract);分类 cs.CL

AI总结 本文提出利用大语言模型解决带约束的路径规划问题,通过自然语言输入进行问题匹配和自推断,实现灵活且可扩展的解决方案。

Comments Accepted by 2026 SPIE Security + Defense Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10651 2026-03-20 cs.RO cs.AI 79%

Interleaving Scheduling and Motion Planning with Incremental Learning of Symbolic Space-Time Motion Abstractions

交织调度与运动规划的增量学习符号时空运动抽象

Elisa Tosello, Arthur Bit-Monnot, Davide Lusuardi, Alessandro Valentini, Andrea Micheli

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出一种交织调度与运动规划的增量学习框架,用于多物体共享空间的调度与运动规划,通过符号时空运动抽象提升复杂时空约束下的执行效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16060 2026-03-20 cs.AI 79%

ARISE: Agent Reasoning with Intrinsic Skill Evolution in Hierarchical Reinforcement Learning

ARISE: 在分层强化学习中通过内在技能进化实现智能体推理

Yu Li, Rui Miao, Zhengling Qi, Tian Lan

机构 * Department of Electrical and Computer Engineering, George Washington University(乔治华盛顿大学电气与计算机工程系) Department of Mathematical Sciences, University of Texas at Dallas(德克萨斯大学达拉斯分校数学科学系) School of Business, George Washington University(乔治华盛顿大学商学院)

专题命中 规划决策 :agent(title,abstract);分类 cs.AI

AI总结 ARISE提出一种分层强化学习框架,通过共享策略管理高阶技能和生成低阶响应,提升数学推理能力,实验显示其在多个基准测试中优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10978 2026-03-20 cs.AI cs.CY 79%

Agentic LLM Framework for Adaptive Decision Discourse

代理大语言模型框架用于自适应决策 discourse

Antoine Dolant, Praveen Kumar

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 本文提出一种代理大语言模型框架,用于模拟决策 discourse,通过多方观点协作开发可行策略,解决复杂系统中的不确定性挑战,展示了两个案例研究,平衡了社会、经济和环境优先事项,为可扩展和情境感知的推荐奠定基础。

Comments 24 pages, 4 figures, 1 appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10492 2026-03-19 cs.CL 79%

Human-AI Co-reasoning for Clinical Diagnosis with Evidence-Integrated Language Agent

人机协同推理用于临床诊断:证据整合语言代理

Zhongzhen Huang, Yan Ling, Hong Chen, Ye Feng, Li Wu, Linjie Mu, Shaoting Zhang, Xiaofan Zhang, Kun Qian, Xiaomu Li

专题命中 规划决策 :agent(title,abstract);分类 cs.CL

AI总结 本文提出PULSE,结合领域调优的大语言模型与文献检索,支持复杂病例的诊断决策。实验显示PULSE在专家级准确度上表现优异,且在罕见病病例中保持稳定性能,揭示了语言模型在临床诊断中的潜力与局限。

Comments After further evaluation, we have decided to withdraw the current version of this manuscript for further revision. We plan to add new experiments, improve the writing and overall presentation for greater clarity and coherence, and re-examine the dataset and related descriptions to ensure rigor and reliability before submitting an updated version

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17583 2026-03-19 cs.CV cs.AI 79%

Edit-As-Act: Goal-Regressive Planning for Open-Vocabulary 3D Indoor Scene Editing

Edit-As-Act:面向开放词汇3D室内场景编辑的目标回归规划

Seongrae Noh, SeungWon Seo, Gyeong-Moon Park, HyeongYeop Kang

机构 * Korea University(韩国大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出Edit-As-Act框架,通过目标回归规划实现开放词汇3D室内场景编辑,解决传统方法在生成和物理一致性上的不足,实验表明其在多个编辑任务中表现优异。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16967 2026-03-19 cs.CV cs.AI 79%

MSRAMIE: Multimodal Structured Reasoning Agent for Multi-instruction Image Editing

MSRAMIE:多模态结构推理代理用于多指令图像编辑

Zhaoyuan Qiu, Ken Chen, Xiangwei Wang, Yu Xia, Sachith Seneviratne, Saman Halgamuge

机构 * University Of Melbourne(墨尔本大学)

专题命中 规划决策 :agent(title,abstract);分类 cs.AI

AI总结 MSRAMIE基于多模态大语言模型构建无需训练的代理框架,通过结构化多模态推理处理多指令图像编辑任务,提升复杂指令遵循度和完成概率,同时保持图像质量和一致性。

Comments 14 pages, 6 figures, 3 tables, appendix and references provided

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15643 2026-03-18 cs.AI 79%

GSI Agent: Domain Knowledge Enhancement for Large Language Models in Green Stormwater Infrastructure

GSI代理:面向绿色雨水基础设施的大语言模型领域知识增强

Shaohuang Wang

专题命中 规划决策 :agent(title,abstract);分类 cs.AI

AI总结 本文提出GSI代理,通过监督微调、检索增强生成和代理推理流程,提升大语言模型在绿色雨水基础设施任务中的领域知识能力,实验表明其在领域任务中的表现显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16110 2026-03-18 cs.AI 79%

VIGIL: Towards Edge-Extended Agentic AI for Enterprise IT Support

VIGIL:迈向企业IT支持的边缘扩展代理AI

Sarthak Ahuja, Neda Kordjazi, Evren Yortucboylu, Vishaal Kapoor, Mariam Dundua, Yiming Li, Derek Ho, Vaibhavi Padala, Jennifer Whitted, Rebecca Steinert

机构 * Amazon Engine, AI Center of Excellence(亚马逊引擎,人工智能卓越中心)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 VIGIL通过在用户设备上部署桌面驻留代理,实现本地诊断、企业知识检索和政策驱动的修复,减少交互轮次,提升诊断速度,支持82%的自助解决,用户反馈显示透明度对信任至关重要。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15280 2026-03-17 cs.AI 79%

Advancing Multimodal Agent Reasoning with Long-Term Neuro-Symbolic Memory

通过长期神经符号记忆推进多模态代理推理

Rongjie Jiang, Jianwei Wang, Gengda Zhao, Chengyang Luo, Kai Wang, Wenjie Zhang

机构 * University of New South Wales(新南威尔士大学) Zhejiang University(浙江大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 规划决策 :agent(title,abstract);分类 cs.AI

AI总结 本文提出NS-Mem框架,结合神经记忆与符号结构,提升多模态代理的推理能力,实验证明其在推理准确率上优于纯神经记忆系统。

Comments 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13888 2026-03-17 cs.LG 79%

Tractable Probabilistic Models for Investment Planning

可计算的概率模型用于投资规划

Nicolas M. Cuadrado A., Mohannad Takrouri, Jiří Němeček, Martin Takáč, Jakub Mareček

专题命中 规划决策 :planning(title,abstract);分类 cs.LG

AI总结 本文提出基于可计算概率模型的投资规划方法,利用求和-乘积网络(SPNs)高效表示高维不确定性,支持精确概率查询,用于嵌入机会约束的混合整数线性规划模型以评估可靠性事件。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14704 2026-03-17 cs.LG cs.CV stat.ML 79%

Chain-of-Trajectories: Unlocking the Intrinsic Generative Optimality of Diffusion Models via Graph-Theoretic Planning

轨迹链:通过图论规划解锁扩散模型的内在生成最优性

Ping Chen, Xiang Liu, Xingpeng Zhang, Fei Shen, Xun Gong, Zhaoxiang Liu, Zezhou Chen, Huan Hu, Kai Wang, Shiguo Lian

专题命中 规划决策 :planning(title,abstract);分类 cs.LG

AI总结 本文提出轨迹链框架,通过图论规划解决扩散模型在高维状态空间中的计算瓶颈,提升生成质量与稳定性。

Comments 12 figues, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14057 2026-03-17 cs.AI 79%

Demand-Driven Context: A Methodology for Building Enterprise Knowledge Bases Through Agent Failure

需求驱动的上下文:通过智能体失败构建企业知识库的方法论

Raj Navakoti, Saideep Navakoti

专题命中 规划决策 :agent(title,abstract);分类 cs.AI

AI总结 本文提出需求驱动上下文方法,通过智能体失败信号来获取企业领域知识,解决传统知识工程方法的局限性,展示在零售订单履行中的应用案例。

Comments 18 pages, 5 figures, 1 algorithm. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13956 2026-03-17 cs.AI 79%

EviAgent: Evidence-Driven Agent for Radiology Report Generation

EviAgent:基于证据的放射学报告生成代理

Tuoshi Qi, Shenshen Bu, Yingfei Xiang, Zhiming Dai

专题命中 规划决策 :agent(title,abstract);分类 cs.AI

AI总结 EviAgent通过引入多维视觉专家和检索机制,解决放射学报告生成中的透明性与证据支持问题,实验表明其在多个数据集上优于通用和专用模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13360 2026-03-17 eess.IV cs.CV cs.LG q-bio.QM 79%

PREDICT-GBM: A multi-center platform to advance personalized glioblastoma radiotherapy planning

PREDICT-GBM:一个多中心平台以推进个性化胶质瘤放疗规划

L. Zimmer, J. Weidner, M. Balcerak, F. Kofler, M. Krupa, I. Ezhov, S. Cepeda, R. Zhang, J. Lowengrub, B. Menze, B. Wiestler

专题命中 规划决策 :planning(title,abstract);分类 cs.LG

AI总结 本文提出PREDICT-GBM平台,整合多中心数据集和标准化评估流程,开发并验证了基于U-Net的复发预测模型,显著提升了放疗规划的个性化水平。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13100 2026-03-16 cs.RO cs.AI 79%

Evaluating VLMs' Spatial Reasoning Over Robot Motion: A Step Towards Robot Planning with Motion Preferences

评估VLMs在机器人运动中的空间推理能力:迈向具有运动偏好的机器人规划的一步

Wenxi Wu, Jingjing Zhang, Martim Brandão

机构 * King’s College London(伦敦国王学院) University College London(伦敦大学学院)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文评估了四种先进VLMs在机器人运动中的空间推理能力,探讨了运动偏好(如物体接近性和路径风格)的处理,并分析了准确率与计算成本的权衡。

Comments Accepted to the First Workshop on Efficient Spatial Reasoning at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12607 2026-03-16 cs.RO cs.AI 79%

CarPLAN: Context-Adaptive and Robust Planning with Dynamic Scene Awareness for Autonomous Driving

CarPLAN: 基于动态场景感知的上下文自适应与鲁棒规划

Junyong Yun, Jungho Kim, ByungHyun Lee, Dongyoung Lee, Sehwan Choi, Seunghyeop Nam, Kichun Jo, Jun Won Choi

机构 * Department of Artificial Intelligence, Hanyang University(翰林大学人工智能系) Interdisciplinary Program in Artificial Intelligence, Seoul National University(首尔国立大学人工智能跨学科项目) Department of Electrical and Computer Engineering, Seoul National University(首尔国立大学电子与计算机工程系) Department of Automotive Engineering, Hanyang University(翰林大学汽车工程系)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 CarPLAN通过位移感知预测编码和上下文自适应多专家解码器,提升自动驾驶在复杂场景中的鲁棒性和适应性规划能力。

Comments 10 pages, 6 figures. Under review at IEEE Transactions on Intelligent Transportation Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14099 2026-03-16 cs.CV cs.AI 79%

FAPE-IR: Frequency-Aware Planning and Execution Framework for All-in-One Image Restoration

FAPE-IR:面向全场景图像修复的频率感知规划与执行框架

Jingren Liu, Shuning Xu, Qirui Yang, Yun Wang, Xiangyu Chen, Zhong Ji

机构 * Tianjin University(天津大学) University of Macau(澳门大学) City University of Hong Kong(香港城市大学) Institute of Artificial Intelligence (TeleAI)(人工智能研究所(TeleAI))

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出FAPE-IR框架,通过频率感知规划与执行模块,结合多模态大语言模型和LoRA-MoE架构,实现统一且可解释的全场景图像修复,实验显示其在七项任务中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05379 2026-03-16 cs.CR cs.AI 79%

ThreatGPT: An Agentic AI Framework for Enhancing Public Safety through Threat Modeling

ThreatGPT: 一个通过威胁建模增强公共安全的代理AI框架

Sharif Noor Zisad, Ragib Hasan

机构 * Department of Computer Science(计算机科学系) University of Alabama at Birmingham(阿拉巴马大学伯明翰分校)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 ThreatGPT通过整合AI与人类判断,帮助工程师、安全官和政策制定者分析公共安全系统的威胁,利用STRIDE、MITRE ATT&CK等框架生成智能威胁模型,提升安全防护能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12188 2026-03-13 cs.AI 79%

Compiling Temporal Numeric Planning into Discrete PDDL+: Extended Version

将时间数值规划编译为离散PDDL+:扩展版

Andrea Micheli, Enrico Scala, Alessandro Valentini

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出了一种将时间数值规划编译为离散PDDL+的方法,该方法在多项式时间内运行,保留计划长度至常数因子,并在实际应用中有效解决复杂的时间数值问题。

Comments This paper is an extended version of the homonymous appearing in the ICAPS 2026 proceedings. This version provides the proofs and addidional explanations of the compilation

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11987 2026-03-13 cs.AI 79%

LABSHIELD: A Multimodal Benchmark for Safety-Critical Reasoning and Planning in Scientific Laboratories

LABSHIELD:一种多模态基准,用于科学实验室中的安全关键推理和规划

Qianpu Sun, Xiaowei Chi, Yuhan Rui, Ying Li, Kuangzhi Ge, Jiajun Li, Sirui Han, Shanghang Zhang

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 LABSHIELD是一个多模态基准,用于评估MLLM在科学实验室中的安全关键推理和规划能力,揭示了现有模型在专业实验室场景中的性能差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11798 2026-03-13 cs.AI 79%

DocSage: An Information Structuring Agent for Multi-Doc Multi-Entity Question Answering

DocSage:一个多文档多实体问答的信息结构代理

Teng Lin, Yizhang Zhu, Zhengxuan Zhang, Yuyu Luo, Nan Tang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 规划决策 :agent(title);agentic(abstract);分类 cs.AI

AI总结 DocSage通过动态模式发现、结构化信息提取和模式感知推理,解决多文档多实体问答中的跨文档证据链构建和实体关系推断问题,实现超过27%的准确率提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11619 2026-03-13 cs.CR cs.AI 79%

Taming OpenClaw: Security Analysis and Mitigation of Autonomous LLM Agent Threats

驯服OpenClaw:自主LLM代理威胁的分析与缓解

Xinhao Deng, Yixiang Zhang, Jiaqing Wu, Jiaqi Bai, Sibo Yi, Zhuoheng Zou, Yue Xiao, Rennai Qiu, Jianan Ma, Jialuo Chen, Xiaohu Du, Xiaofang Yang, Shiwen Cui, Changhua Meng, Weiqiang Wang, Jiaxing Song, Ke Xu, Qi Li

机构 * Ant Group & Tsinghua University(蚂蚁集团与清华大学) Tsinghua University(清华大学)

专题命中 规划决策 :agent(title,abstract);分类 cs.AI

AI总结 本文分析了自主LLM代理OpenClaw的安全威胁,提出五层安全框架,揭示现有防御机制的不足,并提出包括插件审查、上下文过滤等在内的综合防御策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11072 2026-03-13 cs.RO cs.AI 79%

OA-NBV: Occlusion-Aware Next-Best-View Planning for Human-Centered Active Perception on Mobile Robots

OA-NBV:面向移动机器人人类中心主动感知的遮挡感知下一步最佳视角规划

Boxun Hu, Chang Chang, Jiawei Ge, Man Namgung, Xiaomin Lin, Axel Krieger, Tinoosh Mohsenin

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 OA-NBV是一种面向移动机器人人类中心主动感知的遮挡感知下一步最佳视角规划方法,通过目标为中心的可见性模型提高遮挡环境下视角选择的成功率和观察质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13043 2026-03-12 cs.CV cs.AI 79%

GTR-Turbo: Merged Checkpoint is Secretly a Free Teacher for Agentic VLM Training

GTR-Turbo:合并的检查点实际上是为代理VLM训练提供免费的教师

Tong Wei, Yijun Yang, Changhao Zhang, Junliang Xing, Yuanchun Shi, Zongqing Lu, Deheng Ye

机构 * Tsinghua University(清华大学) Tencent Hunyuan(腾讯文生) Peking University(北京大学)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 GTR-Turbo通过合并检查点作为免费教师,提升了多模态代理训练的效率和效果。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06658 2026-03-12 cs.RO cs.AI 79%

Self-Improving Loops for Visual Robotic Planning

自改进循环用于视觉机器人规划

Calvin Luo, Zilai Zeng, Mingxi Jia, Yilun Du, Chen Sun

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 SILVR通过自生成轨迹迭代更新视频模型,实现视觉机器人任务的持续改进,无需人类演示或奖励函数。

Comments ICLR 2026. Project Page: https://diffusion-supervision.github.io/silvr/

详情

展开后加载摘要…

URL PDF HTML 收藏