arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 35547 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 35547 篇

2601.06474 2026-01-21 cs.CV cs.AI 79%

SparseOccVLA: Bridging Occupancy and Vision-Language Models via Sparse Queries for Unified 4D Scene Understanding and Planning

SparseOccVLA: 通过稀疏查询弥合占用与视觉语言模型之间的鸿沟,实现统一的4D场景理解和规划

Chenxu Dang, Jie Wang, Guang Li, Zhiwen Hou, Zihan You, Hangjun Ye, Jie Ma, Long Chen, Yan Wang

机构 * Huazhong University of Science and Technology(华中科技大学) Xiaomi EV(小米电动车) Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 SparseOccVLA通过稀疏查询整合视觉语言模型与语义占用,实现统一的4D场景理解和规划,提升自动驾驶性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10455 2026-01-16 cs.CL cs.RO 79%

SurgGoal: Rethinking Surgical Planning Evaluation via Goal-Satisfiability

SurgGoal: 重新思考手术计划评估 via 目标满足性

Ruochen Li, Kun Yuan, Yufei Xia, Yue Zhou, Qingyu Lu, Weihang Li, Youxiang Zhu, Nassir Navab

机构 * Technical University of Munich, Germany(慕尼黑技术大学) University of Strasbourg, France(斯特拉斯堡大学) University of Glasgow, United Kingdom(格拉斯哥大学) Nanyang Technological University, Singapore(南洋理工大学) University of Massachusetts Boston, USA(马萨诸塞大学波士顿分校)

专题命中 规划决策 :planning(title,abstract);分类 cs.CL

AI总结 SurgGoal通过目标满足性度量重新评估手术计划,揭示视频大语言模型在安全关键环境中的性能问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10222 2026-01-16 cs.AI 79%

Compartmentalised Agentic Reasoning for Clinical NLI

临床自然语言推理中的 compartmentalised agentic 推理

Maël Jullien, Lei Xu, Marco Valentino, André Freitas

机构 * Department of Computer Science, University of Manchester, UK(曼彻斯特大学计算机科学系) National Biomarker Centre, CRUK-MI, University of Manchester, UK(曼彻斯特大学国家生物标记中心) Idiap Research Institute, Switzerland(日内瓦IDIAP研究所) School of Computer Science, University of Sheffield, UK(谢菲尔德大学计算机科学系) École Polytechnique Fédérale de Lausanne (EPFL), Switzerland(洛桑联邦理工学院(EPFL))

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 CARENLI 通过 compartmentalisation 和验证提升临床自然语言推理的准确率,从 23% 提高到 57%

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19126 2026-01-16 cs.CL 79%

AWPO: Enhancing Tool-Use of Large Language Models through Adaptive Integration of Reasoning Rewards

AWPO: 通过适应性整合推理奖励增强大语言模型的工具使用

Zihan Lin, Xiaohan Wang, Hexiong Yang, Jiajun Chai, Jie Cao, Guojun Yin, Wei Lin, Ran He

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

专题命中 规划决策 :tool-use(title,abstract);分类 cs.CL

AI总结 AWPO通过适应性整合推理奖励提升大语言模型的工具使用性能,实现多轮场景中的卓越表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08988 2026-01-15 cs.AI 79%

ART: Action-based Reasoning Task Benchmarking for Medical AI Agents

ART:面向医疗AI代理的基于动作的推理任务基准测试

Ananya Mantravadi, Shivali Dalmia, Abhishek Mukherji

专题命中 规划决策 :AI agent(title,abstract);分类 cs.AI

AI总结 ART通过挖掘真实EHR数据创建挑战性任务,评估医疗AI代理在阈值评估、时间聚合和条件逻辑方面的表现,揭示其推理弱点,推动更可靠的临床决策支持系统发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08621 2026-01-14 cs.CL 79%

GraphSearch: Agentic Search-Augmented Reasoning for Zero-Shot Graph Learning

GraphSearch: 基于代理的搜索增强推理用于零样本图学习

Jiajin Liu, Yuanfu Sun, Dongzhe Fan, Qiaoyu Tan

机构 * Department of Computer Science, New York University (Shanghai)(计算机科学系,纽约大学(上海))

专题命中 规划决策 :agentic(title,abstract);分类 cs.CL

AI总结 GraphSearch通过图感知查询规划器和检索器实现零样本图学习,无需任务特定微调,提升图结构推理效率。

Comments 16 pages, 5 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08271 2026-01-14 cs.AI 79%

Sparsity Is Necessary: Polynomial-Time Stability for Agentic LLMs in Large Action Spaces

稀疏性是必要的:大规模动作空间中代理LLM的多项式时间稳定性

Angshul Majumdar

机构 * Angshul Majumdar(独立研究者)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 研究提出稀疏代理控制框架,通过多项式时间稳定性理论解决大规模动作空间中LLM的稀疏性问题,证明稀疏表示在策略学习中的有效性及密集策略类的样本需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12992 2026-01-14 cs.RO cs.CL cs.CV cs.MA 79%

UNCAP: Uncertainty-Guided Neurosymbolic Planning Using Natural Language Communication for Cooperative Autonomous Vehicles

UNCAP:基于自然语言通信的不确定性引导神经符号规划

Neel P. Bhatt, Po-han Li, Kushagra Gupta, Rohan Siva, Daniel Milan, Alexander T. Hogue, Sandeep P. Chinchali, David Fridovich-Keil, Zhangyang Wang, Ufuk Topcu

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 规划决策 :planning(title,abstract);分类 cs.CL

AI总结 UNCAP通过自然语言通信和不确定性引导方法,提升多车辆协同自动驾驶系统的可扩展性和安全性。

Journal ref AAMAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03215 2026-01-14 cs.AI 79%

COSINT-Agent: A Knowledge-Driven Multimodal Agent for Chinese Open Source Intelligence

COSINT-Agent: 一种面向中文开源情报的知识驱动多模态智能体

Wentao Li, Congcong Wang, Xiaoxiao Cui, Zhi Liu, Wei Guo, Lizhen Cui

专题命中 规划决策 :agent(title,abstract);分类 cs.AI

AI总结 COSINT-Agent通过整合多模态大语言模型与实体-事件-场景知识图谱,提升中文开源情报的多模态推理能力与情报生成效率。

Comments This manuscript (arXiv:2503.03215) is being withdrawn at the supervisor's request. The content is preliminary and needs further internal revision and approval before public release. We will resubmit a revised version after completion. Apologies for the inconvenience

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07597 2026-01-13 cs.NE cs.AI 79%

Pheromone-Focused Ant Colony Optimization algorithm for path planning

基于信息素聚焦的蚁群优化算法用于路径规划

Yi Liu, Hongda Zhang, Zhongxue Gan, Yuning Chen, Ziqing Zhou, Chunlei Meng, Chun Ouyang

机构 * College of Intelligent Robotics and Advanced Manufacturing, Fudan University(智能机器人与先进制造学院,复旦大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出基于信息素聚焦的蚁群优化算法,通过三种策略提升路径规划中的收敛速度和解质量。

Comments Accepted to 2025 IEEE International Conference on Systems, Man, and Cybernetics (SMC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14656 2026-01-13 cs.AI 79%

Cost-Awareness in Tree-Search LLM Planning: A Systematic Study

树搜索LLM规划中的成本意识:系统研究

Zihao Zhang, Hui Wei, Kenan Jiang, Shijia Pan, Shu Kai, Fei Liu

机构 * Emory University(埃默里大学) University of California, Merced(加州大学默塞德分校)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文研究了树搜索LLM规划器在资源受限下的成本意识问题,发现现有方法难以找到最优计划,双向搜索表现最佳,MCTS在短时间任务中最优,表明需新算法而非单纯增加计算量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06562 2026-01-13 cs.LG 79%

Mosaic: Unlocking Long-Context Inference for Diffusion LLMs via Global Memory Planning and Dynamic Peak Taming

Mosaic: 通过全局内存规划和动态峰值镇压解锁扩散语言模型的长上下文推理

Liang Zheng, Bowen Shi, Yitao Hu, Jiawei Zhang, Ruofan Li, Sheng Chen, Wenxin Li, Keqiu Li

机构 * Tianjin University, China(天津大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.LG

AI总结 Mosaic通过全局内存规划和动态峰值镇压,提升扩散语言模型的长上下文推理能力,实现内存效率和推理长度的显著提升。

Comments 11 pages, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06062 2026-01-13 cs.CY cs.AI cs.HC 79%

From Values to Frameworks: A Qualitative Study of Ethical Reasoning in Agentic AI Practitioners

从价值到框架:关于代理AI从业者伦理推理的定性研究

Theodore Roberts, Bahram Zarrin

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 本文通过定性研究揭示代理AI从业者在伦理推理中的三种框架:用户、设计和伦理,强调需管理这些框架以确保伦理结果。

Comments 10 pages, 2 charts, 1 heatmap

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05836 2026-01-12 cs.RO cs.AI 79%

Intelligent Singularity Avoidance in UR10 Robotic Arm Path Planning Using Hybrid Fuzzy Logic and Reinforcement Learning

基于混合模糊逻辑与强化学习的UR10机械臂路径规划中智能奇异点规避

Sheng-Kai Chen, Jyh-Horng Wu

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出一种结合模糊逻辑与强化学习的UR10机械臂路径规划方法,通过实时检测和规避奇异点,实现高成功率的路径规划。

Comments Published in TANET 2025 (Paper No. T0404)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.06111 2026-01-12 cs.RO cs.AI cs.CV cs.SY eess.SY 79%

Competency-Aware Planning for Probabilistically Safe Navigation Under Perception Uncertainty

具有能力感知的规划用于在感知不确定性下的概率安全导航

Sara Pohland, Claire Tomlin

机构 * Department of EECS, UC Berkeley(电子工程与计算机科学系,伯克利大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出PaRCE方法,通过估计模型对输入图像的整体和局部熟悉度,提升在感知不确定性下的导航安全性与效率。

Journal ref 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05214 2026-01-09 cs.AI 79%

Internal Representations as Indicators of Hallucinations in Agent Tool Selection

内部表示作为代理工具选择中的幻觉指示器

Kait Healy, Bharathi Srinivasan, Visakh Madathil, Jing Wu

专题命中 规划决策 :agent(title,abstract);分类 cs.AI

AI总结 本文提出了一种利用LLM内部表示实时检测工具调用幻觉的方法,通过减少计算开销实现高准确率的检测,尤其在参数和工具选择方面表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03687 2026-01-08 cs.AI 79%

Personalized Medication Planning via Direct Domain Modeling and LLM-Generated Heuristics

通过直接领域建模和LLM生成的启发式方法实现个性化药物规划

Yonatan Vernik, Alexander Tuisov, David Izhaki, Hana Weitman, Gal A. Kaminka, Alexander Shleyfman

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文通过直接领域建模和LLM生成的启发式方法,提升了个性化药物规划的规模和效率,支持更接近临床应用的实践。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02757 2026-01-08 cs.AI 79%

LLM Agent Framework for Intelligent Change Analysis in Urban Environment using Remote Sensing Imagery

基于遥感影像的城市环境智能变化分析LLM代理框架

Zixuan Xiao, Jun Ma

专题命中 规划决策 :agent(title,abstract);分类 cs.AI

AI总结 本文提出基于LLM和视觉基础模型的ChangeGPT框架,通过分层结构提升变化检测的智能与适应性,实现在城市环境中的高效变化分析。

Journal ref Automation in Construction 177 (2025) 106341

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03204 2026-01-07 cs.AI cs.MA 79%

InfiAgent: An Infinite-Horizon Framework for General-Purpose Autonomous Agents

InfiAgent: 通用自主代理的无限时间 horizon 框架

Chenglin Yu, Yuchen Wang, Songmiao Wang, Hongxia Yang, Ming Li

机构 * The University of Hong Kong(香港大学) The Hong Kong Polytechnic University(香港理工大学)

专题命中 规划决策 :autonomous agent(title);agent(abstract);分类 cs.AI

AI总结 InfiAgent 通过外部化持久状态实现无限时间 horizon 任务的稳定推理,无需任务特定微调即可在长时间任务中超越传统方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.19500 2026-01-07 cs.RO cs.LG 79%

RobotDiffuse: Diffusion-Based Motion Planning for Redundant Manipulators with the ROP Obstacle Avoidance Dataset

RobotDiffuse: 基于扩散模型的冗余机械臂运动规划与ROP障碍避让数据集

Xudong Mou, Xiaohan Zhang, Tiejun Wang, Tianyu Wo, Cangbai Xu, Ningbo Gu, Rui Wang, Xudong Liu

机构 * School of Computer Science and Engineering, Beihang University, Beijing, China(北京航空航天大学计算机科学与工程学院) School of Software, Beihang University, Beijing, China(北京航空航天大学软件学院) Hangzhou Innovation Institute, Beihang University, Hangzhou, China(北京航空航天大学杭州创新研究院)

专题命中 规划决策 :planning(title,abstract);分类 cs.LG

AI总结 RobotDiffuse通过扩散模型实现冗余机械臂运动规划,结合物理约束与点云编码器,并发布ROP数据集提升障碍避让性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21361 2026-01-07 cs.LG 79%

Compositional Monte Carlo Tree Diffusion for Extendable Planning

组合蒙特卡洛树扩散用于可扩展规划

Jaesik Yoon, Hyeonseo Cho, Sungjin Ahn

机构 * KAIST(韩国科学技术院) SAP(SAP公司) NYU(纽约大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.LG

AI总结 C-MCTD通过引入三个互补组件,将规划从单轨迹优化提升到完整计划组合推理,实现更高效和可扩展的规划方法。

Comments 24 pages, 4 figures, NeurIPS 25 Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01118 2026-01-06 cs.IR cs.AI cs.DL 79%

ScienceDB AI: An LLM-Driven Agentic Recommender System for Large-Scale Scientific Data Sharing Services

ScienceDB AI: 基于大语言模型的代理推荐系统用于大规模科学数据共享服务

Qingqing Long, Haotian Chen, Chenyang Zhao, Xiaolei Du, Xuezhi Wang, Pengyao Wang, Chengzan Li, Yuanchun Zhou, Hengshu Zhu

机构 * Computer Network Information Center, Chinese Academy of Sciences, Beijing, China(中国科学院计算机网络信息中心)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 ScienceDB AI 是首个基于大语言模型的对话推荐系统,专为大规模科学数据共享服务设计,通过自然语言对话和深度推理实现精准的数据集推荐。

Comments 12 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00580 2026-01-05 cs.RO cs.AI cs.MA 79%

Priority-Aware Multi-Robot Coverage Path Planning

优先感知多机器人覆盖率路径规划

Kanghoon Lee, Hyeonjun Kim, Jiachen Li, Jinkyoo Park

机构 * Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院) Korea Military Academy (KMA)(韩国军事学院) University of California, Riverside (UCR)(加州大学河滨分校) Omelet

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出优先感知多机器人覆盖率路径规划方法,通过两阶段框架结合贪心分配与局部搜索,有效减少优先区域延迟并优化完成时间。

Comments IEEE Robotics and Automation Letters, 8 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00087 2026-01-05 cs.RO cs.LG 79%

Reinforcement learning with timed constraints for robotics motion planning

具有时间约束的强化学习用于机器人运动规划

Zhaoan Wang, Junchao Li, Mahdi Mohammad, Shaoping Xiao

机构 * Department of Mechanical Engineering, Iowa Technology Institute, University of Iowa(机械工程系,Iowa技术研究所,爱荷华大学) Talus Renewables, Inc.(Talus Renewables公司) Department of Industrial, Electronic, and Mechanical Engineering, Roma Tre University(工业、电子和机械工程系,罗马三大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.LG

AI总结 本文提出了一种基于自动机的强化学习框架,用于在满足MITL时间约束的MDP和POMDP中合成策略,通过时间限制确定性广义巴克斯自动机实现时间正确性和性能优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24404 2026-01-01 cs.LG cs.CV 79%

Lifting Vision: Ground to Aerial Localization with Reasoning Guided Planning

提升视觉:基于推理引导的地面到空中定位

Soham Pahari, M. Srinivas

机构 * School of Computer Science, UPES(UPES计算机科学学院) Department of CS&E, NIT Warangal(NIT Warangal计算机科学与工程系)

专题命中 规划决策 :planning(title,abstract);分类 cs.LG

AI总结 本文提出ViReLoc框架,通过视觉推理实现地面到空中定位,无需依赖GPS数据,提升空间推理和跨视角检索性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24113 2026-01-01 cs.AI cs.IR 79%

CogRec: A Cognitive Recommender Agent Fusing Large Language Models and Soar for Explainable Recommendation

CogRec: 一种融合大型语言模型和Soar的可解释推荐代理

Jiaxin Hu, Tao Wang, Bingsan Yang, Hongrun Wang

专题命中 规划决策 :agent(title,abstract);分类 cs.AI

AI总结 CogRec融合大型语言模型和Soar认知架构,通过符号推理与在线学习提升推荐系统的可解释性和准确性。

Comments 9 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23545 2025-12-30 cs.CV cs.AI 79%

PathFound: An Agentic Multimodal Model Activating Evidence-seeking Pathological Diagnosis

PathFound: 一种促进证据寻求病理诊断的代理多模态模型

Shengyi Hua, Jianfeng Wu, Tianle Shen, Kangzhe Hu, Zhongzhen Huang, Shujuan Ni, Zhihong Zhang, Yuan Li, Zhe Wang, Xiaofan Zhang

机构 * Qing Yuan Research Institute, Shanghai Jiao Tong University(上海交通大学庆元研究院) Shanghai Innovation Institute(上海创新研究院) Department of Pathology, The First Affiliated Hospital of USTC, Division of Life Sciences and Medicine, University of Science and Technology of China(中国科学技术大学生命科学与医学学院病理科) Intelligent Pathology Institute, Division of Life Sciences and Medicine(生命科学与医学学院智能病理研究所) Department of Pathology, Fudan University Shanghai Cancer Center(复旦大学上海癌症中心病理科) Department of Oncology, Shanghai Medical College, Fudan University(复旦大学上海医学院肿瘤科) Institute of Pathology, Fudan University(复旦大学病理研究所) Department of Pathology, The First Affiliated Hospital with Nanjing Medical University(南京医科大学第一附属医院病理科)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 PathFound是一种通过主动信息获取和诊断完善来提升病理诊断准确性的代理多模态模型,其在多种临床场景中表现出卓越的诊断性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23324 2025-12-30 cs.AI cs.LO 79%

On Conformant Planning and Model-Checking of $\exists^*\forall^*$ Hyperproperties

关于$\exists^*\forall^*$超属性的符合计划与模型检查

Raven Beutner, Bernd Finkbeiner

机构 * CISPA Helmholtz Center for Information Security, Germany(CISPA海德堡信息安全研究中心)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文研究了$\exists^*\forall^*$超属性的模型检查与符合计划问题之间的紧密联系,证明两者可以相互转换并建立完整的编码方法。

Comments ECAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22367 2025-12-30 cs.AI 79%

Subgoaling Relaxation-based Heuristics for Numeric Planning with Infinite Actions

基于子目标的放松启发式方法用于带有无限动作的数值规划

Ángel Aso-Mollar, Diego Aineto, Enrico Scala, Eva Onaindia

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出一种方法,将带有无限动作的数值规划问题转换为简单任务,利用子目标启发式方法进行有效求解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22207 2025-12-30 cs.AI 79%

GamiBench: Evaluating Spatial Reasoning and 2D-to-3D Planning Capabilities of MLLMs with Origami Folding Tasks

GamiBench: 通过折纸任务评估多模态大语言模型的空间推理和2D到3D规划能力

Ryan Spencer, Roey Yaari, Ritvik Vemavarapu, Joyce Yang, Steven Ngo, Utkarsh Sharma

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 GamiBench通过折纸任务评估多模态大语言模型的空间推理和2D到3D规划能力,引入新指标并揭示模型在复杂折叠任务中的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏