arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 11088 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 11088 篇

2510.26139 2026-03-06 cs.RO 82%

Kinodynamic Task and Motion Planning using VLM-guided and Interleaved Sampling

基于VLM引导和交错采样的运动动力学任务与动作规划

Minseo Kwon, Young J. Kim

机构 * Department of Computer Science and Engineering(计算机科学与工程系)

专题命中 规划推理 :planning(title,abstract);reasoning(abstract)

AI总结 本文提出一种基于VLM引导和交错采样的运动动力学任务与动作规划方法,通过混合状态树联合决策任务和运动,提升规划效率和成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05017 2026-03-06 cs.RO 82%

Direct Contact-Tolerant Motion Planning With Vision Language Models

直接接触容忍的运动规划与视觉语言模型

He Li, Jian Sun, Chengyang Li, Guoliang Li, Qiyu Ruan, Shuai Wang, Chengzhong Xu

机构 * State Key Laboratory of Internet of Things for Smart City (SKL-IOTSC), University of Macau(物联网智能城市国家重点实验室,澳门大学) Shenzhen Institutes of Advanced Technology (SIAT), Chinese Academy of Sciences(深圳先进技术研究院,中国科学院) Department of Electrical and Computer Engineering, The University of Hong Kong(香港大学电子与计算机工程系)

专题命中 规划推理 :planning(title,abstract);reasoning(abstract)

AI总结 本文提出直接接触容忍运动规划方法,利用视觉语言模型实现接触感知导航,提升机器人在拥挤环境中的鲁棒性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19524 2026-03-05 cs.CV cs.MA 82%

VideoChat-M1: Collaborative Policy Planning for Video Understanding via Multi-Agent Reinforcement Learning

VideoChat-M1: 通过多智能体强化学习实现视频理解的协作策略规划

Boyu Chen, Zikang Wang, Zhengrong Yue, Kainan Yan, Chenyun Yu, Yi Huang, Zijun Liu, Yafei Wen, Xiaoxin Chen, Yang Liu, Peng Li, Yali Wang

机构 * Shenzhen Key Lab of Computer Vision and Pattern Recognition(深圳计算机视觉与模式识别重点实验室) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) VIVO AI Lab(VIVO人工智能实验室) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Shenzhen Campus of Sun Yat-sen University(孙逸仙大学深圳校区) Shanghai Jiao Tong University(上海交通大学) Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院) Dept. of Comp. Sci. & Tech., Institute for AI, Tsinghua University(清华大学计算机科学与技术系,人工智能研究院)

专题命中 规划推理 :planning(title,abstract);reasoning(abstract)

AI总结 VideoChat-M1通过多智能体强化学习实现视频理解的协作策略规划,显著提升复杂视频任务的性能。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22613 2026-03-04 cs.AI cs.CL cs.LG stat.ML 82%

Benefits and Pitfalls of Reinforcement Learning for Language Model Planning: A Theoretical Perspective

强化学习在语言模型规划中的利弊:一种理论视角

Siwei Wang, Yifei Shen, Haoran Sun, Shi Feng, Shang-Hua Teng, Li Dong, Yaru Hao, Wei Chen

机构 * Microsoft Research Asia(微软亚洲研究院) Peking University(北京大学) Harvard University(哈佛大学) University of Southern California(南加州大学)

专题命中 规划推理 :planning(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文从理论角度分析强化学习在语言模型规划中的利弊,揭示探索的重要性及Q学习在多样性保持方面的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02669 2026-03-04 cs.RO 82%

IMR-LLM: Industrial Multi-Robot Task Planning and Program Generation using Large Language Models

IMR-LLM:基于大语言模型的工业多机器人任务规划与程序生成

Xiangyu Su, Juzhan Xu, Oliver van Kaick, Kai Xu, Ruizhen Hu

机构 * Shenzhen University(深圳大学) SpeedBot Robotics Co., Ltd.(SpeedBot机器人科技有限公司) Carleton University(卡尔顿大学) Institute of AI for Industries, Chinese Academy of Sciences(中国科学院工业人工智能研究所)

专题命中 规划推理 :planning(title,abstract);reasoning(abstract)

AI总结 IMR-LLM通过大语言模型实现工业多机器人任务规划与程序生成,结合析取图和过程树,提出高效任务计划和可执行程序生成方法,并构建了多复杂度层次的IMR-Bench基准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11428 2026-03-03 cs.CV 82%

ImagiDrive: A Unified Imagination-and-Planning Framework for Autonomous Driving

ImagiDrive: 一种用于自动驾驶的统一想象与规划框架

Jingyu Li, Bozhou Zhang, Xin Jin, Jiankang Deng, Xiatian Zhu, Li Zhang

机构 * School of Data Science, Fudan University(复旦大学数据科学学院) Shanghai Innovation Institute(上海创新研究院) Eastern Institute of Technology(技术东院) Imperial College London(伦敦帝国理工学院) University of Surrey(萨里大学)

专题命中 规划推理 :planning(title,abstract);reasoning(abstract)

AI总结 ImagiDrive通过整合视觉-语言模型和驾驶世界模型,实现自动驾驶中的统一想象与规划循环,提升场景生成和决策预测的准确性与效率。

Comments Accepted for publication in 2026 IEEE International Conference on Robotics and Automation (ICRA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18382 2026-02-13 cs.RO 82%

One Demo Is All It Takes: Planning Domain Derivation with LLMs from A Single Demonstration

一个演示就足够:从单个演示中利用LLM进行规划域推导

Jinbang Huang, Yixin Xiao, Zhanguang Zhang, Mark Coates, Jianye Hao, Yingxue Zhang

机构 * Huawei Noah’s Ark Lab(华为诺亚实验室) McGill University(麦吉尔大学)

专题命中 规划推理 :planning(title,abstract);reasoning(abstract)

AI总结 PDDLLM通过结合LLM推理与物理模拟,从单个演示中自动推导规划域,提升长时间跨度任务规划的自动化与可靠性。

Comments Published as a conference paper at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09367 2026-02-11 cs.RO 82%

CAPER: Constrained and Procedural Reasoning for Robotic Scientific Experiments

CAPER:用于机器人科学实验的约束和程序性推理

Jinghan Yang, Jingyi Hou, Xinbo Yu, Wei He, Yifan Wu

机构 * University of Science and Technology Beijing(北京科技大学) Beijing Information Science and Technology University(北京信息科技大学)

专题命中 规划推理 :reasoning(title,abstract);planning(abstract)

AI总结 CAPER通过约束和程序性推理框架提升机器人在科学实验中的可控性、鲁棒性和数据效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08537 2026-02-10 cs.RO 82%

UniPlan: Vision-Language Task Planning for Mobile Manipulation with Unified PDDL Formulation

UniPlan: 为移动操作统一PDDL形式的视觉-语言任务规划

Haoming Ye, Yunxiao Xiao, Cewu Lu, Panpan Cai

专题命中 规划推理 :planning(title,abstract);reasoning(abstract)

AI总结 UniPlan通过统一PDDL形式实现视觉-语言任务规划,提升大规模室内移动操作的规划效率和效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16909 2026-02-10 cs.CV cs.RO 82%

MomaGraph: State-Aware Unified Scene Graphs with Vision-Language Model for Embodied Task Planning

MomaGraph: 体感任务规划中的状态感知统一场景图

Yuanchen Ju, Yongyuan Liang, Yen-Jen Wang, Nandiraju Gireesh, Yuanliang Ju, Seungjae Lee, Qiao Gu, Elvis Hsieh, Furong Huang, Koushil Sreenath

机构 * University of California, Berkeley(加州大学伯克利分校) University of Maryland, College Park(马里兰大学学院公园分校) University of Toronto(多伦多大学)

专题命中 规划推理 :planning(title,abstract);reasoning(abstract)

AI总结 MomaGraph通过统一场景图与强化学习模型,实现家庭环境中体感任务规划的高效任务规划与场景理解。

Comments 25 pages, 10 figures. Project page:https://hybridrobotics.github.io/MomaGraph/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07839 2026-02-10 cs.CL cs.AI cs.LG 82%

TodoEvolve: Learning to Architect Agent Planning Systems

TodoEvolve: 学习架构智能体规划系统

Jiaxi Liu, Yanzuo Jiang, Guibin Zhang, Zihan Zhang, Heng Chang, Zhenfei Yin, Qibing Ren, Junchi Yan

专题命中 规划推理 :planning(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 TodoEvolve通过元规划范式自主合成和修订任务特定的规划架构,在多个智能体基准测试中优于人工设计的规划模块,同时保持低开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04515 2026-02-05 cs.RO cs.CV 82%

EgoActor: Grounding Task Planning into Spatial-aware Egocentric Actions for Humanoid Robots via Visual-Language Models

EgoActor: 通过视觉语言模型将任务规划接地于空间感知的自我中心动作以实现人形机器人

Yu Bai, MingMing Yu, Chaojie Li, Ziyi Bai, Xinlong Wang, Börje F. Karlsson

机构 * Beijing Academy of Artificial Intelligence(北京人工智能研究院)

专题命中 规划推理 :planning(title,abstract);reasoning(abstract)

AI总结 EgoActor通过视觉语言模型将高层任务指令转化为精确的空间感知动作,实现人形机器人在真实和模拟环境中的稳健任务规划与运动执行。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03376 2026-02-04 cs.RO cs.CV 82%

PlanTRansformer: Unified Prediction and Planning with Goal-conditioned Transformer

PlanTRansformer: 一种结合目标条件变换器的统一预测与规划

Constantin Selzer, Fabina B. Flohr

机构 * Department of Electrical Engineering and Information Technology, Intelligent Vehicles Lab (IVL), Munich University of Applied Science(电气工程与信息科技系,智能车辆实验室(IVL),慕尼黑应用科学大学)

专题命中 规划推理 :planning(title,abstract);reasoning(abstract)

AI总结 PlanTRansformer通过整合目标条件预测、动态可行性等技术,提升自动驾驶中的预测与规划性能。

Comments Submitted and accepted at IEEE IV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00566 2026-02-03 cs.RO 82%

UniMotion: A Unified Motion Framework for Simulation, Prediction and Planning

UniMotion: 一种用于仿真、预测和规划的统一运动框架

Nan Song, Junzhe Jiang, Jingyu Li, Xiatian Zhu, Li Zhang

机构 * School of Data Science, Fudan University(复旦大学数据科学学院) Shanghai Innovation Institute(上海创新研究院) University of Surrey(Surrey大学)

专题命中 规划推理 :planning(title,abstract);reasoning(abstract)

AI总结 UniMotion提出了一种统一的运动框架,通过共享结构和定制化训练策略,同时支持运动仿真、预测和规划,实现高效的任务整合和泛化能力。

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24330 2026-01-27 cs.CV 82%

SenseNova-MARS: Empowering Multimodal Agentic Reasoning and Search via Reinforcement Learning

SenseNova-MARS: 通过强化学习赋能多模态代理推理与搜索

Yong Xien Chng, Tao Hu, Wenwen Tong, Xueheng Li, Jiandong Chen, Haojia Yu, Jiefan Lu, Hewei Guo, Hanming Deng, Chengjun Xie, Gao Huang, Dahua Lin, Lewei Lu

机构 * SenseTime Research(商汤科技研究院) Tsinghua University(清华大学) University of Science and Technology of China(中国科学技术大学)

专题命中 规划推理 :reasoning(title,abstract);chain-of-thought(abstract)

AI总结 SenseNova-MARS通过强化学习赋能多模态代理推理与搜索,提升视觉-语言模型在复杂视觉任务中的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.05516 2026-01-22 cs.LG cs.AI cs.CL 82%

BayesAgent: Bayesian Agentic Reasoning Under Uncertainty via Verbalized Probabilistic Graphical Modeling

BayesAgent: 通过 verbalized 概率图模型实现不确定性下的贝叶斯代理推理

Hengguan Huang, Xing Shen, Songtao Wang, Lingfa Meng, Dianbo Liu, David Alejandro Duchene, Hao Wang, Samir Bhatt

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 BayesAgent 通过 verbalized 概率图模型实现不确定性下的贝叶斯代理推理,提升置信度校准和文本生成质量。

Comments Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20665 2026-01-14 cs.CV 82%

DriveRX: A Vision-Language Reasoning Model for Cross-Task Autonomous Driving

DriveRX:一种用于跨任务自动驾驶的视觉-语言推理模型

Muxi Diao, Lele Yang, Hongbo Yin, Zhexu Wang, Yejie Wang, Daxin Tian, Kongming Liang, Zhanyu Ma

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Zhongguancun Academy(中关村学院) Beihang University(北航)

专题命中 规划推理 :reasoning(title,abstract);planning(abstract)

AI总结 DriveRX是一种用于自动驾驶的视觉-语言推理模型,通过结构化推理提升多阶段决策能力,并在复杂驾驶条件下表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24940 2026-01-01 cs.AI cs.CL cs.LG 82%

Iterative Deployment Improves Planning Skills in LLMs

迭代部署提升大语言模型的规划能力

Augusto B. Corrêa, Yoav Gelberg, Luckeciano C. Melo, Ilia Shumailov, André G. Pereira, Yarin Gal

机构 * University of Oxford(牛津大学) AI Sequrity Company(AI安全公司) UFRGS(乌拉圭联邦大学)

专题命中 规划推理 :planning(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 通过迭代部署大语言模型,利用用户编纂的数据提升规划能力,展现隐含奖励函数的强化学习机制,具有AI安全和训练制度替代的双重意义。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24100 2026-01-01 cs.CV 82%

Think Before You Move: Latent Motion Reasoning for Text-to-Motion Generation

在行动前思考:用于文本到动作生成的潜在动作推理

Yijie Qian, Juncheng Wang, Yuxiang Feng, Chao Xu, Wang Lu, Yang Liu, Baigui Sun, Yiqiang Chen, Yong Liu, Shujun Wang

机构 * Zhejiang University(浙江大学) Hong Kong Polytechnic University(香港理工大学) IROOTECH TECHNOLOGY(IROOTECH技术) Wolf 1069 b Lab, Sany Group(Wolf 1069 b实验室,三一集团) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)

专题命中 规划推理 :reasoning(title,abstract);planning(abstract)

AI总结 本文提出Latent Motion Reasoning框架,通过分阶段推理与执行提升文本到动作生成的语义与物理合理性。

Comments project page: https://chenhaoqcdyq.github.io/LMR/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11143 2025-12-15 cs.CR 82%

Automated Penetration Testing with LLM Agents and Classical Planning

基于LLM代理和经典规划的自动化渗透测试

Lingzhi Wang, Xinyi Shi, Ziyu Li, Yi Jiang, Shiyu Tan, Yuhao Jiang, Junjie Cheng, Wenyuan Chen, Xiangmin Shen, Zhenyuan LI, Yan Chen

专题命中 规划推理 :planning(title,abstract);reasoning(abstract)

AI总结 本文提出CHECKMATE框架,结合增强的经典规划与LLM代理,提升渗透测试能力、稳定性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04459 2025-12-05 cs.CV 82%

dVLM-AD: Enhance Diffusion Vision-Language-Model for Driving via Controllable Reasoning

dVLM-AD:通过可控推理增强扩散视觉语言模型以实现驾驶

Yingzi Ma, Yulong Cao, Wenhao Ding, Shuibai Zhang, Yan Wang, Boris Ivanovic, Ming Jiang, Marco Pavone, Chaowei Xiao

机构 * University of Wisconsin-Madison(威斯康星大学麦迪逊分校) NVIDIA(英伟达) Stanford University(斯坦福大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 规划推理 :reasoning(title,abstract);planning(abstract)

AI总结 dVLM-AD通过可控推理提升扩散视觉语言模型,实现更一致的驾驶推理与规划性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.13983 2025-12-05 cs.MA cs.RO cs.SY eess.SY 82%

Learning Two-agent Motion Planning Strategies from Generalized Nash Equilibrium for Model Predictive Control

从广义纳什均衡学习双智能体运动规划策略用于模型预测控制

Hansung Kim, Edward L. Zhu, Chang Seok Lim, Francesco Borrelli

机构 * University of California Berkeley(加州大学伯克利分校) PlusAI Inc(PlusAI公司)

专题命中 规划推理 :planning(title,abstract);reasoning(abstract)

AI总结 本文提出了一种基于广义纳什均衡的学习方法,用于多智能体运动规划中的模型预测控制,通过训练神经网络预测奖励结果来实现博弈论互动的隐式处理。

Comments Accepted Proceeding at 2025 Learning for Dynamics and Control Conference (L4DC)

Journal ref 283:112-123, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19912 2025-11-26 cs.CV cs.RO 82%

Reasoning-VLA: A Fast and General Vision-Language-Action Reasoning Model for Autonomous Driving

Reasoning-VLA: 一种用于自动驾驶的快速且通用的视觉-语言-动作推理模型

Dapeng Zhang, Zhenlong Yuan, Zhangquan Chen, Chih-Ting Liao, Yinda Chen, Fei Shen, Qingguo Zhou, Tat-Seng Chua

机构 * Lanzhou University(兰州大学) National University of Singapore(新加坡国立大学) University of Science and Technology of China(中国科学技术大学) Tsinghua University(清华大学) University of New South Wales(新南威尔士大学)

专题命中 规划推理 :reasoning(title,abstract);chain-of-thought(abstract)

AI总结 Reasoning-VLA通过引入可学习的动作查询和链式思维推理的数据格式,实现了在自动驾驶中快速且通用的视觉-语言-动作推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18230 2025-11-25 cs.CR 82%

Think Fast: Real-Time IoT Intrusion Reasoning Using IDS and LLMs at the Edge Gateway

Think Fast: 在边缘网关使用IDS和LLMs实现实时物联网入侵推理

Saeid Jamshidi, Amin Nikanjam, Negar Shahabi, Kawser Wazed Nafi, Foutse Khomh, Samira Keivanpour, Rolando Herrero

专题命中 规划推理 :reasoning(title,abstract);chain-of-thought(abstract)

AI总结 本文提出一种在边缘网关使用IDS和LLMs实现实时物联网入侵检测的框架,通过整合轻量级ML模型和预训练大语言模型,提升检测准确性、语义可解释性和操作效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.08546 2025-11-21 cs.RO 82%

Grounding LLMs For Robot Task Planning Using Closed-loop State Feedback

通过闭环状态反馈接地LLMs用于机器人任务规划

Vineet Bhat, Ali Umut Kaypak, Prashanth Krishnamurthy, Ramesh Karri, Farshad Khorrami

专题命中 规划推理 :planning(title,abstract);reasoning(abstract)

AI总结 本文提出BrainBody-LLM方法,通过闭环反馈机制提升LLMs在机器人任务规划中的鲁棒性,实现在复杂任务中的显著性能提升。

Comments Preprint version. Accepted full paper available here: https://advanced.onlinelibrary.wiley.com/doi/10.1002/adrr.202500072

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01236 2025-11-04 cs.RO 82%

Don't Just Search, Understand: Semantic Path Planning Agent for Spherical Tensegrity Robots in Unknown Environments

Junwen Zhang, Changyue Liu, Pengqi Fu, Xiang Guo, Ye Shi, Xudong Liang, Zhijian Wang, Hanzhi Ma

专题命中 规划推理 :planning(title,abstract);reasoning(abstract)

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18337 2025-10-24 cs.RO 82%

MoTVLA: A Vision-Language-Action Model with Unified Fast-Slow Reasoning

Wenhui Huang, Changhe Chen, Han Qi, Chen Lv, Yilun Du, Heng Yang

机构 * Harvard University(哈佛大学) University of Michigan(密歇根大学) Nanyang Technological University(南洋理工大学)

专题命中 规划推理 :reasoning(title,abstract);planning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.06689 2025-10-21 cs.SE 82%

Self-planning Code Generation with Large Language Models

Xue Jiang, Yihong Dong, Lecheng Wang, Zheng Fang, Qiwei Shang, Ge Li, Zhi Jin, Wenpin Jiao

专题命中 规划推理 :planning(title,abstract);chain-of-thought(abstract)

Comments Accepted by TOSEM

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14321 2025-10-20 cs.IR 82%

Large Reasoning Embedding Models: Towards Next-Generation Dense Retrieval Paradigm

Jianting Tang, Dongshuai Li, Tao Wen, Fuyu Lv, Dan Ou, Linli Xu

专题命中 规划推理 :reasoning(title,abstract);CoT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07882 2025-10-16 cs.RO 82%

Towards Proprioception-Aware Embodied Planning for Dual-Arm Humanoid Robots

Boyu Li, Siyuan He, Hang Xu, Haoqi Yuan, Xinrun Xu, Yu Zang, Liwei Hu, Junpeng Yue, Zhenxiong Jiang, Pengbo Hu, Börje F. Karlsson, Yehui Tang, Zongqing Lu

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) Beijing Academy of Artificial Intelligence(北京人工智能研究院) AgiBot School of Computer Science, Peking University(北京大学计算机学院)

专题命中 规划推理 :planning(title,abstract);reasoning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏