arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 11104 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 11104 篇

2401.05946 2024-01-12 cs.LG cs.AI 81%

Learning Cognitive Maps from Transformer Representations for Efficient Planning in Partially Observed Environments

Antoine Dedieu, Wolfgang Lehrach, Guangyao Zhou, Dileep George, Miguel Lázaro-Gredilla

专题命中 规划推理 :planning(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.14878 2023-12-25 cs.AI cs.LG 81%

Pangu-Agent: A Fine-Tunable Generalist Agent with Structured Reasoning

Filippos Christianos, Georgios Papoudakis, Matthieu Zimmer, Thomas Coste, Zhihao Wu, Jingxuan Chen, Khyati Khandelwal, James Doran, Xidong Feng, Jiacheng Liu, Zheng Xiong, Yicheng Luo, Jianye Hao, Kun Shao, Haitham Bou-Ammar, Jun Wang

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI、cs.LG

Comments paper and appendix, 27 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.10238 2023-12-20 cs.AI cs.LG cs.MA 81%

Multiagent Inverse Reinforcement Learning via Theory of Mind Reasoning

Haochen Wu, Pedro Sequeira, David V. Pynadath

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI、cs.LG

Comments Accepted as a full paper at AAMAS2023

Journal ref AAMAS (2023) 708-716

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.10571 2023-12-19 cs.RO cs.AI cs.CV cs.LG 81%

Multi-level Reasoning for Robotic Assembly: From Sequence Inference to Contact Selection

Xinghao Zhu, Devesh K. Jha, Diego Romeres, Lingfeng Sun, Masayoshi Tomizuka, Anoop Cherian

专题命中 规划推理 :reasoning(title);planning(abstract);分类 cs.AI、cs.LG

Comments Supplementary video is available at https://www.youtube.com/watch?v=XNYkWSHkAaU&ab_channel=MitsubishiElectricResearchLabs%28MERL%29

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.10332 2023-12-19 cs.IR cs.AI cs.LG 81%

ProTIP: Progressive Tool Retrieval Improves Planning

Raviteja Anantha, Bortik Bandyopadhyay, Anirudh Kashi, Sayantan Mahinder, Andrew W Hill, Srinivas Chappidi

专题命中 规划推理 :planning(title,abstract);分类 cs.AI、cs.LG

Comments preprint version

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.01090 2023-12-19 cs.AI cs.CL 81%

Self Generated Wargame AI: Double Layer Agent Task Planning Based on Large Language Model

Y. Sun, J. Zhao, C. Yu, W. Wang, X. Zhou

专题命中 规划推理 :planning(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.08566 2023-12-15 cs.AI cs.CL cs.RO 81%

Learning adaptive planning representations with natural language guidance

Lionel Wong, Jiayuan Mao, Pratyusha Sharma, Zachary S. Siegel, Jiahai Feng, Noa Korneev, Joshua B. Tenenbaum, Jacob Andreas

专题命中 规划推理 :planning(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.08693 2023-12-05 cs.AI cs.LG 81%

AI planning in the imagination: High-level planning on learned abstract search spaces

Carlos Martin, Tuomas Sandholm

专题命中 规划推理 :planning(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.16563 2023-12-05 cs.LG cs.AI 81%

Skill Reinforcement Learning and Planning for Open-World Long-Horizon Tasks

Haoqi Yuan, Chi Zhang, Hongcheng Wang, Feiyang Xie, Penglin Cai, Hao Dong, Zongqing Lu

专题命中 规划推理 :planning(title,abstract);分类 cs.AI、cs.LG

Comments 24 pages, presented in Foundation Models for Decision Making Workshop at NeurIPS 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.06543 2023-11-07 cs.RO cs.AI cs.LG 81%

MANER: Multi-Agent Neural Rearrangement Planning of Objects in Cluttered Environments

Vivek Gupta, Praphpreet Dhir, Jeegn Dani, Ahmed H. Qureshi

专题命中 规划推理 :planning(title,abstract);分类 cs.AI、cs.LG

Comments The videos and supplementary material are available at https://sites.google.com/view/maner-supplementary

Journal ref Published in IEEE Robotics and Automation Letters, vol. 8, no. 12, pp. 8295-8302, Dec. 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.00063 2023-11-02 cs.RO cs.AI cs.LG cs.MA cs.SY eess.SY 81%

Safe multi-agent motion planning under uncertainty for drones using filtered reinforcement learning

Sleiman Safaoui, Abraham P. Vinod, Ankush Chakrabarty, Rien Quirynen, Nobuyuki Yoshikawa, Stefano Di Cairano

专题命中 规划推理 :planning(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.06833 2023-10-31 cs.LG cs.AI 81%

Transformer-based Planning for Symbolic Regression

Parshin Shojaee, Kazem Meidani, Amir Barati Farimani, Chandan K. Reddy

专题命中 规划推理 :planning(title,abstract);分类 cs.AI、cs.LG

Comments NeurIPS 2023. Project code at: https://github.com/deep-symbolic-mathematics/TPSR

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.01038 2023-09-06 cs.AI cs.LG 81%

Neurosymbolic Reinforcement Learning and Planning: A Survey

K. Acharya, W. Raza, C. M. J. M. Dourado, A. Velasquez, H. Song

专题命中 规划推理 :planning(title);reasoning(abstract);分类 cs.AI、cs.LG

Comments 16 pages, 9 figures, IEEE Transactions on Artificial Intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.16008 2023-08-31 cs.RO cs.AI cs.LG 81%

EnsembleFollower: A Hybrid Car-Following Framework Based On Reinforcement Learning and Hierarchical Planning

Xu Han, Xianda Chen, Meixin Zhu, Pinlong Cai, Jianshan Zhou, Xiaowen Chu

专题命中 规划推理 :planning(title,abstract);分类 cs.AI、cs.LG

Comments 12 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1905.12204 2023-08-15 cs.LG cs.AI cs.MA cs.RO stat.ML 81%

Learning NP-Hard Multi-Agent Assignment Planning using GNN: Inference on a Random Graph and Provable Auction-Fitted Q-learning

Hyunwook Kang, Taehwan Kwon, Jinkyoo Park, James R. Morrison

专题命中 规划推理 :planning(title,abstract);分类 cs.AI、cs.LG

Journal ref Neural Information Processing Systems (NeurIPS) 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.15925 2023-08-03 cs.RO cs.AI cs.LG cs.MA 81%

Asynchronous, Option-Based Multi-Agent Policy Gradient: A Conditional Reasoning Approach

Xubo Lyu, Amin Banitalebi-Dehkordi, Mo Chen, Yong Zhang

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI、cs.LG

Comments Accepted by IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS), 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.00108 2023-08-02 cs.CL cs.AI 81%

DPBERT: Efficient Inference for BERT based on Dynamic Planning

Weixin Wu, Hankz Hankui Zhuo

专题命中 规划推理 :planning(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.00076 2023-08-02 cs.AI cs.LG stat.ML 81%

Crowd Safety Manager: Towards Data-Driven Active Decision Support for Planning and Control of Crowd Events

Panchamy Krishnakumari, Sascha Hoogendoorn-Lanser, Jeroen Steenbakkers, Serge Hoogendoorn

专题命中 规划推理 :planning(title,abstract);分类 cs.AI、cs.LG

Comments Submitted to TRB Annual Meeting 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2112.09836 2023-07-10 cs.AI cs.LG 81%

Creativity of AI: Hierarchical Planning Model Learning for Facilitating Deep Reinforcement Learning

Hankz Hankui Zhuo, Shuting Deng, Mu Jin, Zhihao Ma, Kebing Jin, Chen Chen, Chao Yu

专题命中 规划推理 :planning(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.12579 2023-07-04 cs.LG cs.AI 81%

Sample Efficient Deep Reinforcement Learning via Local Planning

Dong Yin, Sridhar Thiagarajan, Nevena Lazic, Nived Rajaraman, Botao Hao, Csaba Szepesvari

专题命中 规划推理 :planning(title,abstract);分类 cs.AI、cs.LG

Comments 25 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.13630 2023-06-26 cs.RO cs.AI cs.LG 81%

Offline Skill Graph (OSG): A Framework for Learning and Planning using Offline Reinforcement Learning Skills

Ben-ya Halevy, Yehudit Aperstein, Dotan Di Castro

专题命中 规划推理 :planning(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.02670 2023-06-21 cs.LG cs.AI cs.CR cs.RO 81%

Robust Adversarial Attacks Detection based on Explainable Deep Reinforcement Learning For UAV Guidance and Planning

Thomas Hickling, Nabil Aouf, Phillippa Spencer

专题命中 规划推理 :planning(title,abstract);分类 cs.AI、cs.LG

Comments 13 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.10071 2023-06-21 cs.LG cs.AI cs.DC cs.GT cs.SY eess.SY stat.ML 81%

Joint Path planning and Power Allocation of a Cellular-Connected UAV using Apprenticeship Learning via Deep Inverse Reinforcement Learning

Alireza Shamsoshoara, Fatemeh Lotfi, Sajad Mousavi, Fatemeh Afghah, Ismail Guvenc

专题命中 规划推理 :planning(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.04912 2023-06-21 cs.RO cs.AI cs.LG 81%

Embodied Active Learning of Relational State Abstractions for Bilevel Planning

Amber Li, Tom Silver

专题命中 规划推理 :planning(title,abstract);分类 cs.AI、cs.LG

Comments Conference on Lifelong Learning Agents (CoLLAs) 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.09055 2023-06-16 cs.RO cs.AI cs.LG 81%

Predictive Maneuver Planning with Deep Reinforcement Learning (PMP-DRL) for comfortable and safe autonomous driving

Jayabrata Chowdhury, Vishruth Veerendranath, Suresh Sundaram, Narasimhan Sundararajan

专题命中 规划推理 :planning(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.08359 2023-06-16 cs.AI cs.LG 81%

Hierarchical Task Network Planning for Facilitating Cooperative Multi-Agent Reinforcement Learning

Xuechen Mu, Hankz Hankui Zhuo, Chen Chen, Kai Zhang, Chao Yu, Jianye Hao

专题命中 规划推理 :planning(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.10119 2023-06-13 cs.LG cs.AI 81%

Minimal Value-Equivalent Partial Models for Scalable and Robust Planning in Lifelong Reinforcement Learning

Safa Alver, Doina Precup

专题命中 规划推理 :planning(title,abstract);分类 cs.AI、cs.LG

Comments Published as a conference paper at CoLLAs 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.03197 2023-06-07 cs.AI cs.CL 81%

AutoScrum: Automating Project Planning Using Large Language Models

Martin Schroder

专题命中 规划推理 :planning(title);reasoning(abstract);分类 cs.CL、cs.AI

Comments 25 pages, 3 figures, demo: https://github.com/autoscrum/autoscrum

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.01295 2023-06-05 cs.AI cs.CV cs.LG cs.RO 81%

Egocentric Planning for Scalable Embodied Task Achievement

Xiaotian Liu, Hector Palacios, Christian Muise

专题命中 规划推理 :planning(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.05252 2023-05-29 cs.CL cs.AI 81%

Distilling Script Knowledge from Large Language Models for Constrained Language Planning

Siyu Yuan, Jiangjie Chen, Ziquan Fu, Xuyang Ge, Soham Shah, Charles Robert Jankowski, Yanghua Xiao, Deqing Yang

专题命中 规划推理 :planning(title,abstract);分类 cs.CL、cs.AI

Comments Accepted to ACL 2023

详情

展开后加载摘要…

URL PDF HTML 收藏