arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 11120 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 11120 篇

2202.11296 2022-04-25 cs.LG cs.AI 62%

Reinforcement Learning in Practice: Opportunities and Challenges

Yuxi Li

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.04943 2022-04-15 cs.LG cs.AI 62%

Interpretable pipelines with evolutionarily optimized modules for RL tasks with visual inputs

Leonardo Lucio Custode, Giovanni Iacca

专题命中 规划推理 :reasoning(abstract);分类 cs.AI、cs.LG

Comments 9 pages, 6 figures, submitted to GECCO 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.03516 2022-04-08 cs.RO cs.AI cs.LG cs.MA 62%

Distributed Reinforcement Learning for Robot Teams: A Review

Yutong Wang, Mehul Damani, Pamela Wang, Yuhong Cao, Guillaume Sartoretti

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments Preprint of the paper submitted to Springer's Current Robotics Reports

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.02650 2022-04-07 cs.LG cs.AI 62%

Spatio-Temporal Dynamic Graph Relation Learning for Urban Metro Flow Prediction

Peng Xie, Minbo Ma, Tianrui Li, Shenggong Ji, Shengdong Du, Zeng Yu, Junbo Zhang

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.07832 2022-03-16 cs.LG cs.AI cs.MA 62%

Learning to Infer Belief Embedded Communication

Guo Ye, Han Liu, Biswa Sengupta

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.12597 2022-02-28 cs.AI cs.LG 62%

Context-Hierarchy Inverse Reinforcement Learning

Wei Gao, David Hsu, Wee Sun Lee

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2104.00563 2022-02-14 cs.RO cs.AI cs.CV cs.LG cs.MA 62%

Latent Variable Sequential Set Transformers For Joint Multi-Agent Motion Prediction

Roger Girgis, Florian Golemo, Felipe Codevilla, Martin Weiss, Jim Aldon D'Souza, Samira Ebrahimi Kahou, Felix Heide, Christopher Pal

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments 26 pages, 17 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.00914 2022-02-09 cs.LG cs.AI cs.RO 62%

Lipschitz-constrained Unsupervised Skill Discovery

Seohong Park, Jongwook Choi, Jaekyeom Kim, Honglak Lee, Gunhee Kim

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments Accepted to ICLR 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2101.07312 2022-02-03 cs.LG cs.AI cs.NE 62%

Benchmarking Perturbation-based Saliency Maps for Explaining Atari Agents

Tobias Huber, Benedikt Limmer, Elisabeth André

专题命中 规划推理 :reasoning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2201.09653 2022-01-25 cs.LG cs.AI 62%

The Paradox of Choice: Using Attention in Hierarchical Reinforcement Learning

Andrei Nica, Khimya Khetarpal, Doina Precup

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments 20 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2201.04502 2022-01-20 cs.LG cs.AI 62%

Dyna-T: Dyna-Q and Upper Confidence Bounds Applied to Trees

Tarek Faycal, Claudio Zito

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2201.04651 2022-01-14 cs.LG cs.AI 62%

Multi-echelon Supply Chains with Uncertain Seasonal Demands and Lead Times Using Deep Reinforcement Learning

Julio César Alves, Geraldo Robson Mateus

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments 35 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.06394 2022-01-03 cs.LG cs.AI math.OC stat.ML 62%

Reward-Free Model-Based Reinforcement Learning with Linear Function Approximation

Weitong Zhang, Dongruo Zhou, Quanquan Gu

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments 29 pages, 1 figure, 1 table. In NeurIPS 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2112.13404 2021-12-28 cs.AI cs.LG 62%

Abstractions of General Reinforcement Learning

Sultan J. Majeed

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2112.11731 2021-12-23 cs.LG cs.AI 62%

Graph augmented Deep Reinforcement Learning in the GameRLand3D environment

Edward Beeching, Maxim Peter, Philippe Marcotte, Jilles Debangoye, Olivier Simonin, Joshua Romoff, Christian Wolf

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2102.04738 2021-12-10 cs.CV cs.AI cs.LG cs.RO 62%

End-to-End Deep Learning of Lane Detection and Path Prediction for Real-Time Autonomous Driving

Der-Hau Lee, Jinn-Liang Liu

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments 6 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2112.00940 2021-12-03 cs.LG cs.AI cs.MA 62%

Reward-Free Attacks in Multi-Agent Reinforcement Learning

Ted Fujimoto, Timothy Doster, Adam Attarian, Jill Brandenberger, Nathan Hodas

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments Presented at the NeurIPS 2021 Workshop on Learning in Presence of Strategic Behavior

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.02039 2021-11-30 cs.LG cs.AI 62%

Offline Reinforcement Learning as One Big Sequence Modeling Problem

Michael Janner, Qiyang Li, Sergey Levine

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments NeurIPS 2021 (spotlight). Project page and code at: https://trajectory-transformer.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
1912.02368 2021-11-19 cs.LG cs.AI stat.ML 62%

Inter-Level Cooperation in Hierarchical Reinforcement Learning

Abdul Rahman Kreidieh, Glen Berseth, Brandon Trabucco, Samyak Parajuli, Sergey Levine, Alexandre M. Bayen

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2111.06383 2021-11-12 cs.LG cs.AI cs.RO 62%

Distilling Motion Planner Augmented Policies into Visual Control Policies for Robot Manipulation

I-Chun Arthur Liu, Shagun Uppal, Gaurav S. Sukhatme, Joseph J. Lim, Peter Englert, Youngwoon Lee

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments Published at the Conference on Robot Learning (CoRL) 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2111.05479 2021-11-11 cs.LG cs.AI 62%

Spatially and Seamlessly Hierarchical Reinforcement Learning for State Space and Policy space in Autonomous Driving

Jaehyun Kim, Jaeseung Jeong

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments 14 pages, 8 figures, and 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.05154 2021-11-11 cs.HC cs.AI cs.CY cs.LG cs.RO 62%

Explanations in Autonomous Driving: A Survey

Daniel Omeiza, Helena Webb, Marina Jirotka, Lars Kunze

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments Accepted for publication in IEEE Transactions on Intelligent Transportation Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2111.02149 2021-11-04 cs.AI cs.LG 62%

Deployment Optimization for Shared e-Mobility Systems with Multi-agent Deep Neural Search

Man Luo, Bowen Du, Konstantin Klemmer, Hongming Zhu, Hongkai Wen

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2111.00869 2021-11-02 cs.CV cs.AI cs.LG 62%

DetectorNet: Transformer-enhanced Spatial Temporal Graph Neural Network for Traffic Prediction

He Li, Shiyu Zhang, Xuejiao Li, Liangcai Su, Hongjie Huang, Duo Jin, Linghao Chen, Jianbing Huang, Jaesoo Yoo

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments The 29th ACM SIGSPATIAL International Conference on Advances in Geographic Information Systems (ACM SIGSPATIAL 2021)

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.07945 2021-10-12 cs.LG cs.AI math.OC 62%

Learning One Representation to Optimize All Rewards

Ahmed Touati, Yann Ollivier

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.04441 2021-10-12 cs.AI cs.CL cs.RO 62%

Natural Language for Human-Robot Collaboration: Problems Beyond Language Grounding

Seth Pate, Wei Xu, Ziyi Yang, Maxwell Love, Siddarth Ganguri, Lawson L. S. Wong

专题命中 规划推理 :planning(abstract);分类 cs.CL、cs.AI

Comments 5 pages, 2 figures, Presented at AI-HRI symposium as part of AAAI-FSS 2021 (arXiv:2109.10836)

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.14727 2021-10-01 cs.LG cs.AI 62%

Dr Jekyll and Mr Hyde: the Strange Case of Off-Policy Policy Updates

Romain Laroche, Remi Tachet

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments accepted to NeurIPS as a poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2011.08484 2021-09-29 cs.RO cs.AI cs.LG 62%

Combining Reinforcement Learning with Model Predictive Control for On-Ramp Merging

Joseph Lubars, Harsh Gupta, Sandeep Chinchali, Liyun Li, Adnan Raja, R. Srikant, Xinzhou Wu

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.09975 2021-09-24 cs.LG cs.AI cs.RO 62%

Fast nonlinear risk assessment for autonomous vehicles using learned conditional probabilistic models of agent futures

Ashkan Jasour, Xin Huang, Allen Wang, Brian C. Williams

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments Accepted at Autonomous Robots. Author version, with 11 pages, 5 figures, 2 tables. Journal extension of "Fast Risk Assessment for Autonomous Vehicles Using Learned Models of Agent Futures" (Wang et al. RSS 2020, arXiv:2005.13458)

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.07578 2021-09-17 cs.LG cs.AI cs.RO cs.SY eess.SY 62%

Multi-Task Learning with Sequence-Conditioned Transporter Networks

Michael H. Lim, Andy Zeng, Brian Ichter, Maryam Bandari, Erwin Coumans, Claire Tomlin, Stefan Schaal, Aleksandra Faust

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏