arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 11120 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 11120 篇

2005.08006 2020-05-19 eess.SY cs.AI cs.LG cs.SY 62%

Lifelong Control of Off-grid Microgrid with Model Based Reinforcement Learning

Simone Totaro, Ioannis Boukas, Anders Jonsson, Bertrand Cornélusse

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2004.09044 2020-04-21 cs.AI cs.CV cs.LG 62%

Dark, Beyond Deep: A Paradigm Shift to Cognitive AI with Humanlike Common Sense

Yixin Zhu, Tao Gao, Lifeng Fan, Siyuan Huang, Mark Edmonds, Hangxin Liu, Feng Gao, Chi Zhang, Siyuan Qi, Ying Nian Wu, Joshua B. Tenenbaum, Song-Chun Zhu

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments For high quality figures, please refer to http://wellyzhang.github.io/attach/dark.pdf

Journal ref Engineering, Feb, 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2003.13741 2020-04-01 cs.LG cs.AI stat.ML 62%

Parallelization of Monte Carlo Tree Search in Continuous Domains

Karl Kurzer, Christoph Hörtnagl, J. Marius Zöllner

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2003.02655 2020-03-16 cs.RO cs.AI cs.LG cs.SY eess.SY stat.ML 62%

PPMC RL Training Algorithm: Rough Terrain Intelligent Robots through Reinforcement Learning

Tamir Blum, Kazuya Yoshida

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments 6 pages, 7 figures, 4 wheeled rover in a rough environment resembling lunar surface

详情

展开后加载摘要…

URL PDF HTML 收藏
2003.04427 2020-03-11 cs.LG cs.AI stat.ML 62%

Transfer Reinforcement Learning under Unobserved Contextual Information

Yan Zhang, Michael M. Zavlanos

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2003.02599 2020-03-09 cs.AI cs.CL 62%

An Incremental Explanation of Inference in Hybrid Bayesian Networks for Increasing Model Trustworthiness and Supporting Clinical Decision Making

Evangelia Kyrimi, Somayyeh Mossadegh, Nigel Tai, William Marsh

专题命中 规划推理 :reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
1907.07029 2020-03-05 cs.RO cs.AI cs.LG cs.NE 62%

Adaptive Prior Selection for Repertoire-based Online Adaptation in Robotics

Rituraj Kaushik, Pierre Desreumaux, Jean-Baptiste Mouret

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments Frontiers in Robotics and AI. Vol. 6, p. 151, 2020. Video : http://tiny.cc/aprol_video

Journal ref Frontiers in Robotics and AI. 6 (2020) 151

详情

展开后加载摘要…

URL PDF HTML 收藏
1911.01058 2020-02-11 cs.LG cs.AI stat.ML 62%

Explaining the Predictions of Any Image Classifier via Decision Trees

Sheng Shi, Xinfeng Zhang, Wei Fan

专题命中 规划推理 :reasoning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2002.03072 2020-02-11 cs.LG cs.AI stat.ML 62%

Generalized Hidden Parameter MDPs Transferable Model-based RL in a Handful of Trials

Christian F. Perez, Felipe Petroski Such, Theofanis Karaletsos

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments paper presented at AAAI 2020 as oral presentation, 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2002.02836 2020-02-10 cs.LG cs.AI stat.ML 62%

Causally Correct Partial Models for Reinforcement Learning

Danilo J. Rezende, Ivo Danihelka, George Papamakarios, Nan Rosemary Ke, Ray Jiang, Theophane Weber, Karol Gregor, Hamza Merzic, Fabio Viola, Jane Wang, Jovana Mitrovic, Frederic Besse, Ioannis Antonoglou, Lars Buesing

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2002.02286 2020-02-10 cs.LG cs.AI 62%

EgoMap: Projective mapping and structured egocentric memory for Deep RL

Edward Beeching, Christian Wolf, Jilles Dibangoye, Olivier Simonin

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2001.10208 2020-01-29 cs.RO cs.AI cs.LG cs.MA 62%

Towards Learning Multi-agent Negotiations via Self-Play

Yichuan Charlie Tang

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments Autonomous Driving Workshop, IEEE International Conference on Computer Vision (ICCV 2019)

详情

展开后加载摘要…

URL PDF HTML 收藏
1910.05789 2020-01-10 cs.LG cs.AI cs.HC stat.ML 62%

On the Utility of Learning about Humans for Human-AI Coordination

Micah Carroll, Rohin Shah, Mark K. Ho, Thomas L. Griffiths, Sanjit A. Seshia, Pieter Abbeel, Anca Dragan

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments Published at NeurIPS 2019 (http://papers.nips.cc/paper/8760-on-the-utility-of-learning-about-humans-for-human-ai-coordination)

详情

展开后加载摘要…

URL PDF HTML 收藏
1905.10681 2020-01-01 cs.LG cs.AI cs.RO stat.ML 62%

Composing Task-Agnostic Policies with Deep Reinforcement Learning

Ahmed H. Qureshi, Jacob J. Johnson, Yuzhe Qin, Taylor Henderson, Byron Boots, Michael C. Yip

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments ICLR 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
1902.00506 2019-12-10 cs.LG cs.AI stat.ML 62%

The Hanabi Challenge: A New Frontier for AI Research

Nolan Bard, Jakob N. Foerster, Sarath Chandar, Neil Burch, Marc Lanctot, H. Francis Song, Emilio Parisotto, Vincent Dumoulin, Subhodeep Moitra, Edward Hughes, Iain Dunning, Shibl Mourad, Hugo Larochelle, Marc G. Bellemare, Michael Bowling

专题命中 规划推理 :reasoning(abstract);分类 cs.AI、cs.LG

Comments 32 pages, 5 figures, In Press (Artificial Intelligence)

详情

展开后加载摘要…

URL PDF HTML 收藏
1811.00210 2019-11-21 cs.AI cs.LG stat.ML 62%

Online Planner Selection with Graph Neural Networks and Adaptive Scheduling

Tengfei Ma, Patrick Ferber, Siyu Huo, Jie Chen, Michael Katz

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments AAAI 2020. Code is released at https://github.com/matenure/GNN_planner. Data set is released at https://github.com/IBM/IPC-graph-data

详情

展开后加载摘要…

URL PDF HTML 收藏
1911.03594 2019-11-21 cs.LG cs.AI cs.RO stat.ML 62%

Robo-PlaNet: Learning to Poke in a Day

Maxime Chevalier-Boisvert, Guillaume Alain, Florian Golemo, Derek Nowrouzezahrai

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments 4 pages, 3 figures. Version 2: added reference and acknowledgement

详情

展开后加载摘要…

URL PDF HTML 收藏
1911.04175 2019-11-12 cs.LG cs.AI cs.MA cs.RO stat.ML 62%

Multi-Agent Connected Autonomous Driving using Deep Reinforcement Learning

Praveen Palanisamy

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments Accepted, Machine Learning for Autonomous Driving Workshop at the 33rd Conference on Neural Information Processing Systems(NeurIPS 2019)

详情

展开后加载摘要…

URL PDF HTML 收藏
1911.01562 2019-11-06 cs.LG cs.AI cs.RO 62%

DeepRacer: Educational Autonomous Racing Platform for Experimentation with Sim2Real Reinforcement Learning

Bharathan Balaji, Sunil Mallya, Sahika Genc, Saurabh Gupta, Leo Dirac, Vineet Khare, Gourav Roy, Tao Sun, Yunzhe Tao, Brian Townsend, Eddie Calleja, Sunil Muralidhara, Dhanasekar Karuppasamy

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1909.05106 2019-10-29 cs.LG cs.AI cs.SY eess.SY stat.ML 62%

Correlation Priors for Reinforcement Learning

Bastian Alt, Adrian Šošić, Heinz Koeppl

专题命中 规划推理 :reasoning(abstract);分类 cs.AI、cs.LG

Comments 15 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1904.02579 2019-10-16 cs.RO cs.AI cs.HC cs.LG 62%

Can a Robot Become a Movie Director? Learning Artistic Principles for Aerial Cinematography

Mirko Gschwindt, Efe Camci, Rogerio Bonatti, Wenshan Wang, Erdal Kayacan, Sebastian Scherer

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1910.05664 2019-10-15 cs.LG cs.AI cs.CY stat.ML 62%

Extracting Incentives from Black-Box Decisions

Yonadav Shavit, William S. Moses

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments Accepted to the NeurIPS 2019 Workshop on Robust AI in Financial Services: Data, Fairness, Explainability, Trustworthiness, and Privacy

详情

展开后加载摘要…

URL PDF HTML 收藏
1909.09705 2019-09-24 cs.LG cs.AI cs.RO cs.SY eess.SY stat.ML 62%

A Layered Architecture for Active Perception: Image Classification using Deep Reinforcement Learning

Hossein K. Mousavi, Guangyi Liu, Weihang Yuan, Martin Takáč, Héctor Muñoz-Avila, Nader Motee

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments Submitted to ICRA-2020

详情

展开后加载摘要…

URL PDF HTML 收藏
1909.09209 2019-09-23 cs.AI cs.HC cs.LG cs.LO 62%

A Human-Centered Data-Driven Planner-Actor-Critic Architecture via Logic Programming

Daoming Lyu, Fangkai Yang, Bo Liu, Steven Gustafson

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments In Proceedings ICLP 2019, arXiv:1909.07646. arXiv admin note: significant text overlap with arXiv:1906.07268

Journal ref EPTCS 306, 2019, pp. 182-195

详情

展开后加载摘要…

URL PDF HTML 收藏
1908.04436 2019-08-14 cs.LG cs.AI stat.ML 62%

Superstition in the Network: Deep Reinforcement Learning Plays Deceptive Games

Philip Bontrager, Ahmed Khalifa, Damien Anderson, Matthew Stephenson, Christoph Salge, Julian Togelius

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments 7 pages, 4 figures, Accepted at the 15th AAAI Conference on Artificial Intelligence and Interactive Digital Entertainment (AIIDE 19)

详情

展开后加载摘要…

URL PDF HTML 收藏
1906.11021 2019-06-27 cs.RO cs.AI cs.LG 62%

Cooperation-Aware Reinforcement Learning for Merging in Dense Traffic

Maxime Bouton, Alireza Nakhaei, Kikuo Fujimura, Mykel J. Kochenderfer

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments 7 pages, 5 figures

Journal ref IEEE Conference on Intelligent Transportation Systems (ITSC), 2019

详情

展开后加载摘要…

URL PDF HTML 收藏
1906.05684 2019-06-14 cs.CY cs.AI cs.LG stat.AP 62%

Understanding artificial intelligence ethics and safety

David Leslie

专题命中 规划推理 :reasoning(abstract);分类 cs.AI、cs.LG

Journal ref The Alan Turing Institute (June, 2019)

详情

展开后加载摘要…

URL PDF HTML 收藏
1906.05329 2019-06-14 cs.LG cs.AI stat.ML 62%

Sub-Goal Trees -- a Framework for Goal-Directed Trajectory Prediction and Optimization

Tom Jurgenson, Edward Groshev, Aviv Tamar

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments 15 pages (8 main), 2 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
1807.07665 2019-05-28 cs.LG cs.AI stat.ML 62%

Hierarchical Reinforcement Learning for Zero-shot Generalization with Subtask Dependencies

Sungryull Sohn, Junhyuk Oh, Honglak Lee

专题命中 规划推理 :reasoning(abstract);分类 cs.AI、cs.LG

Comments In NeurIPS 2018

详情

展开后加载摘要…

URL PDF HTML 收藏
1904.05759 2019-04-12 cs.LG cs.AI cs.MA 62%

Safer Deep RL with Shallow MCTS: A Case Study in Pommerman

Bilal Kartal, Pablo Hernandez-Leal, Chao Gao, Matthew E. Taylor

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments Adaptive Learning Agents (ALA) Workshop at AAMAS 2019. arXiv admin note: substantial text overlap with arXiv:1812.00045

详情

展开后加载摘要…

URL PDF HTML 收藏