arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 11120 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 11120 篇

2101.00494 2021-01-05 cs.LG cs.AI stat.ML 62%

A Provably Efficient Algorithm for Linear Markov Decision Process with Low Switching Cost

Minbo Gao, Tianle Xie, Simon S. Du, Lin F. Yang

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.11655 2020-12-29 cs.LG cs.AI 62%

Deep Reinforcement Learning with Stacked Hierarchical Attention for Text-based Games

Yunqiu Xu, Meng Fang, Ling Chen, Yali Du, Joey Tianyi Zhou, Chengqi Zhang

专题命中 规划推理 :reasoning(abstract);分类 cs.AI、cs.LG

Comments Accepted by NeurIPS2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2002.12361 2020-12-22 cs.AI cs.LG cs.RO 62%

Sub-Goal Trees -- a Framework for Goal-Based Reinforcement Learning

Tom Jurgenson, Or Avner, Edward Groshev, Aviv Tamar

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments ICML2020, 8 pages, 10 figures. arXiv admin note: text overlap with arXiv:1906.05329

详情

展开后加载摘要…

URL PDF HTML 收藏
2001.08299 2020-12-10 cs.AI cs.LG 62%

GLIB: Efficient Exploration for Relational Model-Based Reinforcement Learning via Goal-Literal Babbling

Rohan Chitnis, Tom Silver, Joshua Tenenbaum, Leslie Pack Kaelbling, Tomas Lozano-Perez

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments AAAI 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2012.01932 2020-12-04 cs.LG cs.AI 62%

Teaching the Machine to Explain Itself using Domain Knowledge

Vladimir Balayan, Pedro Saleiro, Catarina Belém, Ludwig Krippahl, Pedro Bizarro

专题命中 规划推理 :reasoning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2011.10824 2020-11-24 cs.LG cs.AI cs.CR 62%

Policy Teaching in Reinforcement Learning via Environment Poisoning Attacks

Amin Rakhsha, Goran Radanovic, Rati Devidze, Xiaojin Zhu, Adish Singla

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments Journal version of ICML'20 paper. New theoretical results for jointly poisoning rewards and transitions

详情

展开后加载摘要…

URL PDF HTML 收藏
2003.06906 2020-11-10 cs.MA cs.AI cs.LG cs.RO 62%

Model-based Reinforcement Learning for Decentralized Multiagent Rendezvous

Rose E. Wang, J. Chase Kew, Dennis Lee, Tsang-Wei Edward Lee, Tingnan Zhang, Brian Ichter, Jie Tan, Aleksandra Faust

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments CoRL 2020. The video is available at: https://youtu.be/-ydXHUtPzWE

详情

展开后加载摘要…

URL PDF HTML 收藏
2011.02608 2020-11-06 cs.RO cs.AI cs.CV cs.LG cs.MA 62%

Learning a Decentralized Multi-arm Motion Planner

Huy Ha, Jingxi Xu, Shuran Song

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments CoRL 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2008.02616 2020-11-05 cs.RO cs.AI cs.LG cs.MA 62%

The Emergence of Adversarial Communication in Multi-Agent Reinforcement Learning

Jan Blumenkamp, Amanda Prorok

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments Accepted to Conference on Robot Learning (CoRL) 2020. Camera-ready version incorporating rebuttal

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.13685 2020-10-27 cs.LG cs.AI stat.ML 62%

Forethought and Hindsight in Credit Assignment

Veronica Chelu, Doina Precup, Hado van Hasselt

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.11835 2020-10-24 cs.AI cs.LG cs.MA 62%

Multi-agent active perception with prediction rewards

Mikko Lauri, Frans A. Oliehoek

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments 34th Conference on Neural Information Processing Systems (NeurIPS 2020)

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.11940 2020-10-23 cs.RO cs.AI cs.LG 62%

Motion Planner Augmented Reinforcement Learning for Robot Manipulation in Obstructed Environments

Jun Yamada, Youngwoon Lee, Gautam Salhotra, Karl Pertsch, Max Pflueger, Gaurav S. Sukhatme, Joseph J. Lim, Peter Englert

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments Published at the Conference on Robot Learning (CoRL) 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
1908.09453 2020-09-29 cs.LG cs.AI cs.GT cs.MA 62%

OpenSpiel: A Framework for Reinforcement Learning in Games

Marc Lanctot, Edward Lockhart, Jean-Baptiste Lespiau, Vinicius Zambaldi, Satyaki Upadhyay, Julien Pérolat, Sriram Srinivasan, Finbarr Timbers, Karl Tuyls, Shayegan Omidshafiei, Daniel Hennes, Dustin Morrill, Paul Muller, Timo Ewalds, Ryan Faulkner, János Kramár, Bart De Vylder, Brennan Saeta, James Bradbury, David Ding, Sebastian Borgeaud, Matthew Lai, Julian Schrittwieser, Thomas Anthony, Edward Hughes, Ivo Danihelka, Jonah Ryan-Davis

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2009.09696 2020-09-22 cs.AI cs.LG 62%

Exploiting Submodular Value Functions For Scaling Up Active Perception

Yash Satsangi, Shimon Whiteson, Frans A. Oliehoek, Matthijs T. J. Spaan

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Journal ref Autonomous Robot 42 2018. Original article available via Springer journal open access: https://link.springer.com/article/10.1007/s10514-017-9666-5

详情

展开后加载摘要…

URL PDF HTML 收藏
2009.09070 2020-09-22 cs.CY cs.AI cs.LG 62%

Is there a role for statistics in artificial intelligence?

Sarah Friedrich, Gerd Antes, Sigrid Behr, Harald Binder, Werner Brannath, Florian Dumpert, Katja Ickstadt, Hans Kestler, Johannes Lederer, Heinz Leitgöb, Markus Pauly, Ansgar Steland, Adalbert Wilhelm, Tim Friede

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2009.03947 2020-09-22 cs.CL cs.LG 62%

Covid-Transformer: Detecting COVID-19 Trending Topics on Twitter Using Universal Sentence Encoder

Meysam Asgari-Chenaghlu, Narjes Nikzad-Khasmakhi, Shervin Minaee

专题命中 规划推理 :planning(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1911.08553 2020-09-16 eess.SY cs.AI cs.LG cs.SY 62%

Six Degree-of-Freedom Body-Fixed Hovering over Unmapped Asteroids via LIDAR Altimetry and Reinforcement Meta-Learning

Brian Gaudet, Richard Linares, Roberto Furfaro

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments Earlier version presented at 2020 AIAA Scitech conference. arXiv admin note: substantial text overlap with arXiv:1907.06098, arXiv:1906.02113

详情

展开后加载摘要…

URL PDF HTML 收藏
2003.12909 2020-08-20 cs.LG cs.AI cs.CR stat.ML 62%

Policy Teaching via Environment Poisoning: Training-time Adversarial Attacks against Reinforcement Learning

Amin Rakhsha, Goran Radanovic, Rati Devidze, Xiaojin Zhu, Adish Singla

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments ICML 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2008.05131 2020-08-13 cs.AI cs.LG 62%

Learning to Reason in Round-based Games: Multi-task Sequence Generation for Purchasing Decision Making in First-person Shooters

Yilei Zeng, Deren Lei, Beichen Li, Gangrong Jiang, Emilio Ferrara, Michael Zyda

专题命中 规划推理 :reasoning(abstract);分类 cs.AI、cs.LG

Comments 16th AAAI Conference on Artificial Intelligence and Interactive Digital Entertainment (AIIDE-20)

详情

展开后加载摘要…

URL PDF HTML 收藏
2007.12312 2020-07-27 cs.CY cs.AI cs.HC cs.LG 62%

COVID-19 Remote Patient Monitoring: Social Impact of AI

Ashlesha Nesarikar, Waqas Haque, Suchith Vuppala, Abhijit Nesarikar

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments 21 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2006.02419 2020-07-15 cs.CL cs.AI 62%

Emergent Multi-Agent Communication in the Deep Learning Era

Angeliki Lazaridou, Marco Baroni

专题命中 规划推理 :planning(abstract);分类 cs.CL、cs.AI

Comments Added some more references and discussion

详情

展开后加载摘要…

URL PDF HTML 收藏
2007.05896 2020-07-14 cs.LG cs.AI stat.ML 62%

Learning Abstract Models for Strategic Exploration and Fast Reward Transfer

Evan Zheran Liu, Ramtin Keramati, Sudarshan Seshadri, Kelvin Guu, Panupong Pasupat, Emma Brunskill, Percy Liang

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2007.05270 2020-07-13 cs.LG cs.AI stat.ML 62%

Learning to plan with uncertain topological maps

Edward Beeching, Jilles Dibangoye, Olivier Simonin, Christian Wolf

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments ECCV 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2003.11778 2020-07-07 cs.AI cs.LG cs.MA 62%

Too many cooks: Bayesian inference for coordinating multi-agent collaboration

Rose E. Wang, Sarah A. Wu, James A. Evans, Joshua B. Tenenbaum, David C. Parkes, Max Kleiman-Weiner

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments Rose E. Wang and Sarah A. Wu contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2006.15085 2020-06-29 cs.LG cs.AI stat.ML 62%

What can I do here? A Theory of Affordances in Reinforcement Learning

Khimya Khetarpal, Zafarali Ahmed, Gheorghe Comanici, David Abel, Doina Precup

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments Thirty-seventh International Conference on Machine Learning (ICML 2020)

详情

展开后加载摘要…

URL PDF HTML 收藏
2005.07677 2020-06-29 cs.AI cs.LG 62%

Finding Game Levels with the Right Difficulty in a Few Trials through Intelligent Trial-and-Error

Miguel González-Duque, Rasmus Berg Palm, David Ha, Sebastian Risi

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments To be presented in the Conference on Games 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2005.06061 2020-06-24 cs.LG cs.AI stat.ML 62%

TOMA: Topological Map Abstraction for Reinforcement Learning

Zhao-Heng Yin, Wu-Jun Li

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2006.11274 2020-06-22 cs.LG cs.AI math.OC stat.ML 62%

On Reward-Free Reinforcement Learning with Linear Function Approximation

Ruosong Wang, Simon S. Du, Lin F. Yang, Ruslan Salakhutdinov

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2006.06923 2020-06-15 cs.LG cs.AI cs.CV 62%

Potential Field Guided Actor-Critic Reinforcement Learning

Weiya Ren

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

Comments 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2006.02636 2020-06-05 cs.CV cs.AI cs.LG cs.RO stat.ML 62%

The Importance of Prior Knowledge in Precise Multimodal Prediction

Sergio Casas, Cole Gulino, Simon Suo, Raquel Urtasun

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏