arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 15819 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 15819 篇

2011.01975 2020-11-05 cs.AI cs.CV cs.LG cs.RO 62%

Rearrangement: A Challenge for Embodied AI

Dhruv Batra, Angel X. Chang, Sonia Chernova, Andrew J. Davison, Jia Deng, Vladlen Koltun, Sergey Levine, Jitendra Malik, Igor Mordatch, Roozbeh Mottaghi, Manolis Savva, Hao Su

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments Authors are listed in alphabetical order

详情

展开后加载摘要…

URL PDF HTML 收藏
2001.00805 2020-11-05 cs.LG cs.AI 62%

Making Sense of Reinforcement Learning and Probabilistic Inference

Brendan O'Donoghue, Ian Osband, Catalin Ionescu

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments ICLR 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.15469 2020-10-30 cs.LG cs.AI cs.RO 62%

Emergence of Spatial Coordinates via Exploration

Alban Laflaquière

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments 4 pages, 2 figures, BabyMind Workshop at NeurIPS 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.13839 2020-10-28 cs.LG cs.CL 62%

VisualHints: A Visual-Lingual Environment for Multimodal Reinforcement Learning

Thomas Carta, Subhajit Chaudhury, Kartik Talamadupula, Michiaki Tatsubori

专题命中 Agent评测 :agent(abstract);分类 cs.CL、cs.LG

Comments Code is available at http://ibm.biz/VisualHints

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.12639 2020-10-27 cs.RO cs.AI cs.CL cs.CV 62%

The RobotSlang Benchmark: Dialog-guided Robot Localization and Navigation

Shurjo Banerjee, Jesse Thomason, Jason J. Corso

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.CL

Comments Conference on Robot Learning 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.10560 2020-10-22 cs.LG cs.AI cs.CY 62%

Reinforcement Learning for Optimization of COVID-19 Mitigation policies

Varun Kompella, Roberto Capobianco, Stacy Jong, Jonathan Browne, Spencer Fox, Lauren Meyers, Peter Wurman, Peter Stone

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments *Joint First Authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2002.10221 2020-10-21 cs.LG cs.AI 62%

The Archimedean trap: Why traditional reinforcement learning will probably not yield AGI

Samuel Allen Alexander

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments 16 pages

Journal ref Journal of Artificial General Intelligence 11(1): 70--85 (2020)

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.09473 2020-10-20 cs.LG cs.AI 62%

Double-Linear Thompson Sampling for Context-Attentive Bandits

Djallel Bouneffouf, Raphaël Féraud, Sohini Upadhyay, Yasaman Khazaeni, Irina Rish

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments arXiv admin note: text overlap with arXiv:1906.09384

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.07494 2020-10-19 cs.LG cs.AI 62%

Knowledge Transfer in Multi-Task Deep Reinforcement Learning for Continuous Control

Zhiyuan Xu, Kun Wu, Zhengping Che, Jian Tang, Jieping Ye

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.03694 2020-10-12 cs.LG cs.AI 62%

Learning Intrinsic Symbolic Rewards in Reinforcement Learning

Hassam Sheikh, Shauharda Khadka, Santiago Miret, Somdeb Majumdar

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2004.14025 2020-10-08 cs.AI cs.CL 62%

Multi-View Attention Network for Visual Dialog

Sungjin Park, Taesun Whang, Yeochan Yoon, Heuiseok Lim

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.01298 2020-10-06 cs.LG cs.AI cs.RO stat.ML 62%

Beyond Tabula-Rasa: a Modular Reinforcement Learning Approach for Physically Embedded 3D Sokoban

Peter Karkus, Mehdi Mirza, Arthur Guez, Andrew Jaegle, Timothy Lillicrap, Lars Buesing, Nicolas Heess, Theophane Weber

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1912.06088 2020-10-06 cs.LG cs.AI stat.ML 62%

Learning to Reach Goals via Iterated Supervised Learning

Dibya Ghosh, Abhishek Gupta, Ashwin Reddy, Justin Fu, Coline Devin, Benjamin Eysenbach, Sergey Levine

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments First two authors contributed equally. Code available at https://github.com/dibyaghosh/gcsl

详情

展开后加载摘要…

URL PDF HTML 收藏
2002.06806 2020-10-05 cs.LG cs.AI cs.CV 62%

Reinforcement learning for the privacy preservation and manipulation of eye tracking data

Wolfgang Fuhl, Efe Bozkir, Enkelejda Kasneci

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2002.06395 2020-09-23 cs.LG cs.AI quant-ph stat.ML 62%

Quantum Bandits

Balthazar Casalé, Giuseppe Di Molfetta, Hachem Kadri, Liva Ralaivola

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments All your comments are very welcome!

Journal ref Quantum Machine Intelligence 2, 1-7 (2020)

详情

展开后加载摘要…

URL PDF HTML 收藏
2009.09781 2020-09-22 cs.CL cs.LG 62%

Rethinking Supervised Learning and Reinforcement Learning in Task-Oriented Dialogue Systems

Ziming Li, Julia Kiseleva, Maarten de Rijke

专题命中 Agent评测 :agent(abstract);分类 cs.CL、cs.LG

Comments 10 pages

Journal ref Findings of EMNLP 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2003.04960 2020-09-21 cs.LG cs.AI stat.ML 62%

Curriculum Learning for Reinforcement Learning Domains: A Framework and Survey

Sanmit Narvekar, Bei Peng, Matteo Leonetti, Jivko Sinapov, Matthew E. Taylor, Peter Stone

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Journal ref Journal of Machine Learning Research 21(181):1-50, 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2009.06851 2020-09-16 cs.CL cs.LG stat.ML 62%

Unsupervised Abstractive Dialogue Summarization for Tete-a-Tetes

Xinyuan Zhang, Ruiyi Zhang, Manzil Zaheer, Amr Ahmed

专题命中 Agent评测 :agent(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2001.10284 2020-09-15 cs.AI cs.HC cs.LG 62%

Distal Explanations for Model-free Explainable Reinforcement Learning

Prashan Madumal, Tim Miller, Liz Sonenberg, Frank Vetere

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2009.04647 2020-09-11 cs.LG cs.AI q-bio.PE 62%

COVID-19 Pandemic Cyclic Lockdown Optimization Using Reinforcement Learning

Mauricio Arango, Lyudmil Pelov

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2008.12348 2020-09-08 cs.CL cs.AI 62%

Neural Generation Meets Real People: Towards Emotionally Engaging Mixed-Initiative Conversations

Ashwin Paranjape, Abigail See, Kathleen Kenealy, Haojun Li, Amelia Hardy, Peng Qi, Kaushik Ram Sadagopan, Nguyet Minh Phu, Dilara Soylu, Christopher D. Manning

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.CL

Comments Published in 3rd Proceedings of Alexa Prize (Alexa Prize 2019)

详情

展开后加载摘要…

URL PDF HTML 收藏
2008.13044 2020-09-01 cs.LG cs.AI stat.ML 62%

Reinforcement Learning with Feedback-modulated TD-STDP

Stephen Chung, Robert Kozma

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments 17 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2003.12694 2020-08-26 cs.AI cs.CL 62%

Countering Language Drift with Seeded Iterated Learning

Yuchen Lu, Soumye Singhal, Florian Strub, Olivier Pietquin, Aaron Courville

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2008.10427 2020-08-25 cs.CL cs.AI 62%

How To Evaluate Your Dialogue System: Probe Tasks as an Alternative for Token-level Evaluation Metrics

Prasanna Parthasarathi, Joelle Pineau, Sarath Chandar

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
1912.09007 2020-08-20 cs.LG cs.AI cs.HC stat.ML 62%

Interestingness Elements for Explainable Reinforcement Learning: Understanding Agents' Capabilities and Limitations

Pedro Sequeira, Melinda Gervasio

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments To appear in: Artificial Intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2008.06799 2020-08-19 cs.AI cs.LG 62%

Chrome Dino Run using Reinforcement Learning

Divyanshu Marwah, Sneha Srivastava, Anusha Gupta, Shruti Verma

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2008.07087 2020-08-18 cs.LG cs.AI stat.ML 62%

OCEAN: Online Task Inference for Compositional Tasks with Context Adaptation

Hongyu Ren, Yuke Zhu, Jure Leskovec, Anima Anandkumar, Animesh Garg

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments UAI 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
1912.06321 2020-08-18 cs.CV cs.AI cs.LG cs.RO 62%

Sim2Real Predictivity: Does Evaluation in Simulation Predict Real-World Performance?

Abhishek Kadian, Joanne Truong, Aaron Gokaslan, Alexander Clegg, Erik Wijmans, Stefan Lee, Manolis Savva, Sonia Chernova, Dhruv Batra

专题命中 Agent评测 :AI agent(abstract);分类 cs.AI、cs.LG

Journal ref IEEE Robotics and Automation Letters (RA-L) 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2007.16045 2020-08-03 cs.LG cs.AI cs.MA 62%

Moody Learners -- Explaining Competitive Behaviour of Reinforcement Learning Agents

Pablo Barros, Ana Tanevska, Francisco Cruz, Alessandra Sciutti

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments Accepted by ICDl-EPIROB 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2007.14632 2020-07-30 cs.RO cs.AI cs.LG 62%

Tracking Emotions: Intrinsic Motivation Grounded on Multi-Level Prediction Error Dynamics

Guido Schillaci, Alejandra Ciria, Bruno Lara

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments Accepted for publication at the 10th Joint IEEE International Conference on Development and Learning and Epigenetic Robotics (ICDL-EPIROB 2020)

详情

展开后加载摘要…

URL PDF HTML 收藏