arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 15819 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 15819 篇

1810.05587 2019-10-21 cs.MA cs.AI cs.LG 62%

A Survey and Critique of Multiagent Deep Reinforcement Learning

Pablo Hernandez-Leal, Bilal Kartal, Matthew E. Taylor

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments Under review since Oct 2018. Earlier versions of this work had the title: "Is multiagent deep reinforcement learning the answer or the question? A brief survey"

详情

展开后加载摘要…

URL PDF HTML 收藏
1910.07514 2019-10-17 cs.HC cs.CL cs.LG 62%

Designing Style Matching Conversational Agents

Deepali Aneja, Rens Hoegen, Daniel McDuff, Mary Czerwinski

专题命中 Agent评测 :agent(abstract);分类 cs.CL、cs.LG

Comments Conversational Agents: Acting on the Wave of Research and Development, CHI 2019 Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
1910.03487 2019-10-09 cs.CL cs.LG stat.ML 62%

Controlled Text Generation for Data Augmentation in Intelligent Artificial Agents

Nikolaos Malandrakis, Minmin Shen, Anuj Goyal, Shuyang Gao, Abhishek Sethi, Angeliki Metallinou

专题命中 Agent评测 :agent(abstract);分类 cs.CL、cs.LG

Comments EMNLP WNGT workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
1910.00528 2019-10-02 cs.LG cs.AI cs.RO stat.ML 62%

Augmenting learning using symmetry in a biologically-inspired domain

Shruti Mishra, Abbas Abdolmaleki, Arthur Guez, Piotr Trochim, Doina Precup

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1906.11941 2019-09-30 cs.LG cs.AI stat.ML 62%

Learning Policies through Quantile Regression

Oliver Richter, Roger Wattenhofer

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
1909.09906 2019-09-24 cs.AI cs.LG 62%

Leveraging Human Guidance for Deep Reinforcement Learning Tasks

Ruohan Zhang, Faraz Torabi, Lin Guan, Dana H. Ballard, Peter Stone

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments Proceedings of the 28th International Joint Conference on Artificial Intelligence (IJCAI 2019)

详情

展开后加载摘要…

URL PDF HTML 收藏
1906.06841 2019-09-24 cs.LG cs.AI cs.CV 62%

LPaintB: Learning to Paint from Self-Supervision

Biao Jia, Jonathan Brandt, Radomir Mech, Byungmoon Kim, Dinesh Manocha

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1906.11315 2019-09-23 cs.AI cs.CL 62%

Generalization to Novel Objects using Prior Relational Knowledge

Varun Kumar Vijay, Abhinav Ganesh, Hanlin Tang, Arjun Bansal

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
1909.06965 2019-09-17 cs.LG cs.AI stat.ML 62%

Better AI through Logical Scaffolding

Nikos Arechiga, Jonathan DeCastro, Soonho Kong, Karen Leung

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments CAV Workshop on Formal Methods for ML-enabled Autonomous Systems 2019

详情

展开后加载摘要…

URL PDF HTML 收藏
1909.05863 2019-09-16 cs.CL cs.AI cs.IR cs.MA 62%

Finding Generalizable Evidence by Learning to Convince Q&A Models

Ethan Perez, Siddharth Karamcheti, Rob Fergus, Jason Weston, Douwe Kiela, Kyunghyun Cho

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.CL

Comments EMNLP 2019. Code available at https://github.com/ethanjperez/convince

详情

展开后加载摘要…

URL PDF HTML 收藏
1909.04607 2019-09-11 cs.AI cs.LG 62%

Discovery of Useful Questions as Auxiliary Tasks

Vivek Veeriah, Matteo Hessel, Zhongwen Xu, Richard Lewis, Janarthanan Rajendran, Junhyuk Oh, Hado van Hasselt, David Silver, Satinder Singh

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1908.07617 2019-09-10 cs.AI cs.LG 62%

Reinforcement Learning is not a Causal problem

Mauricio Gonzalez-Soto, Felipe Orihuela Espina

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1712.00912 2019-09-10 cs.CV cs.AI cs.LG stat.ML 62%

Deep Learning Diffuse Optical Tomography

Jaejun Yoo, Sohail Sabir, Duchang Heo, Kee Hyun Kim, Abdul Wahab, Yoonseok Choi, Seul-I Lee, Eun Young Chae, Hak Hee Kim, Young Min Bae, Young-wook Choi, Seungryong Cho, Jong Chul Ye

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments Accepted for IEEE Trans. on Medical Imaging

详情

展开后加载摘要…

URL PDF HTML 收藏
1908.10909 2019-08-30 cs.CL cs.LG 62%

Interactive Language Learning by Question Answering

Xingdi Yuan, Marc-Alexandre Cote, Jie Fu, Zhouhan Lin, Christopher Pal, Yoshua Bengio, Adam Trischler

专题命中 Agent评测 :agent(abstract);分类 cs.CL、cs.LG

Comments EMNLP 2019

详情

展开后加载摘要…

URL PDF HTML 收藏
1908.02037 2019-08-07 cs.AI cs.LG 62%

Batch Recurrent Q-Learning for Backchannel Generation Towards Engaging Agents

Nusrah Hussain, Engin Erzin, T. Metin Sezgin, Yucel Yemez

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments 8 pages, 4 figures. arXiv admin note: substantial text overlap with arXiv:1908.01618

详情

展开后加载摘要…

URL PDF HTML 收藏
1908.01007 2019-08-06 cs.LG cs.AI stat.ML 62%

Improving Deep Reinforcement Learning in Minecraft with Action Advice

Spencer Frazier, Mark Riedl

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1907.02908 2019-07-08 cs.LG cs.AI stat.ML 62%

On Inductive Biases in Deep Reinforcement Learning

Matteo Hessel, Hado van Hasselt, Joseph Modayil, David Silver

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1907.00921 2019-07-02 cs.LG cs.AI cs.RO stat.ML 62%

Active Learning within Constrained Environments through Imitation of an Expert Questioner

Kalesha Bullard, Yannick Schroecker, Sonia Chernova

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments In Conference Proceedings for IJCAI 2019

详情

展开后加载摘要…

URL PDF HTML 收藏
1906.10918 2019-06-27 cs.LG cs.AI cs.NE 62%

Towards Empathic Deep Q-Learning

Bart Bussmann, Jacqueline Heinerman, Joel Lehman

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments To be presented as a poster at the IJCAI-19 AI Safety Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
1905.01992 2019-06-27 cs.CL cs.LG stat.ML 62%

An Adversarial Learning Framework For A Persona-Based Multi-Turn Dialogue Model

Oluwatobi Olabiyi, Anish Khazane, Alan Salimov, Erik T. Mueller

专题命中 Agent评测 :agent(abstract);分类 cs.CL、cs.LG

Comments NAACL NeuralGen Workshop 2019. arXiv admin note: substantial text overlap with arXiv:1905.01998

详情

展开后加载摘要…

URL PDF HTML 收藏
1906.09237 2019-06-25 cs.LG cs.AI stat.ML 62%

Shaping Belief States with Generative Environment Models for RL

Karol Gregor, Danilo Jimenez Rezende, Frederic Besse, Yan Wu, Hamza Merzic, Aaron van den Oord

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments pre-print

详情

展开后加载摘要…

URL PDF HTML 收藏
1906.07838 2019-06-20 cs.LG cs.AI cs.RO stat.ML 62%

RadGrad: Active learning with loss gradients

Paul Budnarain, Renato Ferreira Pinto Junior, Ilan Kogan

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1807.01281 2019-06-19 cs.LG cs.AI stat.ML 62%

Human-level performance in first-person multiplayer games with population-based deep reinforcement learning

Max Jaderberg, Wojciech M. Czarnecki, Iain Dunning, Luke Marris, Guy Lever, Antonio Garcia Castaneda, Charles Beattie, Neil C. Rabinowitz, Ari S. Morcos, Avraham Ruderman, Nicolas Sonnerat, Tim Green, Louise Deason, Joel Z. Leibo, David Silver, Demis Hassabis, Koray Kavukcuoglu, Thore Graepel

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1906.06812 2019-06-18 cs.LG cs.AI math.OC 62%

A gray-box approach for curriculum learning

Francesco Foglino, Matteo Leonetti, Simone Sagratella, Ruggiero Seccia

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments 10 pages, 1 figure

Journal ref Optimization of Complex Systems: Theory, Models, Algorithms and Applications, 2020, pp 720-729

详情

展开后加载摘要…

URL PDF HTML 收藏
1810.12162 2019-06-17 cs.LG cs.AI cs.IT cs.NE math.IT stat.ML 62%

Model-Based Active Exploration

Pranav Shyam, Wojciech Jaśkowski, Faustino Gomez

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments ICML 2019. Code: https://github.com/nnaisense/max

详情

展开后加载摘要…

URL PDF HTML 收藏
1906.04161 2019-06-11 cs.LG cs.AI cs.CV cs.RO stat.ML 62%

Self-Supervised Exploration via Disagreement

Deepak Pathak, Dhiraj Gandhi, Abhinav Gupta

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments Accepted at ICML 2019. Website at https://pathak22.github.io/exploration-by-disagreement/

详情

展开后加载摘要…

URL PDF HTML 收藏
1906.02671 2019-06-07 cs.MM cs.CL cs.LG cs.NE cs.RO 62%

Grounding Natural Language Commands to StarCraft II Game States for Narration-Guided Reinforcement Learning

Nicholas Waytowich, Sean L. Barton, Vernon Lawhern, Ethan Stump, Garrett Warnell

专题命中 Agent评测 :agent(abstract);分类 cs.CL、cs.LG

Comments 10 pages, 3 figures. Published at SPIE 2019

详情

展开后加载摘要…

URL PDF HTML 收藏
1906.01035 2019-06-05 cs.LG cs.AI cs.NE stat.ML 62%

A Perspective on Objects and Systematic Generalization in Model-Based RL

Sjoerd van Steenkiste, Klaus Greff, Jürgen Schmidhuber

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments Accepted to the ICML 2019 workshop on Workshop on Generative Modeling and Model-Based Reasoning for Robotics and AI

详情

展开后加载摘要…

URL PDF HTML 收藏
1903.02020 2019-06-03 cs.LG cs.AI stat.ML 62%

Using Natural Language for Reward Shaping in Reinforcement Learning

Prasoon Goyal, Scott Niekum, Raymond J. Mooney

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments IJCAI 2019

详情

展开后加载摘要…

URL PDF HTML 收藏
1905.08937 2019-05-31 cs.HC cs.AI cs.CL 62%

Can a Humanoid Robot be part of the Organizational Workforce? A User Study Leveraging Sentiment Analysis

Nidhi Mishra, Manoj Ramanathan, Ranjan Satapathy, Erik Cambria, Nadia Magnenat-Thalmann

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.CL

Comments Submitted to IEEE RO-MAN2019

详情

展开后加载摘要…

URL PDF HTML 收藏