arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 15801 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 15801 篇

2107.13619 2021-07-30 cs.AI cs.LG 62%

A Deep Graph Reinforcement Learning Model for Improving User Experience in Live Video Streaming

Stefanos Antaris, Dimitrios Rafailidis, Sarunas Girdzijauskas

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.11811 2021-07-27 cs.LG cs.AI 62%

Reinforced Imitation Learning by Free Energy Principle

Ryoya Ogishima, Izumi Karino, Yasuo Kuniyoshi

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.04887 2021-07-15 cs.LG cs.AI stat.ML 62%

Interaction-Grounded Learning

Tengyang Xie, John Langford, Paul Mineiro, Ida Momennejad

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments Published in ICML 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.05786 2021-07-14 cs.AI cs.LG 62%

Carle's Game: An Open-Ended Challenge in Exploratory Machine Creativity

Q. Tyrell Davis

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments 8 pages, 11 figures, accepted to IEEE Conference on Games 2021: 978-1-6654-3886-5/21/$31.00 ©2021 IEEE

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.05216 2021-07-13 cs.LG cs.AI 62%

A Simple Reward-free Approach to Constrained Reinforcement Learning

Sobhan Miryoosefi, Chi Jin

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.03577 2021-07-09 cs.AI cs.LG q-fin.CP 62%

Adaptive Stress Testing for Adversarial Learning in a Financial Environment

Khalid El-Awady

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2102.06858 2021-07-07 cs.AI cs.LG cs.RO 62%

LTL2Action: Generalizing LTL Instructions for Multi-Task RL

Pashootan Vaezipoor, Andrew Li, Rodrigo Toro Icarte, Sheila McIlraith

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments International Conference on Machine Learning (ICML) 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.01969 2021-07-06 cs.LG cs.AI 62%

The MineRL BASALT Competition on Learning from Human Feedback

Rohin Shah, Cody Wild, Steven H. Wang, Neel Alex, Brandon Houghton, William Guss, Sharada Mohanty, Anssi Kanervisto, Stephanie Milani, Nicholay Topin, Pieter Abbeel, Stuart Russell, Anca Dragan

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments NeurIPS 2021 Competition Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.15128 2021-06-30 cs.LG cs.AI 62%

Regularized OFU: an Efficient UCB Estimator forNon-linear Contextual Bandit

Yichi Zhou, Shihong Song, Huishuai Zhang, Jun Zhu, Wei Chen, Tie-Yan Liu

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2102.02472 2021-06-28 cs.LG cs.AI stat.ML 62%

Transfer Learning in Bandits with Latent Continuity

Hyejin Park, Seiyun Shin, Kwang-Sung Jun, Jungseul Ok

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.10411 2021-06-23 cs.LG cs.AI 62%

Boosting Offline Reinforcement Learning with Residual Generative Modeling

Hua Wei, Deheng Ye, Zhao Liu, Hao Wu, Bo Yuan, Qiang Fu, Wei Yang, Zhenhui Li

专题命中 Agent评测 :AI agent(abstract);分类 cs.AI、cs.LG

Comments Accepted by IJCAI 2021, appendix included, 9 pages, 4 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.10305 2021-06-22 cs.AI cs.LG 62%

Multi-Task Learning for User Engagement and Adoption in Live Video Streaming Events

Stefanos Antaris, Dimitrios Rafailidis, Romina Arriaza

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.05387 2021-06-16 cs.LG cs.CL 62%

Eye of the Beholder: Improved Relation Generalization for Text-based Reinforcement Learning Agents

Keerthiram Murugesan, Subhajit Chaudhury, Kartik Talamadupula

专题命中 Agent评测 :agent(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.06061 2021-06-14 cs.LG cs.AI cs.NE 62%

Data-driven battery operation for energy arbitrage using rainbow deep reinforcement learning

Daniel J. B. Harrold, Jun Cao, Zhong Fan

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments 13 pages, 9 figures (17 counting each subfigure)

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.06009 2021-06-14 cs.AI cs.LG 62%

Synthesising Reinforcement Learning Policies through Set-Valued Inductive Rule Learning

Youri Coppens, Denis Steckelmacher, Catholijn M. Jonker, Ann Nowé

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments 17 pages, 4 figures. The final authenticated publication is available online at https://doi.org/10.1007/978-3-030-73959-1_15

Journal ref Trustworthy AI - Integrating Learning, Optimization and Reasoning (2021), Lecture Notes in Computer Science, vol. 12641, pp. 163-179

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.05966 2021-06-11 cs.CV cs.AI cs.LG cs.RO 62%

Learning by Watching

Jimuyang Zhang, Eshed Ohn-Bar

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments CVPR 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.04847 2021-06-11 cs.LG cs.AI 62%

Adversarial Reinforcement Learning for Procedural Content Generation

Linus Gisslén, Andy Eakins, Camilo Gordillo, Joakim Bergdahl, Konrad Tollmar

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments 8 pages, 6 figures (11 subfigures)

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.04905 2021-06-10 cs.CL cs.AI 62%

DGA-Net Dynamic Gaussian Attention Network for Sentence Semantic Matching

Kun Zhang, Guangyi Lv, Meng Wang, Enhong Chen

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.CL

Comments Accepted by CICAI2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.03927 2021-06-09 cs.GT cs.AI cs.LG cs.MA 62%

Improving Social Welfare While Preserving Autonomy via a Pareto Mediator

Stephen McAleer, John Lanier, Michael Dennis, Pierre Baldi, Roy Fox

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.03273 2021-06-08 cs.LG cs.AI stat.ML 62%

Control-Oriented Model-Based Reinforcement Learning with Implicit Differentiation

Evgenii Nikishin, Romina Abachi, Rishabh Agarwal, Pierre-Luc Bacon

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments Code at https://github.com/evgenii-nikishin/omd

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.02390 2021-06-07 cs.LG cs.AI stat.ML 62%

Online reinforcement learning with sparse rewards through an active inference capsule

Alejandro Daniel Noel, Charel van Hoof, Beren Millidge

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.02257 2021-06-07 cs.CV cs.AI cs.LG 62%

Visual Question Rewriting for Increasing Response Rate

Jiayi Wei, Xilian Li, Yi Zhang, Xin Wang

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2101.07947 2021-06-07 cs.CL cs.AI 62%

WeChat AI & ICT's Submission for DSTC9 Interactive Dialogue Evaluation Track

Zekang Li, Zongjia Li, Jinchao Zhang, Yang Feng, Jie Zhou

专题命中 Agent评测 :planning(abstract);分类 cs.AI、cs.CL

Comments DSTC9@AAAI2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.00969 2021-06-03 cs.CL cs.AI 62%

COM2SENSE: A Commonsense Reasoning Benchmark with Complementary Sentences

Shikhar Singh, Nuan Wen, Yu Hou, Pegah Alipoormolabashi, Te-Lin Wu, Xuezhe Ma, Nanyun Peng

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.CL

Comments In Proceedings of Findings of the Association for Computational Linguistics: ACL 2021 (ACL-Findings). Contains 16 pages, 14 figures and 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.07326 2021-06-01 q-bio.PE cs.AI cs.LG 62%

Collective defense of honeybee colonies: experimental results and theoretical modeling

Andrea López-Incera, Morgane Nouvian, Katja Ried, Thomas Müller, Hans J. Briegel

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Journal ref BMC Biol 19, 106 (2021)

详情

展开后加载摘要…

URL PDF HTML 收藏
2005.12632 2021-05-25 cs.CR cs.AI cs.LG 62%

Modeling Penetration Testing with Reinforcement Learning Using Capture-the-Flag Challenges: Trade-offs between Model-free Learning and A Priori Knowledge

Fabio Massimo Zennaro, Laszlo Erdodi

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments 13 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2105.10026 2021-05-24 cs.CL cs.AI cs.CV 62%

Improving Generation and Evaluation of Visual Stories via Semantic Consistency

Adyasha Maharana, Darryl Hannan, Mohit Bansal

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.CL

Comments NAACL 2021 (16 pages)

详情

展开后加载摘要…

URL PDF HTML 收藏
2105.10014 2021-05-24 cs.LG cs.AI cs.CV cs.RO 62%

Evaluating Robustness over High Level Driving Instruction for Autonomous Driving

Florence Carton, David Filliat, Jaonary Rabarisoa, Quoc Cuong Pham

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments Accepted to IV21, 32nd IEEE Intelligent Vehicles Symposium

详情

展开后加载摘要…

URL PDF HTML 收藏
2105.05246 2021-05-12 cs.LG cs.AI 62%

Spectral Normalisation for Deep Reinforcement Learning: an Optimisation Perspective

Florin Gogianu, Tudor Berariu, Mihaela Rosca, Claudia Clopath, Lucian Busoniu, Razvan Pascanu

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments Accepted at ICML2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2105.03310 2021-05-11 cs.LG cs.AI stat.ML 62%

Context-Based Soft Actor Critic for Environments with Non-stationary Dynamics

Yuan Pu, Shaochen Wang, Xin Yao, Bin Li

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments 12 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏