arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 4786 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 4786 篇

1912.00947 2020-04-22 nlin.AO cs.LG nlin.CD 57%

Restoring Chaos Using Deep Reinforcement Learning

Sumit Vashishtha, Siddhartha Verma

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

Comments 4 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1907.03799 2020-04-22 cs.LG cs.CV cs.NE stat.ML 57%

Rehearsal-Free Continual Learning over Small Non-I.I.D. Batches

Vincenzo Lomonaco, Davide Maltoni, Lorenzo Pellegrini

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

Comments Accepted in the CLVision Workshop at CVPR2020: 12 pages, 7 figures, 5 tables, 3 algorithms

详情

展开后加载摘要…

URL PDF HTML 收藏
2004.09930 2020-04-22 cs.CL 57%

Relabel the Noise: Joint Extraction of Entities and Relations via Cooperative Multiagents

Daoyuan Chen, Yaliang Li, Kai Lei, Ying Shen

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.CL

Comments Accepted by ACL 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
1907.06536 2020-04-14 cs.LG cs.MA cs.NI stat.ML 57%

Federated Reinforcement Distillation with Proxy Experience Memory

Han Cha, Jihong Park, Hyesung Kim, Seong-Lyun Kim, Mehdi Bennis

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

Comments To be presented at the 28th International Joint Conference on Artificial Intelligence (IJCAI-19), 1st International Workshop on Federated Machine Learning for User Privacy and Data Confidentiality (FML'19), Macao, China

详情

展开后加载摘要…

URL PDF HTML 收藏
2004.02249 2020-04-07 eess.IV cs.CV cs.LG 57%

CondenseUNet: A Memory-Efficient Condensely-Connected Architecture for Bi-ventricular Blood Pool and Myocardium Segmentation

S. M. Kamrul Hasan, Cristian A. Linte

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.LG

Comments 7 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1911.10298 2020-04-03 cs.LG cs.RO stat.ML 57%

CoverNet: Multimodal Behavior Prediction using Trajectory Sets

Tung Phan-Minh, Elena Corina Grigore, Freddy A. Boulton, Oscar Beijbom, Eric M. Wolff

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2002.05156 2020-04-01 cs.GT cs.AI cs.CC 57%

Public Bayesian Persuasion: Being Almost Optimal and Almost Persuasive

Matteo Castiglioni, Andrea Celli, Nicola Gatti

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2003.06745 2020-03-17 cs.CV cs.CL 57%

Vision-Dialog Navigation by Exploring Cross-modal Memory

Yi Zhu, Fengda Zhu, Zhaohuan Zhan, Bingqian Lin, Jianbin Jiao, Xiaojun Chang, Xiaodan Liang

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.CL

Comments CVPR2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2003.06734 2020-03-17 cs.CV cs.LG cs.RO 57%

Active Perception and Representation for Robotic Manipulation

Youssef Zaky, Gaurav Paruthi, Bryan Tripp, James Bergstra

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2003.01927 2020-03-17 cs.LG stat.ML 57%

DefogGAN: Predicting Hidden Information in the StarCraft Fog of War with Generative Adversarial Nets

Yonghyun Jeong, Hyunjin Choi, Byoungjip Kim, Youngjune Gwon

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2001.09746 2020-03-11 cs.CY cs.HC cs.LG 57%

SensAI+Expanse Emotional Valence Prediction Studies with Cognition and Memory Integration

Nuno A. C. Henriques, Helder Coelho, Leonel Garcia-Marques

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

Comments Accepted as regular paper in COGNITIVE 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2003.04069 2020-03-10 cs.LG stat.ML 57%

Zooming for Efficient Model-Free Reinforcement Learning in Metric Spaces

Ahmed Touati, Adrien Ali Taiga, Marc G. Bellemare

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1910.02974 2020-03-10 cs.CV cs.CL cs.RO 57%

SMArT: Training Shallow Memory-aware Transformers for Robotic Explainability

Marcella Cornia, Lorenzo Baraldi, Rita Cucchiara

专题命中 记忆与上下文管理 :autonomous agent(abstract);分类 cs.CL

Comments ICRA 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2002.01196 2020-03-09 cs.CL 57%

Dynamic Knowledge Routing Network For Target-Guided Open-Domain Conversation

Jinghui Qin, Zheng Ye, Jianheng Tang, Xiaodan Liang

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.CL

Comments 8 pages, 2 figues, 6tables, AAAI2020, fix our model's abbreviation

详情

展开后加载摘要…

URL PDF HTML 收藏
1912.10329 2020-02-25 cs.LG stat.ML 57%

Can Agents Learn by Analogy? An Inferable Model for PAC Reinforcement Learning

Yanchao Sun, Furong Huang

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

Comments To be published in proceedings of AAMAS 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
1907.11625 2020-02-21 cs.SI cs.LG 57%

Influence maximization in unknown social networks: Learning Policies for Effective Graph Sampling

Harshavardhan Kamarthi, Priyesh Vijayan, Bryan Wilder, Balaraman Ravindran, Milind Tambe

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

Comments Accepted at AAMAS 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2002.06038 2020-02-17 cs.LG stat.ML 57%

Never Give Up: Learning Directed Exploration Strategies

Adrià Puigdomènech Badia, Pablo Sprechmann, Alex Vitvitskyi, Daniel Guo, Bilal Piot, Steven Kapturowski, Olivier Tieleman, Martín Arjovsky, Alexander Pritzel, Andew Bolt, Charles Blundell

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

Comments Published as a conference paper in ICLR 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2002.01370 2020-02-05 cs.LG stat.ML 57%

Bootstrapping a DQN Replay Memory with Synthetic Experiences

Wenzel Baron Pilar von Pilchau, Anthony Stein, Jörg Hähner

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1809.03214 2020-02-04 cs.LG cs.RO stat.ML 57%

Adaptive Behavior Generation for Autonomous Driving using Deep Reinforcement Learning with Compact Semantic States

Peter Wolf, Karl Kurzer, Tobias Wingert, Florian Kuhnt, J. Marius Zöllner

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2001.11701 2020-02-03 cs.CL 57%

Teaching Machines to Converse

Jiwei Li

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.CL

Comments phd thesis

详情

展开后加载摘要…

URL PDF HTML 收藏
2001.10363 2020-01-29 eess.SP cs.LG 57%

RIS Enhanced Massive Non-orthogonal Multiple Access Networks: Deployment and Passive Beamforming Design

Xiao Liu, Yuanwei Liu, Yue Chen, H. Vincent Poor

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1707.08553 2020-01-28 cs.LG 57%

Direct Load Control of Thermostatically Controlled Loads Based on Sparse Observations Using Deep Reinforcement Learning

Frederik Ruelens, Bert J. Claessens, Peter Vrancx, Fred Spiessens, Geert Deconinck

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

Comments submitted and waiting review in IEEE transactions on smart grid 2017

Journal ref CSEE Journal of Power and Energy Systems, Vol. 5, Iss. 4, Dec. 2019, pp. 423-432

详情

展开后加载摘要…

URL PDF HTML 收藏
2001.05636 2020-01-17 cs.LG stat.ML 57%

MIME: Mutual Information Minimisation Exploration

Haitao Xu, Brendan McCane, Lech Szymanski, Craig Atkinson

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1907.11461 2020-01-17 cs.MA cs.AI 57%

Action Semantics Network: Considering the Effects of Actions in Multiagent Systems

Weixun Wang, Tianpei Yang, Yong Liu, Jianye Hao, Xiaotian Hao, Yujing Hu, Yingfeng Chen, Changjie Fan, Yang Gao

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

Comments accepted by ICLR2020

详情

展开后加载摘要…

URL PDF HTML 收藏
1905.11832 2020-01-17 cs.LG cs.CV stat.ML 57%

Snooping Attacks on Deep Reinforcement Learning

Matthew Inkawhich, Yiran Chen, Hai Li

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

Comments 13 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1912.10515 2019-12-24 cs.LO cs.AI 57%

Bringing Belief Base Change into Dynamic Epistemic Logic

Marlo Souza, Álvaro Moreira

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

Comments Published at DaLI 2019

详情

展开后加载摘要…

URL PDF HTML 收藏
1906.04279 2019-12-19 cs.LG stat.ML 57%

Exploration via Hindsight Goal Generation

Zhizhou Ren, Kefan Dong, Yuan Zhou, Qiang Liu, Jian Peng

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

Comments Thirty-third Conference on Neural Information Processing Systems (NeurIPS 2019)

详情

展开后加载摘要…

URL PDF HTML 收藏
1911.09682 2019-11-25 quant-ph cs.LG 57%

Quantum Observables for continuous control of the Quantum Approximate Optimization Algorithm via Reinforcement Learning

Artur Garcia-Saez, Jordi Riu

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

Comments 6 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1911.08701 2019-11-21 cs.LG stat.ML 57%

Bayesian Curiosity for Efficient Exploration in Reinforcement Learning

Tom Blau, Lionel Ott, Fabio Ramos

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1911.07224 2019-11-19 cs.LG cs.RO stat.ML 57%

Learning from Trajectories via Subgoal Discovery

Sujoy Paul, Jeroen van Baar, Amit K. Roy-Chowdhury

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

Comments NeurIPS 2019 Accepted

详情

展开后加载摘要…

URL PDF HTML 收藏