arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 15801 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 15801 篇

2211.06552 2023-03-22 cs.CL cs.AI 62%

Collecting Interactive Multi-modal Datasets for Grounded Language Understanding

Shrestha Mohanty, Negar Arabzadeh, Milagro Teruel, Yuxuan Sun, Artem Zholus, Alexey Skrynnik, Mikhail Burtsev, Kavya Srinet, Aleksandr Panov, Arthur Szlam, Marc-Alexandre Côté, Julia Kiseleva

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.CL

Journal ref Interactive Learning for Natural Language Processing NeurIPS 2022 Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.06155 2023-03-14 cs.LG cs.AI cs.DC cs.SY eess.SY 62%

Digital Twin-Assisted Knowledge Distillation Framework for Heterogeneous Federated Learning

Xiucheng Wang, Nan Cheng, Longfei Ma, Ruijin Sun, Rong Chai, Ning Lu

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.05380 2023-03-13 cs.LG cs.AI 62%

On the Interventional Kullback-Leibler Divergence

Jonas Wildberger, Siyuan Guo, Arnab Bhattacharyya, Bernhard Schölkopf

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.08894 2023-03-08 cs.LG cs.AI cs.GT 62%

A Deep Reinforcement Learning Approach for Finding Non-Exploitable Strategies in Two-Player Atari Games

Zihan Ding, Dijia Su, Qinghua Liu, Chi Jin

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.02657 2023-03-07 cs.LG cs.AI cs.IT cs.NI eess.SP math.IT 62%

Sparsity-Aware Intelligent Massive Random Access Control in Open RAN: A Reinforcement Learning Based Approach

Xiao Tang, Sicong Liu, Xiaojiang Du, Mohsen Guizani

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments This paper has been submitted to IEEE Journal on Selected Areas in Communications

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.07741 2023-03-07 cs.LG cs.AI 62%

Prioritized offline Goal-swapping Experience Replay

Wenyan Yang, Joni Pajarinen, Dinging Cai, Joni Kämäräinen

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.02526 2023-03-07 cs.LG cs.AI cs.CR stat.ML 62%

On Private and Robust Bandits

Yulian Wu, Xingyu Zhou, Youming Tao, Di Wang

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.01502 2023-03-03 cs.CL cs.AI 62%

Computational Language Acquisition with Theory of Mind

Andy Liu, Hao Zhu, Emmy Liu, Yonatan Bisk, Graham Neubig

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.CL

Comments 9 pages, 3 figures. To be published in the 11th International Conference on Learning Representations, ICLR 2023, Conference Track Proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.01484 2023-03-03 cs.RO cs.AI cs.CV cs.LG 62%

Predicting Motion Plans for Articulating Everyday Objects

Arjun Gupta, Max E. Shepherd, Saurabh Gupta

专题命中 Agent评测 :planning(abstract);分类 cs.AI、cs.LG

Comments To Appear in ICRA 2023. Project webpage: https://arjung128.github.io/mpao/

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.00871 2023-03-03 cs.CV cs.AI cs.LG cs.RO 62%

Bayesian Deep Learning for Affordance Segmentation in images

Lorenzo Mur-Labadia, Ruben Martinez-Cantin, Jose J. Guerrero

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments 2023 IEEE International Conference on Robotics and Automation (ICRA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.12502 2023-03-03 cs.CV cs.CL cs.LG 62%

The Dialog Must Go On: Improving Visual Dialog via Generative Self-Training

Gi-Cheon Kang, Sungdong Kim, Jin-Hwa Kim, Donghyun Kwak, Byoung-Tak Zhang

专题命中 Agent评测 :agent(abstract);分类 cs.CL、cs.LG

Comments CVPR 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.00518 2023-03-02 cs.LG cs.AI 62%

Efficient Scheduling of Data Augmentation for Deep Reinforcement Learning

Byungchan Ko, Jungseul Ok

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments arXiv admin note: substantial text overlap with arXiv:2102.08581

Journal ref Neurips2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.15914 2023-03-01 cs.LG cs.AI 62%

Improving the quality of generative models through Smirnov transformation

Ángel González-Prieto, Alberto Mozo, Sandra Gómez-Canaval, Edgar Talavera

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments 28 pages, 16 Figures, 4 Tables

Journal ref Information Sciences Volume 609, 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.10924 2023-02-23 cs.SD cs.AI cs.HC cs.LG eess.AS 62%

A Reinforcement Learning Framework for Online Speaker Diarization

Baihan Lin, Xinxin Zhang

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.14571 2023-02-23 cs.LG cs.AI 62%

Provable Benefits of Representational Transfer in Reinforcement Learning

Alekh Agarwal, Yuda Song, Wen Sun, Kaiwen Wang, Mengdi Wang, Xuezhou Zhang

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.10320 2023-02-22 cs.LG cs.AI cs.NE cs.RO 62%

Meta-World Conditional Neural Processes

Suzan Ece Ada, Emre Ugur

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments 11 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.07399 2023-02-16 cs.NI cs.AI cs.LG 62%

To Risk or Not to Risk: Learning with Risk Quantification for IoT Task Offloading in UAVs

Anne Catherine Nguyen, Turgay Pamuklu, Aisha Syed, W. Sean Kennedy, Melike Erol-Kantarci

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments Accepted for ICC2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.06604 2023-02-14 cs.RO cs.AI cs.CV cs.LG cs.SY eess.SY 62%

ALAN: Autonomously Exploring Robotic Agents in the Real World

Russell Mendonca, Shikhar Bahl, Deepak Pathak

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments ICRA 2023. Website at https://robo-explorer.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.05838 2023-02-14 cs.AI cs.LG 62%

Maneuver Decision-Making For Autonomous Air Combat Through Curriculum Learning And Reinforcement Learning With Sparse Rewards

Yu-Jie Wei, Hong-Peng Zhang, Chang-Qiang Huang

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.14296 2023-02-07 cs.LG cs.AI cs.RO stat.ML 62%

A System for Morphology-Task Generalization via Unified Representation and Behavior Distillation

Hiroki Furuta, Yusuke Iwasawa, Yutaka Matsuo, Shixiang Shane Gu

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments Accepted at ICLR2023 (notable-top-25%), Website: https://sites.google.com/view/control-graph

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.13138 2023-01-31 cs.AI cs.LG 62%

Towards the Linear Algebra Based Taxonomy of XAI Explanations

Sven Nomm

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments 6 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2201.05560 2023-01-30 cs.LG cs.AI cs.NI 62%

Demystifying Reinforcement Learning in Time-Varying Systems

Pouya Hamadanian, Malte Schwarzkopf, Siddartha Sen, Mohammad Alizadeh

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.12418 2023-01-24 cs.RO cs.AI cs.HC cs.LG 62%

MILD: Multimodal Interactive Latent Dynamics for Learning Human-Robot Interaction

Vignesh Prasad, Dorothea Koert, Ruth Stock-Homburg, Jan Peters, Georgia Chalvatzaki

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments Accepted at the IEEE-RAS International Conference on Humanoid Robots (Humanoids) 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.08133 2023-01-23 cs.LG cs.AI cs.RO 62%

Metric Residual Networks for Sample Efficient Goal-Conditioned Reinforcement Learning

Bo Liu, Yihao Feng, Qiang Liu, Peter Stone

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments Goal-conditioned reinforcement learning, neural architecture design

详情

展开后加载摘要…

URL PDF HTML 收藏
2011.00136 2023-01-23 cs.CL cs.LG 62%

Improving Dialogue Breakdown Detection with Semi-Supervised Learning

Nathan Ng, Marzyeh Ghassemi, Narendran Thangarajan, Jiacheng Pan, Qi Guo

专题命中 Agent评测 :agent(abstract);分类 cs.CL、cs.LG

Comments 6 pages, 1 figure, accepted at the NeurIPS Workshop on Human in the Loop Dialogue Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.08255 2023-01-13 cs.LG cs.AI cs.RO 62%

Sample-efficient Reinforcement Learning Representation Learning with Curiosity Contrastive Forward Dynamics Model

Thanh Nguyen, Tung M. Luu, Thang Vu, Chang D. Yoo

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Journal ref 2021 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2105.14111 2023-01-11 cs.LG cs.AI 62%

Goal Misgeneralization in Deep Reinforcement Learning

Lauro Langosco, Jack Koch, Lee Sharkey, Jacob Pfau, Laurent Orseau, David Krueger

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments Published in ICML 2022. 9 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.02401 2023-01-09 cs.CL cs.AI 62%

You Truly Understand What I Need: Intellectual and Friendly Dialogue Agents grounding Knowledge and Persona

Jungwoo Lim, Myunghoon Kang, Yuna Hur, Seungwon Jung, Jinsung Kim, Yoonna Jang, Dongyub Lee, Hyesung Ji, Donghoon Shin, Seungryong Kim, Heuiseok Lim

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.CL

Comments Accepted at Findings of EMNLP 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.01392 2023-01-05 cs.LG cs.AI 62%

Benchmarks and Algorithms for Offline Preference-Based Reward Learning

Daniel Shin, Anca D. Dragan, Daniel S. Brown

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments Transactions on Machine Learning Research. arXiv admin note: text overlap with arXiv:2107.09251

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.01379 2023-01-05 cs.AI cs.LG 62%

A Succinct Summary of Reinforcement Learning

Sanjeevan Ahilan

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏