arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 15867 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 15867 篇

2106.06616 2022-02-23 cs.LG 57%

Learning Competitive Equilibria in Exchange Economies with Bandit Feedback

Wenshuo Guo, Kirthevasan Kandasamy, Joseph E Gonzalez, Michael I. Jordan, Ion Stoica

专题命中 Agent评测 :agent(abstract);分类 cs.LG

Comments Proceedings of The 25nd International Conference on Artificial Intelligence and Statistics; 32 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.10381 2022-02-22 cs.AI 57%

Rule Mining over Knowledge Graphs via Reinforcement Learning

Lihan Chen, Sihang Jiang, Jingping Liu, Chao Wang, Sheng Zhang, Chenhao Xie, Jiaqing Liang, Yanghua Xiao, Rui Song

专题命中 Agent评测 :agent(abstract);分类 cs.AI

Comments Knowledge-Based Systems

Journal ref KNOSYS_108371, 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.10137 2022-02-22 cs.CL eess.AS 57%

A new data augmentation method for intent classification enhancement and its application on spoken conversation datasets

Zvi Kons, Aharon Satt, Hong-Kwang Kuo, Samuel Thomas, Boaz Carmeli, Ron Hoory, Brian Kingsbury

专题命中 Agent评测 :agent(abstract);分类 cs.CL

Comments \c{opyright} 2022 IEEE. Personal use of this material is permitted. Permission from IEEE must be obtained for all other uses, in any current or future media, including reprinting/republishing this material for advertising or promotional purposes, creating new collective works, for resale or redistribution to servers or lists, or reuse of any copyrighted component of this work in other works

详情

展开后加载摘要…

URL PDF HTML 收藏
2201.11861 2022-02-22 cs.LG 57%

The Challenges of Exploration for Offline Reinforcement Learning

Nathan Lambert, Markus Wulfmeier, William Whitney, Arunkumar Byravan, Michael Bloesch, Vibhavari Dasagi, Tim Hertweck, Martin Riedmiller

专题命中 Agent评测 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2105.02331 2022-02-22 cs.AI 57%

Safety Enhancement for Deep Reinforcement Learning in Autonomous Separation Assurance

Wei Guo, Marc Brittain, Peng Wei

专题命中 Agent评测 :agent(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.09251 2022-02-18 cs.LG 57%

Offline Preference-Based Apprenticeship Learning

Daniel Shin, Daniel S. Brown, Anca D. Dragan

专题命中 Agent评测 :agent(abstract);分类 cs.LG

Comments ICML Workshop on Human-AI Collaboration in Sequential Decision-Making, 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.11278 2022-02-18 cs.LG cs.RO 57%

Deep Surrogate Q-Learning for Autonomous Driving

Maria Kalweit, Gabriel Kalweit, Moritz Werling, Joschka Boedecker

专题命中 Agent评测 :agent(abstract);分类 cs.LG

Comments Accepted at ICRA 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.02915 2022-02-17 cs.CL 57%

LadRa-Net: Locally-Aware Dynamic Re-read Attention Net for Sentence Semantic Matching

Kun Zhang, Guangyi Lv, Le Wu, Enhong Chen, Qi Liu, Meng Wang

专题命中 Agent评测 :agent(abstract);分类 cs.CL

Comments Accpeted by IEEE Transactions on Neural Networks and Learning Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.00509 2022-02-15 math.OC cs.LG 57%

Decentralized Stochastic Variance Reduced Extragradient Method

Luo Luo, Haishan Ye

专题命中 Agent评测 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.04842 2022-02-11 cs.SI cs.CL cs.CY physics.soc-ph 57%

Networks and Identity Drive Geographic Properties of the Diffusion of Linguistic Innovation

Aparna Ananthasubramaniam, David Jurgens, Daniel M. Romero

专题命中 Agent评测 :agent(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.03836 2022-02-09 cs.DC cs.LG math.OC 57%

An Improved Analysis of Gradient Tracking for Decentralized Machine Learning

Anastasia Koloskova, Tao Lin, Sebastian U. Stich

专题命中 Agent评测 :agent(abstract);分类 cs.LG

Comments published at NeurIPS 2021

Journal ref 35th Conference on Neural Information Processing Systems (NeurIPS 2021)

详情

展开后加载摘要…

URL PDF HTML 收藏
2112.02027 2022-02-09 q-bio.NC cs.LG 57%

Divergent representations of ethological visual inputs emerge from supervised, unsupervised, and reinforcement learning

Grace W. Lindsay, Josh Merel, Tom Mrsic-Flogel, Maneesh Sahani

专题命中 Agent评测 :agent(abstract);分类 cs.LG

Comments 23 total pages, 9 main figures, 8 Supplementary figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.03193 2022-02-08 cs.DC cs.LG cs.NI 57%

Network Resource Allocation Strategy Based on Deep Reinforcement Learning

Shidong Zhang, Chao Wang, Junsan Zhang, Youxiang Duan, Xinhong You, Peiying Zhang

专题命中 Agent评测 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.03040 2022-02-08 cs.CL 57%

Towards Learning Through Open-Domain Dialog

Eugénio Ribeiro, Ricardo Ribeiro, David Martins de Matos

专题命中 Agent评测 :agent(abstract);分类 cs.CL

Comments 6 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.02672 2022-02-08 cs.GT cs.AI 57%

(Almost) Envy-Free, Proportional and Efficient Allocations of an Indivisible Mixed Manna

Vasilis Livanos, Ruta Mehta, Aniket Murhekar

专题命中 Agent评测 :agent(abstract);分类 cs.AI

Comments 23 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.09159 2022-02-08 cs.LG cs.RO 57%

Automatic Curricula via Expert Demonstrations

Siyu Dai, Andreas Hofmann, Brian Williams

专题命中 Agent评测 :agent(abstract);分类 cs.LG

Comments NeurIPS 2021 Deep Reinforcement Learning Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.00355 2022-02-08 cs.CV cs.AI 57%

SUM: A Benchmark Dataset of Semantic Urban Meshes

Weixiao Gao, Liangliang Nan, Bas Boom, Hugo Ledoux

专题命中 Agent评测 :planning(abstract);分类 cs.AI

Comments 27 pages, 14 figures

Journal ref ISPRS Journal of Photogrammetry and Remote Sensing, Volume 179, September 2021, Pages 108-120

详情

展开后加载摘要…

URL PDF HTML 收藏
1810.08743 2022-02-07 cs.LG cs.MA stat.ML 57%

Quantifying the Burden of Exploration and the Unfairness of Free Riding

Christopher Jung, Sampath Kannan, Neil Lutz

专题命中 Agent评测 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.01040 2022-02-03 cs.AI 57%

Knowledge Engineering in the Long Game of Artificial Intelligence: The Case of Speech Acts

Marjorie McShane, Jesse English, Sergei Nirenburg

专题命中 Agent评测 :agent(abstract);分类 cs.AI

Comments Presented at The Ninth Advances in Cognitive Systems (ACS) Conference 2021 (arXiv:2201.06134)

详情

展开后加载摘要…

URL PDF HTML 收藏
2201.12163 2022-01-31 cs.LG stat.ML 57%

Biases in In Silico Evaluation of Molecular Optimization Methods and Bias-Reduced Evaluation Methodology

Hiroshi Kajino, Kohei Miyaguchi, Takayuki Osogami

专题命中 Agent评测 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2104.03692 2022-01-25 cs.GT cs.AI cs.SI 57%

Computation and Bribery of Voting Power in Delegative Simple Games

Gianlorenzo D'Angelo, Esmaeil Delfaraz, Hugo Gilbert

专题命中 Agent评测 :agent(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2201.08102 2022-01-24 cs.LG 57%

Safe Deep RL in 3D Environments using Human Feedback

Matthew Rahtz, Vikrant Varma, Ramana Kumar, Zachary Kenton, Shane Legg, Jan Leike

专题命中 Agent评测 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2201.07719 2022-01-20 cs.AI 57%

Improving Behavioural Cloning with Human-Driven Dynamic Dataset Augmentation

Federico Malato, Joona Jehkonen, Ville Hautamäki

专题命中 Agent评测 :agent(abstract);分类 cs.AI

Comments 6 pages, 5 figures, 2 code snippets, accepted at the AAAI-22 Workshop on Interactive Machine Learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2201.07226 2022-01-20 cs.SE 57%

Stepwise Migration of a Monolith to a Microservices Architecture: Performance and Migration Effort Evaluation

Diogo Faustino, Nuno Gonçalves, Manuel Portela, António Rito Silva

专题命中 Agent评测 :planning(abstract);分类 cs.SE

Comments 12 pages, 1 figure, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
1909.10371 2022-01-20 cs.AI cs.HC 57%

Towards Intelligent Interactive Theatre: Drama Management as a way of Handling Performance

Nic Velissaris, Jessica Rivera-Villicana

专题命中 Agent评测 :agent(abstract);分类 cs.AI

Comments International Conference on Interactive Digital Storytelling (ICIDS) 2019

Journal ref Interactive Storytelling. ICIDS 2019. Lecture Notes in Computer Science, vol 11869. Springer, Cham. pp 233-238

详情

展开后加载摘要…

URL PDF HTML 收藏
2201.06835 2022-01-19 cs.LG cs.DC 57%

Ray Based Distributed Autonomous Vehicle Research Platform

Derek Xu

专题命中 Agent评测 :agent(abstract);分类 cs.LG

Comments 15 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2006.14978 2022-01-14 cs.LG stat.ML 57%

Online 3D Bin Packing with Constrained Deep Reinforcement Learning

Hang Zhao, Qijin She, Chenyang Zhu, Yin Yang, Kai Xu

专题命中 Agent评测 :agent(abstract);分类 cs.LG

Comments AAAI 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.01854 2022-01-05 cs.LG 57%

Optimization-Based Algebraic Multigrid Coarsening Using Reinforcement Learning

Ali Taghibakhshi, Scott MacLachlan, Luke Olson, Matthew West

专题命中 Agent评测 :agent(abstract);分类 cs.LG

Comments Advances in Neural Information Processing Systems (NeurIPS2021)

Journal ref Advances in Neural Information Processing Systems (2021)

详情

展开后加载摘要…

URL PDF HTML 收藏
2201.00486 2022-01-04 cs.LG cs.GT cs.MA econ.GN q-fin.EC 57%

Using Non-Stationary Bandits for Learning in Repeated Cournot Games with Non-Stationary Demand

Kshitija Taywade, Brent Harrison, Judy Goldsmith

专题命中 Agent评测 :agent(abstract);分类 cs.LG

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2112.14338 2021-12-30 cs.GT cs.AI 57%

Socially-Optimal Mechanism Design for Incentivized Online Learning

Zhiyuan Wang, Lin Gao, Jianwei Huang

专题命中 Agent评测 :agent(abstract);分类 cs.AI

Journal ref IEEE INFOCOM 2022

详情

展开后加载摘要…

URL PDF HTML 收藏