arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 15866 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 15866 篇

2301.11396 2023-06-21 cs.LG 57%

Class-Incremental Learning with Repetition

Hamed Hemati, Andrea Cossu, Antonio Carta, Julio Hurtado, Lorenzo Pellegrini, Davide Bacciu, Vincenzo Lomonaco, Damian Borth

专题命中 Agent评测 :agent(abstract);分类 cs.LG

Comments Accepted to the 2nd Conference on Lifelong Learning Agents (CoLLAs), 2023 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.09490 2023-06-19 cs.DC cs.LG cs.NI cs.SY eess.SY 57%

Attention-based Open RAN Slice Management using Deep Reinforcement Learning

Fatemeh Lotfi, Fatemeh Afghah, Jonathan Ashdown

专题命中 Agent评测 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.12507 2023-06-16 cs.AI 57%

Distilling Internet-Scale Vision-Language Models into Embodied Agents

Theodore Sumers, Kenneth Marino, Arun Ahuja, Rob Fergus, Ishita Dasgupta

专题命中 Agent评测 :agent(abstract);分类 cs.AI

Comments 9 pages, 7 figures. Presented at ICML 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.05810 2023-06-12 cs.LG 57%

Explaining Reinforcement Learning with Shapley Values

Daniel Beechey, Thomas M. S. Smith, Özgür Şimşek

专题命中 Agent评测 :agent(abstract);分类 cs.LG

Comments 12 pages, 9 figures. Accepted at ICML 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.05769 2023-06-12 cs.LG 57%

Self-Paced Absolute Learning Progress as a Regularized Approach to Curriculum Learning

Tobias Niehues, Ulla Scheler, Pascal Klink

专题命中 Agent评测 :agent(abstract);分类 cs.LG

Comments 11 pages, 8 figures. The paper was a result from an Integrated Project at TU Darmstadt for which we received course credit (9 ECTS) and is not meant to be published elsewhere

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.04823 2023-06-09 cs.CL 57%

Data Augmentation for Improving Tail-traffic Robustness in Skill-routing for Dialogue Systems

Ting-Wei Wu, Fatemeh Sheikholeslami, Mohammad Kachuee, Jaeyoung Do, Sungjin Lee

专题命中 Agent评测 :agent(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.03532 2023-06-07 cs.AI cs.MA 57%

A Belief Model for Conflicting and Uncertain Evidence -- Connecting Dempster-Shafer Theory and the Topology of Evidence

Daira Pinto Prieto, Ronald de Haan, Aybüke Özgün

专题命中 Agent评测 :agent(abstract);分类 cs.AI

Comments To appear in the proceedings of KR 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.08059 2023-06-07 stat.ML cs.LG 57%

Fast Rates for Maximum Entropy Exploration

Daniil Tiapkin, Denis Belomestny, Daniele Calandriello, Eric Moulines, Remi Munos, Alexey Naumov, Pierre Perrault, Yunhao Tang, Michal Valko, Pierre Menard

专题命中 Agent评测 :agent(abstract);分类 cs.LG

Comments ICML-2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.03021 2023-06-06 cs.CV cs.LG 57%

Automating Style Analysis and Visualization With Explainable AI -- Case Studies on Brand Recognition

Yu-hsuan Chen, Levent Burak Kara, Jonathan Cagan

专题命中 Agent评测 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.15953 2023-06-06 cs.LG 57%

Timing is Everything: Learning to Act Selectively with Costly Actions and Budgetary Constraints

David Mguni, Aivar Sootla, Juliusz Ziomek, Oliver Slumbers, Zipeng Dai, Kun Shao, Jun Wang

专题命中 Agent评测 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.01324 2023-06-05 cs.LG 57%

Hyperparameters in Reinforcement Learning and How To Tune Them

Theresa Eimer, Marius Lindauer, Roberta Raileanu

专题命中 Agent评测 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.05911 2023-06-02 cs.LG stat.ML 57%

Model Transferability With Responsive Decision Subjects

Yatong Chen, Zeyu Tang, Kun Zhang, Yang Liu

专题命中 Agent评测 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.00242 2023-06-02 stat.ML cs.LG 57%

Combinatorial Neural Bandits

Taehyun Hwang, Kyuwook Chai, Min-hwan Oh

专题命中 Agent评测 :agent(abstract);分类 cs.LG

Comments Accepted in ICML 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.00149 2023-06-02 math.OC cs.LG 57%

Distributed Online Convex Optimization with Adversarial Constraints: Reduced Cumulative Constraint Violation Bounds under Slater's Condition

Xinlei Yi, Xiuxian Li, Tao Yang, Lihua Xie, Yiguang Hong, Tianyou Chai, Karl H. Johansson

专题命中 Agent评测 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.12839 2023-06-02 math.OC cs.DC cs.LG 57%

Decentralized Stochastic Bilevel Optimization with Improved per-Iteration Complexity

Xuxing Chen, Minhui Huang, Shiqian Ma, Krishnakumar Balasubramanian

专题命中 Agent评测 :agent(abstract);分类 cs.LG

Comments ICML 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.19861 2023-06-01 cs.AI 57%

Human Control: Definitions and Algorithms

Ryan Carey, Tom Everitt

专题命中 Agent评测 :agent(abstract);分类 cs.AI

Comments UAI 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.19453 2023-06-01 cs.GT cs.AI 57%

Best of Both Distortion Worlds

Vasilis Gkatzelis, Mohamad Latifian, Nisarg Shah

专题命中 Agent评测 :agent(abstract);分类 cs.AI

Comments EC'23

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.18269 2023-05-30 cs.AI cs.CY 57%

Doing the right thing for the right reason: Evaluating artificial moral cognition by probing cost insensitivity

Yiran Mao, Madeline G. Reinecke, Markus Kunesch, Edgar A. Duéñez-Guzmán, Ramona Comanescu, Julia Haas, Joel Z. Leibo

专题命中 Agent评测 :agent(abstract);分类 cs.AI

Comments 11 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.18071 2023-05-30 cs.AI cs.GT cs.MA 57%

Towards a Unifying Model of Rationality in Multiagent Systems

Robert Loftin, Mustafa Mert Çelikok, Frans A. Oliehoek

专题命中 Agent评测 :agent(abstract);分类 cs.AI

Comments 5 Pages, To appear in the OptLearnMAS Workshop at AAMAS 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.13192 2023-05-30 cs.LG stat.ML 57%

Differentially Private Federated Combinatorial Bandits with Constraints

Sambhav Solanki, Samhita Kanaparthy, Sankarshan Damle, Sujit Gujar

专题命中 Agent评测 :agent(abstract);分类 cs.LG

Comments 12 pages, 4 Figures, A version of this paper has appeared in the Proceedings of the ECML PKDD '22

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.17258 2023-05-30 cs.AI cs.HC cs.RO 57%

STL: Surprisingly Tricky Logic (for System Validation)

Ho Chit Siu, Kevin Leahy, Makai Mann

专题命中 Agent评测 :agent(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.12350 2023-05-30 cs.RO cs.LG cs.SY eess.SY 57%

Unsupervised Reward Shaping for a Robotic Sequential Picking Task from Visual Observations in a Logistics Scenario

Vittorio Giammarino, Andrew J Meyer, Kai Biegun

专题命中 Agent评测 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.07800 2023-05-30 cs.CL 57%

The Whole Truth and Nothing But the Truth: Faithful and Controllable Dialogue Response Generation with Dataflow Transduction and Constrained Decoding

Hao Fang, Anusha Balakrishnan, Harsh Jhamtani, John Bufe, Jean Crawford, Jayant Krishnamurthy, Adam Pauls, Jason Eisner, Jacob Andreas, Dan Klein

专题命中 Agent评测 :agent(abstract);分类 cs.CL

Comments Findings of ACL 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.17071 2023-05-29 cs.LG cs.CR cs.IR 57%

Adversarial Attacks on Online Learning to Rank with Click Feedback

Jinhang Zuo, Zhiyao Zhang, Zhiyong Wang, Shuai Li, Mohammad Hajiesmaili, Adam Wierman

专题命中 Agent评测 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.16924 2023-05-29 cs.AI 57%

Learning Interpretable Models of Aircraft Handling Behaviour by Reinforcement Learning from Human Feedback

Tom Bewley, Jonathan Lawry, Arthur Richards

专题命中 Agent评测 :agent(abstract);分类 cs.AI

Comments arXiv admin note: substantial text overlap with arXiv:2210.01007

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.16697 2023-05-29 cs.CL 57%

DKAF: KB Arbitration for Learning Task-Oriented Dialog Systems with Dialog-KB Inconsistencies

Vishal Vivek Saley, Rocktim Jyoti Das, Dinesh Raghu, Mausam

专题命中 Agent评测 :agent(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.12540 2023-05-29 eess.AS cs.AI cs.SD 57%

On the Efficacy and Noise-Robustness of Jointly Learned Speech Emotion and Automatic Speech Recognition

Lokesh Bansal, S. Pavankumar Dubagunta, Malolan Chetlur, Pushpak Jagtap, Aravind Ganapathiraju

专题命中 Agent评测 :agent(abstract);分类 cs.AI

Comments accepted to be part of INTERSPEECH 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.16078 2023-05-29 cs.LG cs.RO 57%

Behavior Estimation from Multi-Source Data for Offline Reinforcement Learning

Guoxi Zhang, Hisashi Kashima

专题命中 Agent评测 :agent(abstract);分类 cs.LG

Comments Accepted by AAAI 2023. Fixed errors in Fig. 4, Table 1, and Eq (6) in the camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.15621 2023-05-26 cs.LG 57%

Matrix Estimation for Offline Reinforcement Learning with Low-Rank Structure

Xumei Xi, Christina Lee Yu, Yudong Chen

专题命中 Agent评测 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.14990 2023-05-24 math.OC cs.LG cs.MA 57%

Bridging Mean-Field Games and Normalizing Flows with Trajectory Regularization

Han Huang, Jiajia Yu, Jie Chen, Rongjie Lai

专题命中 Agent评测 :agent(abstract);分类 cs.LG

Comments 36 pages, 22 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏