arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 15756 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 15756 篇

2110.12908 2022-04-19 cs.AI cs.HC cs.LG cs.SY eess.SY 73%

Learning to run a power network with trust

Antoine Marot, Benjamin Donnot, Karim Chaouache, Adrian Kelly, Qiuhua Huang, Ramij-Raja Hossain, Jochen L. Cremer

专题命中 Agent评测 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.08648 2022-03-17 cs.RO cs.AI cs.HC cs.LG q-bio.NC 73%

Artificial Intelligence Enables Real-Time and Intuitive Control of Prostheses via Nerve Interface

Diu Khue Luu, Anh Tuan Nguyen, Ming Jiang, Markus W. Drealan, Jian Xu, Tong Wu, Wing-kin Tam, Wenfeng Zhao, Brian Z. H. Lim, Cynthia K. Overstreet, Qi Zhao, Jonathan Cheng, Edward W. Keefer, Zhi Yang

专题命中 Agent评测 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2112.09169 2022-01-04 cs.AI cs.LG 73%

On Optimizing Interventions in Shared Autonomy

Weihao Tan, David Koleczek, Siddhant Pradhan, Nicholas Perello, Vivek Chettiar, Vishal Rohra, Aaslesha Rajaram, Soundararajan Srinivasan, H M Sajjad Hossain, Yash Chandak

专题命中 Agent评测 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.LG

Comments Accepted by AAAI2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.07699 2021-12-02 cs.RO cs.AI cs.LG cs.SY eess.SY 73%

Safe Autonomous Racing via Approximate Reachability on Ego-vision

Bingqing Chen, Jonathan Francis, Jean Oh, Eric Nyberg, Sylvia L. Herbert

专题命中 Agent评测 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.LG

Comments 17 pages, 15 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.03150 2021-11-02 cs.IR cs.AI cs.LG 73%

Recommendation Fairness: From Static to Dynamic

Dell Zhang, Jun Wang

专题命中 Agent评测 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

Comments A position paper for the FAccTRec-2021 workshop. Revised based on the reviewers' feedback. 6 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.13287 2021-10-27 cs.AI cs.CE cs.LG cs.MA q-fin.TR 73%

Towards Realistic Market Simulations: a Generative Adversarial Networks Approach

Andrea Coletta, Matteo Prata, Michele Conti, Emanuele Mercanti, Novella Bartolini, Aymeric Moulin, Svitlana Vyetrenko, Tucker Balch

专题命中 Agent评测 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

Comments 8 pages, 9 figures, ICAIF'21 - 2nd ACM International Conference on AI in Finance

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.07578 2021-09-17 cs.LG cs.AI cs.RO cs.SY eess.SY 73%

Multi-Task Learning with Sequence-Conditioned Transporter Networks

Michael H. Lim, Andy Zeng, Brian Ichter, Maryam Bandari, Erwin Coumans, Claire Tomlin, Stefan Schaal, Aleksandra Faust

专题命中 Agent评测 :agent(abstract);planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.06689 2021-09-15 cs.MA cs.AI cs.LG 73%

Reactive and Safe Road User Simulations using Neural Barrier Certificates

Yue Meng, Zengyi Qin, Chuchu Fan

专题命中 Agent评测 :agent(abstract);planning(abstract);分类 cs.AI、cs.LG

Comments Accepted at IROS 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.01445 2021-09-06 cs.NI cs.AI cs.LG 73%

Is Machine Learning Ready for Traffic Engineering Optimization?

Guillermo Bernárdez, José Suárez-Varela, Albert López, Bo Wu, Shihan Xiao, Xiangle Cheng, Pere Barlet-Ros, Albert Cabellos-Aparicio

专题命中 Agent评测 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

Comments To appear at IEEE ICNP 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.08170 2021-07-22 cs.LG cs.AI 73%

Megaverse: Simulating Embodied Agents at One Million Experiences per Second

Aleksei Petrenko, Erik Wijmans, Brennan Shacklett, Vladlen Koltun

专题命中 Agent评测 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

Comments Paper published in ICML2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.01825 2021-07-06 cs.LG cs.AI 73%

Sample Efficient Reinforcement Learning via Model-Ensemble Exploration and Exploitation

Yao Yao, Li Xiao, Zhicheng An, Wanpeng Zhang, Dijun Luo

专题命中 Agent评测 :agent(abstract);planning(abstract);分类 cs.AI、cs.LG

Comments 7 pages, 5 figures, accepted by IEEE International Conference on Robotics and Automation 2021 (IEEE ICRA 2021)

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.12895 2021-06-25 cs.LG cs.AI cs.RO 73%

rSoccer: A Framework for Studying Reinforcement Learning in Small and Very Small Size Robot Soccer

Felipe B. Martins, Mateus G. Machado, Hansenclever F. Bassani, Pedro H. M. Braga, Edna S. Barros

专题命中 Agent评测 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.11345 2021-06-23 cs.AI cs.HC cs.LG cs.MA 73%

Cogment: Open Source Framework For Distributed Multi-actor Training, Deployment & Operations

AI Redefined, Sai Krishna Gottipati, Sagar Kurandwad, Clodéric Mars, Gregory Szriftgiser, François Chabot

专题命中 Agent评测 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.LG

Comments 16 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.03216 2021-06-15 cs.LG cs.AI cs.MA 73%

Continuous Coordination As a Realistic Scenario for Lifelong Learning

Hadi Nekoei, Akilesh Badrinaaraayanan, Aaron Courville, Sarath Chandar

专题命中 Agent评测 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

Comments 19 pages with supplementary materials. Added results for Lifelong RL methods and some future work. Accepted to ICML 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.02930 2021-06-08 cs.CV cs.AI cs.LG cs.RO 73%

Spectral Temporal Graph Neural Network for Trajectory Prediction

Defu Cao, Jiachen Li, Hengbo Ma, Masayoshi Tomizuka

专题命中 Agent评测 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.LG

Comments ICRA 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2104.03311 2021-04-08 cs.LG cs.AI cs.CV cs.GR cs.RO 73%

PlasticineLab: A Soft-Body Manipulation Benchmark with Differentiable Physics

Zhiao Huang, Yuanming Hu, Tao Du, Siyuan Zhou, Hao Su, Joshua B. Tenenbaum, Chuang Gan

专题命中 Agent评测 :agent(abstract);planning(abstract);分类 cs.AI、cs.LG

Comments Accepted to ICLR 2021 as a spotlight presentation. Project page: http://plasticinelab.csail.mit.edu/

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.16985 2021-04-01 cs.LG cs.AI cs.MA cs.NI 73%

Energy Efficient Edge Computing: When Lyapunov Meets Distributed Reinforcement Learning

Mohamed Sana, Mattia Merluzzi, Nicola di Pietro, Emilio Calvanese Strinati

专题命中 Agent评测 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.08057 2021-03-16 cs.LG cs.AI cs.IR 73%

RecSim NG: Toward Principled Uncertainty Modeling for Recommender Ecosystems

Martin Mladenov, Chih-Wei Hsu, Vihan Jain, Eugene Ie, Christopher Colby, Nicolas Mayoraz, Hubert Pham, Dustin Tran, Ivan Vendrov, Craig Boutilier

专题命中 Agent评测 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.05079 2021-03-10 cs.LG cs.AI 73%

Domain-Robust Visual Imitation Learning with Mutual Information Constraints

Edoardo Cetin, Oya Celiktutan

专题命中 Agent评测 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.LG

Comments Presented at ICLR 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2012.05672 2021-01-22 cs.LG cs.AI cs.MA 73%

Imitating Interactive Intelligence

Josh Abramson, Arun Ahuja, Iain Barr, Arthur Brussee, Federico Carnevale, Mary Cassin, Rachita Chhaparia, Stephen Clark, Bogdan Damoc, Andrew Dudzik, Petko Georgiev, Aurelia Guy, Tim Harley, Felix Hill, Alden Hung, Zachary Kenton, Jessica Landon, Timothy Lillicrap, Kory Mathewson, Soňa Mokrá, Alistair Muldal, Adam Santoro, Nikolay Savinov, Vikrant Varma, Greg Wayne, Duncan Williams, Nathaniel Wong, Chen Yan, Rui Zhu

专题命中 Agent评测 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2101.07844 2021-01-21 cs.LG cs.AI cs.SY eess.SY 73%

Scalable Optimization for Wind Farm Control using Coordination Graphs

Timothy Verstraeten, Pieter-Jan Daems, Eugenio Bargiacchi, Diederik M. Roijers, Pieter J. K. Libin, Jan Helsen

专题命中 Agent评测 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2101.05507 2021-01-15 cs.LG cs.AI cs.HC cs.MA 73%

Evaluating the Robustness of Collaborative Agents

Paul Knott, Micah Carroll, Sam Devlin, Kamil Ciosek, Katja Hofmann, A. D. Dragan, Rohin Shah

专题命中 Agent评测 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1912.09729 2020-12-16 cs.AI cs.LG 73%

Mastering Complex Control in MOBA Games with Deep Reinforcement Learning

Deheng Ye, Zhao Liu, Mingfei Sun, Bei Shi, Peilin Zhao, Hao Wu, Hongsheng Yu, Shaojie Yang, Xipeng Wu, Qingwei Guo, Qiaobo Chen, Yinyuting Yin, Hao Zhang, Tengfei Shi, Liang Wang, Qiang Fu, Wei Yang, Lanxiao Huang

专题命中 Agent评测 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.LG

Comments AAAI 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2008.10134 2020-12-15 cs.CV cs.AI cs.LG 73%

m2caiSeg: Semantic Segmentation of Laparoscopic Images using Convolutional Neural Networks

Salman Maqbool, Aqsa Riaz, Hasan Sajid, Osman Hasan

专题命中 Agent评测 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.LG

Comments 16 pages, 5 figures, Code available at: https://github.com/salmanmaq/segmentationNetworks, Dataset available at: https://www.kaggle.com/salmanmaq/m2caiseg

详情

展开后加载摘要…

URL PDF HTML 收藏
2001.08299 2020-12-10 cs.AI cs.LG 73%

GLIB: Efficient Exploration for Relational Model-Based Reinforcement Learning via Goal-Literal Babbling

Rohan Chitnis, Tom Silver, Joshua Tenenbaum, Leslie Pack Kaelbling, Tomas Lozano-Perez

专题命中 Agent评测 :agent(abstract);planning(abstract);分类 cs.AI、cs.LG

Comments AAAI 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2011.02403 2020-11-05 cs.AI cs.LG cs.RO 73%

IDE-Net: Interactive Driving Event and Pattern Extraction from Human Data

Xiaosong Jia, Liting Sun, Masayoshi Tomizuka, Wei Zhan

专题命中 Agent评测 :agent(abstract);planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2002.11952 2020-10-02 cond-mat.mes-hall cs.AI cs.LG cs.RO 73%

Autonomous robotic nanofabrication with reinforcement learning

Philipp Leinen, Malte Esders, Kristof T. Schütt, Christian Wagner, Klaus-Robert Müller, F. Stefan Tautz

专题命中 Agent评测 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.LG

Comments 3 figures

Journal ref Sci. Adv. 6, eabb6987 (2020)

详情

展开后加载摘要…

URL PDF HTML 收藏
1908.09453 2020-09-29 cs.LG cs.AI cs.GT cs.MA 73%

OpenSpiel: A Framework for Reinforcement Learning in Games

Marc Lanctot, Edward Lockhart, Jean-Baptiste Lespiau, Vinicius Zambaldi, Satyaki Upadhyay, Julien Pérolat, Sriram Srinivasan, Finbarr Timbers, Karl Tuyls, Shayegan Omidshafiei, Daniel Hennes, Dustin Morrill, Paul Muller, Timo Ewalds, Ryan Faulkner, János Kramár, Bart De Vylder, Brennan Saeta, James Bradbury, David Ding, Sebastian Borgeaud, Matthew Lai, Julian Schrittwieser, Thomas Anthony, Edward Hughes, Ivo Danihelka, Jonah Ryan-Davis

专题命中 Agent评测 :agent(abstract);planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2008.13221 2020-09-01 cs.LG cs.AI cs.HC cs.RO stat.ML 73%

Human-in-the-Loop Methods for Data-Driven and Reinforcement Learning Systems

Vinicius G. Goecks

专题命中 Agent评测 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.LG

Comments PhD thesis, Aerospace Engineering, Texas A&M (2020). For more information, see https://vggoecks.com/

详情

展开后加载摘要…

URL PDF HTML 收藏
2008.04105 2020-08-11 cs.NI cs.AI cs.LG cs.MA 73%

Distributed Deep Reinforcement Learning for Functional Split Control in Energy Harvesting Virtualized Small Cells

Dagnachew Azene Temesgene, Marco Miozzo, Deniz Gündüz, Paolo Dini

专题命中 Agent评测 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

Comments Submitted to IEEE transaction on sustainable computing. arXiv admin note: text overlap with arXiv:1906.05735

详情

展开后加载摘要…

URL PDF HTML 收藏