arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 15756 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 15756 篇

2409.13373 2024-09-23 cs.AI cs.CL 62%

LLMs Still Can't Plan; Can LRMs? A Preliminary Evaluation of OpenAI's o1 on PlanBench

Karthik Valmeekam, Kaya Stechly, Subbarao Kambhampati

专题命中 Agent评测 :planning(abstract);分类 cs.AI、cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.05175 2024-09-20 cs.CR cs.CL cs.LG 62%

AirGapAgent: Protecting Privacy-Conscious Conversational Agents

Eugene Bagdasarian, Ren Yi, Sahra Ghalebikesabi, Peter Kairouz, Marco Gruteser, Sewoong Oh, Borja Balle, Daniel Ramage

专题命中 Agent评测 :agent(abstract);分类 cs.CL、cs.LG

Comments at CCS'24

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.08069 2024-09-19 cs.LG cs.AI 62%

Explore-Go: Leveraging Exploration for Generalisation in Deep Reinforcement Learning

Max Weltevrede, Felix Kaubek, Matthijs T. J. Spaan, Wendelin Böhmer

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16426 2024-09-18 cs.LG cs.AI cs.SY eess.SY 62%

Fault Detection for agents on power grid topology optimization: A Comprehensive analysis

Malte Lehna, Mohamed Hassouna, Dmitry Degtyar, Sven Tomforde, Christoph Scholz

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments 11 Pages plus references and appendix. The appendix consist of additional material of the paper and is not included in the initial submission. The paper was presented at the ECML workshop ML4SPS

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.00765 2024-09-18 cs.LG cs.AI cs.SY eess.SY 62%

Managing power grids through topology actions: A comparative study between advanced rule-based and reinforcement learning agents

Malte Lehna, Jan Viebahn, Christoph Scholz, Antoine Marot, Sven Tomforde

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments 12 pages plus references and appendix, 11 figures, submitted to the journal Energy and AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.09040 2024-09-17 cs.HC cs.AI cs.CL 62%

ChatSUMO: Large Language Model for Automating Traffic Scenario Generation in Simulation of Urban MObility

Shuyang Li, Talha Azfar, Ruimin Ke

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.08386 2024-09-16 cs.MA cs.AI cs.CL cs.CR cs.DC 62%

Self-Supervised Inference of Agents in Trustless Environments

Vladyslav Larin, Ivan Nikitin, Alexander Firsov

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.18209 2024-09-13 cs.LG cs.AI cs.RO 62%

Long and Short-Term Constraints Driven Safe Reinforcement Learning for Autonomous Driving

Xuemin Hu, Pan Chen, Yijun Wen, Bo Tang, Long Chen

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.07808 2024-09-13 cs.CV cs.AI cs.LG cs.RO 62%

What Matters to Enhance Traffic Rule Compliance of Imitation Learning for End-to-End Autonomous Driving

Hongkuan Zhou, Wei Cao, Aifen Sui, Zhenshan Bing

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments 14 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.04641 2024-09-10 cs.LG cs.AI 62%

Stacked Universal Successor Feature Approximators for Safety in Reinforcement Learning

Ian Cannon, Washington Garcia, Thomas Gresavage, Joseph Saurine, Ian Leong, Jared Culbertson

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.00622 2024-09-04 cs.CV cs.AI cs.LG 62%

Roundabout Dilemma Zone Data Mining and Forecasting with Trajectory Prediction and Graph Neural Networks

Manthan Chelenahalli Satish, Duo Lu, Bharatesh Chakravarthi, Mohammad Farhadi, Yezhou Yang

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.15077 2024-09-04 cs.CL cs.AI cs.GT 62%

Eliciting Informative Text Evaluations with Large Language Models

Yuxuan Lu, Shengwei Xu, Yichi Zhang, Yuqing Kong, Grant Schoenebeck

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.CL

Comments Accepted by the Twenty-Fifth ACM Conference on Economics and Computation (EC'24)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.00285 2024-08-26 cs.AI cs.LG cs.RO 62%

iMTSP: Solving Min-Max Multiple Traveling Salesman Problem with Imperative Learning

Yifan Guo, Zhongqiang Ren, Chen Wang

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments 8 pages, 3 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.09462 2024-08-21 cs.AI cs.LG 62%

A Framework for Empowering Reinforcement Learning Agents with Causal Analysis: Enhancing Automated Cryptocurrency Trading

Rasoul Amirzadeh, Dhananjay Thiruvady, Asef Nazari, Mong Shan Ee

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08925 2024-08-20 cs.IR cs.AI cs.CL cs.HC 62%

Retail-GPT: leveraging Retrieval Augmented Generation (RAG) for building E-commerce Chat Assistants

Bruno Amaral Teixeira de Freitas, Roberto de Alencar Lotufo

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.CL

Comments 5 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.17243 2024-08-19 cs.LG cs.AI 62%

Surprise-Adaptive Intrinsic Motivation for Unsupervised Reinforcement Learning

Adriana Hugessen, Roger Creus Castanyer, Faisal Mohamed, Glen Berseth

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments Published at the Reinforcement Learning Conference 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.05799 2024-08-15 cs.CL cs.AI cs.MA q-fin.GN 62%

Designing Heterogeneous LLM Agents for Financial Sentiment Analysis

Frank Xing

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.CL

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.02930 2024-08-07 cs.LG cs.AI 62%

The Need for a Big World Simulator: A Scientific Challenge for Continual Learning

Saurabh Kumar, Hong Jun Jeon, Alex Lewandowski, Benjamin Van Roy

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments Accepted to the Finding the Frame Workshop at RLC 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.00823 2024-08-06 cs.CL cs.AI cs.MA 62%

WorkBench: a Benchmark Dataset for Agents in a Realistic Workplace Setting

Olly Styles, Sam Miller, Patricio Cerda-Mardini, Tanaya Guha, Victor Sanchez, Bertie Vidgen

专题命中 Agent评测 :planning(abstract);分类 cs.AI、cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.00278 2024-08-01 cs.RO cs.AI cs.CV cs.LG 62%

PerAct2: Benchmarking and Learning for Robotic Bimanual Manipulation Tasks

Markus Grotz, Mohit Shridhar, Tamim Asfour, Dieter Fox

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.20506 2024-07-31 cs.LG cs.AI 62%

Boosting Efficiency in Task-Agnostic Exploration through Causal Knowledge

Yupei Yang, Biwei Huang, Shikui Tu, Lei Xu

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments This paper was accepted by IJCAI'24

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.20466 2024-07-31 cs.LG cs.AI 62%

A Method for Fast Autonomy Transfer in Reinforcement Learning

Dinuka Sahabandu, Bhaskar Ramasubramanian, Michail Alexiou, J. Sukarno Mertoguno, Linda Bushnell, Radha Poovendran

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.19456 2024-07-31 cs.LG cs.AI 62%

A Survey of Imitation Learning Methods, Environments and Metrics

Nathan Gavenski, Felipe Meneguzzi, Michael Luck, Odinaldo Rodrigues

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.17974 2024-07-30 cs.CL cs.AI 62%

Recent Trends in Personalized Dialogue Generation: A Review of Datasets, Methodologies, and Evaluations

Yi-Pei Chen, Noriki Nishida, Hideki Nakayama, Yuji Matsumoto

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.CL

Comments Presented in LREC-COLING 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.12126 2024-07-29 cs.CL cs.AI 62%

LLMs-in-the-loop Part-1: Expert Small AI Models for Bio-Medical Text Translation

Bunyamin Keles, Murat Gunay, Serdar I. Caglar

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.CL

Comments 14 pages, 2 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.15050 2024-07-23 cs.LG cs.AI cs.CR cs.MM 62%

Arondight: Red Teaming Large Vision Language Models with Auto-generated Multi-modal Jailbreak Prompts

Yi Liu, Chengjun Cai, Xiaoli Zhang, Xingliang Yuan, Cong Wang

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments To be published in ACM MM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.14940 2024-07-23 cs.CL cs.LG cs.SD eess.AS 62%

Conversational Rubert for Detecting Competitive Interruptions in ASR-Transcribed Dialogues

Dmitrii Galimzianov, Viacheslav Vyshegorodtsev

专题命中 Agent评测 :agent(abstract);分类 cs.CL、cs.LG

Comments 9 pages, 1 figure, 3 tables

Journal ref Computer Science & Information Technology (CS & IT), ISSN : 2231 - 5403, Volume 14, Number 13, June 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.12178 2024-07-23 cs.LG cs.AI stat.ML 62%

Exploration Unbound

Dilip Arumugam, Wanqiao Xu, Benjamin Van Roy

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments Accepted to the Finding the Frame Workshop at RLC 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.14361 2024-07-23 cs.LG cs.AI 62%

Auxiliary task discovery through generate-and-test

Banafsheh Rafiee, Sina Ghiassian, Jun Jin, Richard Sutton, Jun Luo, Adam White

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.14262 2024-07-22 cs.LG cs.AI math.OC 62%

Hyperparameter Optimization for Driving Strategies Based on Reinforcement Learning

Nihal Acharya Adde, Hanno Gottschalk, Andreas Ebert

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

Comments Submitted and accepted by LOD24 conference https://lod2024.icas.events/

详情

展开后加载摘要…

URL PDF HTML 收藏