arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 15866 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 15866 篇

2308.09975 2024-12-10 cs.CL 57%

FinEval: A Chinese Financial Domain Knowledge Evaluation Benchmark for Large Language Models

Xin Guo, Haotian Xia, Zhaowei Liu, Hanyang Cao, Zhi Yang, Zhiqiang Liu, Sizhe Wang, Jinyi Niu, Chuqi Wang, Yanhui Wang, Xiaolong Liang, Xiaoming Huang, Bing Zhu, Zhongyu Wei, Yun Chen, Weining Shen, Liwen Zhang

专题命中 Agent评测 :agent(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.15026 2024-12-09 cs.AR cs.AI 57%

Benchmarking End-To-End Performance of AI-Based Chip Placement Algorithms

Zhihai Wang, Zijie Geng, Zhaojie Tu, Jie Wang, Yuxi Qian, Zhexuan Xu, Ziyan Liu, Siyuan Xu, Zhentao Tang, Shixiong Kai, Mingxuan Yuan, Jianye Hao, Bin Li, Yongdong Zhang, Feng Wu

专题命中 Agent评测 :workflow(abstract);分类 cs.AI

Comments A comprehensive benchmark for AI-based chip placement algorithms using end-to-end performance metrics

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04368 2024-12-06 cs.LG 57%

Finer Behavioral Foundation Models via Auto-Regressive Features and Advantage Weighting

Edoardo Cetin, Ahmed Touati, Yann Ollivier

专题命中 Agent评测 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03767 2024-12-06 cs.LG stat.ML 57%

Hyper: Hyperparameter Robust Efficient Exploration in Reinforcement Learning

Yiran Wang, Chenshu Liu, Yunfan Li, Sanae Amani, Bolei Zhou, Lin F. Yang

专题命中 Agent评测 :agent(abstract);分类 cs.LG

Comments arXiv admin note: text overlap with arXiv:1907.05388 by other authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02266 2024-12-04 cs.LG 57%

BOTracle: A framework for Discriminating Bots and Humans

Jan Kadel, August See, Ritwik Sinha, Mathias Fischer

专题命中 Agent评测 :agent(abstract);分类 cs.LG

Comments Bot Detection; User Behaviour Analysis; Published at ESORICS International Workshops 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00751 2024-12-03 cs.AI 57%

Rethinking Cognition: Morphological Info-Computation and the Embodied Paradigm in Life and Artificial Intelligence

Gordana Dodig-Crnkovic

专题命中 Agent评测 :agent(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07094 2024-12-02 cs.LG cs.IT math.IT 57%

Differentially-Private Collaborative Online Personalized Mean Estimation

Yauhen Yakimenka, Chung-Wei Weng, Hsuan-Yin Lin, Eirik Rosnes, Jörg Kliewer

专题命中 Agent评测 :agent(abstract);分类 cs.LG

Comments Presented in part at the 2023 IEEE International Symposium on Information Theory (ISIT)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17353 2024-11-27 cs.LG q-fin.CP 57%

Joint Combinatorial Node Selection and Resource Allocations in the Lightning Network using Attention-based Reinforcement Learning

Mahdi Salahshour, Amirahmad Shafiee, Mojtaba Tefagh

专题命中 Agent评测 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16262 2024-11-26 cs.AI q-bio.NC 57%

Probing for Consciousness in Machines

Mathis Immertreu, Achim Schilling, Andreas Maier, Patrick Krauss

专题命中 Agent评测 :agent(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15396 2024-11-26 cs.IR cs.AI cs.HC 57%

The Decoy Dilemma in Online Medical Information Evaluation: A Comparative Study of Credibility Assessments by LLM and Human Judges

Jiqun Liu, Jiangen He

专题命中 Agent评测 :AI agent(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07679 2024-11-21 cs.LG cs.GT 57%

Safe Exploitative Play with Untrusted Type Beliefs

Tongxin Li, Tinashe Handina, Shaolei Ren, Adam Wierman

专题命中 Agent评测 :agent(abstract);分类 cs.LG

Comments 26 pages, NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08272 2024-11-21 cs.GT cs.LG 57%

Is Knowledge Power? On the (Im)possibility of Learning from Strategic Interactions

Nivasini Ananthakrishnan, Nika Haghtalab, Chara Podimata, Kunhe Yang

专题命中 Agent评测 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.01441 2024-11-21 q-fin.TR cs.LG 57%

Learning the Market: Sentiment-Based Ensemble Trading Agents

Andrew Ye, James Xu, Vidyut Veedgav, Yi Wang, Yifan Yu, Daniel Yan, Ryan Chen, Vipin Chaudhary, Shuai Xu

专题命中 Agent评测 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.10809 2024-11-19 cs.LG 57%

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay

Feng Chen, Fuguang Han, Cong Guan, Lei Yuan, Zhilong Zhang, Yang Yu, Zongzhang Zhang

专题命中 Agent评测 :agent(abstract);分类 cs.LG

Comments 10 pages, 3 figures, 1 table, inclusion at ICLR 2024 Workshop on Generative Models for Decision Making

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.13545 2024-11-19 cs.CL 57%

IQA-EVAL: Automatic Evaluation of Human-Model Interactive Question Answering

Ruosen Li, Ruochen Li, Barry Wang, Xinya Du

专题命中 Agent评测 :agent(abstract);分类 cs.CL

Comments Accepted by NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.08318 2024-11-15 cs.LG 57%

No-Regret Learning of Nash Equilibrium for Black-Box Games via Gaussian Processes

Minbiao Han, Fengxue Zhang, Yuxin Chen

专题命中 Agent评测 :agent(abstract);分类 cs.LG

Comments 40th Conference on Uncertainty in Artificial Intelligence (UAI 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07700 2024-11-13 cs.LG 57%

Test Where Decisions Matter: Importance-driven Testing for Deep Reinforcement Learning

Stefan Pranger, Hana Chockler, Martin Tappler, Bettina Könighofer

专题命中 Agent评测 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.04918 2024-11-13 cs.IR cs.AI 57%

Explicit and Implicit Semantic Ranking Framework

Xiaofeng Zhu, Thomas Lin, Vishal Anand, Matthew Calderwood, Eric Clausen-Brown, Gord Lueck, Wen-wai Yim, Cheng Wu

专题命中 Agent评测 :agent(abstract);分类 cs.AI

Journal ref Companion Proceedings of the ACM Web Conference 2023 (WWW '23 Companion), April 30-May 4, 2023, Austin, TX, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.04605 2024-11-08 cs.SE 57%

Mint: Cost-Efficient Tracing with All Requests Collection via Commonality and Variability Analysis

Haiyu Huang, Cheng Chen, Kunyi Chen, Pengfei Chen, Guangba Yu, Zilong He, Yilun Wang, Huxing Zhang, Qi Zhou

专题命中 Agent评测 :agent(abstract);分类 cs.SE

Comments Accepted by ASPLOS'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.20746 2024-11-07 cs.CL cs.CY cs.HC 57%

ElectionSim: Massive Population Election Simulation Powered by Large Language Model Driven Agents

Xinnong Zhang, Jiayu Lin, Libo Sun, Weihong Qi, Yihang Yang, Yue Chen, Hanjia Lyu, Xinyi Mou, Siming Chen, Jiebo Luo, Xuanjing Huang, Shiping Tang, Zhongyu Wei

专题命中 Agent评测 :agent(abstract);分类 cs.CL

Comments 42 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02654 2024-11-06 cs.GT cs.LG 57%

Fair and Welfare-Efficient Constrained Multi-matchings under Uncertainty

Elita Lobo, Justin Payan, Cyrus Cousins, Yair Zick

专题命中 Agent评测 :agent(abstract);分类 cs.LG

Comments 37 pages, 3 figures, to appear in NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.16486 2024-11-06 cs.LG 57%

Survival Multiarmed Bandits with Bootstrapping Methods

Peter Veroutis, Frédéric Godin

专题命中 Agent评测 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.01236 2024-11-05 cs.CR cs.AI 57%

AutoPT: How Far Are We from the End2End Automated Web Penetration Testing?

Benlong Wu, Guoqiang Chen, Kejiang Chen, Xiuwei Shang, Jiapeng Han, Yanru He, Weiming Zhang, Nenghai Yu

专题命中 Agent评测 :agent(abstract);分类 cs.AI

Comments 22 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.01121 2024-11-05 cs.CE cs.LG q-fin.PR 57%

Hedging and Pricing Structured Products Featuring Multiple Underlying Assets

Anil Sharma, Freeman Chen, Jaesun Noh, Julio DeJesus, Mario Schlener

专题命中 Agent评测 :agent(abstract);分类 cs.LG

Comments Workshop on Simulation of Financial Markets and Economic Systems

Journal ref 5th ACM International Conference on AI in Finance, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.00821 2024-11-05 cs.LG 57%

ROADFIRST: A Comprehensive Enhancement of the Systemic Approach to Safety for Improved Risk Factor Identification and Evaluation

Shriyan Reyya, Yao Cheng

专题命中 Agent评测 :planning(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.00572 2024-11-04 cs.OS cs.LG 57%

Enhancing Adaptive Mixed-Criticality Scheduling with Deep Reinforcement Learning

Bruno Mendes, Pedro F. Souto, Pedro C. Diniz

专题命中 Agent评测 :agent(abstract);分类 cs.LG

Comments Version submitted to RTNS 2024, on 17/08/2024 (with some typos fixed)

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.05344 2024-11-04 cs.RO cs.AI 57%

Recent Advances of Deep Robotic Affordance Learning: A Reinforcement Learning Perspective

Xintong Yang, Ze Ji, Jing Wu, Yu-kun Lai

专题命中 Agent评测 :agent(abstract);分类 cs.AI

Comments This paper is under review

Journal ref IEEE Transactions on Cognitive and Developmental Systems Volume: 15, Issue: 3, September 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.00522 2024-11-04 cs.LG cs.IT math.IT 57%

Analyzing Multimodal Integration in the Variational Autoencoder from an Information-Theoretic Perspective

Carlotta Langer, Yasmin Kim Georgie, Ilja Porohovoj, Verena Vanessa Hafner, Nihat Ay

专题命中 Agent评测 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.00171 2024-11-04 cs.LG math.OC 57%

EARL-BO: Reinforcement Learning for Multi-Step Lookahead, High-Dimensional Bayesian Optimization

Mujin Cheon, Jay H. Lee, Dong-Yeun Koh, Calvin Tsay

专题命中 Agent评测 :agent(abstract);分类 cs.LG

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.02827 2024-11-04 cs.LG cs.SY eess.SY 57%

PowerGraph: A power grid benchmark dataset for graph neural networks

Anna Varbella, Kenza Amara, Blazhe Gjorgiev, Mennatallah El-Assady, Giovanni Sansavini

专题命中 Agent评测 :planning(abstract);分类 cs.LG

Comments 21 pages, 8 figures, conference paper

详情

展开后加载摘要…

URL PDF HTML 收藏