arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-02-23 至 2026-02-23 共收录 8 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 8 篇

2602.18319 2026-02-23 cs.GR cs.AI cs.HC cs.LG 62%

Robo-Saber: Generating and Simulating Virtual Reality Players

Robo-Saber:生成和模拟虚拟现实玩家

Nam Hee Kim, Jingjing May Liu, Jaakko Lehtinen, Perttu Hämäläinen, James F. O'Brien, Xue Bin Peng

机构 * Aalto University(阿alto大学) University of California, Berkeley(加州大学伯克利分校) NVIDIA Simon Fraser University(西蒙弗雷泽大学)

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

AI总结 Robo-Saber通过生成和模拟虚拟现实玩家行为,为VR游戏测试提供了一种基于风格范例和数据集训练的运动生成系统。

Comments 13 pages, 15 figures. Accepted to Eurographics 2026. Project page: https://robo-saber.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18029 2026-02-23 cs.CL cs.AI 62%

Towards More Standardized AI Evaluation: From Models to Agents

迈向更标准化的AI评估:从模型到代理

Ali El Filali, Inès Bedar

机构 * G42

专题命中 Agent评测 :agentic(abstract);分类 cs.AI、cs.CL

AI总结 本文探讨了AI评估从模型向代理转变的必要性,强调评估应作为测量学科而非表演舞台,以在非确定性系统中调节信任和治理。

Comments 19 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17978 2026-02-23 cs.LG cs.AI 62%

Learning Optimal and Sample-Efficient Decision Policies with Guarantees

学习具有保证的最优和样本高效的决策策略

Daqian Shao

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种样本高效且具有保证的学习方法,用于在存在隐藏混杂因素的情况下学习最优决策策略,并通过实验验证了其在现实决策中的有效性。

Comments A thesis submitted for the degree of DPhil in Computer Science at Oxford

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02605 2026-02-23 cs.AI 57%

Adaptive GR(1) Specification Repair for Liveness-Preserving Shielding in Reinforcement Learning

自适应GR(1)规范修复用于强化学习中的存活保持防护

Tiberiu-Andrei Georgescu, Alexander W. Goodall, Dalal Alrajeh, Francesco Belardinelli, Sebastian Uchitel

机构 * Imperial College London(伦敦帝国理工学院) Universidad de Buenos Aires(布宜诺斯艾利斯大学)

专题命中 Agent评测 :agent(abstract);分类 cs.AI

AI总结 本文提出基于GR(1)规范的自适应防护框架,通过在线修复规范实现环境假设违反时的安全与存活保持。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04512 2026-02-23 math.NA cs.NA q-bio.CB 50%

Support Graph Preconditioners for Off-Lattice Cell-Based Models

支持图预置器用于非晶格细胞基模型

Justin Steinman, Andreas Buttenschön

专题命中 Agent评测 :agent(abstract)

AI总结 本研究提出了一种基于图的支持图预置器,用于提高非晶格细胞基模型中摩擦主导方程求解的效率和性能。

Journal ref SIAM Journal on Numerical Analysis, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.01506 2026-02-23 quant-ph physics.comp-ph 50%

Quantum noise modeling through Reinforcement Learning

通过强化学习建模量子噪声

Simone Bordoni, Andrea Papaluca, Piergiorgio Buttarini, Alejandro Sopena, Stefano Giagu, Stefano Carrazza

专题命中 Agent评测 :agent(abstract)

AI总结 本文提出利用强化学习建模量子噪声,通过模拟验证其有效性,并展示在量子算法研究中的应用。

Comments 13 pages, 9 figures

Journal ref Quantum Science and Technology, Volume 11, Number 1. Published 20 November 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17916 2026-02-23 cs.GT 50%

Robust Temporal Guarantees in Budgeted Sequential Auctions

预算序列拍卖中的鲁棒时间保证

Giannis Fikioris, Robert Kleinberg, Yoav Kolumbus, Yishay Mansour, Eva Tardos

专题命中 Agent评测 :agent(abstract)

AI总结 本文提出了一种预算序列拍卖的学习算法,保证代理在预算限制下获得稳定的胜利次数,具有鲁棒的时间保证特性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.06924 2026-02-23 cs.GT 50%

Maximizing Nash Social Welfare in 2-Value Instances: A Simpler Proof for the Half-Integer Case

在2值实例中最大化纳什社会福利:半整数情况的更简单证明

Kurt Mehlhorn

专题命中 Agent评测 :agent(abstract)

AI总结 本文提出在2值实例中通过更简单证明实现半整数情况下的纳什社会福利最大化。

Comments arXiv admin note: substantial text overlap with arXiv:2207.10949

详情

展开后加载摘要…

URL PDF HTML 收藏