arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 573 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 573 篇

2604.10383 2026-07-31 cs.CV 版本更新 50%

Authoring for Living Worlds: Tool-Constrained LLM Agents for Executable Multi-Actor Scenarios

代理视频生成:通过工具约束的LLM规划从文本到可执行事件图

Nicolae Cudlenco, Mihai Masala, Marius Leordeanu

机构 * Institute of Mathematics of the Romanian Academy(罗马尼亚科学院数学研究所) National University of Science and Technology Politehnica Bucharest(布加勒斯特理工大学) Büchi Labortechnik AG(布奇实验室技术股份公司)

专题命中 Agent评测 :agent(abstract)

AI总结 本文提出了一种代理系统,通过LLM生成结构化的事件图规范,并在3D引擎中确定性执行,解决了传统视频生成的语义可靠性问题,展示了在物理真实性和语义对齐上的优越表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.16443 2026-07-31 econ.GN q-fin.EC 版本更新 50%

The Turing Valley: How AI Capabilities Shape Labor Income

图灵谷:AI能力如何塑造劳动力收入

Enrique Ide, Eduard Talamàs

专题命中 Agent评测 :agent(abstract)

AI总结 本文研究AI能力在不同维度上如何影响劳动力收入,揭示了人类与AI沟通方式对劳动力市场的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20540 2026-07-31 econ.TH 版本更新 50%

Diagnostic Feedback under Hidden Task Difficulty

隐藏任务难度下的诊断反馈

Mark Izgarshev, Georgy Lukyanov

专题命中 Agent评测 :agent(abstract)

AI总结 该研究针对隐藏任务难度的场景,提出均衡精炼机制,可在特定条件下实现对困难任务的诊断,证明隐藏难度能生成智能体相关信息,且该机制适用于连续努力与不完美诊断的情况。

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.06947 2026-07-31 eess.IV cs.CV 版本更新 50%

BCNet: Bronchus Classification via Structure Guided Representation Learning

BCNet:基于结构引导表征学习的支气管分类

Wenhao Huang, Haifan Gong, Huan Zhang, Yu Wang, Xiang Wan, Haofeng Li, Guanbin Li, Hong Shen

专题命中 Agent评测 :planning(abstract)

AI总结 该研究针对自动支气管分类的个体拓扑差异挑战,提出结构引导的BCNet框架,在BronAtlas基准上F1分数超现有最优方法8%以上,还发布了支气管成像分析开放基准BronAtlas。

Comments The benchmark is available at https://osf.io/pskr9/?viewonly=94fa3d87274b4095ac9a4b88cc9a1341

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12214 2026-07-30 cs.CV 版本更新 50%

Robust 4D Driving Scene Reconstruction from Imperfect Visual Priors

超越完美先验:用于野外4D驾驶重建的自适应高斯图

Xiaoyun Dong, Qian Xu, Yun Wang, Yang Lu, Jen-Ming Wu, Jianping Wang

机构 * City University of Hong Kong(香港城市大学) Hon Hai Research Institute(鸿海研究院)

专题命中 Agent评测 :agent(abstract)

AI总结 研究针对野外4D驾驶场景重建,现有方法依赖精确先验,噪声先验下有问题。提出自适应高斯图(AGG)框架,含语义引导策略和自适应拓扑进化模块。在KITTI和Wild-30实验验证,AGG在视觉保真度和鲁棒性上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23321 2026-07-30 cs.IR 版本更新 50%

MMEB-V3: Measuring the Performance Gaps of Omni-Modality Embedding Models

MMEB-V3: 多模态嵌入模型性能差距的测量

Haohang Huang, Xuan Lu, Mingyi Su, Xuan Zhang, Ziyan Jiang, Ping Nie, Kai Zou, Tomas Pfister, Wenhu Chen, Wei Zhang, Xiaoyu Shen, Rui Meng

专题命中 Agent评测 :agent(abstract)

AI总结 本文提出MMEB-V3基准,评估文本、图像、视频、音频及基于代理的多模态嵌入,发现现有模型在跨模态检索中存在显著偏差和不足。

Comments Accepted at COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11509 2026-07-30 cs.GT cs.CC 版本更新 50%

On the Complexity of the Optimal Correlated Equilibria in Extensive-Form Games

扩展式博弈中最优相关均衡的复杂性

Vincent Cheval, Florian Horn, Soumyajit Paul, Mahsa Shirmohammadi

专题命中 Agent评测 :agent(abstract)

AI总结 该研究证明多人扩展式博弈中最优NFCE的阈值问题为PSPACE-难,AFCE的该问题为NP-难,确定了多类相关均衡阈值问题的NP-完全性,还将扩展式博弈中任意NE计算归入FixP。

Comments Technical report of paper published in The 26th ACM Conference on Economics and Computation (EC26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04748 2026-07-29 econ.TH 版本更新 50%

Honesty, Stigma, and Cooperation in an Overlapping-Generations Game

重叠世代博弈中的诚实、污名与合作

David Li, Georgy Lukyanov

专题命中 Agent评测 :agent(abstract)

AI总结 研究重叠世代博弈中诚实、污名与合作关系,通过纳入选择到均衡信念,分析不同情况下均衡状态,发现特定参数区域多种均衡共存,内部分支不稳定,还探讨了最大最小规则及记录清除对合作的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00288 2026-07-28 cs.RO cs.CV 版本更新 50%

UAV-ON: A Benchmark for Open-World Object Goal Navigation with Aerial Agents

UAV-ON:用于空中智能体的开放世界目标导航基准测试

Jianqiang Xiao, Yuexuan Sun, Yixin Shao, Boxi Gan, Rongqiang Liu, Yanjin Wu, Weili Guan, Xiang Deng

机构 * Harbin Institute of Technology(哈尔滨工业大学)

专题命中 Agent评测 :agent(abstract)

AI总结 介绍用于空中智能体开放世界目标导航的UAV-ON基准测试,含14个环境及1270个目标对象,通过实例级指令编码。实现多种基线方法评估,结果凸显空中导航和语义目标基础的复合挑战,推动复杂环境下无人机可扩展自主性研究。

Comments Accepted to ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19131 2026-07-27 cs.SI 版本更新 50%

Conspiracy Theory Rabbit Holes Emerge via Interacting Contagions

阴谋论兔子洞通过相互作用的传播出现

Fabian Tschofenig, Paul Vicinanza, Henrich Greve, Hayagreeva Rao, Douglas Guilbeault

专题命中 Agent评测 :agent(abstract)

AI总结 研究探讨人们陷入阴谋论兔子洞的原因,通过分析推文用序列风险模型等揭示阴谋论间相互作用及定居者效应,比较多种模型,发现传染病生态模型能重现相关动态,还表明防止阴谋论首次公开认可有重要作用。

Comments 49 pages, 13 figures, 5 tables, including supplementary appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04842 2026-07-27 cs.NI 版本更新 50%

Intelligent resource allocation in wireless networks via deep reinforcement learning

通过深度强化学习实现无线网络中的智能资源分配

Marie Diane Iradukunda, Chabi F. Elégbédé, Yaé Ulrich Gaba

专题命中 Agent评测 :agent(abstract)

AI总结 本文提出利用深度强化学习实现无线网络中智能资源分配,通过DQN智能体实现自适应功率控制,实验显示其在吞吐量和公平性方面优于传统方法。

Comments 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.14288 2026-07-27 cs.GT 版本更新 50%

Popular Matchings under Preference Variation and an Algorithm for Popular Common Bases with Integral Comparison Margins

偏好变化下的流行匹配以及具有整数比较边际的流行公共基算法

Gergely Csáji

专题命中 Agent评测 :agent(abstract)

AI总结 研究匹配市场中偏好变化下的流行匹配与优势匹配,给出单边市场相关多项式时间算法及双边市场流行匹配NP难、优势匹配在部分情况下易处理的结论,核心方法是扩展原始对偶水平算法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08202 2026-07-24 physics.soc-ph econ.GN q-fin.EC 版本更新 50%

Mean-Field Analytical Solution of the Mesa Boltzmann Wealth Model

梅萨玻尔兹曼财富模型的平均场解析解

Jiyuan Lyu

专题命中 Agent评测 :agent(abstract)

AI总结 研究梅萨玻尔兹曼财富模型的平均场版本,通过建立主方程和运用概率生成函数方法解析确定模型参数、推导稳态财富分布特性,数值模拟与理论吻合,为该模型提供解析基准供相关模拟参考。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04731 2026-07-23 cs.GT 版本更新 50%

Improved Approximation Guarantees for Groupwise Maximin Share Fairness

改进的群组最大最小份额公平性近似保证

Georgios Amanatidis, Anna Korfiati, Evangelos Markakis, Christodoulos Santorinaios

专题命中 Agent评测 :agent(abstract)

AI总结 针对可加性估值函数的不可分割商品公平分配问题,提出一种多项式时间算法,将群组最大最小份额(GMMS)的近似比改进为ϕ-1(ϕ≈1.618),并通过子实例分析证明该界渐近紧致。

Comments Accepted to the 19th International Symposium on Algorithmic Game Theory (SAGT 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30017 2026-07-23 math.PR 版本更新 50%

Conditional Probability Spaces and the Structure of Agreement

条件概率空间与一致性的结构

Erya Yang, Adam Brandenburger

专题命中 Agent评测 :agent(abstract)

AI总结 利用条件概率空间(Rényi, 1955)的框架,在一般条件下推导出Aumann(1976)的一致性定理,无需共同先验、信息划分、测度正性和知识算子等传统假设。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25824 2026-07-23 q-fin.MF 版本更新 50%

Mean-field game of mean-variance portfolio optimization with peer-based risk aversion

基于同伴相对风险厌恶的均值-方差投资组合管理的平均场博弈

Weilun Cheng, Zongxia Liang, Sheng Wang, Xiang Yu

专题命中 Agent评测 :agent(abstract)

AI总结 本文研究具有同伴相对风险厌恶的均值-方差投资组合管理的平均场博弈问题,通过平滑正则化和不动点论证证明了时间不一致平均场均衡的存在性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.14516 2026-07-23 cs.LO 版本更新 50%

Beyond the Spell: A Dynamic Logic Analysis of Misdirection

超越咒语:误导的动态逻辑分析

Benjamin Icard, Raul Fervari

专题命中 Agent评测 :agent(abstract)

AI总结 研究视觉误导,引入动态认知逻辑,既能表示对主体信念的言语误导,也能表示对主体观察的视觉误导,通过对“法式落物”建模说明逻辑动态性,还给出可靠完备公理系统并讨论相关特性。

Comments To appear in Journal of Applied Logics - IfCoLog Journal of Logics and their Applications, Volume 13, Number 4 (August 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.03793 2026-07-21 cs.GT 版本更新 50%

Honest Reporting in Scored Oversight: True-KL0 Property via the Prekopa Principle

评分监督中的诚实报告:通过普雷科帕原理的真KL0属性

Lauri Lovén

专题命中 Agent评测 :agent(abstract)

AI总结 研究评分激励机制中异构评分规则的真KL0属性,通过特定替换和对数凹性等工具证明,得出诚实报告是占优策略最优及相关定量结果,刻画了不同维度下真KL0属性的边界情况

Comments 30 pages. Manuscript prepared for Annals of Applied Probability. Certificate scripts and reference outputs archived at Zenodo, doi:10.5281/zenodo.21440507

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02101 2026-07-21 math.AP 版本更新 50%

A Mean-Field Game Model For Large-Scale Attrition in Attacker-Defender Systems

大规模攻击-防御系统中的均场博弈模型

Avetik Arakelyan, Tigran Bakaryan, Davit Alaverdyan, Naira Hovakimyan, Isaac Kaminer

专题命中 Agent评测 :agent(abstract)

AI总结 本文提出一种新的均场博弈框架,用于保护一个或多个高价值目标,通过统计距离建模群体性消耗,分析攻击-防御互动的最优策略与人口分布演化。

Comments keywords: Mean-field games, attacker-defender systems, attrition modeling, optimal transport, autonomous defense

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04231 2026-07-21 physics.soc-ph cs.MA q-bio.PE 版本更新 50%

Where Do We Poop? City-Wide Simulation of Defecation Behavior for Wastewater-Based Epidemiology

我们在哪里排便?基于废水流行病学的城市范围排便行为模拟

Hossein Amiri, Akshay Deverakonda, Yuke Wang, Andreas Züfle

专题命中 Agent评测 :agent(abstract)

AI总结 研究基于现有生活模式模型,引入地理空间模拟框架,结合传染病模型,考虑人口流动、厕所使用等因素,模拟废水病原体负荷时空动态,以佐治亚州富尔顿县为例进行研究,展示其对废水监测等方面的支持作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11695 2026-07-21 physics.flu-dyn cs.CV eess.IV math.OC 版本更新 50%

Particle Image Velocimetry Refinement via Consensus ADMM for Active Fluid Control

基于共识交替方向乘子法的粒子图像测速细化用于主动流体控制

Alan Bonomi, Francesco Banelli, Antonio Terpin

机构 * ETH Zürich(苏黎世联邦理工学院)

专题命中 Agent评测 :agent(abstract)

AI总结 研究针对传统粒子图像测速法及机器学习方法在流量量化中的不足,提出将其作为多估计器融合问题,采用基于交替方向乘子法的共识框架,经实验验证该方法能提升性能,并成功应用于实际主动流体控制中。

Comments Accepted for presentation at, and publication in the proceedings of, the 2026 65th IEEE Conference on Decision and Control (CDC). Code available at https://github.com/antonioterpin/flowgym

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11058 2026-07-21 math.OC math.PR 版本更新 50%

Kernel Metrics and Learning for Borel MDPs: Identifiability and Adaptive Control

博雷尔马尔可夫决策过程的核度量与学习:可识别性与自适应控制

Omar Mrani-Zentar, Serdar Yüksel

专题命中 Agent评测 :agent(abstract)

AI总结 研究标准博雷尔空间下未知转移核的马尔可夫决策过程,通过建立核拓扑关系等进行正则性分析,给出贝叶斯和经验的可识别性结果,用于设计近最优自适应控制策略,解决无先验参数表示的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.13370 2026-07-21 math.OC 版本更新 50%

Group Steering: Approaches Based on Power Moments

群体转向:基于幂矩的方法

Guangyu Wu, Anders Lindquist

专题命中 Agent评测 :agent(abstract)

AI总结 研究一大群由离散时间渐近稳定一阶线性系统控制的智能体的转向问题,提出用幂矩表征其密度函数或占有测度,通过矩系统表示、凸优化等实现控制,终端密度收敛,仿真验证算法。

Comments 11 pages, 6 figures. Portions of this work have been accepted by the IFAC World Congress 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14438 2026-07-20 cs.GT 版本更新 50%

Compensation Design

补偿设计

Ioannis Anagnostides, Kshipra Bhawalkar, Christopher Liaw, Aranyak Mehta, Renato Paes Leme, Yifeng Teng, Grigoris Velegkas, Weiqiang Zheng

专题命中 Agent评测 :agent(abstract)

AI总结 研究分散环境中补偿设计问题,提出简单无视成本且匿名的边际贡献支付规则,证明其在大市场情形下能保证纯纳什均衡存在且PoA至多为\(2 + o_{\lambda}(1)\),还扩展到粗相关均衡等多种情况并给出相应结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03676 2026-07-20 physics.soc-ph cond-mat.stat-mech 版本更新 50%

Entropy Geometry and Condensation in Wealth Allocation

熵几何与财富分配中的凝结现象

Korak Biswas

专题命中 Agent评测 :agent(abstract)

AI总结 本文提出了一种基于统计框架的财富分配模型,揭示了财富凝结现象的形成机制及开放系统中财富分配的动态平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03829 2026-07-20 physics.acc-ph hep-ex 版本更新 50%

First Experimental Demonstration of Reinforcement Learning-Based Tuning on the PSI Injector 2 Cyclotron

基于强化学习的PSI注入器2回旋加速器调谐的首次实验演示

M. Haj Tahar, W. Joho, E. Solodko, M. Bocchio, S. Marquie, M. Busch, A. Barchetti, J. Grillenberger, J. Snuverink, M. Schneider

专题命中 Agent评测 :agent(abstract)

AI总结 研究针对高功率质子回旋加速器束流调谐难题,开发基于机器学习的调谐框架,结合强化学习算法、实时诊断控制及加速器物理启发调整,经12天测试,实现多运行点调谐及策略泛化,是高功率回旋加速器强化学习辅助调谐的首次演示。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16495 2026-07-20 eess.SP 版本更新 50%

Performance Evaluation of High Power Microwave Systems Against UAVs A Probabilistic Antenna Propagation Framework with Sensitivity Analysis

高功率微波系统对无人机的性能评估:具有灵敏度分析的概率天线传播框架

Muhammad Khalil, Ke Wang, Jinho Choi

专题命中 Agent评测 :planning(abstract)

AI总结 研究高功率微波系统对无人机性能,提出含随机目标运动等因素的概率框架,耦合多种模型得出相关统计量,分析各因素影响,预测不同目标效能概率,支持系统规模确定、权衡分析及任务规划。

Comments 9

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08667 2026-07-17 cs.CR 版本更新 50%

X-rated Compliance Theater: An Empirical Evaluation of European Age Verification Systems in Adult Websites

X级合规剧场:欧洲成人网站年龄验证系统的实证评估

Simone Lavermicocca, Michele Carminati, Stefano Longari

专题命中 Agent评测 :workflow(abstract)

AI总结 本文首次实证评估欧洲成人网站强制部署的年龄验证机制,发现其在低成本攻击下存在系统性安全漏洞,并提出了缓解隐私与安全风险的设计方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15571 2026-07-17 cs.CC cs.LO math-ph math.CT math.MP 版本更新 50%

Thermodynamic Limits of Proof

物理计数的计算复杂性

Tristan Simas

专题命中 Agent评测 :agent(abstract)

AI总结 研究物理计数的计算复杂性,提出决策商 Q 作为最小抽象,并证明多个复杂性理论结果。

Comments Main PDF: 35 pages, 4 tables. Supplementary: 26 pages, 2 tables. Lean 4 release artifact available at https://doi.org/10.5281/zenodo.18140965

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15280 2026-07-17 cs.HC 版本更新 50%

Supporting Multimodal Data Interaction on Refreshable Tactile Displays: An Architecture to Combine Touch and Conversational AI

在可刷新触觉显示器上支持多模态数据交互:一种将触觉与对话式AI结合的架构

Samuel Reinders, Munazza Zaib, Matthew Butler, Bongshin Lee, Ingrid Zukerman, Lizhen Qu, Kim Marriott

专题命中 Agent评测 :agent(abstract)

AI总结 本文提出了一种结合触觉与对话式AI的架构,用于在可刷新触觉显示器上实现多模态数据交互,通过融合触觉输入与语音语言,提升视障人士的数据可视化体验。

Comments Accepted to be presented at IEEE PacificVis 2026; Best Paper Award (VisNotes track); Replacement: external DOI added

详情

展开后加载摘要…

URL PDF HTML 收藏