arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 1239 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 1239 篇

2607.27039 2026-07-30 math.OC q-fin.MF 新提交 50%

Forcing and duality-corrected contracts for volatility control

用于波动率控制的强制型和对偶修正型合约

Alessandro Chiusolo, Emma Hubert, Dylan Possamaï, Nizar Touzi

专题命中 Agent评测 :agent(abstract)

AI总结 本文针对带漂移和波动率控制的连续时间委托代理问题,在指出现有方法最优性假设局限性的基础上,提出两类通用合约形式以修正对偶间隙,为波动率控制下的最优激励构建提供更通用方案。

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26438 2026-07-30 quant-ph 新提交 50%

Quantum Optical Reinforcement Learning via Spectrum-Resolved Hong-Ou-Mandel Interference

基于光谱分辨Hong-Ou-Mandel干涉的量子光学强化学习

Shaojun Wu, Jiahua Xu, Shan Jin, Zhen Yang, Yifang Xu, Chenglong You, Guangwei Deng, Luyan Sun, Chang-Ling Zou, Xiaoting Wang

专题命中 Agent评测 :agent(abstract)

AI总结 本文提出光谱分辨Hong-Ou-Mandel干涉架构,构建光学Actor-Critic智能体,在5个连续控制基准任务中性能优于多层感知器基线,还成功实现Transmon量子比特可调耦合门的在线校准,保真度恢复效果优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25568 2026-07-29 cs.GT 新提交 50%

Network Reciprocity Shapes Evolutionary Cybersecurity Dynamics

网络互惠塑造进化网络安全动态

Adeela Bashir, Zia Ush Shamszaman, Zhao Song, The Anh Han

专题命中 Agent评测 :agent(abstract)

AI总结 研究人工智能辅助网络安全系统中群体结构对攻防动态的影响。提出混合角色进化博弈框架,结合随机进化分析与模拟。发现交互结构是关键决定因素,局部网络交互组织防御主体可提升网络长期弹性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25131 2026-07-29 cs.HC q-bio.NC 新提交 50%

Beyond the Post Hoc User Study: Modeling Visual Decision-Making with Active Inference

超越事后用户研究:用主动推理对视觉决策进行建模

Harrison J. Goldwyn, Graham Johnson, Christopher Ibarra, Lace Padilla, Kenny Gruchalla

专题命中 Agent评测 :agent(abstract)

AI总结 研究旨在填补可视化解释机制空白,用主动推理将认知理论转化为模拟。以柱状图平均估计任务为例实现两类主体,分析其易出现的偏差及产生的认知痕迹,为可视化解释机制假设提供框架,支持更优的计算机模拟评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24826 2026-07-29 cs.IR cs.MA 新提交 50%

Aethel: A Reproducible Graph-Retrieval Framework for Multi-Hop Financial Diligence

Aethel:用于多跳金融尽职调查的可重现图检索框架

Krish Sapru

专题命中 Agent评测 :agent(abstract)

AI总结 针对二级私募股权交易中财务披露信息综合难题,Aethel框架结合二分个性化PageRank图检索等技术,将语料库建模为实体-段落图。在多跳金融尽职调查任务中,该框架在特定数据集上有较好表现,优势依赖语料库规模和实体索引质量,且发布相关工件保证可重现性。

Comments 11 pages, 3 figures, 2 tables. Includes evaluations on MuSiQue, 2WikiMultiHopQA, and a 4,123-chunk financial-disclosure corpus. Code and evaluation artifacts are available for reproducibility

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25475 2026-07-29 physics.soc-ph nlin.AO q-bio.PE 新提交 50%

Coevolution of epidemic dynamics and network topology driven by disease fatality and waning immunity

由疾病致死率和免疫力下降驱动的流行病动力学与网络拓扑结构的共同演化

ThankGod I. S. Ikpe, Takayuki Hiraoka, Naoya Fujiwara

专题命中 Agent评测 :agent(abstract)

AI总结 研究流行病动力学与网络拓扑的相互作用,开发基于主体模型,发现模型会经历流行病转变,网络可能失去无标度特性,通过异质平均场近似验证结果,凸显网络演化在流行病模型中的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25458 2026-07-29 cs.SI cs.CY nlin.AO 新提交 50%

Resilience: Understand Breakdown, Foster Recovery, and Choose the Right Perspective

恢复力:理解崩溃、促进恢复并选择正确视角

Frank Schweitzer

专题命中 Agent评测 :agent(abstract)

AI总结 研究恢复力,区分两种系统动态,指出崩溃常自我造成且正反馈有正负作用。认为易变系统中恢复力是主体交互的涌现属性,需数据驱动方法,模型显示恢复力是稳健性与适应性的妥协,二阶解决方案更有前景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22885 2026-07-28 cs.CR 新提交 50%

ReCon: A Resource-Constrained Benchmark for LLM-Based Cybersecurity Compliance Across Ingestion and Retrieval Pipelines

ReCon:用于跨摄取和检索管道的基于大语言模型的网络安全合规性的资源受限基准测试

Rohit Negi, Rishik Jain, Soumyo V Chakarborty, Amit Negi, Sandeep K Shukla

专题命中 Agent评测 :agentic(abstract)

AI总结 研究政府、企业和机构网络安全合规问题,利用无需GPU和高内存的大语言模型进行合规检查任务基准测试,实验证明低资源大语言模型在政策文件合规检查中可提供良好一致性/准确性。

Comments 22 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22132 2026-07-27 cs.SI 新提交 50%

On the Fragility of Majority Illusions

论多数错觉的脆弱性

Maaike Venema-Los, Zoé Christoff, Serte Donderwinkel, Davide Grossi

专题命中 Agent评测 :agent(abstract)

AI总结 研究社交网络中多数错觉的脆弱性,通过考虑主体观点随时间变化的网络及规模增大的随机图序列两种情况,发现多数错觉在多数更新下会消失,且出现可能性趋于零。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21960 2026-07-27 cs.RO 新提交 50%

Adaptive Undulatory Locomotion of Snake-like Robots in Dynamic Viscous Environments via Deep Reinforcement Learning

通过深度强化学习实现蛇形机器人在动态粘性环境中的自适应波动运动

Tsuyoshi Kimoto, Akio Yamano, Kohei Honda, Takashi Iwasa

专题命中 Agent评测 :agent(abstract)

AI总结 研究蛇形机器人在动态粘性环境中的自适应运动,利用深度强化学习,通过非对称演员 - 评论家框架及特权信息提炼,使机器人获得非正弦自适应步态,提高推进速度和运输效率,突破传统控制极限。

Comments 23 pages, 6 figures. Submitted to a journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21630 2026-07-27 cs.NE 新提交 50%

Evolving Self-Organising Agents Without Fitness: Three Falsifiable Experiments from Constraint-Driven Selection to Developmental Encoding

无适应度的自组织智能体演化:从约束驱动选择到发育编码的三个可证伪实验

Anushka Sharma

专题命中 Agent评测 :agent(abstract)

AI总结 研究在无设计者指定适应度函数时生物发育进化动力学能否产生,通过Genesis平台进行三个实验周期,测试可证伪假设,得出约束驱动选择、智能体介导生态位构建及CPPN间接编码相关结果,还产生了诊断工具和协议。

Comments GECCO Companion '26 Workshop Paper (EvoSelf/ESO Workshop), July 13-17, 2026, San Jose, Costa Rica. 3 pages. ACM ISBN 979-8-4007-2488-6/2026/07

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21890 2026-07-27 math.OC 新提交 50%

Stackelberg Games with a Robust Leader

具有稳健领导者的斯塔克尔伯格博弈

Juan Li, Jianfeng Zhang, Zimu Zhu

专题命中 Agent评测 :agent(abstract)

AI总结 研究具有一个领导者和多个追随者的斯塔克尔伯格博弈,稳健领导者考虑最坏情况,通过弱形式将问题转化为零和博弈,利用HJB方程刻画,还指出委托代理问题是其特殊情况。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20782 2026-07-24 q-bio.TO 新提交 50%

A Bayesian-optimization framework coupling a multiphase PDE tumor model to efficiently design combination therapy schedules

一种将多相偏微分方程肿瘤模型耦合的贝叶斯优化框架,以有效设计联合治疗方案

Ioannis Lampropoulos, Yorgos Psarellis, Michail Kavousanakis

专题命中 Agent评测 :agent(abstract)

AI总结 研究如何设计联合癌症治疗方案,提出将多相偏微分方程肿瘤模拟器与贝叶斯优化框架耦合的方法,可在少量昂贵模拟中找到最优治疗方案,应用于三个临床场景,提供了可转移的设计优化方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21471 2026-07-24 cs.CV 新提交 50%

Future Rendering $\neq$ Future Surface: A Benchmark and Dataset for Dynamic Surface Reconstruction Beyond the Observed Window

未来渲染≠未来表面:超越观察窗口的动态表面重建基准和数据集

Yukun Shi, Minglun Gong

机构 * University of Guelph(圭尔夫大学)

专题命中 Agent评测 :planning(abstract)

AI总结 研究针对动态场景重建中未来表面重建缺乏标准基准的问题,引入FutureSurf基准和数据集,通过特定训练与评分方式评估方法,发现现有主干在受控运动及多个场景中有差距,且未来渲染质量与表面精度解耦。

Comments See https://github.com/Ricky-S/futuresurf

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21072 2026-07-24 cs.CV 新提交 50%

Show, Don't Tell: Evaluating Spatial Cognition in Generative Pixels Rather Than LLM Text

展示而非讲述:在生成像素而非语言模型文本中评估空间认知

Xu Wang, Kaixiang Yao, Miao Pan, Xiaohe Zhou, Xuanyu Liu, Wenqi Zhang, Xuhong Zhang

机构 * Zhejiang University(浙江大学)

专题命中 Agent评测 :agentic(abstract)

AI总结 研究图像生成模型空间认知评估问题,提出ProVisE框架及SpatialGen - Bench基准,通过统一设置评估相关模型,发现图像生成模型在像素空间直接外化答案时有竞争力,文本输出语言模型在组合空间推理中有优势,揭示了两者互补优势并建立测试平台。

Comments 36 pages, 14 figures. Project page: https://zju-omniai.github.io/ProVisE/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21046 2026-07-24 cs.GT 新提交 50%

Discrete Truthful Heterogeneous Two-Facility Location: The Line and Beyond

离散真实异构双设施选址:在线性图及其他图上的研究

Panagiotis Kanellopoulos, Alexandros A. Voudouris

专题命中 Agent评测 :agent(abstract)

AI总结 研究离散异构双设施选址的确定性防策略机制,针对线性图设计最优\(4/3\)近似机制填补比率差距,在线性图外为连通图设计\(2\)近似机制并证明\(K_{1,3}\)下界为\(3/2\)。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21215 2026-07-24 quant-ph 新提交 50%

Quantum Circuit Fragments and Link Products in Continuous Variables

连续变量中的量子电路片段与链接积

Amalina Lai, Graeme D. Berk, Minjeong Song, Mile Gu

专题命中 Agent评测 :agent(abstract)

AI总结 研究连续变量中的量子电路片段,引入相关链接积构建框架,在高斯区域简化形式体系,可从模块化组件构建非马尔可夫过程等,扩展量子梳工具包,为相关量子信息任务提供系统方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21029 2026-07-24 astro-ph.GA 新提交 50%

Dissecting the multiple-component outflow in NGC 5548 with absorption-line Variability

用吸收线变率剖析 NGC 5548 中的多成分外流

Yaqi Chen, Zhicheng He, Guilin Liu

专题命中 Agent评测 :agent(abstract)

AI总结 研究利用吸收线变率方法结合多光谱数据估算 NGC 5548 中紫外外流成分径向距离,通过分析吸收线变率探测率曲线测量复合时标,确定各成分位置,结果与文献相符,展现新方法有效性。

Journal ref Yaqi Chen et al 2026 ApJ 997 245

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20196 2026-07-23 cs.GT 新提交 50%

Improved Lower Bounds and Output Augmentation for Facility Location Mechanisms

设施选址机制的改进下界与输出增强

Rafael Gomes, Sophie Klumper, Guido Schäfer, Jens Schlöter

专题命中 Agent评测 :agent(abstract)

AI总结 研究平等主义目标下战略设施选址问题,证明防策略机制近似比渐近下界,给出双代理随机近似机制;考虑输出增强框架,设计不同设置下的确定性或随机近似机制,展现输出增强可替代随机性及成组防策略特性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17502 2026-07-21 q-fin.MF q-fin.PR 新提交 50%

Mean-field equilibrium price formation under single-default risk

单一违约风险下的均值场均衡价格形成

Masashi Sekine

专题命中 Agent评测 :agent(abstract)

AI总结 研究不完全金融市场中单一违约风险下的均衡价格形成,通过二次增长倒向随机微分方程刻画参与者最优策略,推导出均值场二次增长BSDE,量化相关因素对风险溢价的影响,建立短时可解性并证明风险溢价渐近使市场出清。

Comments 46 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18139 2026-07-21 econ.TH cs.GT 新提交 50%

1-out-of-5 Maximin-Share Allocations Always Exist for Four Agents

对于四个代理,五选一最大最小份额分配总是存在

Christoph Schwerdtfeger

专题命中 Agent评测 :agent(abstract)

AI总结 研究四个具有非负加法估值代理的五选一最大最小份额分配问题,通过平衡剩余划分引理证明其总是存在并改进了保证,刻画了该情况下的条件,且定理经机器验证。

Comments 8 pages. The complete Lean 4 formalization (kernel-checked; axioms: propext, Classical.choice, Quot.sound) is included in the ancillary files

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17811 2026-07-21 cs.GT 新提交 50%

When One Good Is Not Enough: EF1 and Pareto Optimality Are Not Compatible for Submodular Valuations

当一种商品不够用时:对于次模估值,EF1与帕累托最优不兼容

Simon Mackenzie, Mashbat Suzuki

专题命中 Agent评测 :agent(abstract)

AI总结 研究离散公平分配中EF1与PO对于次模估值是否兼容的问题,通过构建反例表明二者不兼容,确定不可能边界,找到恢复兼容性的条件,量化坚持EF1时的效率损失。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17640 2026-07-21 cs.MA cs.SY econ.GN eess.SY q-fin.EC 新提交 50%

A Digital Twin-Based Method for Evaluating Local Collective Tariffs in Distribution-Level Energy Systems

一种基于数字孪生的配电网级能源系统局部集体电价评估方法

Kristoffer Christensen, Bo Nørregaard Jørgensen, Zheng Grace Ma

专题命中 Agent评测 :agent(abstract)

AI总结 针对配电网级能源系统电价机制评估需求,提出基于数字孪生的方法,整合多种建模与抽象,应用于丹麦局部集体电价评估,揭示其对成本及时间对齐的影响,为分析比较电价结构提供基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17423 2026-07-21 cs.CV 新提交 50%

TimeLens2: Generalist Video Temporal Grounding with Multimodal LLMs

TimeLens2:使用多模态大语言模型进行通用视频时间定位

Yuhan Zhu, Changlian Ma, Xiangyu Zeng, Xinhao Li, Zhiqiu Zhang, Songze Li, Jun Zhang, Tianxiang Jiang, Yuandong Yang, Ziang Yan, Zikang Wang, Xinyu Chen, Haoran Chen, Shaowei Zhang, Limin Wang

机构 * Nanjing University(南京大学) Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学) University of Science and Technology of China(中国科学技术大学) Fudan University(复旦大学)

专题命中 Agent评测 :agent(abstract)

AI总结 研究通用视频时间定位问题,TimeLens2将时间证据视为区间集,通过多种策略构建多跨度监督,其时间瓦瑟斯坦奖励等方法提供反馈,在多个基准测试中表现出色,不同变体均有性能提升。

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16542 2026-07-21 cs.NE 新提交 50%

From Optimal Policies to Individual Differences: Rethinking Reinforcement Learning for Biology

从最优策略到个体差异:重新思考用于生物学的强化学习

Patrick Govoni, Palina Bartashevich, Clémence Bergerot, Valerii Chirkov, Valentin Lecheval, Pawel Romanczuk

专题命中 Agent评测 :agent(abstract)

AI总结 研究指出强化学习虽用于解释生物行为,但存在个体间行为变异性差距,当前模型多呈现单一最佳个体或群体平均。通过研究强化学习各子领域方法,探索利用生物学合理机制产生行为多样性、缩小生物与模拟差距的潜在路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18126 2026-07-21 quant-ph cs.CR 新提交 50%

CutBackdoor: A Circuit Cut Triggered Backdoor Attack on Variational Quantum Algorithms

CutBackdoor:一种对变分量子算法的电路切割触发后门攻击

Ahatesham Bhuiyan, Hoang Ngo, Cheng Chu, Qian Lou, Lei Jiang, My T. Thai, Mengxin Zheng

专题命中 Agent评测 :workflow(abstract)

AI总结 研究针对变分量子算法,提出CutBackdoor这一参数供应链后门攻击方法,利用CutQC的切割电路执行触发,在有限次电路切割执行下,中毒参数增加切割路径重建误差,经多基准测试验证,放大切割路径能量,划定攻击结构边界。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15963 2026-07-20 cs.HC 新提交 50%

A Human-Centric Evaluation of a Retrieval-Augmented Generation System for Explaining Quebec Insurance Contracts

以用户为中心对用于解释魁北克保险合同的检索增强生成系统的评估

David Beauchemin, Richard Khoury

专题命中 Agent评测 :agent(abstract)

AI总结 研究针对在线保险销售中消费者面临的‘建议差距’问题,对用于解释魁北克汽车保险合同的检索增强生成系统进行以用户为中心的评估,通过用户研究得出系统被视为‘认知均衡器’,但也有局限性,凸显人在回路框架在高风险消费金融中实施AI的重要性。

Comments Accepter to HCII 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15782 2026-07-20 cs.CR cs.AR 新提交 50%

Vogls: a Fast Interactive Full-timing Simulator for Pre-silicon Power Side-Channel Analysis

Vogls:用于硅前功率侧信道分析的快速交互式全时序模拟器

Gijs Burghoorn, Ileana Buhan, Lejla Batina

专题命中 Agent评测 :workflow(abstract)

AI总结 研究针对侧信道分析中现有模拟器不足的问题,提出Vogls模拟器。它结合编译代码性能、全时序仿真及细粒度控制,有Python接口和高效跟踪收集工作流程,在案例研究中能在多抽象级别成功恢复密钥。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15862 2026-07-20 math.OC 新提交 50%

PriEco-DRL: Joint Optimization of Electric-Bus Eco-Driving and Transit-Priority Adaptive Signals via Deep Reinforcement Learning

PriEco-DRL:基于深度强化学习的电动公交生态驾驶与公交优先自适应信号联合优化

Dingshan Sun, Ang Li, Chaopeng Tan, Zicheng Su, Wanjing Ma, Marco Rinaldi

专题命中 Agent评测 :agent(abstract)

AI总结 本文提出PriEco-DRL框架,运用深度强化学习将电动公交生态驾驶与公交优先自适应信号控制相结合,采用优先级加权最大压力控制器及结构化奖励,经集中训练和分散执行,实验表明其能降低电动公交能耗,实现能量-时间权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15113 2026-07-17 cs.DS cs.DM 新提交 50%

A lower bound of 4 for online graph exploration

在线图探索的4的下界

Julia Baligacs

专题命中 Agent评测 :agent(abstract)

AI总结 研究在线图探索问题,通过证明对智能体行为施加限制不影响竞争比,得出该问题竞争比至少为4,改进了此前10/3的最好下界,还表明某些图属性可在不影响竞争比时被假设。

Comments to appear in LATIN 2026

详情

展开后加载摘要…

URL PDF HTML 收藏