arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 573 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 573 篇

2506.18873 2026-08-14 econ.TH 版本更新 50%

Broad Validity of the First-Order Approach in Moral Hazard

道德风险中一阶方法的广泛有效性

Eduardo Azevedo, Ilan Wolff

专题命中 Agent评测 :agent(abstract)

AI总结 该研究证明了在道德风险问题中,当代理人保留效用足够高时,一阶方法具有广泛有效性,并提供了最优合同的构造方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00484 2026-08-14 cs.GT cs.CC cs.DS 版本更新 50%

Satisfactory Budget Division

满意预算分配

Laurent Gourvès, Michael Lampis, Nikolaos Melissinos, Aris Pagourtzis

专题命中 Agent评测 :agent(abstract)

AI总结 该研究探讨可分割预算分配问题,以智能体对至少τ个项目的预算请求满足度为核心,分析相关问题的最大满足比例、实例类别、判定复杂性及最小总预算等内容。

Comments Accepted for AAMAS 2025 as an extended abstract

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23162 2026-08-13 cs.CY cs.CR cs.DC cs.ET econ.GN q-fin.EC 版本更新 50%

SolarChain: A Physics-Grounded Embodied IoT System for Verifiable Urban Solar Market Design

SolarChain:连接物理定律、可验证信任与可持续市场的城市能源韧性

Shilin Ou, Yifan Xu, Zhenshan Zhang, Luyao Zhang, Ming-Chun Huang

专题命中 Agent评测 :agent(abstract)

AI总结 提出SolarChain平台,通过基于热力学极限的物理验证和点对点市场机制,解决城市太阳能数据篡改和投机问题,实现可信交易与可持续投资。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27211 2026-08-13 cs.GT 版本更新 50%

Truthful-in-Expectation Mechanisms for MMS Approximation

期望 truthful 机制用于 MMS 近似

Moshe Babaioff, Uriel Feige, Noam Manaker Morag

专题命中 Agent评测 :agent(abstract)

AI总结 本文研究了在战略代理具有加性估值的情况下,如何公平分配不可分割物品。提出了一种期望 truthful 机制,保证每个代理获得其最大化最小份额的较大比例。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23783 2026-08-13 cs.CV 版本更新 50%

Diffusion Probe: Generated Image Result Prediction Using CNN Probes

扩散探针:利用CNN探针进行生成图像结果预测

Benlei Cui, Bukun Huang, Zhizeng Ye, Xuemei Dong, Tuo Chen, Hui Xue, Dingkang Yang, Longtao Huang, Jingqun Tang, Haiwen Hong

机构 * Alibaba Group(阿里巴巴集团) Laboratory for Statistical Monitoring and Intelligent Governance of Common Prosperity, School of Statistics and Data Science, Zhejiang Gongshang University(浙江工商大学统计与数据科学学院共同富裕统计监测与智能治理实验室) Southeast University(东南大学) College of Intelligent Robotics and Advanced Manufacturing, Fudan University(复旦大学智能机器人与先进制造学院) ByteDance Inc.(字节跳动有限公司)

专题命中 Agent评测 :agent(abstract)

AI总结 本文提出Diffusion Probe框架,通过早期扩散交叉注意力分布预测最终图像质量,提升文本生成图像的效率与质量。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09892 2026-08-12 cs.RO 版本更新 50%

XPolicyLab: A Unified Standard and Open Ecosystem for Robot Policy Evaluation and Deployment

XPolicyLab:用于机器人策略评估与部署的统一标准及开放生态系统

XPolicyLab Community, Tianxing Chen, Yue Chen, Tian Nian, Zijian Cai, Guangyu Chen, Wenwei Lin, Qiwei Liang, Zanxin Chen, Peicheng Xiang, Kailun Su, Zixuan Li, Junyuan Tang, Yan Qin, Qiangyu Chen, Shaolong Zhu, Xiang Li, Jiahao Zhang, Weijie Wan, Baijun Chen, Honghao Su, Kehe Ye, Shujia Liu, Kaixuan Wang, Haotian Liang, Yunze Liu, Mingleyang Li, Yuran Wang, Boyu Chen, Hongzhe Bi, Shuhe Huang, Hengkai Tan, Jisong Cai, Yao Mu, Jun Guo, Xiaofeng Wang, Zheng Zhu, Weijie Ke, Hengtao Li, Yuhang Tang, Xiaofan Li, Ganlin Yang, Zhangzheng Tu, Shuai Yang, Wenxuan Song, Pengxiang Ding, Kaidong Zhang, Yu Sun, Junliang Guo, Tong Zhang, Yixing Chen, Rongxu Cui, Zongzheng Zhang, Haoxiang Ma, Junhao Cai, Haoyu Zhang, Senqiao Yang, Jinhui Ye, Pengguang Chen, Shu Liu, Xiu Su, Wenhan Fang, Wenhao Li, Yichao Cao, Chengyao Wang, Qiang Chen, Ping Luo, Wenbo Ding

机构 * THU(清华大学)

专题命中 Agent评测 :agent(abstract)

AI总结 XPolicyLab是统一机器人策略评估与部署的开放生态系统,通过标准化接口降低集成成本,集成42个策略,可适配仿真与真实机器人,减少了策略与环境的适配工作量。

Comments Website: xpolicylab.github.io, Code: https://github.com/XPolicyLab/XPolicyLab

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07765 2026-08-12 eess.SY cs.SY 版本更新 50%

Information-Aware Model Predictive Control for Satellite Inspection

面向卫星巡检任务的信息感知模型预测控制

Sarah E. Clees, Sean Phillips, Christopher Petersen

专题命中 Agent评测 :agent(abstract)

AI总结 该研究提出信息感知MPC框架,将估计协方差纳入控制目标,通过数值模拟验证其能生成满足约束且主动降低目标估计协方差的卫星巡检轨迹。

Comments Presented at the 2026 AAS/AIAA Astrodynamics Specialist Conference in Whistler, BC, Canada. v2 - corrected title metadata, content remains unchanged

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24676 2026-08-11 cs.GT 版本更新 50%

The Degree of Strategy-Proofness for Risk-Averse Committee Selection

风险规避委员会选择的防策略性程度

Dael Sinay, Rica Gonen

专题命中 Agent评测 :agent(abstract)

AI总结 研究风险规避委员会选择的防策略性程度,将RAT程度框架扩展到基于批准的委员会选择,聚焦比例批准投票规则,通过建立界限表明其在不同选民选票知晓数量下对安全操纵的敏感性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23539 2026-08-11 cs.CY 版本更新 50%

Private Again: Artificial Intelligence Agents Restore Anonymity---Foreclosing Discrimination and Its Proof

再次私密:人工智能代理恢复匿名性——消除歧视及其证据

Anirban Mukherjee, Hannah Hanwen Chang

专题命中 Agent评测 :agent(abstract)

AI总结 研究人工智能代理恢复匿名性以消除歧视及证据问题,核心方法是代理介导交易使歧视缺乏输入信息与证据,主要贡献是促使法律将代理介导匿名性作为民权基础设施管理,应对相关挑战。

Comments Forthcoming, Stetson Law Review Forum (Summer 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07018 2026-08-11 cs.HC 版本更新 50%

Designing Youth Social Media through Problem Space Attunement

青少年社交媒体设计中的问题空间调适

JaeWon Kim

专题命中 Agent评测 :agent(abstract)

AI总结 本文通过三种问题空间失调(概念性、定义性、评价性)分析青少年社交媒体设计中的权力失衡,并提出虚构探究工作坊、Discord异步社区和LLM代理模拟沙盒等干预方法,以建立以青少年为中心的关系支持型社交媒体设计准则。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14162 2026-08-11 physics.geo-ph physics.ao-ph physics.data-an 版本更新 50%

An Attention-Based Stochastic Simulator for Multisite Extremes to Evaluate Nonstationary, Cascading Flood Risk

基于注意力机制的多站点极端事件随机模拟器用于评估非平稳级联洪水风险

Adam Nayak, Pierre Gentine, Upmanu Lall

专题命中 Agent评测 :planning(abstract)

AI总结 本文提出一种结合注意力机制的多站点洪水模拟框架,通过随机生成多变量洪水频率、强度和持续时间序列,评估非平稳级联洪水风险,为保险和财务规划提供可行的洪水风险模拟。

Journal ref Nayak, A., Gentine, P., and Lall, U. (2026). "Attention-Based Stochastic Simulation of Climate-Informed Spatiotemporal Flood Risk for Multisite Insurance Portfolios." Geophysical Research Letters, 53 (15)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20087 2026-08-11 econ.TH 版本更新 50%

Screening Frontiers

筛选前沿

Frank Yang

专题命中 Agent评测 :agent(abstract)

AI总结 本文研究了盈余弹性前沿在最优菜单中的作用,证明其在不同机制下的最优性,并应用于多个经济领域。

Comments 75 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.08552 2026-08-11 nlin.AO math.DS 版本更新 50%

Extreme vulnerability to intruder attacks destabilizes network dynamics

极端的入侵攻击对网络动态的脆弱性

Amirhossein Nazerian, Sahand Tangerami, Malbor Asllani, David Phillips, Hernan Makse, Francesco Sorrentino

专题命中 Agent评测 :agent(abstract)

AI总结 本文研究了网络中单个低度节点的入侵攻击如何破坏动态稳定性,挑战了传统对枢纽节点脆弱性的假设,并揭示了非线性网络中的脆弱性特征。

Comments Accepted for publication in Nature Communications

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06586 2026-08-11 cs.CY 版本更新 50%

Simulating Dispute Mediation with LLM-Based Agents for Legal Research

基于大语言模型智能体的争议调解模拟:面向法律研究

Junjie Chen, Haitao Li, Minghao Qin, Yujia Zhou, Yanxue Ren, Wuyue Wang, Yiqun Liu, Yueyue Wu, Qingyao Ai

专题命中 Agent评测 :agent(abstract)

AI总结 研究针对法律争议调解实证研究的局限,提出首个基于LLM的AgentMediation框架模拟争议调解,通过可控实验发现符合社会学理论的模式,为社科与AI在法律研究的融合提供平台。

Comments AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03638 2026-08-11 cs.DS 版本更新 50%

Stability Notions for Hospital Residents with Sizes

带容量的医院住院医生问题的稳定性概念

Haricharan Balasundaram, J B Krishnashree, Girija Limaye, Meghana Nasre

专题命中 Agent评测 :agent(abstract)

AI总结 本文针对带容量的医院住院医生问题(HRS)研究基于容量的稳定性,证明该类问题必存在对应稳定匹配,给出严格优于3的近似算法,还证明最大规模该匹配问题及稳定匹配判定问题的NP难性,并提出受限场景下的稳定匹配高效算法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.03713 2026-08-10 cs.AR cs.PF 版本更新 50%

SPEC CPU2026: Characterization, Representativeness, and Cross-Suite Comparison

SPEC CPU2026:特征、代表性及跨套件比较

Ruihao Li, Andrew Jacob, Neeraja J. Yadwadkar, Lizy K. John

专题命中 Agent评测 :agentic(abstract)

AI总结 本文研究SPEC CPU2026在九种平台上的性能特征,发现其相比2017版增加了指令量和内存占用,同时通过分析发现其在架构评估中可通过精简工作负载集保持高保真度,并通过与其他基准的比较展示其在通用计算中的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05939 2026-08-10 econ.TH 版本更新 50%

Rational Inattention to States and Choice Characteristics

对状态和特征的不注意

Christopher W. Engh

专题命中 Agent评测 :agent(abstract)

AI总结 本文提出一个理性不注意模型,通过施罗德桥问题和严格凹外问题,研究主体在获取成本信息时对状态和特征的不注意行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00364 2026-08-07 cs.GT cs.SI 版本更新 50%

Understanding Federated Learning Through the Lens of Mechanism Design: The Role of Data Heterogeneity

通过机制设计视角理解联邦学习:数据异质性的作用

Lina Alkarmi, Po-Yen Chen, Mingyan Liu

专题命中 Agent评测 :agent(abstract)

AI总结 该研究通过将经典外部性机制适配联邦学习场景,对比了夏普利值机制与外部性机制在社会最优性、个体理性等维度的表现,揭示了互惠公平与社会效率的权衡关系。

Comments Extended version (with full proofs) of a paper accepted at GameSec 2026. 29 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02450 2026-08-07 math.CO 版本更新 50%

Lower bounds for multivariate independence polynomials and their generalisations

多重独立多项式的下界及其推广

Joonkyung Lee, Jaehyeon Seo

专题命中 Agent评测 :agent(abstract)

AI总结 本文研究了多重独立多项式的下界及其推广,提出并证明了关于图的独立集的不等式,并推测该结果可推广至其他反铁磁模型。

Comments 17 pages. Clarify Section 3 and add a Lean formalisation of Theorem 1.4. See https://github.com/thegreatseo/multivar-indep-formalize for the GitHub repo

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22884 2026-08-07 econ.EM 版本更新 50%

Complementarities in Sparse Two-Sided Interaction Models

稀疏双边交互模型中的互补性

Federico Crippa

专题命中 Agent评测 :agent(abstract)

AI总结 本文针对仅实现潜在匹配稀疏子集的双边交互模型,引入含互补性参数的Tukey模型,提出基于周期的估计量并应用于世界银行经理-国家匹配,发现负向互补性,验证了能力强的经理在复杂环境中更具价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.01013 2026-08-07 quant-ph cond-mat.str-el hep-th 版本更新 50%

Running Quantum Computers in Discovery Mode

以发现模式运行量子计算机

Aydin Deger, Benedikt Placke, G. J. Sreejith, Alessio Lerose, S. L. Sondhi

专题命中 Agent评测 :agent(abstract)

AI总结 研究展示量子计算机与经典机器学习智能体协同运行,可通过定义兴趣函数调整电路,以高概率发现离散时间晶体等量子多体动力学新现象,确立了混合设备中兴趣函数设计的研究范式。

Comments 10 + 8 pages, 4+6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23112 2026-08-06 cs.CY 版本更新 50%

How Should AI Safety Benchmarks Benchmark Safety?

AI安全基准应该如何进行基准测试?

Cheng Yu, Severin Engelmann, Ruoxuan Cao, Dalia Ali, Orestis Papakyriakopoulos

专题命中 Agent评测 :workflow(abstract)

AI总结 本文提出改进AI安全基准的方法,通过系统回顾210个基准,指出其技术、知识论和社会技术缺陷,并提出稳健度量和风险管理原则以提升基准有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25459 2026-08-05 cs.RO 版本更新 50%

GS-Playground: A High-Throughput Photorealistic Simulator for Vision-Informed Robot Learning

GS-Playground:一种高吞吐量的视觉真实模拟器用于基于视觉的机器人学习

Yufei Jia, Heng Zhang, Ziheng Zhang, Junzhe Wu, Mingrui Yu, Zifan Wang, Dixuan Jiang, Zheng Li, Chenyu Cao, Zhuoyuan Yu, Xun Yang, Haizhou Ge, Yuchi Zhang, Jiayuan Zhang, Zhenbiao Huang, Tianle Liu, Shenyu Chen, Jiacheng Wang, Bin Xie, Xuran Yao, Xiwa Deng, Guangyu Wang, Jinzhi Zhang, Lei Hao, Zhixing Chen, Yuxiang Chen, Anqi Wang, Hongyun Tian, Yiyi Yan, Zhanxiang Cao, Yizhou Jiang, Hanyang Shao, Yue Li, Lu Shi, Bokui Chen, Wei Sui, Hanqing Cui, Yusen Qin, Ruqi Huang, Lei Han, Tiancai Wang, Guyue Zhou

机构 * THU(清华大学) Motphys Dexmal DISCOVER Robotics HKUST(GZ)(香港科技大学(广州)) BIT(北京理工大学) NUS(新加坡国立大学) HITSZ(哈尔滨工业大学) XJTU(西安交通大学) NJU(南京大学) SJTU(上海交通大学) D-Robotics

专题命中 Agent评测 :workflow(abstract)

AI总结 GS-Playground通过高吞吐量的多模态模拟框架,结合高效物理引擎和3DGS渲染管道,提升视觉强化学习的效率,降低大规模视觉RL的门槛,实现感知与物理的无缝衔接。

Comments Robotics: Science and Systems 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00883 2026-08-05 cs.MM cs.CV cs.SD 版本更新 50%

Audio-Visual World Models: Learning Physically Grounded Multisensory Dynamics

视听世界模型:为具身智能体奠定多感官想象的基础

Jiahua Wang, Leqi Zheng, Jialong Wu, Yaoxin Mao, Shijie Cheng

机构 * Tsinghua University(清华大学) Beijing Institute of Technology(北京理工大学)

专题命中 Agent评测 :agent(abstract)

AI总结 提出视听世界模型(AVWM)统一框架,通过条件扩散Transformer(AV-CDiT)联合预测双耳音频与视觉动态,在30小时基准AVW-4k上实现高保真多模态预测,并验证其在具身导航中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
1510.08490 2026-08-05 cs.SI physics.soc-ph 版本更新 50%

Psychological Determinants and Consequences of Complex Networks

复杂网络的心理决定因素与后果

Jamil Civitarese, Fernanda Concatto, Cláudio Abreu

专题命中 Agent评测 :agent(abstract)

AI总结 该研究提出两个模型,分别将心理因素作为社会网络的决定因素与后果,基于Bianconi-Barabási网络和智能体方法,解释网络规模、外向性、年龄的关系及城市部落的出现。

Comments Old, dormant paper from my MSc that I never revisited and is trivial

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28415 2026-08-04 gr-qc 版本更新 50%

Long-lived quasinormal frequencies for regular black hole supported by the Einasto profile in the presence of the magnetic field

具有Einasto密度分布的正则黑洞在磁场作用下的长寿命拟正常频率

Milena Skvortsova

专题命中 Agent评测 :agent(abstract)

AI总结 研究磁场影响下基于Einasto密度分布的正则黑洞中标量场的拟正常模式、灰体因子及吸收截面,通过高阶WKB展开和Padé求和计算拟正常频率,并展示有效质量和Einasto参数变化对阻尼率的抑制作用。

Comments 12 pages, 7 figures, the mistakes have been corrected

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.06945 2026-08-04 cs.CV 版本更新 50%

Direct and Adaptable Mesh-Gaussian Scene Reconstruction from Multi-View Images

从多视图图像进行直接且可自适应的网格-高斯场景重建

Ancheng Lin, Tianqing Su, Zuo Yuan, Quanke Su, Samuel S. Mao, Yusheng Xiang

机构 * School of Computer Science, Australian Artificial Intelligence Institute (AAII)(计算机科学学院,澳大利亚人工智能研究所) University of Technology Sydney(悉尼技术大学) School of Automobile(汽车学院) Chang’an University(长安大学)

专题命中 Agent评测 :agent(abstract)

AI总结 该研究针对现有方法分离几何与外观建模的问题,提出端到端网格-高斯场景表示,实现直接联合学习,提升重建效率与质量,可高效适配局部场景修改,支撑具身智能相关环境维护。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31457 2026-08-03 cs.GT 版本更新 50%

Learning Fair Allocation of Indivisible Items from Limited Feedback

从有限反馈中学习不可分割物品的公平分配

Xinyu Liu, David Kempe, Evi Micha

专题命中 Agent评测 :agent(abstract)

AI总结 研究算法在未知估值下通过有限反馈学习公平分配不可分割物品的问题,提出基于椭球法的框架,在加性估值下多项式时间内找到EF1或PROP1分配,并在单调估值下保证多项式轮次内找到EF1分配。

Comments 42 pages, full version. Accepted to the ACM Conference on Economics and Computation (EC 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03105 2026-08-03 stat.AP cs.MA cs.SI physics.soc-ph 版本更新 50%

Computationally Efficient Estimation of Localized Treatment Effects for Multi-Level, Multi-Component Interventions to Address the Opioid Crisis

高效估算多层级多组件干预措施的局部治疗效应以应对阿片类药物危机

Abdulrahman A. Ahmed, M. Amin Rahimian, Qiushi Chen, Praveen Kumar

专题命中 Agent评测 :agent(abstract)

AI总结 本文提出一种双层元模型框架,通过两阶段序列设计高效采样,用于估算多层级干预措施的局部治疗效应,减少计算资源消耗,应用于估算巴比妥酸盐分发和纳洛酮分布对过量死亡率的影响。

Comments repository link: https://github.com/abdulrahmanfci/gpr-metamodel/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15114 2026-07-31 cs.IR cs.SI 版本更新 50%

CoSimRec: Measuring Coordinated-Content Penetration in Recommender Feedback Loops

CoSimRec:衡量推荐反馈循环中的协同内容渗透

Nan Li, Jiahong Shao, Jiuyang Lyu

专题命中 Agent评测 :agent(abstract)

AI总结 研究推荐反馈循环中协同内容渗透问题,提出CoSimRec离线代理评估框架,通过算法渗透率指标家族衡量相关情况,在多数据集和推荐器上评估,发现随机控制无显著正向渗透,基于流行度和反馈敏感排名有提升,同步感知排名降低APR。

Comments This work has been submitted to the IEEE for possible publication. Copyright may be transferred without notice, after which this version may no longer be accessible

详情

展开后加载摘要…

URL PDF HTML 收藏