Broad Validity of the First-Order Approach in Moral Hazard
道德风险中一阶方法的广泛有效性
专题命中 Agent评测 :agent(abstract)
AI总结 该研究证明了在道德风险问题中,当代理人保留效用足够高时,一阶方法具有广泛有效性,并提供了最优合同的构造方法。
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
道德风险中一阶方法的广泛有效性
专题命中 Agent评测 :agent(abstract)
AI总结 该研究证明了在道德风险问题中,当代理人保留效用足够高时,一阶方法具有广泛有效性,并提供了最优合同的构造方法。
满意预算分配
专题命中 Agent评测 :agent(abstract)
AI总结 该研究探讨可分割预算分配问题,以智能体对至少τ个项目的预算请求满足度为核心,分析相关问题的最大满足比例、实例类别、判定复杂性及最小总预算等内容。
Comments Accepted for AAMAS 2025 as an extended abstract
SolarChain:连接物理定律、可验证信任与可持续市场的城市能源韧性
专题命中 Agent评测 :agent(abstract)
AI总结 提出SolarChain平台,通过基于热力学极限的物理验证和点对点市场机制,解决城市太阳能数据篡改和投机问题,实现可信交易与可持续投资。
期望 truthful 机制用于 MMS 近似
专题命中 Agent评测 :agent(abstract)
AI总结 本文研究了在战略代理具有加性估值的情况下,如何公平分配不可分割物品。提出了一种期望 truthful 机制,保证每个代理获得其最大化最小份额的较大比例。
扩散探针:利用CNN探针进行生成图像结果预测
机构 * Alibaba Group(阿里巴巴集团) ; Laboratory for Statistical Monitoring and Intelligent Governance of Common Prosperity, School of Statistics and Data Science, Zhejiang Gongshang University(浙江工商大学统计与数据科学学院共同富裕统计监测与智能治理实验室) ; Southeast University(东南大学) ; College of Intelligent Robotics and Advanced Manufacturing, Fudan University(复旦大学智能机器人与先进制造学院) ; ByteDance Inc.(字节跳动有限公司)
专题命中 Agent评测 :agent(abstract)
AI总结 本文提出Diffusion Probe框架,通过早期扩散交叉注意力分布预测最终图像质量,提升文本生成图像的效率与质量。
Comments CVPR 2026
XPolicyLab:用于机器人策略评估与部署的统一标准及开放生态系统
机构 * THU(清华大学)
专题命中 Agent评测 :agent(abstract)
AI总结 XPolicyLab是统一机器人策略评估与部署的开放生态系统,通过标准化接口降低集成成本,集成42个策略,可适配仿真与真实机器人,减少了策略与环境的适配工作量。
Comments Website: xpolicylab.github.io, Code: https://github.com/XPolicyLab/XPolicyLab
面向卫星巡检任务的信息感知模型预测控制
专题命中 Agent评测 :agent(abstract)
AI总结 该研究提出信息感知MPC框架,将估计协方差纳入控制目标,通过数值模拟验证其能生成满足约束且主动降低目标估计协方差的卫星巡检轨迹。
Comments Presented at the 2026 AAS/AIAA Astrodynamics Specialist Conference in Whistler, BC, Canada. v2 - corrected title metadata, content remains unchanged
风险规避委员会选择的防策略性程度
专题命中 Agent评测 :agent(abstract)
AI总结 研究风险规避委员会选择的防策略性程度,将RAT程度框架扩展到基于批准的委员会选择,聚焦比例批准投票规则,通过建立界限表明其在不同选民选票知晓数量下对安全操纵的敏感性。
再次私密:人工智能代理恢复匿名性——消除歧视及其证据
专题命中 Agent评测 :agent(abstract)
AI总结 研究人工智能代理恢复匿名性以消除歧视及证据问题,核心方法是代理介导交易使歧视缺乏输入信息与证据,主要贡献是促使法律将代理介导匿名性作为民权基础设施管理,应对相关挑战。
Comments Forthcoming, Stetson Law Review Forum (Summer 2026)
青少年社交媒体设计中的问题空间调适
专题命中 Agent评测 :agent(abstract)
AI总结 本文通过三种问题空间失调(概念性、定义性、评价性)分析青少年社交媒体设计中的权力失衡,并提出虚构探究工作坊、Discord异步社区和LLM代理模拟沙盒等干预方法,以建立以青少年为中心的关系支持型社交媒体设计准则。
基于注意力机制的多站点极端事件随机模拟器用于评估非平稳级联洪水风险
专题命中 Agent评测 :planning(abstract)
AI总结 本文提出一种结合注意力机制的多站点洪水模拟框架,通过随机生成多变量洪水频率、强度和持续时间序列,评估非平稳级联洪水风险,为保险和财务规划提供可行的洪水风险模拟。
Journal ref Nayak, A., Gentine, P., and Lall, U. (2026). "Attention-Based Stochastic Simulation of Climate-Informed Spatiotemporal Flood Risk for Multisite Insurance Portfolios." Geophysical Research Letters, 53 (15)
筛选前沿
专题命中 Agent评测 :agent(abstract)
AI总结 本文研究了盈余弹性前沿在最优菜单中的作用,证明其在不同机制下的最优性,并应用于多个经济领域。
Comments 75 pages, 6 figures
极端的入侵攻击对网络动态的脆弱性
专题命中 Agent评测 :agent(abstract)
AI总结 本文研究了网络中单个低度节点的入侵攻击如何破坏动态稳定性,挑战了传统对枢纽节点脆弱性的假设,并揭示了非线性网络中的脆弱性特征。
Comments Accepted for publication in Nature Communications
基于大语言模型智能体的争议调解模拟:面向法律研究
专题命中 Agent评测 :agent(abstract)
AI总结 研究针对法律争议调解实证研究的局限,提出首个基于LLM的AgentMediation框架模拟争议调解,通过可控实验发现符合社会学理论的模式,为社科与AI在法律研究的融合提供平台。
Comments AAAI 2026
带容量的医院住院医生问题的稳定性概念
专题命中 Agent评测 :agent(abstract)
AI总结 本文针对带容量的医院住院医生问题(HRS)研究基于容量的稳定性,证明该类问题必存在对应稳定匹配,给出严格优于3的近似算法,还证明最大规模该匹配问题及稳定匹配判定问题的NP难性,并提出受限场景下的稳定匹配高效算法。
SPEC CPU2026:特征、代表性及跨套件比较
专题命中 Agent评测 :agentic(abstract)
AI总结 本文研究SPEC CPU2026在九种平台上的性能特征,发现其相比2017版增加了指令量和内存占用,同时通过分析发现其在架构评估中可通过精简工作负载集保持高保真度,并通过与其他基准的比较展示其在通用计算中的优势。
对状态和特征的不注意
专题命中 Agent评测 :agent(abstract)
AI总结 本文提出一个理性不注意模型,通过施罗德桥问题和严格凹外问题,研究主体在获取成本信息时对状态和特征的不注意行为。
通过机制设计视角理解联邦学习:数据异质性的作用
专题命中 Agent评测 :agent(abstract)
AI总结 该研究通过将经典外部性机制适配联邦学习场景,对比了夏普利值机制与外部性机制在社会最优性、个体理性等维度的表现,揭示了互惠公平与社会效率的权衡关系。
Comments Extended version (with full proofs) of a paper accepted at GameSec 2026. 29 pages, 5 figures
多重独立多项式的下界及其推广
专题命中 Agent评测 :agent(abstract)
AI总结 本文研究了多重独立多项式的下界及其推广,提出并证明了关于图的独立集的不等式,并推测该结果可推广至其他反铁磁模型。
Comments 17 pages. Clarify Section 3 and add a Lean formalisation of Theorem 1.4. See https://github.com/thegreatseo/multivar-indep-formalize for the GitHub repo
稀疏双边交互模型中的互补性
专题命中 Agent评测 :agent(abstract)
AI总结 本文针对仅实现潜在匹配稀疏子集的双边交互模型,引入含互补性参数的Tukey模型,提出基于周期的估计量并应用于世界银行经理-国家匹配,发现负向互补性,验证了能力强的经理在复杂环境中更具价值。
以发现模式运行量子计算机
专题命中 Agent评测 :agent(abstract)
AI总结 研究展示量子计算机与经典机器学习智能体协同运行,可通过定义兴趣函数调整电路,以高概率发现离散时间晶体等量子多体动力学新现象,确立了混合设备中兴趣函数设计的研究范式。
Comments 10 + 8 pages, 4+6 figures
AI安全基准应该如何进行基准测试?
专题命中 Agent评测 :workflow(abstract)
AI总结 本文提出改进AI安全基准的方法,通过系统回顾210个基准,指出其技术、知识论和社会技术缺陷,并提出稳健度量和风险管理原则以提升基准有效性。
GS-Playground:一种高吞吐量的视觉真实模拟器用于基于视觉的机器人学习
机构 * THU(清华大学) ; Motphys ; Dexmal ; DISCOVER Robotics ; HKUST(GZ)(香港科技大学(广州)) ; BIT(北京理工大学) ; NUS(新加坡国立大学) ; HITSZ(哈尔滨工业大学) ; XJTU(西安交通大学) ; NJU(南京大学) ; SJTU(上海交通大学) ; D-Robotics
专题命中 Agent评测 :workflow(abstract)
AI总结 GS-Playground通过高吞吐量的多模态模拟框架,结合高效物理引擎和3DGS渲染管道,提升视觉强化学习的效率,降低大规模视觉RL的门槛,实现感知与物理的无缝衔接。
Comments Robotics: Science and Systems 2026
视听世界模型:为具身智能体奠定多感官想象的基础
机构 * Tsinghua University(清华大学) ; Beijing Institute of Technology(北京理工大学)
专题命中 Agent评测 :agent(abstract)
AI总结 提出视听世界模型(AVWM)统一框架,通过条件扩散Transformer(AV-CDiT)联合预测双耳音频与视觉动态,在30小时基准AVW-4k上实现高保真多模态预测,并验证其在具身导航中的有效性。
复杂网络的心理决定因素与后果
专题命中 Agent评测 :agent(abstract)
AI总结 该研究提出两个模型,分别将心理因素作为社会网络的决定因素与后果,基于Bianconi-Barabási网络和智能体方法,解释网络规模、外向性、年龄的关系及城市部落的出现。
Comments Old, dormant paper from my MSc that I never revisited and is trivial
具有Einasto密度分布的正则黑洞在磁场作用下的长寿命拟正常频率
专题命中 Agent评测 :agent(abstract)
AI总结 研究磁场影响下基于Einasto密度分布的正则黑洞中标量场的拟正常模式、灰体因子及吸收截面,通过高阶WKB展开和Padé求和计算拟正常频率,并展示有效质量和Einasto参数变化对阻尼率的抑制作用。
Comments 12 pages, 7 figures, the mistakes have been corrected
从多视图图像进行直接且可自适应的网格-高斯场景重建
机构 * School of Computer Science, Australian Artificial Intelligence Institute (AAII)(计算机科学学院,澳大利亚人工智能研究所) ; University of Technology Sydney(悉尼技术大学) ; School of Automobile(汽车学院) ; Chang’an University(长安大学)
专题命中 Agent评测 :agent(abstract)
AI总结 该研究针对现有方法分离几何与外观建模的问题,提出端到端网格-高斯场景表示,实现直接联合学习,提升重建效率与质量,可高效适配局部场景修改,支撑具身智能相关环境维护。
从有限反馈中学习不可分割物品的公平分配
专题命中 Agent评测 :agent(abstract)
AI总结 研究算法在未知估值下通过有限反馈学习公平分配不可分割物品的问题,提出基于椭球法的框架,在加性估值下多项式时间内找到EF1或PROP1分配,并在单调估值下保证多项式轮次内找到EF1分配。
Comments 42 pages, full version. Accepted to the ACM Conference on Economics and Computation (EC 2026)
高效估算多层级多组件干预措施的局部治疗效应以应对阿片类药物危机
专题命中 Agent评测 :agent(abstract)
AI总结 本文提出一种双层元模型框架,通过两阶段序列设计高效采样,用于估算多层级干预措施的局部治疗效应,减少计算资源消耗,应用于估算巴比妥酸盐分发和纳洛酮分布对过量死亡率的影响。
Comments repository link: https://github.com/abdulrahmanfci/gpr-metamodel/
CoSimRec:衡量推荐反馈循环中的协同内容渗透
专题命中 Agent评测 :agent(abstract)
AI总结 研究推荐反馈循环中协同内容渗透问题,提出CoSimRec离线代理评估框架,通过算法渗透率指标家族衡量相关情况,在多数据集和推荐器上评估,发现随机控制无显著正向渗透,基于流行度和反馈敏感排名有提升,同步感知排名降低APR。
Comments This work has been submitted to the IEEE for possible publication. Copyright may be transferred without notice, after which this version may no longer be accessible