arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 1239 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 1239 篇

2608.09724 2026-08-11 eess.SY cs.SI cs.SY 新提交 50%

Analysis and Consensus Control of Emergent Dynamic Polarization in Minimally-Nonlinear Opinion Dynamics

最小非线性观点动力学中涌现动态极化的分析与共识控制

Rajul Kumar, Ningshi Yao

专题命中 Agent评测 :agent(abstract)

AI总结 本文提出M-NOD框架解析社交网络观点演化产生的动态极化,证明其稳定性条件,开发局部控制策略仅锚定单个智能体即可消除振荡分歧、恢复共识。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09061 2026-08-11 cs.GT 新提交 50%

Breaking the 4-Approximation Barrier in Strategyproof Two-Facility Location

策略proof双设施选址问题中突破4近似比障碍

Mengfan Ma, Bo Peng

专题命中 Agent评测 :agent(abstract)

AI总结 该研究在Ptolemaic度量空间中提出随机策略proof双设施选址机制,将最优近似比从4降至约3.667,同时将最优下界从1.045提升至约1.207,突破了此前的4近似比障碍。

Comments 23 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08299 2026-08-11 math.PR math.OC q-fin.MF 新提交 50%

Non-linear optimal stopping with Bermudan strategies: the infinite horizon case

基于百慕大策略的非线性最优停止:无限时域情形

Miryana Grigorova, Ohood Aldalbahi

专题命中 Agent评测 :agent(abstract)

AI总结 本文针对无限时域下带非线性评估的最优停止问题,基于百慕大策略证明动态规划原理、ε-最优停时与最优停时的存在性,给出Doob型收敛结果并提供BSDEs相关示例。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09545 2026-08-11 physics.optics 新提交 50%

Direct Laser Interference Patterning of Functional Metal Surfaces: From Written Geometry to Functional Interfaces

功能金属表面的直接激光干涉图案化:从写入几何到功能界面

Petr Hauschwitz

专题命中 Agent评测 :agent(abstract)

AI总结 本综述以DLIP为模型系统,指出仅靠几何无法预测金属表面功能,需分离写入几何与形成的界面,明确跨领域变量可转移性,为DLIP表面工程提供预测框架。

Comments Review article, 6 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06900 2026-08-10 cs.SD eess.AS 新提交 50%

MMAG: A Multi-Control Mixed Audio Generation Benchmark

MMAG:多控制混合音频生成基准

Zihao Zheng, Xuenan Xu, Jiahao Mei, Yixuan Li, Minghao Lv, Wen Wu, Chao Zhang, Mengyue Wu

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai AI Lab(上海人工智能实验室)

专题命中 Agent评测 :agentic(abstract)

AI总结 本研究针对现有音频生成基准的不足,推出MMAG混合音频生成基准,构建含4000个标注音频的数据集,提出系统评估协议,测试发现各类模型在多控制能力间存在性能权衡,为该领域提供综合基准。

Comments 15 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07011 2026-08-10 cs.CE econ.GN math.OC q-fin.EC 新提交 50%

Linguistic Pattern Based Optimization of Economic and Spatial Uniformity Criteria in Facility Layout Problems

设施布局问题中基于语言模式的经济与空间均匀性准则优化

Jerzy Grobelny, Rafał Michalski

专题命中 Agent评测 :agent(abstract)

AI总结 本文扩展LP Alinks框架,引入NCS空间均匀性准则,通过实验揭示结构与语言参数对布局的影响,推导参数选择矩阵,对比显示其在成本与均匀性权衡上表现更优。

Comments 28 pages, 14 figures

Journal ref Grobelny, J., Michalski, R. Linguistic pattern based optimization of economic and spatial uniformity criteria in facility layout problems. Cent Eur J Oper Res 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06998 2026-08-10 q-bio.MN physics.bio-ph 新提交 50%

Simulating is not always understanding: When model complexity obscures biology

模拟并不总是意味着理解:当模型复杂性掩盖生物学本质时

Lendert Gelens, Alejandro Fábregas-Tejeda, Grant Ramsey, Sylvia Wenmackers, Bart Smeets

专题命中 Agent评测 :agent(abstract)

AI总结 该研究指出细胞生物学模型的理解关键是自由参数与实验约束的比率而非复杂性,建议减少参数、开展与简单模型的系统比较以追踪细胞行为的涌现机制。

Comments 17 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05379 2026-08-07 econ.TH 新提交 50%

Catastrophic Attention Preferences

灾难性注意力偏好

R. Emilio Muniz-Langle

专题命中 Agent评测 :agent(abstract)

AI总结 本文为仅关注不利结果子集的灾难性思维建立了公理化的灾难性注意力偏好模型,完成了行为学刻画,参数可识别,还刻画了比较模糊厌恶,模型嵌套主观期望效用并收敛到最大最小期望效用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05527 2026-08-07 stat.ME stat.AP 新提交 50%

Fast Power Evaluation under Biased-Coin Minimization: Sampling and Randomization Calibration

偏币最小化下的快速功效评估:抽样与随机化校准

Masahiro Kojima

专题命中 Agent评测 :planning(abstract)

AI总结 针对偏币最小化下设计阶段功效评估计算量大的问题,开发SIGA框架及SIGA-S、SIGA-R程序,可高效近似参考随机化检验的结果并显著降低计算量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05539 2026-08-07 cs.CV 新提交 50%

OmniMech: All-in-one Multimodal Mechanical Benchmark for 3D Reconstruction

OmniMech:面向3D重建的全合一多模态机械基准

Taiting Lu, Runze Liu, Ziwei Dong, Sisong Bei, Jingying Zeng, Mingjia Wang, Zhenghao Li, Kaiyuan Lin, Yi-Shan Wu, Yangshoudu Zheng, Hongxing Pan, Kai Zhang, Guoliang Shi, Ling Ma, Yifan Yang, Jiaying Lu, Qi He, Sung-Liang Chen, Yi-Chao Chen, Yincheng Jin, Mahanth Gowda

专题命中 Agent评测 :agentic(abstract)

AI总结 研究人员提出OmniMech——首个百万级多模态机械基准,针对工业制造数据的可执行CAD生成任务,含四类任务,实验发现现有模型在相关任务中存在不足,将发布资源支持后续研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04774 2026-08-06 cs.CY cs.SI 新提交 50%

Decentralization of Agenda-Setting Power and Domain-Selective Bridging: Algorithm Design Beyond the Echo Chamber Debate

议程设置权力的去中心化与领域选择性桥接:超越回音室辩论的算法设计

Masahiro Fujita

专题命中 Agent评测 :agent(abstract)

AI总结 本文提出议程民主化指数与社会信息健康模型,设计领域选择性桥接算法,经智能体模拟验证,该算法能在集体决策相关领域改善信息共享,同时维持爱好与生活方式领域用户体验,将回音室辩论转化为工程设计问题。

Comments 34 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04536 2026-08-06 cs.DB 新提交 50%

From Research Questions to Columns: Operationalization-Aware Data Discovery

从研究问题到列:感知操作化的数据发现

Houming Chen, H. V. Jagadish

专题命中 Agent评测 :agent(abstract)

AI总结 该研究提出感知操作化的数据发现(OADD)任务,构建基准OADD-Bench,评估多种方法后发现OADD仍是未解决问题,其中OADD定向智能体表现最佳。

Comments 6 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04042 2026-08-06 cs.RO 新提交 50%

Kitchen Robotic Manipulation utilizing Foundation Models

基于基础模型的厨房机器人操作

Myung-Hwan Jeon, Sankalp Yamsani, Joohyung Kim

机构 * Kumoh National Institute of Technology(金乌国立技术大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 Agent评测 :planning(abstract)

AI总结 本研究提出一种整合多种基础模型的模块化厨房机器人感知流水线,经评估优化后可在杂乱遮挡场景下实现89.12%的ADI,无需环境重训练即可完成餐具处理等家庭操作任务。

Comments Intelligent Service Robotics (ISR)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03783 2026-08-05 eess.SP 新提交 50%

New Mid-Band (FR3, 6-24 GHz) XL-MIMO for 6G: Channel Modeling, Algorithm Evaluation, and Field Trials

面向6G的新型中频段(FR3,6-24 GHz)超大規模多输入多输出(XL-MIMO):信道建模、算法评估与现场试验

Haiyang Miao, Jianhua Zhang, Feifei Gao, Pan Tang, Qi Zhen, Mengxue Li, Ping Zhao, Shihao Zhang, Liang Xia, Guangyi Liu

专题命中 Agent评测 :planning(abstract)

AI总结 本文针对6G的新型中频段XL-MIMO,综述其频谱规划、信道建模、算法进展,比较不同规模XL-MIMO系统性能,结合U6GHz频段现场试验,明确目标信噪比是影响XL-MIMO性能的关键因素。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03971 2026-08-05 cs.CV 新提交 50%

UniWorld-Design: From Pixel Generation to Layer-Native Design

UniWorld-Design:从像素生成到层原生设计

Zongjian Li, Zhiyuan Yan, Chenxu Bai, Chen Chen, Haoxiang Sun, Shaodong Wang, Feize Wu, Shenghai Yuan, Bin Lin, Zheyuan Liu, Yuwei Niu, Li Yuan

专题命中 Agent评测 :agentic(abstract)

AI总结 UniWorld-Design是一种以语义RGBA层为原子单元的图像生成框架,含T2RGBA和I2L两个模型,在Crello基准测试中I2L和T2RGBA均优于现有相关模型。

Comments Project page: https://rabbitvis.rabbitpre.com/blog

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03445 2026-08-05 cs.SI 新提交 50%

A Note on Reinforcement Learning to Develop Self-defined Agents' Behavior

关于强化学习开发智能体自定义行为的注记

Matteo Morini, Pietro Terna

专题命中 Agent评测 :agent(abstract)

AI总结 本研究基于有限理性假设,采用无监督学习为主的技术,通过Cross Targets(交叉目标)方法训练人工智能体,实现行为内部一致性,成功让随机游走智能体解决图节点分类问题。

Journal ref M. Morini, and P. Terna (2021). A note on reinforcement learning to develop self-defined agents' behavior. Carlo Alberto Notebooks, No. 638, January 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03078 2026-08-05 cs.CV 新提交 50%

LDU-Bench: Multimodal LLM Evaluation for Lithography Defect Understanding under Layout-Varying Circuit Backgrounds

LDU-Bench:面向不同布局电路背景下光刻缺陷理解的多模态大语言模型评估基准

Huanglong Ji, Botong Zhao, Shujing Lv, Yue Lv

专题命中 Agent评测 :workflow(abstract)

AI总结 本文提出LDU-Bench这一多模态基准,将光刻审查工作流程分解为四项任务,评估发现现有多模态大语言模型的缺陷分类能力无法稳定迁移至下游审查阶段,为工业MLLM评估提供了统一平台。

Comments 12 pages, 3 figures, and 5 tables, including appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00517 2026-08-04 econ.TH 新提交 50%

Exact Budget Balance via Payment-Rule Ambiguity: Incentive Preservation, Transfer Capacity, and Participation

通过支付规则模糊性实现精确预算平衡:激励保持、转移能力与参与度

Hiroaki Odahara

专题命中 Agent评测 :agent(abstract)

AI总结 本文研究通过支付规则模糊性修复激励相容机制的支付侧以实现精确预算平衡,探讨了不同信息条件下的可行性、转移能力及参与度等问题。

Comments 54 pages, 1 figure; includes appendices and ancillary verification code

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01494 2026-08-04 q-fin.PM q-fin.RM 新提交 50%

Conformal Kelly: Conformal Prediction Intervals as the Scale in Fractional Kelly Position Sizing

共形凯利:将共形预测区间用作分数凯利头寸规模的尺度

Robert Jacob Ryan

专题命中 Agent评测 :agent(abstract)

AI总结 该研究提出将共形预测区间与分数凯利结合用于投资组合头寸规模确定,经6年测试表现优于被动基准,还引入风险控制优化回撤,相关配置经预注册和LLM智能体搜索验证。

Comments 30 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00917 2026-08-04 q-fin.MF 新提交 50%

Pro-rata mechanisms in groundwater markets

地下水市场中的按比例分配机制

Igor Cialenco, Michael Ludkovski, Gael Dimitri Tekam Fongouo

专题命中 Agent评测 :agent(abstract)

AI总结 本文针对地下水市场供需失衡问题,扩展已有价格形成模型提出按比例配给机制,结合外生限制、主从博弈场景展开理论分析与数值验证,还与多种非对称配给方案对比,为市场监管提供了工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01895 2026-08-04 cs.HC 新提交 50%

Emotional Expression in Persuasion by Quadruped Virtual Agents: Toward Cross-Species Design Patterns

四足虚拟智能体说服过程中的情感表达:迈向跨物种设计模式

Kaoru Sumi, Souki Osawa

专题命中 Agent评测 :agent(abstract)

AI总结 该研究开发了虚拟狗、猫、马智能体,对比不同行为条件后发现,四足虚拟智能体的说服效果更依赖情感表达等功能性线索,而非物种特有动作,为跨物种设计模式提供了依据。

Comments Preprint. 68 pages, 4 figures, 8 tables. Submitted to Frontiers in AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01693 2026-08-04 cs.GT 新提交 50%

Optimal Prior-Free Mechanisms for Consumer Surplus

无先验约束下的消费者剩余最优机制

Tomer Ezra

专题命中 Agent评测 :agent(abstract)

AI总结 该研究解决多维机制设计中剩余剩余最大化的最坏情况可近似性问题,提出普遍真实且事后个体理性的机制,得到最优最坏情况保证,解决相关开放问题并改进现有结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01157 2026-08-04 cs.CV 新提交 50%

InteracVid: Building a Real Interactive Audio-Visual Response Dataset from Live-Chat Videos

InteracVid:基于直播聊天视频构建真实交互式视听响应数据集

Chi Zhang, Haoyang Shi, Yueyi Liu, Zhaokun Yan, Yishu Yin, Yuhang Wu, Miao Liu

机构 * College of AI, Tsinghua University(清华大学人工智能学院)

专题命中 Agent评测 :planning(abstract)

AI总结 该研究提出首个开源大规模交互式视听数据集InteracVid,解决现有生成模型监督信号缺失问题,实验证实其可提升多模态助手的交互规划与响应生成性能,为交互式多模态生成提供关键基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00327 2026-08-04 math.OC 新提交 50%

Persistent Mean Tracking in Client--Server Open Networks

客户端-服务器开放网络中的持久均值跟踪

Amit Dutta, Fat-Hy Omar Rajab, Marcos M. Vasconcelos, Olugbenga M. Anubi

专题命中 Agent评测 :agent(abstract)

AI总结 针对开放客户端-服务器网络中瞬态智能体污染导致朴素平均法无法恢复持久均值的问题,提出两阶段估计框架,通过双层窗口识别与平滑滤波实现均值跟踪,经数值模拟验证有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00934 2026-08-04 gr-qc astro-ph.HE 新提交 50%

Unified remnant models for aligned-spin, precessing, and eccentric binary black hole mergers

非进动自旋、进动及偏心双黑洞并合的统一残余模型

Tousif Islam, Digvijay Wadekar, Gaurav Khanna

专题命中 Agent评测 :agent(abstract)

AI总结 该研究利用数值相对论等模拟数据,构建了适用于非进动、进动及偏心双黑洞并合残余性质的统一解析模型,精度优于现有模型,可通过gwModels包公开供相关领域应用。

Comments Models are available through https://github.com/tousifislam/gwModels/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29080 2026-08-03 econ.TH 新提交 50%

Rawlsian equity: a new notion of fairness for the assignment problem

罗尔斯式公平:分配问题的一种新公平概念

Özgün Ekici, Sinan Ertemel, M. Bumin Yenmez

专题命中 Agent评测 :agent(abstract)

AI总结 该研究提出用于不可分割对象分配的罗尔斯式公平概念,证明其分配集合与辅助市场稳定分配集合一致,主体提议的延迟接受算法可计算其主体最优元素,但无策略防卫的罗尔斯式公平规则。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29200 2026-08-03 cs.CV 新提交 50%

UltraSAM3: A Concept-Driven Foundation Model for Universal Ultrasound Image Segmentation

UltraSAM3:一种用于通用超声图像分割的概念驱动基础模型

Bo Xu, Quanhao Zhu, Rui Lin, Boling Zhu, Chenyuan Wang, Hongfei Lin, Feng Xia, Chenhua Ji

机构 * Dalian University of Technology Affiliated Center Hospital(大连大学附属中心医院)

专题命中 Agent评测 :agent(abstract)

AI总结 针对现有超声分割方法的任务局限或需专家视觉提示问题,提出概念驱动的UltraSAM3模型及指令引导智能体,在多基准测试中性能优于同类模型,提升了临床交互的实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27548 2026-07-31 econ.GN q-fin.EC 新提交 50%

Explaining the Macroeconomic Inertia Puzzle

解释宏观经济惯性之谜

Michael Cai

专题命中 Agent评测 :agent(abstract)

AI总结 本文通过将调查预期替代主体自身预期,结合嵌入不可观测成分模型的异质性主体一般均衡框架,解释了宏观经济惯性之谜,并指出惯性政策会延长传导滞后。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27743 2026-07-31 cs.GT 新提交 50%

Delegated Fair Division

委托式公平分配

Argyrios Deligkas, Michail Fasoulakis, Stavros D. Ioannidis, Alviona Mancho, Evangelos Markakis

专题命中 Agent评测 :agent(abstract)

AI总结 该研究针对委托式公平分配模型,区分两种信息结构并提供高效算法,生成同时满足中心与代理人层面基于嫉妒的公平性保证的分配方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26731 2026-07-30 cs.HC 新提交 50%

Affective Tools for Thought: Towards Shared Attention and Affective Reorienting in AI-Supported Thinking

面向情感化思维工具:实现AI辅助思维中的共享注意力与情感重定向

Yifu Liu, Raffaele Andrea Buono, Nadia Bianchi-Berthouze

专题命中 Agent评测 :agent(abstract)

AI总结 该研究针对现有思维工具对情感的片面认知,提出情感是认知的构成要素,明确情感化思维工具的两大障碍,给出三种设计策略并基于相关实证研究为未来设计提供启发。

Comments 4 pages, 2-column ACM format. Accepted to the CHI 2026 Workshop on Tools for Thought: Understanding, Protecting, and Augmenting Human Cognition with Generative AI, April 16, 2026, Barcelona, Spain. Workshop website: https://ai-tools-for-thought.github.io/workshop/

详情

展开后加载摘要…

URL PDF HTML 收藏