arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 15819 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 15819 篇

2602.10535 2026-07-23 cs.HC 版本更新 78%

Exploring the Interplay Between Voice, Personality, and Gender in Human-Agent Interactions

探索语音、个性与性别在人机交互中的相互作用

Kai Alexander Hackney, Lucas Guarenti Zangari, Jhonathan Sora-Cardenas, Emmanuel Munoz, Sterling R. Kalogeras, Betsy DiSalvo, Pedro Guillermo Feijoo-Garcia

专题命中 Agent评测 :agent(title,abstract)

AI总结 研究探讨用户能否通过语音识别人工代理的外向性,并分析感知个性与用户-代理同步性之间的关系,发现女性语音在区分外向性上更有效,而男性语音则不一致。

Journal ref https://www.frontiersin.org/articles/10.3389/fcomp.2026.1855830

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18557 2026-07-22 physics.geo-ph 新提交 78%

AGENTS4GEOS: agentic platform for open-source multi-physics simulation

AGENTS4GEOS:用于开源多物理场模拟的智能体平台

Adriano M. A. Côrtes, Roberto M. Velho, Fernando A. Rochinha, Alvaro L. G. A. Coutinho, Mauricio Araya-Polo, Hervé Gross

专题命中 Agent评测 :agentic(title);agent(abstract)

AI总结 研究针对多物理场模拟计算需求及训练数据集瓶颈,提出基于模型上下文协议的Agents4GEOS智能体框架,借助52个领域感知工具及协调器,自动化日常任务,助力专家专注工作挑战。

Comments 14 pages, 11 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05197 2026-07-22 cs.HC cs.CY 78%

Ghosting the Machine: Stop Calling Human-Agent Relations Parasocial

让机器消失:停止将人与代理关系称为寄生关系

Jaime Banks

专题命中 Agent评测 :agent(title,abstract)

AI总结 本文指出将人类与对话代理关系称为寄生关系是误用,该术语原指单向、非辩证的虚构关系,导致对复杂现象的简化和误判,需重新认识人与代理的社会性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17347 2026-07-21 cs.IR 新提交 78%

Adapting Embedding Models for Agent Capability Retrieval

使嵌入模型适应智能体能力检索

Tingwei Chen, Yunxiao Shi, Zhengdong Chu, Qingsong Wen, Min Xu

专题命中 Agent评测 :agent(title,abstract)

AI总结 研究如何让一般文本检索的现成模型适应智能体能力检索,通过微调三个模型在特定数据集上训练,测试其在未训练目录上的迁移能力,结果显示适应对两个目录均有帮助。

Comments Accepted for oral presentation at the AgentSearch Workshop, SIGIR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17214 2026-07-21 math.OC 新提交 78%

A Principal-Agent Mean-Field Game Model of Insurance with Risk Interdependence

具有风险相互依存性的保险委托-代理平均场博弈模型

Asaf Cohen, Ruolan He, Mingyan Liu

专题命中 Agent评测 :agent(title,abstract)

AI总结 研究道德风险、内生参与和战略风险相互依存下的保险合同设计问题,用异质平均场博弈近似战略互动,建立下层均衡存在性与唯一性,嵌入上层优化问题,证明相关均衡存在,扩展到有限合同菜单,表明多合同筛选可提高委托人预期收益。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13987 2026-07-16 cs.CR 新提交 78%

Agent Skill Security: Threat Models, Attacks, Defenses, and Evaluation

智能体技能安全:威胁模型、攻击、防御与评估

Sanket Badhe, Priyanka Tiwari

专题命中 Agent评测 :agent(title,abstract)

AI总结 研究智能体可复用技能安全,提出SkillSec-Eval框架,刻画技能生命周期并开发威胁分类法,通过对327个真实技能实证评估,发现多阶段有漏洞,强调需进行生命周期感知安全分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09420 2026-07-13 q-bio.PE 新提交 78%

PesTwin: A modular agent-based framework for pest and vector population control

PesTwin:一种用于害虫和病媒种群控制的基于模块化代理的框架

Andrea De Antoni, Giovanni Iacca, Andrea Pugliese, Anna Strampelli, Gerard Terradas, Matteo Rucco, Andrew Hammond

专题命中 Agent评测 :agent(title,abstract)

AI总结 针对基因控制技术建模工具滞后问题,提出PesTwin框架,可跨物种等模拟基因控制技术,捕捉多种因素。经与实验室数据验证后可扩展到田间场景,能在基因控制系统实际应用前进行模拟测试,助力相关决策,缩短研发到应用路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07584 2026-07-09 cs.NI 新提交 78%

PHaul: A PPO-based forwarding agent for Sub6 enhanced Integrated Access and Backhaul networks

PHaul:一种用于Sub6增强型综合接入与回传网络的基于近端策略优化(PPO)的转发代理

Jorge Pueyo, Daniel Camps-Mur and, Miguel Catalan-Cid

专题命中 Agent评测 :agent(title,abstract)

AI总结 研究Sub6增强型IAB网络的转发问题,提出PHaul,结合离线启发式算法与基于PPO的在线DRL代理,利用网络数字孪生采样更新映射,相比替代算法,能提升吞吐量效率和公平性,且对拓扑差异有鲁棒性。

Journal ref IEEE Transactions on Network and Service Management, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06118 2026-07-08 cs.CV cs.MM 新提交 78%

WebRetriever: A Large-Scale Comprehensive Benchmark for Efficient Web Agent Evaluation

WebRetriever:用于高效网络智能体评估的大规模综合基准测试

Wei Dong, Tianyu Fu, Zhe Yu, Hanning Wang, Anyang Su, Zhizhou Fang, Yuyang Chen, Shuo Wang, Minghui Wu, Ping Jiang, Zhen Lei, Chenxu Zhao

机构 * Mininglamp Technology(旷视科技) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所综合技术集成中心)

专题命中 Agent评测 :agent(title,abstract)

AI总结 针对现有网络智能体评估基准测试的局限,提出WebRetriever这一大规模综合基准测试,涵盖多领域网站和任务。采用NavEval框架及三个评估协议,实验揭示不同协议性能差异,为网络智能体研发提供细粒度见解和严谨基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23212 2026-07-08 cond-mat.dis-nn cond-mat.stat-mech nlin.AO 版本更新 78%

Replication and Information Extraction in a Minimal Agent-Environment Model

最小化智能体 - 环境模型中的复制与信息提取

Sebastiano Ariosto, Jerome Garnier-Brun, Luca Saglietti, Davide Straziota

专题命中 Agent评测 :agent(title,abstract)

AI总结 研究在无明确指导或奖励下从数据提取信息的问题,通过对分类规则施加简单性偏差,利用统计力学工具刻画自发学习相变,扩展到智能体群体后发现交互可重塑学习相边界,开辟仅通过标签交换的分散学习途径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19073 2026-07-07 cs.CV 新提交 78%

Taming I2V models for Image HOI Editing: A Cognitive Benchmark and Agentic Self-Correcting Framework

驯服I2V模型用于图像HOI编辑:认知基准与智能体自校正框架

Jiayi Gao, Qingchao Chen, Yuxin Peng, Yang Liu

机构 * Wangxuan Institute of Computer Technology, Peking University, Beijing, China(王轩计算机技术研究所,北京大学,北京,中国) National Institute of Health Data Science, Peking University, Beijing, China(国家健康数据科学研究院,北京大学,北京,中国)

专题命中 Agent评测 :agentic(title,abstract)

AI总结 提出HOI-Edit基准和SCPE框架,利用I2V模型的时间生成能力进行动态人-物交互编辑,通过自校正提示迭代优化,实现与SOTA竞争的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00304 2026-07-02 cs.LG cs.AI cs.CL 新提交 78%

Mapping the Evaluation Frontier: An Empirical Survey of the Bias-Reliability Tradeoff Across Eleven Evaluator-Agent Conditions

映射评估前沿:跨11种评估器-智能体条件的偏差-可靠性权衡的实证调查

Zewen Liu

专题命中 Agent评测 :agent(title);分类 cs.AI、cs.CL、cs.LG

AI总结 通过扩展至11种评估条件,实证验证了LLM评估系统中评估器耦合、策略多样性与小样本测量可靠性之间的权衡,并发布了标准化基准数据集。

Comments 5 pages, 1 figure, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31613 2026-07-01 cs.CV cs.RO 新提交 78%

Robust Autonomous UAV Landing on Maritime Platforms via Multimodal Agentic AI and Active Wave Compensation

基于多模态智能体AI和主动波浪补偿的自主无人机稳健海上平台着陆

Francisco S. Neves, Pedro N. Pereira, Raul D. S. G. Campilho, Andry M. Pinto

机构 * Fundação Para a Ciência e a Tecnologia(葡萄牙科学技术基金会)

专题命中 Agent评测 :agentic(title);agent(abstract)

AI总结 提出一种解耦的多飞行器着陆框架,利用双深度强化学习智能体(SAC和模态RL)实现无人机在海上平台的稳健着陆,在15次试验中达到100%成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15917 2026-07-01 cs.CV 版本更新 78%

Making Image Editing Easier via Adaptive Task Reformulation with Agentic Executions

通过具有代理执行的自适应任务重构使图像编辑更易于实现

Bo Zhao, Kairui Guo, Runnan Du, Haiyang Sun, Pengshan Wang, Huan Yang, Kun Gai, Yixin Cao, Wei Ji

机构 * Nanjing University(南京大学) Beijing Institute of Technology(北京理工大学) College of Artificial Intelligence, China University of Petroleum (Beijing)(中国石油大学(北京)人工智能学院) Beijing University of Posts and Telecommunications(北京邮电大学) Fudan University(复旦大学)

专题命中 Agent评测 :agentic(title);agent(abstract)

AI总结 本文提出通过自适应任务重构框架提升图像编辑性能,通过代理分析和反馈优化任务描述,改进编辑效果,尤其在复杂案例中表现显著。

Comments 9pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29850 2026-06-30 cs.CV 78%

Efficient Visual Pointing for Embodied AI:Agent-Driven Data Synthesis, Cross-Block Attention, and Iterative Correction

面向具身AI的高效视觉指代:智能体驱动数据合成、跨块注意力与迭代校正

Zijian Hong, Qi Lv, Yuxiang Xie, Jianming Xing, Xiang Deng, Weili Guan, Liqiang Nie

机构 * Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))

专题命中 Agent评测 :agent(title,abstract)

AI总结 提出PointArena 2026解决方案,通过智能体驱动数据合成、确定性可操控数据流水线、跨块注意力与迭代校正模块,实现77.2%总体准确率,排名第二。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28779 2026-06-30 cs.HC 78%

Telephony Voice Agent for Banking Services

银行服务的电话语音代理

Nitya Dhagat, Vipul K. Dabhi, Harshadkumar B. Prajapati, Zankhana J. Barad

专题命中 Agent评测 :agent(title,abstract)

AI总结 提出基于Google Dialogflow CX的语音AI银行系统,支持余额查询、交易记录、卡激活等核心功能,并通过高并发和噪声测试验证其可扩展性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04160 2026-06-29 cs.GT 版本更新 78%

Representation theorems for actual and alpha powers over two-agent general concurrent game frames

关于双智能体一般并发博弈框架中实际权力和α权力的表示定理

Zixuan Chen, Fengkui Ju, Thomas Agotnes

专题命中 Agent评测 :agent(title,abstract)

AI总结 本文针对双智能体一般并发博弈框架,证明了实际权力和α权力的八种类型分别可由八类邻域框架表示,推广了已有结果,并指出双智能体实际权力刻画无法推广到任意有限智能体集合。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26074 2026-06-25 cs.GT 新提交 78%

Strategyproof Facility Location and Committee Selection with Mixed Max and Sum Agent Types

混合最大和求和代理类型的策略性设施选址与委员会选择

Yue Gruszecki, Elliot Anshelevich

专题命中 Agent评测 :agent(title,abstract)

AI总结 针对代理具有最大型或求和型成本函数的策略性设施选址问题,设计确定性策略证明机制,并证明在代理类型私有但位置已知时近似比为(3-2/k),在位置私有且位于直线度量时近似比为3。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23070 2026-06-23 q-fin.TR 新提交 78%

Mitigating Adverse Selection in Concentrated Liquidity AMMs with Dynamic Fees: An Agent-Based Model Approach

缓解集中流动性AMM中的逆向选择:基于动态费用的代理建模方法

Daniele Maria Di Nosse, Fabrizio Lillo

专题命中 Agent评测 :agent(title,abstract)

AI总结 针对Uniswap v3等集中流动性AMM中流动性提供者面临的逆向选择成本,提出基于波动率和订单流毒性的动态费用机制,通过代理建模验证其可补偿损失而非直接降低损失。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23408 2026-06-23 math.OC cs.NA math.NA 新提交 78%

Finite difference methods for a continuous-time heterogeneous agent model with recursive utility

具有递归效用的连续时间异质主体模型的有限差分方法

Yves Achdou, Qing Tang

专题命中 Agent评测 :agent(title,abstract)

AI总结 针对Epstein-Zin递归效用下的连续时间异质主体模型,提出Howard-Newton和Howard-Tarski-Kantorovich算法求解离散化的HJB方程,证明算法收敛性及解的存在性,并给出先验误差估计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17128 2026-06-19 cs.AR 新提交 78%

Shift-Left High-Level Synthesis Verification via Knowledge-Augmented LLM Agent

通过知识增强的LLM智能体实现左移高层次综合验证

Zhihan Xiao, Hongbing Lang, Zhe Zhao, Luke Ztz Hu, Songping Mai

专题命中 Agent评测 :agent(title,abstract)

AI总结 提出一种知识增强的智能体驱动左移验证框架,通过双层级一致性检查、符号执行和HLS验证知识图谱,在综合前自动验证C与HLS-C的功能一致性,覆盖率达98.26%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18591 2026-06-18 cs.CV 新提交 78%

Bridging Creative Intent and Visual Quality: Creator-Driven Recurrent Video Generation with Agentic Feedback Loops

桥接创意意图与视觉质量:基于创作者驱动的循环视频生成与代理反馈循环

Denis Savytski, Aiden Lei, Heding Liu, Warren Yang, Sihan Liang, Alexander Liu, Zhe Zhao

机构 * University of California, Davis(加州大学戴维斯分校) The Harker School(哈克学校) Basis Independent Silicon Valley(硅谷贝斯独立学校) Saratoga High(萨拉托加高中)

专题命中 Agent评测 :agentic(title);agent(abstract)

AI总结 提出CHIEF框架,通过人类-AI协作的迭代视频精炼,结合创作者驱动和代理主观反馈,提升长视频的叙事连贯性与创意方向。

Comments Accepted to the Workshop on Human-AI Co-Creativity at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18121 2026-06-17 cs.MA cs.IT math.IT 新提交 78%

On the Reliability of Networks of AI Agents: Density Evolution, Stopping Sets, and Architecture Optimization

AI代理网络的可靠性:密度演化、停止集与架构优化

Ehsan Aghazadeh, Hossein Pishro-Nik

专题命中 Agent评测 :AI agent(title);agent(abstract)

AI总结 将多代理AI系统建模为稀疏图上的消息传递,扩展LDPC编码的密度演化理论,分析三种擦除失效模式,并证明密度演化定理以预测未解决子声明的渐近比例。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13749 2026-06-15 cs.MA 新提交 78%

Large Language Models as Supervised Extraction Assistants: Lowering the Barrier to Documentation Standard Adoption in Agent-Based Modelling

大型语言模型作为监督式提取助手:降低基于智能体建模中文档标准采纳的门槛

Peer-Olaf Siebers, Christopher Frantz

专题命中 Agent评测 :agent(title,abstract)

AI总结 本研究探索利用大型语言模型(LLMs)辅助自动化ABM文档标准(如RAT-RS)的采纳,通过四个LLMs从已发表论文中提取报告,发现LLMs在描述性任务上表现可靠,但在解释性和评估性任务上存在局限,并提出了何时依赖LLM、何时需要人工监督的实用启发式方法。

Comments 17 pages, accepted for publication at the Social Simulation Conference 2026, see https://www.durham.ac.uk/research/institutes-and-centres/research-methods/social-simulation-conference-2026/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14331 2026-06-15 physics.soc-ph cond-mat.stat-mech econ.GN q-fin.EC 新提交 78%

Wealth Inequality and Planetary Boundaries in a Stylized Agent-Based Model

一个基于主体的风格化模型中的财富不平等与行星边界

Thomas Valade, Michael Benzaquen, Matthieu Cristelli, Stanislao Gualdi, Pierre Lenders

专题命中 Agent评测 :agent(title,abstract)

AI总结 通过构建异质主体模型,研究财富不平等如何阻碍绿色转型,发现超过一定阈值后经济锁定在棕色状态,并评估了不同财政政策的效果。

Comments 26 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03636 2026-06-15 cs.GT 版本更新 78%

Causal Mirage Equilibrium in Agentic Machine Intelligence

生成式机器智能中的因果幻象均衡

Hamidou Tembine

专题命中 Agent评测 :agentic(title);agent(abstract)

AI总结 针对生成式机器智能中语义表征与物理现实脱钩的问题,提出风险敏感平均场型因果幻象均衡(CME),证明其存在性并揭示内生强化主导时非因果状态的稳定分岔。

Comments 10 pages, 1 figure. References double-checked manually

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13639 2026-06-12 cs.MA 新提交 78%

Tuning Agent-Based Predator-Prey Models Toward Lotka-Volterra Dynamics

将基于智能体的捕食者-猎物模型调谐至洛特卡-沃尔泰拉动力学

Corinna Mandl, Siddharth Chaturvedi, Marcel van Gerven

专题命中 Agent评测 :agent(title,abstract)

AI总结 研究通过调整环境与种群参数,使基于智能体的捕食者-猎物模型产生类似洛特卡-沃尔泰拉方程的周期性振荡,并利用基于特征的损失函数优化参数。

Comments 12 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10546 2026-06-11 cs.MA 版本更新 78%

SkillAxe: Sharpening LLM-Authored Agent Skills Through Evaluation-Guided Self-Refinement

SkillAxe: 通过评估引导的自我精炼提升LLM编写的智能体技能

Srishti Gautam, Arjun Radhakrishna, Sumit Gulwani

专题命中 Agent评测 :agent(title,abstract)

AI总结 提出SkillAxe框架,通过无监督评估引导LLM自我诊断和精炼技能,在SkillsBench上提升通过率28%,缩小与人类技能的差距47-67%。

Comments 9 pages, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.10271 2026-06-11 cs.CR cs.CE 78%

Agent-based Model of Initial Token Allocations: Evaluating Wealth Concentration in Fair Launches

基于代理的初始代币分配模型:评估公平发行中的财富集中

Joaquin Delgado Fernandez, Tom Barbereau, Orestis Papageorgiou

专题命中 Agent评测 :agent(title,abstract)

AI总结 本文通过基于代理的模型研究公平发行后代币集中问题,发现无论分配方式如何,代币流动性导致集中现象持续存在。

Journal ref ACM Trans. Manage. Inf. Syst. 15, 1 (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09375 2026-06-09 physics.soc-ph 新提交 78%

An Agent-Based Model for Migration Decision-Making Under Higher Frequency of Extreme Climate Events

极端气候事件频率增加下的迁移决策基于智能体的模型

Valentina Antonaccio Guedes, Rafael Prieto-Curiel

专题命中 Agent评测 :agent(title,abstract)

AI总结 构建基于智能体的模型,通过感知风险、迁移愿望和迁移能力的共同演化,揭示气候冲击如何非线性地影响迁移决策,并导致脆弱群体陷入困境。

Comments 44 pages including appendix, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏