arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 15819 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 15819 篇

2506.07842 2026-03-10 q-bio.PE 78%

Simulating nationwide coupled disease and fear spread in an agent-based model

在基于代理的模型中模拟全国范围的疾病和恐惧传播

Joy Kitson, Prescott C. Alexander, Joseph Tuccillo, David J. Butts, Christa Brelsford, Abhinav Bhatele, Sara Y. Del Valle, Timothy C. Germann

专题命中 Agent评测 :agent(title,abstract)

AI总结 本文提出了一种基于代理的模型,模拟疾病和恐惧的传播,通过分析不同疾病状态和行为反应,揭示了耦合动态对流行病波的影响。

Comments 21 pages, 8 figures, 2 tables

Journal ref Scientific Reports, 15(1), 42235 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.04559 2026-03-06 cond-mat.soft physics.bio-ph 78%

The importance of being discrete -- An agent-based model for active nematics and more

离散的重要性——一种用于主动向列相和更多应用的基于代理的模型

Mathieu Dedenon, Carles Blanch-Mercader, Karsten Kruse, Jens Elgeti

专题命中 Agent评测 :agent(title,abstract)

AI总结 本文提出了一种基于代理的模型,用于研究主动向列相中的自发流动和拓扑缺陷,展示了其在活材料描述中的广泛应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03762 2026-03-05 cs.CV 78%

Seeing as Experts Do: A Knowledge-Augmented Agent for Open-Set Fine-Grained Visual Understanding

如同专家所见:一个知识增强的代理用于开放集细粒度视觉理解

Junhan Chen, Zilu Zhou, Yujun Tong, Dongliang Chang, Yitao Luo, Zhanyu Ma

专题命中 Agent评测 :agent(title,abstract)

AI总结 KFRA通过知识增强推理代理实现开放集细粒度视觉理解,提升推理准确率和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03671 2026-03-05 q-fin.CP q-fin.TR 78%

Is an investor stolen their profits by mimic investors? Investigated by an agent-based model

投资者是否因模仿者而损失了利润?通过基于代理的模型进行调查

Takanobu Mizuta, Isao Yagi

专题命中 Agent评测 :agent(title,abstract)

AI总结 本文通过基于代理的模型研究了投资者因模仿者而损失利润的问题,发现增加基本策略代理使市场稳定从而减少利润,而增加技术策略代理使市场波动从而增加利润。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01189 2026-03-03 cs.RO cs.HC 78%

Agent-Based Simulation of Trust Development in Human-Robot Teams: An Empirically-Validated Framework

基于代理的机器人团队信任发展模拟:一个经实证验证的框架

Ravi Kalluri

专题命中 Agent评测 :agent(title,abstract)

AI总结 本文提出一个经实证验证的代理模型,用于模拟人类-机器人团队中的信任动态,揭示了机器人可靠性对信任和绩效的关键影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01146 2026-03-03 cs.LO 78%

Uniform Agent-interpolation of Distributed Knowledge

分布式知识的统一代理插值

Youan Su

专题命中 Agent评测 :agent(title,abstract)

AI总结 本文提出了一种纯语法算法,用于确定具有分布式知识的模态逻辑K、KD和KT的统一插值公式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00825 2026-03-03 cs.CV 78%

COMBAT: Conditional World Models for Behavioral Agent Training

COMBAT:基于行为代理训练的条件世界模型

Anmol Agarwal, Pranay Meshram, Sumer Singh, Saurav Suman, Andrew Lapp, Shahbuland Matiana, Louis Castricato, Spencer Frazier

机构 * Overworld AI Indian Institute of Science Education and Research Bhopal(印度科学教育与研究学院博帕尔分校)

专题命中 Agent评测 :agent(title,abstract)

AI总结 COMBAT通过在Tekken 3中训练实时动作控制的世界模型,利用扩散模型模拟动态对手,实现对玩家行为的响应性训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13772 2026-03-03 cs.GT 78%

Quantile agent utility and implications to randomized social choice

分位数代理效用及其对随机社会选择的影响

Ioannis Caragiannis, Fabian Frank, Sanjukta Roy

专题命中 Agent评测 :agent(title,abstract)

AI总结 本文提出分位数代理效用概念,通过比较代表者来评估随机结果,展示了在随机社会选择中效率、公平和无策略性可以同时满足的可能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04026 2026-03-02 cs.HC 78%

VeriWeb: Verifiable Long-Chain Web Benchmark for Agentic Information-Seeking

VeriWeb: 可验证的长链网络基准测试用于代理信息检索

Shunyu Liu, Minghao Liu, Huichi Zhou, Zhenyu Cui, Yang Zhou, Yuhao Zhou, Jialiang Gao, Heng Zhou, Yunhao Yang, Wendong Fan, puzhen zhang, Ge Zhang, Jiajun Shi, Weihao Xuan, Jiaxing Huang, Shuang Luo, Fang Wu, Heli Qi, Qingcheng Zeng, Junjie Wang, Aosong Feng, Jindi Lv, Sicong Jiang, Ziqi Ren, Wangchunshu Zhou, Zhenfei Yin, Wenlong Zhang, Guohao Li, Wenhao Yu, Lei Ma, Lei Bai, Qunshu Lin, Mingli Song, Dacheng Tao

专题命中 Agent评测 :agentic(title,abstract)

AI总结 VeriWeb是一个用于评估和开发网络代理的可验证长链网络基准测试,通过长链复杂性和子任务级可验证性设计,揭示了处理长时间网络任务的性能差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21548 2026-02-27 cs.DC 78%

DualPath: Breaking the Storage Bandwidth Bottleneck in Agentic LLM Inference

DualPath: 突破代理LLM推理中的存储带宽瓶颈

Yongtong Wu, Shaoyuan Chen, Yinmin Zhong, Rilin Huang, Yixuan Tan, Wentao Zhang, Liyue Zhang, Shangyan Zhou, Yuxuan Liu, Shunfeng Zhou, Mingxing Zhang, Xin Jin, Panpan Huang

专题命中 Agent评测 :agentic(title,abstract)

AI总结 DualPath通过双路径KV缓存加载技术,突破代理LLM推理中的存储带宽瓶颈,提升推理系统吞吐量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19639 2026-02-24 cs.MA 78%

Effects of Property Recovery Incentives and Social Interaction on Self-Evacuation Decisions in Natural Disasters: An Agent-Based Modelling Approach

财产回收激励与社会互动对自然灾害中自我撤离决策的影响:基于代理的建模方法

Made Krisnanda, Raymond Chiong, Yang Yang, Kirill Glavatskiy

专题命中 Agent评测 :agent(title,abstract)

AI总结 本文通过基于代理的建模方法,研究了财产回收激励和社会互动对自然灾害中家庭撤离决策的影响,发现社会网络结构和优先级设置对撤离率有显著影响。

Comments 21 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14391 2026-02-17 cs.NI 78%

ASA: Adaptive Smart Agent Federated Learning via Device-Aware Clustering for Heterogeneous IoT

ASA: 通过设备感知聚类实现异构物联网的自适应智能代理联邦学习

Ali Salimi, Saadat Izadi, Mahmood Ahmadi, Hadi Tabatabaee Malazi

专题命中 Agent评测 :agent(title,abstract)

AI总结 ASA通过设备感知聚类实现异构物联网的自适应智能代理联邦学习,提升效率、可扩展性和公平性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12102 2026-02-13 cs.MA 78%

DEpiABS: Differentiable Epidemic Agent-Based Simulator

DEpiABS:可微分流行病基于代理的模拟器

Zhijian Gao, Shuxin Li, Bo An

专题命中 Agent评测 :agent(title,abstract)

AI总结 DEpiABS是一种可微分基于代理的流行病模拟器,通过平衡机理细节、计算效率和可解释性,提升流行病预测的准确性与通用性。

Comments 17 pages, 9 figures, to be published in AAMAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06340 2026-02-09 cond-mat.stat-mech cond-mat.soft 78%

Ornstein-Uhlenbeck information particle: A new candidate of active agent

信息粒子:一种新的活性代理候选者

Xin Song, Xiji Shao, Yanwen Zhu, Cheng Yang, Linli He, Shigeyuki Komura, Zhanglin Hou

专题命中 Agent评测 :agent(title,abstract)

AI总结 本文提出了一种基于OU浴反馈控制的信息粒子,通过调整惯性效应和波动强度,实现两种不同运动模式,展示了其在活性代理中的潜力。

Comments 8 pages, 5 figures including 3 figures in main text and 2 figures in Appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05671 2026-02-06 cs.HC 78%

(Computer) Vision in Action: Comparing Remote Sighted Assistance and a Multimodal Voice Agent in Inspection Sequences

行动中的视觉:比较远程视觉援助与多模态语音代理在检查序列中的表现

Damien Rudaz, Barbara Nino Carreras, Sara Merlino, Brian L. Due, Barry Brown

专题命中 Agent评测 :agent(title,abstract)

AI总结 研究比较了远程视觉援助与多模态语音代理在检查任务中的表现,发现代理无法产生基于环境的视觉动作,从而缺乏关键资源。

Comments Conditionally accepted at CHI 2026, 32 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06189 2026-02-04 physics.soc-ph 78%

On the Effect of Missing Transmission Chain Information in Agent-Based Models: Outcomes of Superspreading Events and Workplace Transmission

关于代理模型中缺失传播链信息的影响:超传播事件和工作场所传播的后果

Sascha Korf, Sophia Johanna Wagner, Gerta Köster, Martin J. Kühn

专题命中 Agent评测 :agent(title,abstract)

AI总结 本文研究了代理模型中缺失传播链信息对流行病预测的影响,通过比较超传播事件和工作场所传播的不同场景,揭示简化假设对结果的影响。

Comments 54 pages, 25 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21347 2026-01-30 eess.AS cs.SD 78%

Towards Robust Dysarthric Speech Recognition: LLM-Agent Post-ASR Correction Beyond WER

迈向鲁棒的口吃语音识别:LLM代理在WER之外的ASR后修正

Xiuwen Zheng, Sixun Dong, Bornali Phukon, Mark Hasegawa-Johnson, Chang D. Yoo

专题命中 Agent评测 :agent(title,abstract)

AI总结 本文提出基于LLM的代理用于ASR后修正,通过语义校正提升口吃语音识别的鲁棒性,实现WER降低和语义性能提升。

Comments Accepted to ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15273 2026-01-22 q-bio.QM 78%

How high-resolution agent-based models can improve fundamental insights in tissue development and cell culturing methods

高分辨率基于代理的模型如何改进组织发育和细胞培养方法的基础见解

Paul Van Liedekerke, Jiří Pešek, Kevin Alessandri, Dirk Drasdo

专题命中 Agent评测 :agent(title,abstract)

AI总结 本文探讨了可变形细胞模型在组织发育和细胞培养方法中的应用,通过高分辨率模拟提升生物和生物技术问题的定量分析能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15258 2026-01-22 cs.GT 78%

Distributed Agent-Constrained Truthful Facility Location

分布式代理约束下的诚实设施定位

Argyrios Deligkas, Panagiotis Kanellopoulos, Alexandros A. Voudouris

专题命中 Agent评测 :agent(title,abstract)

AI总结 该研究提出了一种分布式设施定位机制,通过两阶段选择代表位置,确保代理无法通过策略性报告获益,并分析了两种成本变体下的近似比界。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15144 2026-01-22 q-bio.PE 78%

Modification speed and radius of higher-order interactions alter the oscillatory dynamics in an agent-based model

高阶相互作用的修改速度和半径改变代理模型中的振荡动力学

Thomas Van Giel, Hanna Jaspaert, Aisling J. Daly, Bernard De Baets, Jan M. Baetens

专题命中 Agent评测 :agent(title,abstract)

AI总结 本研究探讨了高阶相互作用在代理模型中对物种振荡动力学的影响,发现其修改速度和半径显著影响系统稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13801 2026-01-21 cs.RO 78%

HoverAI: An Embodied Aerial Agent for Natural Human-Drone Interaction

HoverAI: 一种用于自然人-无人机交互的具身空中代理

Yuhua Jin, Nikita Kuzmin, Georgii Demianchuk, Mariya Lezina, Fawad Mehboob, Issatay Tokmurziyev, Miguel Altamirano Cabrera, Muhammad Ahsan Mustafa, Dzmitry Tsetserukou

机构 * Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Skolkovo Institute of Science and Technology(斯克尔科沃信息科技研究所)

专题命中 Agent评测 :agent(title,abstract)

AI总结 HoverAI通过结合无人机移动、视觉投影和对话式AI,实现了人-无人机自然交互的具身代理,提升了空间感知与社交响应能力。

Comments This paper has been accepted for publication at LBR HRI 2026 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12628 2026-01-21 cs.SI 78%

Constructing a Dataset to Support Agent-Based Modeling of Online Interactions: Users, Topics, and Interaction Networks

构建支持在线交互 agent-based 模型的数据集:用户、话题和交互网络

Abdul Sittar, Miha Cesnovar, Alenka Gucek, Marko Grobelnik

专题命中 Agent评测 :agent(title,abstract)

AI总结 本文通过构建基于 Reddit 的大规模数据集,支持 agent-based 模型研究用户、话题和交互网络的现实性与验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05484 2026-01-21 cs.CY 78%

Evaluating LLM Safety Across Child Development Stages: A Simulated Agent Approach

评估大语言模型在儿童发展阶段的安全性:一种模拟代理方法

Abhejay Murali, Saleh Afroogh, Kevin Chen, David Atkinson, Amit Dhurandhar, Junfeng Jiao

专题命中 Agent评测 :agent(title,abstract)

AI总结 本文提出ChildSafe基准,通过模拟不同儿童发展阶段的认知变化,评估大语言模型在面对认知多样性时的安全性与对齐鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09813 2026-01-16 q-bio.PE 78%

An agent-based modelling approach to investigate the impact of gender on tuberculosis transmission in Uganda

基于代理建模的方法研究乌干达性别对肺结核传播的影响

James W. G. Doran, Dennis Mujuni, Kit Gallagher, Christian A. Yates, Ruth Bowness

专题命中 Agent评测 :agent(title,abstract)

AI总结 本研究通过开发基于代理的模型,探讨性别因素对乌干达肺结核传播的影响,发现性别均等的疾病进展参数可降低病例比率和总病例数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20975 2026-01-15 cs.CV 78%

SPOT!: Map-Guided LLM Agent for Unsupervised Multi-CCTV Dynamic Object Tracking

SPOT!: 多CCTV动态目标跟踪的映射引导LLM代理

Yujin Roh, Inho Jake Park, Chigon Hwang

专题命中 Agent评测 :agent(title,abstract)

AI总结 SPOT通过映射引导LLM代理在多CCTV环境中实现无先验训练的动态目标跟踪,有效解决盲区导致的轨迹丢失问题。

Comments 33 pages, 27figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07763 2026-01-13 cs.GT 78%

Structural Approach to Guiding a Present-Biased Agent

结构化方法用于引导现时偏好代理

Tatiana Belova, Yuriy Dementiev, Artur Ignatiev, Danil Sagunov

专题命中 Agent评测 :agent(title,abstract)

AI总结 本文提出了一种结构化方法,用于引导现时偏好代理,通过参数化算法分析任务图的计算复杂性,并给出了固定参数可 tractable 算法。

Comments Accepted at AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06920 2026-01-13 cs.NE cs.MA 78%

Calibrating Agent-Based Financial Markets Simulators with Pretrainable Automatic Posterior Transformation-Based Surrogates

基于可预训练的自动后验变换的代理基于金融市场模拟器校准

Boquan Jiang, Zhenhua Yang, Chenkai Wang, Muyao Zhong, Heping Fang, Peng Yang

专题命中 Agent评测 :agent(title,abstract)

AI总结 本文提出ANTR方法,通过可预训练的神经密度估计器和自适应信任区域策略,提升代理基于金融市场模拟器的校准精度和效率。

Comments 32 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04554 2026-01-09 cs.IR 78%

Exploring Recommender System Evaluation: A Multi-Modal User Agent Framework for A/B Testing

探索推荐系统评估:一种用于A/B测试的多模态用户代理框架

Wenlin Zhang, Xiangyang Li, Qiyuan Ge, Kuicai Dong, Pengyue Jia, Xiaopeng Li, Zijian Zhang, Maolin Wang, Yichao Wang, Huifeng Guo, Ruiming Tang, Xiangyu Zhao

专题命中 Agent评测 :agent(title,abstract)

AI总结 本文提出一种多模态用户代理框架,用于替代传统A/B测试,通过模拟真实用户行为提升推荐系统性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15196 2026-01-07 math.OC cs.SY eess.SY 78%

AdGT: Decentralized Gradient Tracking with Tuning-free Per-Agent Stepsize

AdGT:具有无调优每代理步长的去中心化梯度追踪

Diyako Ghaderyan, Stefan Werner

专题命中 Agent评测 :agent(title,abstract)

AI总结 AdGT是一种自适应梯度追踪方法,通过根据局部目标的光滑度调整步长,实现去中心化优化的线性收敛。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21598 2025-12-29 cs.CV 78%

From Shallow Humor to Metaphor: Towards Label-Free Harmful Meme Detection via LMM Agent Self-Improvement

从浅层幽默到隐喻:通过LMM代理自我改进实现无标签有害迷因检测

Jian Lang, Rongpei Hong, Ting Zhong, Leiting Chen, Qiang Gao, Fan Zhou

机构 * University of Electronic Science and Technology of China(电子科技大学) Southwestern University of Finance and Economics(西南财经大学) Intelligent Digital Media Technology Key Laboratory of Sichuan Province(四川省智能数字媒体技术重点实验室)

专题命中 Agent评测 :agent(title,abstract)

AI总结 ALARM通过LMM代理自我改进实现无标签有害迷因检测,利用浅层迷因信息提升对复杂迷因的识别能力。

Comments 12 pages. Accepted by KDD 2026 research track. Codes are released at https://github.com/Jian-Lang/ALARM

详情

展开后加载摘要…

URL PDF HTML 收藏