arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 7246 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 1195 篇

2606.10465 2026-06-10 cs.SE 新提交 88%

MASTOR: A Multi-Agent Approach to Semantic Test Oracle Generation for RESTful APIs

MASTOR: 一种面向RESTful API的语义测试预言生成多智能体方法

Sida Deng, Rubing Huang, Zhenzhen Yang, Man Zhang, Xuan Xie, Rongcun Wang

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.SE

AI总结 提出MASTOR多智能体方法,通过分析源码上下文生成语义测试预言,包括状态字段预言和行为一致性预言,在13个开源项目上达到75.4%平均变异得分。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10307 2026-06-10 cs.CL 新提交 88%

Early-Token Confidence Predicts Reasoning Quality in Multi-Agent LLM Debate

早期令牌置信度预测多智能体LLM辩论中的推理质量

Ali Keramati, Justin Cheok, Jacob Horne, Mark Warschauer

机构 * University of California, Irvine(加州大学尔湾分校)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.CL

AI总结 研究利用解码时令牌级对数概率作为置信度信号,预测多智能体LLM辩论中的推理质量,发现早期令牌置信度是最强预测因子。

Comments 15 pages, 8 figures, 4 tables; ACL Proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09610 2026-06-09 cs.RO cs.AI 新提交 88%

Shape Formation for the Cooperative Transportation of Arbitrary Objects Using Multi-Agent Reinforcement Learning

基于多智能体强化学习的任意物体协同运输中的形状形成

Mohamed Sayed, Wolfram Burgard, Tanja Katharina Kaiser

机构 * University of Technology Nuremberg(纽伦堡工业大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 提出一种多智能体强化学习方法,使多机器人系统自主形成支撑任意形状和非均匀质量分布物体的编队,同时避免障碍物,实现可靠且泛化的协同运输。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08897 2026-06-09 cs.CV cs.AI q-bio.QM 新提交 88%

A multi-agent system for spine MRI report generation from multi-sequence imaging

基于多序列影像的脊柱MRI报告生成多智能体系统

Zhiping Xiao, Junwei Yang, Gongbo Sun, Han Zhang, Hanwen Xu, Yi Yao, Zachary D. Miller, William E. King, Mohammed M. Kanani, Jalal B. Andre, Sammy Chu, Ming Zhang, Paul E. Kinahan, Nathan M. Cross, Sheng Wang

机构 * University of Washington(华盛顿大学) Peking University(北京大学) University of Wisconsin–Madison(威斯康星大学麦迪逊分校) New York University(纽约大学) University of Washington Medical Center(华盛顿大学医学中心)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 提出SpineAgent多智能体框架,利用多序列基础模型整合T1/T2等序列信息,实现脊柱MRI报告生成、病理定位和图文检索,在跨厂商和跨队列评估中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08367 2026-06-09 cs.MA cs.AI 新提交 88%

Emergence World: A Platform for Evaluating Long-Horizon Multi-Agent Autonomy

Emergence World: 一个用于评估长时域多智能体自主性的平台

Deepak Akkil, Ravi Kokku, Karthik Vikram, Tamer Abuelsaad, Aditya Vempaty, Satya Nitta

机构 * Emergence AI

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 提出一个持续运行的多智能体模拟平台,通过集成实时外部数据、120+工具和持久记忆系统,评估LLM代理在长时域(数周至数月)中的行为漂移、治理和跨模型影响等动态特性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08323 2026-06-09 cs.HC cs.AI 新提交 88%

"So There's a Catch-22 Here": How Early Adopters Who Build Multi-Agent LLM Systems Conceptualize Transparency

"所以这里有个第22条军规":构建多智能体LLM系统的早期采用者如何概念化透明度

Suchismita Naik, Samir Passi, Mihaela Vorvoreanu, Scott Saponas, Amanda Hall

机构 * Purdue University(普渡大学) Cornell University(康奈尔大学) Microsoft Research(微软研究院)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 通过访谈13位早期采用者,研究多智能体LLM系统构建者如何理解透明度,提出包含可重复性、调试、边界设定、可视化和审计的多维框架,强调透明度作为情境化的社会技术实践。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08030 2026-06-09 cs.MA cs.AI 新提交 88%

Voting Protocols as Coordination Mechanisms for Role-Constrained Multi-Agent Tutoring Systems

投票协议作为角色约束的多智能体辅导系统的协调机制

Eric S. Qiu, Joyce Gill

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 多智能体 :agent(title,abstract);multi-agent(title);agentic(abstract);分类 cs.AI

AI总结 研究投票协议如何塑造四个角色约束的教学智能体之间的协调,通过比较四种投票协议在模拟辅导环境中的效果,发现协议选择显著影响集体决策和协调行为。

Comments Accepted to ICML 2026 Workshop on AI4Good

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07845 2026-06-09 cs.MA cs.LG 新提交 88%

GRPO Does Not Close the Multi-Agent Coordination Gap

GRPO 并未缩小多智能体协调差距

Najmul Hasan, Prashanth BusiReddyGari

机构 * Department of Mathematics and Computer Science University of North Carolina at Pembroke(数学与计算机科学系北卡罗来纳大学帕克维尔分校)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 通过哲学家就餐问题测试大语言模型的多智能体协调能力,发现GRPO训练无法显著提升性能,瓶颈在于训练方法而非计算量。

Comments 15 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07818 2026-06-09 cs.CL cs.NE 新提交 88%

Representational Similarity and Model Behavior in Multi-Agent Interaction

多智能体交互中的表征相似性与模型行为

Yujin Potter, Seun Eisape, Shiyang Lai, Alexander Huth, James Evans, Been Kim, Jacob Eisenstein, Dawn Song, Alane Suhr

机构 * University of Washington(华盛顿大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.CL

AI总结 研究LLM对间的表征相似性对合作与创新的影响,发现高相似性促进合作但降低新颖性,且早期层相似性关联最强。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07805 2026-06-09 cs.AI cs.MA 新提交 88%

Beyond Goodhart's Law: A Dynamic Benchmark for Evaluating Compliance in Multi-Agent Systems

超越古德哈特定律:多智能体系统中合规性评估的动态基准

Yiyang Zhao, Zhuo Zhang, Qingxuan Le, Lizhen Qu, Zenglin Xu

机构 * Fudan University(复旦大学) Shanghai Academy of AI for Science(上海人工智能科学研究院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Monash University(莫纳什大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 针对多智能体系统在压力下可能违反安全规则的问题,提出MAC-Bench动态对抗基准,通过SERV流水线生成无污染场景,并引入CSR和MG指标评估前沿模型的合规性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07645 2026-06-09 cs.CV cs.AI 新提交 88%

FineGen: A VLM-based Multi-Agent Framework for Fine-Grained Image-Text Dataset Construction

FineGen:基于VLM的多智能体框架用于细粒度图像-文本数据集构建

Chang Kong, Yuebing Li, Peng Mo, Haigang Zhang, Qiuming Luo

机构 * Shenzhen Polytechnic University(深圳职业技术大学) Institute of Applied Artificial Intelligence of the Guangdong-Hong Kong Macao Greater Bay Area(粤港澳大湾区应用人工智能研究所) Shenzhen University(深圳大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 提出FineGen框架,通过生成-验证-校正流水线和闭环反馈机制自动构建含硬负样本的细粒度数据集,在ImageNet上构建FineGen-100K,硬样本准确率提升14.4%。

Comments 15 pages, 2 figures, conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06754 2026-06-08 cs.MA cs.CL 新提交 88%

MADRAG: Multi-Agent Debate with Retrieval-Augmented Generation for Training-Free Analytic Essay Scoring

MADRAG: 基于检索增强生成的多智能体辩论用于免训练分析性论文评分

Ali Keramati, Shiyuan Zhou, Sharad Mehrotra, Mark Warschauer

机构 * University of California, Irvine(加州大学尔湾分校)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.CL

AI总结 提出MADRAG框架,结合多智能体辩论与检索增强,通过倡导者、批评者和法官的交互以及检索示例校准,实现无需训练的论文评分,性能接近监督系统。

Comments 21 pages, 7 figures, 14 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11215 2026-08-13 cs.AI cond-mat.stat-mech cs.CL cs.LG cs.MA physics.soc-ph 新提交 88%

Poor Man's Agentic Modeling: Simulating Large LLM-Agent Societies on a Laptop

简易智能体建模:在笔记本电脑上模拟大型大语言模型(LLM)智能体群体

Igor Itkin

专题命中 多智能体 :agent(title,abstract);agentic(title,comments);分类 cs.AI、cs.CL、cs.LG

AI总结 该研究提出用低成本拟合的低参数模型替代LLM智能体,可在笔记本电脑上模拟任意数量的LLM智能体群体,通过「交互顺序×记忆」分类法验证了该方法在多个LLM模拟上的有效性。

Comments 25 pages, 12 figures. Code and data at github.com/YehudaItkin/poor-mans-agentic-modeling; systematic review and pre-registration archived at Zenodo (doi:10.5281/zenodo.21198322, doi:10.5281/zenodo.21340310)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05729 2026-08-07 cs.AI cs.CL cs.CV cs.HC 新提交 88%

Unified Agent: Managing Interactions across Devices

统一智能体:管理跨设备交互

Xinshuang Liu, Runfa Blark Li, Shaoxiu Wei, Xin Lin, Truong Nguyen

机构 * University of California, San Diego(加利福尼亚大学圣迭戈分校)

专题命中 多智能体 :agent(title,abstract);AI agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 本文针对现有智能体跨设备交互场景的不足,提出带紧凑状态设计的统一智能体,构建对应基准数据集,其性能显著优于多种现有设计,且在不同MLLM设置下表现鲁棒。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28242 2026-07-31 cs.SE cs.AI cs.MA 新提交 88%

Agentic Metaverse Services: A New As-a-Service Paradigm

智能体元宇宙服务:一种新的即服务范式

Xiaofei Xu, Quan Z. Sheng, Zhongjie Wang, Boualem Benatallah, Xiao Wang, Ruipeng Han

专题命中 多智能体 :agentic(title,abstract);agent(abstract,abstract_cn);分类 cs.AI、cs.SE

AI总结 该研究提出智能体元宇宙服务(AMServ)与元宇宙环境下的智能体即服务(Meta-AaaS)新范式,概述其特征、原理、应用实例,指出发展趋势,将推动AI时代新兴服务产业发展。

Comments 11 pages, 5 figures; Accepted at the 2026 IEEE International Conference on Web Services (ICWS 2026); Corresponding author: Prof. Xiaofei Xu

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21877 2026-06-23 cs.AI cs.CR cs.SE 新提交 88%

AgentRiskBOM: A Risk-Scoping Security Bill of Materials for Agentic AI Systems

AgentRiskBOM:面向智能体AI系统的风险范围安全物料清单

Srimonti Dutta, Akshata Kishore Moharir

机构 * WAI USA Research Labs(WAI美国研究实验室) WAI USA(WAI美国)

专题命中 多智能体 :agentic(title,abstract);agent(abstract);AI agent(abstract);multi-agent(abstract)

AI总结 提出AgentRiskBOM,一种扩展SBOM/AIBOM/MLBOM的安全物料清单,通过添加运行时权限字段(自主性、工具权限、内存、凭证范围等)来填补智能体AI系统的能力透明度缺口,并在13个开源智能体上验证其覆盖率和检测能力。

Comments Accepted at IEEE International Conference on Cybersecurity and AI-Based Systems (Cyber-AI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17127 2026-06-17 q-bio.QM cs.AI cs.LG 新提交 88%

Agentic Discovery of Non-Canonical Antimicrobial Peptides with AMPGAN v3

AMPGAN v3 的非经典抗菌肽智能发现

Jay Jung, Xiaohan Zhang, Shenghan Song, Mahmoud Sayedahmed, Chijian Xiang, Yunong Xu, Ahmed AbdelKhalek, Severin T. Schneebeli, Matthew J. Wargo, Jianing Li, Safwan Wshah

机构 * University of Vermont(弗吉尼亚大学) Larner College of Medicine, University of Vermont(弗吉尼亚大学医学学院) Purdue University(普渡大学) Department of Comparative Pathobiology(比较病理科部门) Department of Horticulture and Landscape Architecture(园艺与景观建筑部门) Department of Industrial and Molecular Pharmaceutics(工业与分子药学部门)

专题命中 多智能体 :agentic(title,abstract);agent(abstract);planning(abstract);multi-agent(abstract)

AI总结 提出 AMPGAN v3,一种多目标条件 GAN,扩展生成词汇至 D-氨基酸和末端修饰,通过双判别器提升稳定性,体外验证显示对革兰氏阳性菌有活性,并引入 PepCraft 多智能体框架用于端到端发现。

Comments Presented at the GenBio Workshop, ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09122 2026-06-09 cs.SE cs.AI cs.ET cs.MA cs.NI 新提交 88%

Autonomous Incident Resolution at Hyperscale: An Agentic AI Architecture for Network Operations

超大规模下的自主事件解决:面向网络运维的智能体AI架构

Arun Malik

机构 * Arun Malik

专题命中 多智能体 :agentic(title,abstract);agent(abstract);AI agent(abstract);multi-agent(abstract)

AI总结 提出一种多智能体编排框架,通过分层分解、技能调用、知识编码和渐进自主,在超大规模云网络中实现90%以上常见事件的自主解决,并保障安全。

Comments 7 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24787 2026-08-26 cs.MA 新提交 88%

Test-Time Collaborative Classification over Multi-Agent Networks

多智能体网络上的测试时协同分类

Ping Hu, Mert Kayaalp, Ali H. Sayed

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 针对多智能体系统异质性导致的全局模型联合训练难题,提出测试时协同分类框架,通过分布式协议交换决策统计量,建立误差保证与泛化界并验证其性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24439 2026-08-26 cs.CV 新提交 88%

DoublesEval: Diagnosing Multi-Agent Tactical Reasoning in Vision-Language Models via Professional Doubles Badminton

DoublesEval:通过专业双打羽毛球诊断视觉语言模型的多智能体战术推理能力

Jintao Cheng, Weibin Li

机构 * The Hong Kong University of Science and Technology(香港科技大学) University of Macau(澳门大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 本研究提出DoublesEval框架,以专业双打羽毛球为测试平台评估VLMs的多智能体战术推理能力,发现现有模型存在明显瓶颈,所提TacticCheck可提升模型表现但仍有差距,强调需改进VLMs的评估范式。

Comments Accepted by BMVC2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22840 2026-08-25 cs.GT 新提交 88%

Equilibrium in Multi-Agent Reinforcement Learning

多智能体强化学习中的均衡

Maurizio D'Andrea, Bar Light

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 本文针对多智能体强化学习,提出马尔可夫贝叶斯粗相关均衡(MBCCE),证明自适应马尔可夫粗悔憾(AMCR)消失时经验分布聚点为MBCCE,且两种算法可生成近似MBCCE并得到有限时间收敛速率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23145 2026-08-25 cs.MA physics.optics 新提交 88%

First Demonstration of Multi-Agent LLM System for Million-Scale Optical Link Management in Global Production AIDCs

面向全球生产型人工智能数据中心(AIDC)中百万级光链路管理的多智能体大语言模型(LLM)系统的首次演示

Jingyi Su, Yihao Zhang, Dianxuan Fu, Leiyan Fei, Juan Wang, Mengfan Dai, Qing Liu, Xiong Wu, Yufeng Jiang, Cheng Chen, Bowen Zhang, Peilong Wang, Xi Chen, Zonglong He, Hongchen Yu, Zhicheng Ye, Weisheng Hu, Qunbi Zhuge

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 该研究首次演示了用于全球生产型AIDC百万级光链路自主故障管理的多智能体LLM系统,经SFT和记忆演化优化,在十周现场数据中F1达97.7%、故障减少超60%,性能优于SOTA LLM。

Comments 4 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18866 2026-08-20 eess.SY cs.SY 新提交 88%

Deciding Relabeling Observation Consistency in Multi-Agent Discrete-Event Systems

多智能体离散事件系统中重标记观测一致性的判定

Tomáš Masopust

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 本文证明多智能体离散事件系统的重标记观测一致性(ROC)是PSPACE完全问题,给出易处理情形的多项式时间算法与充分条件,修正了文献中相关错误结论并证明ROC的组合性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18241 2026-08-20 cs.GT 新提交 88%

Online Multi-Agent Contracts

在线多智能体契约

Paul Dütting, Michal Feldman, Yoav Gal-Tzur, Thomas Kesselheim

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 该研究针对在线多智能体契约模型,设计了子模收益下O(1)竞争力的在线策略,还证明了子模与XOS收益在在线契约场景下的竞争力界限存在本质分离。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17739 2026-08-19 cs.MA 新提交 88%

Offline Multi-Agent Reinforcement Learning with a Physics-Informed World Model for Cooperative Mixed Traffic Control

面向协同混合交通控制的、融入物理信息世界模型的离线多智能体强化学习

Lu Liu, Chi Xie, Xi Xiong

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 本研究针对混合交通中部分可观测高速瓶颈的网联自动驾驶车辆协同控制问题,提出融入物理信息世界模型的离线多智能体强化学习框架,经SUMO实验验证可提升状态重构与预测准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16908 2026-08-19 cs.SI 新提交 88%

MAG-Bot: A Multi-Agent Auditing Framework for Social Bot Detection

MAG-Bot:一种用于社交机器人检测的多智能体审计框架

Sichen Zhao, Yalun Qi

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 本研究提出基于LangGraph的多智能体框架MAG-Bot,用于社交机器人检测,通过角色约束的证据分解修正单LLM审计的盲点,在TwiBot-22测试集上显著提升了检测的准确率、召回率与F1值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15133 2026-08-18 math.OC cs.SY eess.SY math.DS 新提交 88%

Consensusability of Continuous-Time Multi-Agent Systems With Unbounded Heterogeneous Constant Delays: A Signed Laplacian Perspective

具有无界异构常时滞的连续时间多智能体系统的一致性能力:符号拉普拉斯视角

Yue Song, Mengqi Xue, Jiazuo Hou, Yuxi Lu, Qi Liu

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 该研究结合频域分析与代数图论,构建符号拉普拉斯算子,推导时滞下连续时间多智能体系统的一致性条件,为时滞一致性机制提供新视角。

Comments 9 pages, 4 figures

Journal ref IEEE Transactions on Automatic Control, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14335 2026-08-17 eess.SP 新提交 88%

Multi-Agent Reinforcement Learning for Joint Handover Management and Power Allocation in Multi-Orbit Satellite Networks

面向多轨道卫星网络中联合切换管理与功率分配的多智能体强化学习

Yassine Afif, Ashutosh Balakrishnan, Philippe Martins, Mohammed Almekhlafi, Antoine Lesage-Landry, Gunes Karabulut Kurt

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 针对多轨道卫星网络的联合切换管理与功率分配问题,提出结合MAPPO与TarMAC的多智能体强化学习策略,在保证接近贪心方案吞吐量的同时大幅减少切换次数,性能优于仅低轨方案与保守停留策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14390 2026-08-17 cs.MA 新提交 88%

Submodular Policy Learning for Distributed Task Allocation in Open Multi-Agent Systems

开放多智能体系统中分布式任务分配的次模策略学习

Jing Liu, Luca Ballotta, Yangyang Yang, Fangfei Li, Yang Tang, Ruggero Carli

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 本文针对开放多智能体系统分布式任务分配问题,提出SubMAPL方法,通过划分多线性扩展解决次模函数松弛与分类策略不匹配问题,在多智能体覆盖任务上性能优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13982 2026-08-17 cs.MA 新提交 88%

XAI-Guided Conservative Decentralized Execution for Offline Multi-Agent Network Slicing

面向离线多智能体网络切片的可解释人工智能引导保守式分散执行

Eslam Eldeeb, Hatim Chergui, Merouane Debbah

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 该研究针对离线多智能体网络切片的资源分配问题,提出XAI引导的保守式分散执行方法,实现零资源冲突,降低信令开销与88%的有效推理延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏