arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-27 至 2026-08-27 共收录 29 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 29 篇

2608.25523 2026-08-27 cs.CL 新提交 92%

TOPAS: Workflow-Aware Prefix-State Scheduling for Multi-Agent LLM Serving

TOPAS:面向多智能体大语言模型服务的工作流感知前缀状态调度器

Hongqiu Ni, Han Tian, Chi Zhang, Guopeng Li, Haisheng Tan

机构 * University of Science and Technology of China(中国科学技术大学) Hefei University of Technology(合肥工业大学)

专题命中 多智能体 :agent(title,abstract);workflow(title,abstract);multi-agent(title,abstract);分类 cs.CL

AI总结 针对多智能体LLM服务的前缀缓存权衡问题,提出TOPAS调度器,在SGLang框架中实现,经实验可显著降低合成及MetaGPT工作负载下的作业完成时间。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25992 2026-08-27 cs.AI cs.MA 新提交 91%

ProgRouter: Online Progress-Guided Orchestration for Multi-Agent LLM Workflows under Quality-Cost Tradeoffs

ProgRouter:面向质量-成本权衡的多智能体大语言模型工作流的在线进度引导编排

Somgyuan Li, Ahmed M. Abdelmoniem, Shiqiang Wang

机构 * Aston University(阿斯顿大学) Queen Mary University of London(伦敦玛丽女王大学) University of Exeter(埃克塞特大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);agentic(abstract,comments);workflow(abstract)

AI总结 ProgRouter是一种在线进度引导路由框架,通过多视图任务进度评分器等机制,在多智能体LLM工作流中平衡任务质量与时间、成本预算,在多类任务数据集上较基线降低运营成本且保持性能。

Comments Accepted in Findings of the Association for Computational Linguistics: EMNLP 2026. Index Terms: Collaborative agentic workflows, LLM agent orchestration, Quality-cost trade-off, Task progress prediction, Online decision-making

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15356 2026-08-27 cs.AI cs.MA 版本更新 91%

Regulator-Manufacturer AI Agents Modeling: Mathematical Feedback-Driven Multi-Agent LLM Framework

监管方-制造商AI智能体建模:数学反馈驱动的多智能体大语言模型框架

Yu Han, Zekun Guo

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);AI agent(title);分类 cs.AI

AI总结 本研究提出数学反馈驱动的多智能体LLM框架,模拟监管动态,揭示监管转变对医疗器械行业行为的影响,为相关利益方提供优化监管实践与合规性的可操作见解。

Comments v3 adds a technical clarification note on the implementation and quantitative analyses; the body of the paper is unchanged from v2

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25457 2026-08-27 cs.CR cs.AI cs.MA 新提交 90%

MACGen: Toward Functionally Correct and Secure Code Generation via Multi-Agent Collaboration

MACGen:通过多智能体协作实现功能正确且安全的代码生成

Miseon Yu, Jaehoon Choi, Younghan Lee, Yunheung Paek

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract);agentic(abstract)

AI总结 MACGen是整合规划等多环节的多智能体代码生成框架,在CWEval、BaxBench基准上,较直接提示显著提升安全代码生成的功能与安全性指标。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09772 2026-08-27 cs.AI 版本更新 90%

Two Heads are Better Than One: Test-time Scaling of Multi-agent Collaborative Reasoning

两个脑袋胜过一个:测试时扩展多智能体协作推理

Can Jin, Hongwu Peng, Qixin Zhang, Yang Zhou, Yujin Tang, Tong Che, Dimitris N. Metaxas

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 该研究针对单智能体测试时扩展(TTS)的瓶颈,提出用多智能体系统(MAS)升级TTS,引入M500数据集并结合CEO智能体的自适应策略,微调的Qwen2.5-32B-MAS等模型性能优于基础模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11635 2026-08-27 cs.CY cs.AI cs.CL 版本更新 90%

EduAgentQG: Multi-Agent Personalized Mathematics Question Generation with Explicit Diversity and Objective-Aware Evaluation

EduAgentQG:具有显式多样性和目标感知评估的多智能体个性化数学问题生成

Rui Jia, Min Zhang, Fengrui Liu, Bo Jiang, Kun Kuang, Zhongxiang Dai

机构 * East China Normal University(东华大学) Shanghai Institute of Al for Education(上海人工智能教育研究院) The Chinese University of Hong Kong, Shenzhen School of Data Science(香港中文大学(深圳)数据科学学院)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract);分类 cs.AI、cs.CL

AI总结 本文针对现有数学问题生成方法难以兼顾目标对齐与可控多样性的问题,提出多智能体框架EduAgentQG,构建专属基准并验证其在多项指标上优于COT等基线方法。

Comments Accepted to IPM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25920 2026-08-27 cs.AI cs.SE 新提交 88%

Repair or Resample? Rethinking Failure Debugging in LLM Multi-Agent Systems

修复还是重采样?重新思考LLM多智能体系统中的故障调试

Zhongwen Luan, Xiaoyu Zhang, Ming Hu, Yue Yang, Jiongchi Yu, Xiaohong Chen

机构 * East China Normal University(华东师范大学) Nanyang Technological University(南洋理工大学) Singapore Management University(新加坡管理大学) Xi’an University of Architecture and Technology(西安建筑科技大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.SE

AI总结 本研究针对LLM多智能体系统的故障调试,提出SymTrace评估框架与SymFail数据集,发现现有无指导重运行方法不可靠,提出的症状驱动干预方法可显著提升故障修复率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25277 2026-08-27 cs.CL cs.AI 新提交 88%

Routed Graph Handoff: Adaptive Format Selection for Multi-Agent LLM Delegation

路由图交接:多智能体大语言模型委派的自适应格式选择

Pratyay Banerjee, Ankit Chadha

机构 * Amazon(亚马逊)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL

AI总结 本研究针对多智能体 LLM 协调的高 token 开销问题,提出路由图交接方法,通过轻量级 LLM 路由器在图与自然语言间自适应选择,在多基准测试中实现性能提升或持平,且开销极低。

Comments Accepted in EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25937 2026-08-27 cs.AI cs.MA 新提交 88%

Candidate supply and answer selection shape the value of LLM judging in multi-agent systems

候选供给与答案选择塑造多智能体系统中大语言模型(LLM)评判的价值

Jia-Hao Ji, Sijie Li, Jiabei Cheng, Zixi She, Jin-Tai Yu, Zhiyuan Yuan

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 该研究针对多智能体系统中LLM评判的价值,通过分析多组基准数据集,发现结合答案频率与LLM评判可提升答案准确率,为设计多智能体架构提供了诊断基础。

Comments 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25794 2026-08-27 cs.LG cs.DC cs.SD eess.AS eess.SP 新提交 88%

Cooperative Multi-Agent Reinforcement Learning for Adaptive Aggregation in Semi-Supervised Federated Learning with non-IID Data

面向非独立同分布数据的半监督联邦学习中自适应聚合的协作多智能体强化学习

Rene Glitza, Luca Becker, Rainer Martin

机构 * Institute of Communication Acoustics, Ruhr-Universität Bochum(鲁尔大学波鸿分校通信声学研究所)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 针对非独立同分布数据半监督联邦学习的挑战,提出pFedMARL方法,利用多智能体强化学习动态调整聚合策略,提升模型准确率、鲁棒性与公平性,性能优于FedAvg等方法。

Comments 5 pages, 4 figures, ICASSP 2026 - 2026 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16063 2026-08-27 cs.HC cs.AI 版本更新 88%

Automated Healthcare Thematic Analysis using Multi-Agent Large Language Model: Algorithm Development and Evaluation

一个多智能体大语言模型框架用于自动化定性分析

Qidi Xu, Nuzha Amjad, Grace Giles, Alexa Cumming, De'angelo Hermesky, Alexander Wen, Min Ji Kwak, Yejin Kim

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本文提出CoTI框架,通过多智能体协作实现自动化定性分析,提升主题识别效率,但指出过度依赖AI可能影响研究者独立思考。

Comments 45 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25770 2026-08-27 cs.MA 新提交 88%

HypoForge: A Self-Improving Multi-Agent Framework for Automated Hypothesis Generation and Testing via Scientific Skill Learning

HypoForge:一种通过科学技能学习实现自动假设生成与测试的自改进多智能体框架

Ziqing Qian, Jiaying Lei, Yifang Wang, Nan Cao

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 提出HypoForge多智能体框架,通过匹配阶段特定监督的技能学习策略,无需微调基础模型即可实现自改进,在相关基准上优于现有框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25323 2026-08-27 eess.SY 新提交 88%

Scalable Tube-Tightened Multi-Agent Safety via Certified Constraint Reduction

基于可验证约束缩减的可扩展多智能体安全控制:管收紧策略

Armel Koulong

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 该研究针对多智能体系统的分布式模型预测控制,提出可验证的约束缩减方法,减少安全约束数量,保留标称控制,提升计算效率且保证安全。

Comments Submitted for consideration at the 2027 American Control Conference (ACC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25099 2026-08-27 math.OC math.DS 新提交 88%

A Control-Theoretic Approach for Resource-Aware Consensus in Multi-Agent AI

面向多智能体AI中资源感知共识的控制论方法

James Flagg, Esteban A. Hernandez-Vargas

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 该研究针对LLM-MAS共识性能与计算资源关联保证不足的问题,提出将集体信念动态表征为离散时间切换系统的控制论方法,构建共识-预算证书区域,实现资源感知的多智能体协调。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14335 2026-08-27 eess.SP eess.SY 交叉投稿 88%

Multi-Agent Reinforcement Learning for Joint Handover Management and Power Allocation in Multi-Orbit Satellite Networks

面向多轨道卫星网络中联合切换管理与功率分配的多智能体强化学习

Yassine Afif, Ashutosh Balakrishnan, Philippe Martins, Mohammed Almekhlafi, Antoine Lesage-Landry, Gunes Karabulut Kurt

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 针对多轨道卫星网络的联合切换管理与功率分配问题,提出结合MAPPO与TarMAC的多智能体强化学习策略,在保证接近贪心方案吞吐量的同时大幅减少切换次数,性能优于仅低轨方案与保守停留策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23616 2026-08-27 cs.SE cs.AI 版本更新 86%

Rebuild Dossier: Mechanically-Enforced Specs for Agentic App Rebuilds, and What Model-Tier Failures Reveal

重建档案:智能体应用重建的机械执行规范,以及模型层级故障所揭示的问题

Parker Fawcett

专题命中 多智能体 :agentic(title);agent(abstract);AI agent(abstract);multi-agent(abstract)

AI总结 本研究推出开源工具rebuild-dossier,通过锁定应用接口、自动化检查强制执行构建流程,发现模型层级故障并验证其有效性,工具可跨模型与工具链复现。

Comments 48 pages, 1 figure. Code and evaluation artifacts: this https URL (https://github.com/Parker-Fawcett/rebuild-dossier) (archived at DOI: https://doi.org/10.5281/zenodo.22036801 )

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26008 2026-08-27 cs.CR cs.CL 新提交 84%

A Self-Evolving Multi-Agent Framework Defense against LLM Jailbreak Attacks

一种针对LLM越狱攻击的自进化多智能体框架防御方法

Tongyan Hu, Bryan Hooi

专题命中 多智能体 :agent(title);multi-agent(title);分类 cs.CL

AI总结 该研究针对LLM越狱攻击提出一种基于规则记忆的自进化多智能体防御框架,无需参数更新,可降低攻击成功率且保留良性效用,适用于两类LLM模型。

Comments 8 pages (main), with appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25152 2026-08-27 cs.CL cs.AI 新提交 84%

Belief Cascades Drive Persuasion in LLM Agent Networks

信念级联驱动LLM智能体网络中的说服行为

Haoyi Qiu, Genglin Liu, Pranav Narayanan Venkit, Kung-Hsiang Huang, Saadia Gabriel, Chien-Sheng Wu, Nanyun Peng

机构 * University of California, Los Angeles(加州大学洛杉矶分校) Salesforce AI Research(Salesforce AI研究)

专题命中 多智能体 :agent(title,abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 该研究构建受控测试平台,发现LLM智能体网络中说服动态受拓扑等因素影响,直接暴露可预测立场变化,需结合多维度数据评估多智能体说服。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15161 2026-08-27 cs.CL cs.AI 版本更新 84%

Retrieval-Augmented Agentic Rubric Generation for Reliable Medical Response Evaluation

用于医疗对话系统可靠评估的自动化评分标准

Yinzhu Chen, Abdine Maiga, Hossein A. Rahmani, Emine Yilmaz

机构 * AI Center, University College London(伦敦大学学院人工智能中心)

专题命中 多智能体 :agentic(title);agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出一种检索增强的多智能体框架,用于自动生成实例特定的评估评分标准,通过权威医学证据生成可验证的细粒度评估标准,并在HealthBench和LLMEval-Med数据集上取得显著成效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25193 2026-08-27 cs.ET cs.LG 新提交 83%

Simulating Cognitive Smart Freight Corridors with Agent-Based Models and Reinforcement Learning

基于智能体模型与强化学习的认知智能货运走廊模拟

Madelaine Martinez-Ferguson, Chun Wang, Mustafa Can Camur, Xueping Li

专题命中 多智能体 :agent(title,abstract);multi-agent(abstract);分类 cs.LG

AI总结 该研究提出耦合多技术层的ABM框架,结合RL与MARL模拟认知智能货运走廊,实验表明其在吞吐量、拥堵、节能等方面优于基准场景,高需求下优势更显著。

Comments 11 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26081 2026-08-27 cs.AI cond-mat.mtrl-sci cs.CL 新提交 73%

SwarmWorld: Stigmergic technological evolution in societies of language-model agents

SwarmWorld:语言模型智能体社会中的标记介导技术演化

Subhadeep Pal, Fiona Y. Wang, Markus J. Buehler

机构 * Laboratory for Atomistic and Molecular Mechanics (LAMM)(原子与分子力学实验室(LAMM)) Department of Civil and Environmental Engineering(土木与环境工程系) Department of Biological Engineering(生物工程系) Department of Mechanical Engineering(机械工程系) Center for Computational Science and Engineering(计算科学与工程中心) Schwarzman College of Computing(苏世民计算机学院) Massachusetts Institute of Technology(麻省理工学院)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 该研究提出SwarmWorld框架,让无角色的LLM智能体自组织成技术社会,其协作构建的技术组合比独立搜索更具韧性,揭示了标记介导的技术演化机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22583 2026-08-27 cs.LG cs.AI 版本更新 73%

Clinical Graph-JEPA: Predictive Patient-State Knowledge Graphs for Cognitive Decision Support

Clinical Graph-JEPA:用于认知决策支持的预测性患者状态知识图谱

Kushagra Yadav, Nalin Prabhath, Amit Lamba, James E. Schrager, Goeun Han, Yining Mao

机构 * New York University(纽约大学) University of Chicago(芝加哥大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 该研究针对临床知识图谱构建难题,提出结合多智能体关系提议等技术的Clinical Graph-JEPA框架,在MIMIC-IV数据集上验证其提升了留一边缘恢复的MRR。

Comments Accepted at WM@Booth 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04632 2026-08-27 cs.CL cs.AI 版本更新 73%

From National Curricula to Cultural Awareness: Constructing Open-Ended Culture-Specific Question Answering Dataset

从国家课程到文化意识:构建开放性文化特定问答数据集

Haneul Yoo, Won Ik Cho, Geunhye Kim, Jiyoon Han

机构 * KAIST AI Center(韩国国立科学技术院人工智能中心) Samsung Electronics(三星电子) Hankuk University of Foreign Studies(韩国外语大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出CuCu框架,利用国家课程构建文化特定的开放性问答数据集KCaQA,以提升语言模型在文化对齐方面的表现。

Comments EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25477 2026-08-27 cs.NI cs.LG 新提交 70%

AERIS: Offline Policy Improvement for Multi-UAV Integrated Sensing and Communication

AERIS:面向多无人机集成感知与通信的离线策略改进

Ziyuan Wang, Yifan Sui, Wei Wei, Wenjie Xin, Zekai Zhang, Xiangwang Hou, Xiao-Ping (Steven) Zhang

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 针对多无人机集成感知与通信的控制问题,提出离线策略改进框架AERIS及STAR-CRDT算法,在保障安全的同时显著提升ISAC性能与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25419 2026-08-27 cs.MA cs.LG 新提交 70%

BVR Sim: An Open and High-Throughput Environment for Heterogeneous Air-Combat Reinforcement Learning

BVR Sim:用于异构空战强化学习的开源高通量环境

Haocheng Sun (Beijing University of Posts and Telecommunications), Mulai Tan (Air Force Engineering University)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 本文提出开源异构空战强化学习环境 BVR Sim,支持多飞行器模型,具备高仿真效率,策略可跨平台迁移,且兼容主流多智能体强化学习框架。

Comments 9 pages, 4 figures, 4 tables. Code and reproducibility artifacts available at the project repository

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24910 2026-08-27 cs.HC cs.AI 新提交 70%

From Plots to Words: Model-Aware Multimodal Explanations as a Foundation for Accessible, Non-Visual Interaction

从图表到文本:模型感知的多模态解释作为可访问非视觉交互的基础

Nur Keleşoğlu, Łukasz Sobczak, Joanna Domańska

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 该研究提出多智能体框架,将时间序列预测的视觉输出转为模型感知文本解释,可提升非视觉交互的可访问性,其可解释配置使解释质量最高提升32%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17068 2026-08-27 cs.LG eess.SY 版本更新 70%

Spatio-temporal dual-stage hypergraph MARL for human-centric multimodal corridor traffic signal control

时空双阶段超图多智能体强化学习用于以人为中心的多模式走廊交通信号控制

Xiaocai Zhang, Neema Nassir, Milad Haghani

机构 * Department of Infrastructure Engineering, Faculty of Engineering and Information Technology, The University of Melbourne, VIC 3010, Australia(工程与信息技术学院基础设施工程系,墨尔本大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 本文提出STDSH-MARL方法,通过时空双阶段超图注意力机制和混合动作空间,提升走廊交通信号对多模式旅行者和公共交通的适应性与优先级。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25383 2026-08-27 cs.NI 新提交 67%

Traffic-Adaptive Per-Hop Multipath Routing in Multi-Hop UAV Networks

多跳无人机网络中流量自适应的逐跳多路径路由

Zhenyu Zhao, Tiankui Zhang, Xiaoxia Xu, Yuanpeng Zheng, Junjie Li, Wenjuan Xing

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 针对多跳无人机网络的链路波动与拓扑变化问题,提出MAPPO-DM算法实现逐跳多路径流量自适应路由,可提升分组按时交付率并降低丢失率,性能优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25281 2026-08-27 math.OC eess.SY math-ph stat.ML 新提交 67%

Schrödinger Bridges over Kinetic Swarming Models

基于动力学蜂拥模型的薛定谔桥

Asmaa Eldesoukey, Md Zulfiqur Haider, Italo Napolitano, Yongxin Chen, Abhishek Halder

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 该研究针对受随机扰动的惯性蜂拥,基于薛定谔桥理论,提出嵌套不动点方案求解最优控制,实现有限时间内将蜂拥群体引导至规定端点分布的目标。

详情

展开后加载摘要…

URL PDF HTML 收藏