arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 14943 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 14943 篇

2608.06520 2026-08-10 cs.LG 新提交 88%

Online Security Learning in Cooperative Multi-Agent Systems under Hidden Byzantine Attacks

隐藏拜占庭攻击下多智能体系统的在线安全学习

Ximing Sun, Yue Wang

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 本文针对隐藏拜占庭攻击下的多智能体系统在线协同控制问题,分析攻击者信息对模型几何特性的影响,推导安全学习的信息论极限,提出鲁棒学习者并给出遗憾界,为可靠多智能体系统提供理论与算法基础。

Comments preprint; Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10317 2026-08-10 cs.RO cs.LG 版本更新 88%

Robot guide with multi-agent control and automatic scenario generation with LLM

基于多智能体控制与大语言模型自动场景生成的机器人引导系统

Elizaveta D. Moskovskaya, Anton D. Moscowsky

机构 * National Research Center "Kurchatov Institute"(国家研究快机构"库恰托夫研究所")

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 该研究开发了结合多智能体资源管理与LLM自动场景生成的混合社交机器人控制架构,在MENTOR-1导游机器人上验证了其能提升长期讲故事任务中机器人交互的自然性与丰富度。

Comments 14 pages, 4 figures, 4 tables, 1 demo-video and repository link. There were major changes: an introduction, a review, and a new experiment. Some tables and figures have also been changed

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05791 2026-08-07 cs.MA cs.AI 新提交 88%

A Two-Tier Perspective on Inference-Time Parallelism in Multi-Agent LLM Systems

多智能体大语言模型系统推理时并行性的两层视角

Zihan Xu, Haolin Tian, Hai Jiang

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本文提出整合两类并行性的TIPEX框架,在GAIA基准上验证推理时并行性可提升多智能体系统性能,中等难度任务从两类并行性协调中获益最多。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05340 2026-08-07 cs.NI cs.AI 新提交 88%

Multi-Agent Transformer for Queue-Level XR Traffic Scheduling in TSN Networks

面向TSN网络中队列级XR流量调度的多智能体Transformer

Marcos Carvalho, Fatih Temiz, Shavbo Salehi, Melike Erol-Kantarci, Daniel F. Macedo

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 针对TSN网络中队列级XR流量调度的现有方法存在队列依赖捕捉能力弱、对XR流量适应性差的问题,本文提出基于多智能体Transformer的多智能体强化学习方法,仿真显示其延迟与故障率降低效果显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29152 2026-08-07 cs.AI 版本更新 88%

SimMOF: AI agent for Automated MOF Simulations

SimMOF:用于自动化MOF模拟的AI代理

Jaewoong Lee, Taeun Bae, Jihan Kim

机构 * Department of Chemical and Biomolecular Engineering, Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院(KAIST)化学与生物分子工程系)

专题命中 多智能体 :agent(title,abstract);AI agent(title);workflow(abstract);分类 cs.AI

AI总结 SimMOF通过自然语言查询自动化MOF模拟全流程,实现依赖感知计划生成、可运行输入生成、多代理协同执行及结果分析,提供数据驱动的MOF研究可扩展基础。

Comments 42 pages, 7 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16141 2026-08-07 cs.MA cs.LG cs.NI 版本更新 88%

Communication-Aware Multi-Agent Reinforcement Learning for Decentralized Cooperative UAV Deployment

面向通信的多智能体强化学习用于分布式协同无人机部署

Enguang Fan, Yifan Chen, Zihan Shan, Klara Nahrstedt, Matthew Caesar, Jae Kim

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Boeing Research and Technology(波音研究与技术)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 本文提出基于图的多智能体强化学习框架,通过集中训练分散执行策略,在部分可观测和间歇性链路条件下实现高效无人机协同部署,展示了在合作中继部署和对抗任务中的优越性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04663 2026-08-06 cs.AI 新提交 88%

Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning

校准人工愧疚:用于亲社会多智能体强化学习的神经基础奖励塑造

Aaditya Mehta, Arya Shah

机构 * Mahatma Gandhi International School(圣雄甘地国际学校)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 该研究从人类神经行为数据校准愧疚信号作为亲社会奖励权重,嵌入多智能体强化学习环境后,其智能体的社会选择率最贴合人类数据,为亲社会奖励塑造提供了定量约束。

Comments 12 pages, 6 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04311 2026-08-06 cs.CL 新提交 88%

Pun Intended: Multi-Agent Translation of Wordplay with Contrastive Learning and Phonetic-Semantic Embeddings

并非双关:基于对比学习与音义嵌入的多智能体文字游戏翻译

Russell Taylor, Benjamin Herbert, Michael Sana

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.CL

AI总结 本研究结合大型语言模型与语言约束,提出三种双关语翻译方法,其多智能体系统在CLEF JOKER 2025竞赛中获专家评估第一,可改善文字游戏翻译效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21194 2026-08-06 cs.CR cs.AI 版本更新 88%

Is Monitoring Enough? Strategic Agent Selection For Stealthy Attack in Multi-Agent Discussions

监控足够吗?多智能体讨论中的隐蔽攻击策略性代理选择

Qiuchi Xiang, Haoxuan Qu, Hossein Rahmani, Jun Liu

机构 * Lancaster University, United Kingdom(兰卡斯特大学,英国)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 研究多智能体讨论中的隐蔽攻击问题,提出针对监控场景的攻击方法,证明持续监控无法完全消除对抗风险。

Comments Accepted at ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13661 2026-08-06 cs.LG cs.MA 版本更新 88%

Communication-Enhanced Tutoring for Efficient Decentralized Multi-Agent Reinforcement Learning

MACTAS: 基于自注意力的多智能体强化学习中智能体间通信方法 with 动作-价值函数分解

Maciej Wojtala, Bogusz Stefańczyk, Dominik Bogucki, Łukasz Lepak, Paweł Wawrzyński

机构 * University of Warsaw(华沙大学) IDEAS Research Institute(IDEAS研究机构) Institute of Fundamental Technological Research, Polish Academy of Sciences(波兰科学院基础技术研究所) IDEAS NCBR Warsaw University of Technology(华沙技术大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 MACTAS通过自注意力机制实现多智能体强化学习中的智能体间通信,结合动作-价值函数分解,提供可微通信方法,实现大规模系统的高效训练与高性能表现。

Comments Submitted for AAAI 2027

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18528 2026-08-06 cs.SE 版本更新 88%

AutoLogger: A Multi-Agent Framework for the End-to-End Automated Logging

通过多智能体框架实现端到端自动日志记录

Renyi Zhong, Yintong Huo, Wenwei Gu, Yichen Li, Michael R. Lyu

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.SE

AI总结 本文提出Autologger框架,通过多智能体系统实现端到端自动日志记录,提升日志生成质量与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03239 2026-08-05 cs.CL 新提交 88%

Relational Priors as Convergence Pressure in LLM-Based Multi-Agent Systems

关系先验作为基于大语言模型的多智能体系统中的收敛压力

Ming Shen, Chao Shang, Sadat Shahriar, Devang Kulshreshtha, Yi Zhang, Sandesh Swamy, Yanjun Qi

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.CL

AI总结 该研究将关系先验注入LLM-MAS提示中,发现其主要起收敛压力作用,正向性提升可促进智能体协调但未必提高准确性,建议按需使用而非默认添加。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17535 2026-08-05 cs.SE 版本更新 88%

AgentModernize: Preserving Business Logic in Legacy Modernization with Multi-Agent LLMs and Behavioral Specification Graphs

AgentModernize: 通过多智能体LLM和行为规范图在遗留系统现代化中保留业务逻辑

Sheikh Nazib Ahmed, Marnim Galib

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.SE

AI总结 本文提出AgentModernize框架,通过多智能体系统和行为规范图来保留业务逻辑,解决传统方法在遗留系统现代化中丢失隐含规则和交叉模块约束的问题,实验表明该方法在多个场景中表现优异。

Comments 10 pages, 8 tables, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25928 2026-08-05 cs.SE 版本更新 88%

TheBotCompany: Self-Organizing Multi-agent Systems for Continuous Software Development

自主多智能体系统用于连续软件开发

Wenhan Lyu, Yue Xiao, Yixuan Zhang, Yifan Sun

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.SE

AI总结 本文提出TheBotCompany框架,通过三阶段状态机、自组织智能体团队和异步人类监督,实现持续软件开发的自动化与长期进展。

Comments Accepted by ASE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22226 2026-08-05 cs.AI 版本更新 88%

Embedded Universal Predictive Intelligence: a coherent framework for multi-agent learning

嵌入式通用预测智能:多智能体学习的统一框架

Alexander Meulemans, Rajai Nasser, Maciej Wołczyk, Marissa A. Weis, Seijin Kobayashi, Blake Richards, Guillaume Lajoie, Angelika Steger, Marcus Hutter, James Manyika, Rif A. Saurous, João Sacramento, Blaise Agüera y Arcas

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本文提出基于自我预测的嵌入式通用智能框架,解决多智能体学习中的非稳定性问题,引入新的博弈论解概念和合作形式。

Comments 202 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13077 2026-08-05 cs.LG cs.MA 版本更新 88%

Improving Sample Efficiency in Multi-Agent Reinforcement Learning for Simulated Football Games via Exploration

通过探索提升模拟足球游戏多智能体强化学习的样本效率

Amir Baghi, Jens Sjölund, Joakim Bergdahl, Linus Gisslén, Alessandro Sestini

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 本文针对多智能体强化学习样本效率低的问题,在TiZero框架中引入随机网络蒸馏奖励并修改架构,使样本效率提升13.3%,增强了模型的泛化性与行为稳定性。

Comments 12 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02291 2026-08-04 cs.AI 新提交 88%

Shared Prefixes, Better Credit: Adaptive Routing for Multi-Agent Reasoning

共享前缀,更优信用:面向多智能体推理的自适应路由

Yiqing Liu, Zihao Wang, Hantao Yao, Wu Liu, Yongdong Zhang

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本研究针对现有多智能体推理自适应路由方法的粗粒度监督缺陷,提出TreeCredit共享前缀信用分配框架,通过状态匹配下游比较估计算子效用,在六个推理基准上实现了准确率与推理成本的更优权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02218 2026-08-04 cs.AI 新提交 88%

PosterMELD: Multi-Agent Paper-to-Poster Generation for Controllable Design Diversity with Editable Print-Ready Outputs

PosterMELD:面向可编辑打印就绪输出的可控设计多样性多智能体论文转海报生成

Haojie Hu, Chenhao Dang, Yaojia Liu, Hengrui Kang, Conghui He, Weijia Li

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 PosterMELD是模板条件化多智能体海报生成流水线,可导出可编辑PPTX和PNG,在621篇论文实验中PRR达81.3%,成本仅为Codex+Skill的3.5%,性能优于P2P、PosterGen等方法。

Comments 9 pages, 5 figures, and 4 tables. Code and resources are available at https://github.com/Shannon4Science/PosterMELD

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01805 2026-08-04 cs.AI 新提交 88%

CockpitHAT: Dependency-Graph-Driven Hierarchical Attribution for Embodied Multi-Agent Cockpits

CockpitHAT:面向具身多智能体座舱的依赖图驱动分层归因方法

Wei Wang, Shuanghe Liu, Zhu Zhuo, Jiaqi Zhong, Xiaozhao Zhao, Xiaojie Zuo, Jie Su

机构 * ByteDance(字节跳动)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 该研究针对LLM多智能体系统的“正确性崩溃”问题,提出CockpitHAT分层归因框架,发布含212条轨迹的CockpitBench基准,在相关基准上超越现有方法,实现可靠故障诊断。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01745 2026-08-04 cs.LG 新提交 88%

Heterogeneous Multi-Agent Reinforcement Learning for Radio Resource Management under Coupled Finite-Horizon Constraints

耦合有限时域约束下用于无线资源管理的异构多智能体强化学习

Yeonseo Jeong, Wonhyeok Ko, Sungweon Hong, Songnam Hong

机构 * Hanyang University(汉阳大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 研究针对耦合有限时域约束下的无线资源管理难题,提出嵌入李雅普诺夫的异构多智能体强化学习框架HeLyMARL,通过虚拟队列实现预算约束的逐部分时域绑定,仿真中其性能优于多种基准方法。

Comments 13 pages, 6 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01425 2026-08-04 cs.MA cs.LG 新提交 88%

Training Small LLMs as Spatial Multi-Agent Policies

将小型大语言模型(LLM)训练为空间多智能体策略

Yi Mao, Andrew Perrault

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 该研究针对小型冻结LLM在空间合作博弈中表现不佳的问题,通过机械合成可行性守卫构建符号选项库,用PA-MAGRPO训练LoRA适配器,实现了小型LLM的有效多智能体策略,并揭示奖励与合作解耦,需结合行为评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01085 2026-08-04 cs.MA cs.LG 新提交 88%

When Collaboration Becomes a Trigger: Collective Evidence-Threshold Backdoors in Multi-Agent Systems

当协作成为触发因素:多智能体系统中的集体证据阈值后门

Jia-Hao Xiao, Lei Feng, Min-Ling Zhang

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 针对多智能体系统的新型集体证据阈值后门威胁,提出BCBI注入后门、LATTE防御方法,在基准测试中实现高效后门激活与低干扰防御效果。

Comments 26 pages,11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00715 2026-08-04 cs.RO cs.LG 新提交 88%

Staged Multi-Agent Training (SMAT) for Hip Exoskeletons: Metabolic and Biomechanical Validation of a Simulation-Trained Co-Adaptive Controller

用于髋部外骨骼的分阶段多智能体训练(SMAT):仿真训练的协同自适应控制器的代谢与生物力学验证

Yifei Yuan, Jakob Wolf, Ghaith Androwis, Xianlian Zhou

机构 * New Jersey Institute of Technology(新泽西理工学院) Kessler Foundation(凯斯勒基金会)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 本研究提出分阶段多智能体训练(SMAT)策略,将其部署于髋部外骨骼并经8名健康成人测试,证实该策略可显著降低代谢率,且在不同步行速度和地形上具备泛化性。

Comments 14 pages, 9 figures. Extended version of a paper to appear at IROS 2026 (arXiv:2603.07618)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00243 2026-08-04 cs.AI 新提交 88%

More Debate, Same Evidence: Structural Limits of Homogeneous Multi-Agent Groundedness

更多辩论,相同证据:同质多智能体 groundedness 的结构局限

Yuelyu Ji

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 该研究针对 groundedness 验证测试多智能体小组交换意见可提升判断质量的假设,在6个基准上评估同质三智能体小组,发现其准确率差异在+8.5至-4.4个百分点,未证实该前提。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00028 2026-08-04 cs.MA cs.AI 新提交 88%

Width, Memory, and Delay: A Resource Accounting for the Limits of Flat Multi-Agent Systems

宽度、内存与延迟:扁平多智能体系统的资源限制核算

Oleksandr Kuznetsov, Emanuele Frontoni

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 该研究针对扁平多智能体系统,构建了基于宽度、内存、延迟的定量资源模型,反驳了其存在不可约因果下限的结论,明确资源不可替代性并给出设计规则。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20997 2026-08-04 cs.AI 版本更新 88%

BioInsight: Multi-Agent Orchestration for Interactive Biomedical Knowledge Discovery

BioInsight: 面向交互式生物医学知识发现的多智能体编排

Jieyi Wang, Bingxuan Li, Nanyi Jiang, Desong Meng, Zirui Fan, Yuxin Guo, Jiayu Liu, Kunlun Zhu, Eddie Yang, Xiusi Chen, Pan Lu, Bingxin Zhao

机构 * Peking University(北京大学) University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Pennsylvania(宾夕法尼亚大学) Purdue University(普渡大学) Stanford University(斯坦福大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 提出多智能体系统BioInsight,通过交互式界面生成替代静态报告,实现疾病证据的组织、推理与可视化,在多项生物医学任务中取得最优性能。

Comments Update some experiments and contents

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13077 2026-08-04 cs.MA cs.AI 版本更新 88%

Counterfactual Reasoning for Causal Responsibility Attribution in Probabilistic Multi-Agent Systems

反事实推理在概率多智能体系统中的因果责任归因

Chunyan Mu, Muhammad Najib

机构 * University of Aberdeen(阿伯丁大学) Heriot-Watt University(赫瑞瓦特大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本文提出基于反事实推理的因果责任归因方法,利用Shapley值确保公平性和一致性,构建了支持责任感知多智能体系统验证与策略推理的框架,并通过纳什均衡计算稳定策略配置。

Comments Accepted at IJCAI 2026. This is the full version containing all proofs

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08630 2026-08-04 cs.LG 版本更新 88%

Credit Assignment and Efficient Exploration based on Influence Scope in Multi-agent Reinforcement Learning

多智能体强化学习中基于影响范围的信用分配与高效探索

Shuai Han, Mehdi Dastani, Shihan Wang

机构 * Utrecht University(乌特勒支大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 针对多智能体强化学习稀疏奖励场景下的信用分配与探索难题,提出ISA算法,通过计算智能体影响范围分配信用并划定探索空间,实验表明其性能优于现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23792 2026-08-03 cs.NI cs.LG cs.NA math.NA 版本更新 88%

GNN-based Multi-Agent Control of Traffic Shockwaves in Sparse Vehicular Ad-hoc Networks

基于图神经网络的稀疏车载自组织网络中交通激波的多智能体控制

Prachi Nandi, Madhuri Malakar, Sonakshi Satpathy, Pabitra Mohan Khilar

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 研究稀疏车载自组织网络中交通激波问题,提出集成图神经网络的去中心化多智能体强化学习框架,车辆利用本地信息和邻车交互学习协同控制策略,能有效减少交通激波传播,即使低比例车辆联网时也能减少80%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09037 2026-08-03 cs.AI cs.MA 版本更新 88%

A Multi-Agent System for Motor Design Optimization via an FEA-AI Hybrid Approach

基于FEA-AI混合方法的IPMSM设计优化多智能体系统

Jinseong Han, Sunwoong Yang, Namwoo Kang

机构 * Cho Chun Shik Graduate School of Mobility, KAIST(KAIST Cho Chun Shik 移动研究生院) Department of Mechanical Engineering, Hanyang University(汉阳大学机械工程系) Narnia Labs

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 提出一种端到端自动化IPMSM设计优化框架,通过RAG结构化问题定义与不确定性感知的FEA-AI混合优化流水线,平衡计算成本与预测可靠性,在同等FEA预算下优于纯FEA或纯AI方法。

Comments 37 pages, 31 figures

详情

展开后加载摘要…

URL PDF HTML 收藏