arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-02-10 至 2026-02-10 共收录 27 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 27 篇

2602.08272 2026-02-10 cs.LG cs.AI 91%

When Do Multi-Agent Systems Outperform? Analysing the Learning Efficiency of Agentic Systems

多智能体系统何时表现更优?分析智能体系统的学习效率

Junwei Su, Chuan Wu

机构 * Department of Computer Science, University of Hong Kong(计算机科学系,香港大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);agentic(title);分类 cs.AI、cs.LG

AI总结 本文研究多智能体强化学习在大语言模型中的学习效率,通过理论分析揭示任务分解与对齐对样本复杂性的影响,明确MARL在特定任务下的优势条件。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08847 2026-02-10 cs.LG cs.AI 90%

Dr. MAS: Stable Reinforcement Learning for Multi-Agent LLM Systems

Dr. MAS:多智能体大语言模型系统的稳定强化学习

Lang Feng, Longtao Zheng, Shuo He, Fuxiang Zhang, Bo An

机构 * Nanyang Technological University, Singapore(南洋理工大学,新加坡)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);tool use(abstract);分类 cs.AI、cs.LG

AI总结 Dr. MAS通过智能体级归一化方法稳定多智能体大语言模型的强化学习训练,提升性能并减少梯度不稳定问题。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15047 2026-02-10 cs.LG cs.AI 90%

PiFlow: Principle-Aware Scientific Discovery with Multi-Agent Collaboration

PiFlow:基于多智能体协作的原则感知科学发现

Yingming Pu, Tao Lin, Hongyu Chen

机构 * Westlake University(西湖大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);agentic(abstract);分类 cs.AI、cs.LG

AI总结 PiFlow通过多智能体协作和原则引导,提升科学发现效率和质量,实现高效且稳健的AI驱动研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08254 2026-02-10 cs.AI cs.IR cs.MA 89%

SynthAgent: A Multi-Agent LLM Framework for Realistic Patient Simulation -- A Case Study in Obesity with Mental Health Comorbidities

SynthAgent:一种多智能体LLM框架用于真实患者模拟——以肥胖伴发心理健康共病的案例研究

Arman Aghaee, Sepehr Asgarian, Jouhyun Jeon

机构 * Klick Health(Klick健康)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);autonomous agent(abstract);分类 cs.AI

AI总结 SynthAgent通过多智能体框架生成高保真的虚拟患者,用于研究肥胖与心理健康共病的患者旅程和决策过程。

Comments Presented in AAAI 2026 Singapore at the workshop of Health Intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08529 2026-02-10 cs.MA 89%

EvoCorps: An Evolutionary Multi-Agent Framework for Depolarizing Online Discourse

EvoCorps:一种用于去极化的进化多智能体框架

Ning Lin, Haolun Li, Mingshu Liu, Chengyun Ruan, Kaibo Huang, Yukun Wei, Zhongliang Yang, Linna Zhou

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract)

AI总结 EvoCorps通过进化多智能体框架主动应对在线讨论中的极化问题,提升讨论质量并实现闭环干预。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08529 2026-02-10 cs.CL cs.AI 88%

CoMAS: Co-Evolving Multi-Agent Systems via Interaction Rewards

CoMAS: 通过交互奖励实现协同进化多智能体系统

Xiangyuan Xue, Yifan Zhou, Guibin Zhang, Zaibin Zhang, Yijiang Li, Chen Zhang, Zhenfei Yin, Philip Torr, Wanli Ouyang, Lei Bai

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL

AI总结 CoMAS通过交互奖励实现智能体的自主进化,优于未训练智能体并取得最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01465 2026-02-10 cs.AI cs.SE 88%

Agyn: A Multi-Agent System for Team-Based Autonomous Software Engineering

Agyn:基于团队的自主软件工程多智能体系统

Nikita Benkovich, Vitalii Valkov

机构 * Mila – Quebec AI Institute (e-Lab)(魁北克AI研究所(e-Lab)) Tel-Aviv, Israel(特拉维夫,以色列)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.SE

AI总结 Agyn提出了一种基于团队结构的多智能体系统,通过模拟工程团队的组织过程和协作方法,实现自主软件工程任务的高效处理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05045 2026-02-10 cs.LG cs.MA 88%

Spatiotemporal Attention-Augmented Inverse Reinforcement Learning for Multi-Agent Task Allocation

时空注意力增强的逆强化学习用于多智能体任务分配

Huilin Yin, Zhikun Yang, Linchuan Zhang, Daniel Watzenig

机构 * College of Electronic and Information Engineering, Tongji University(同济大学电子与信息工程学院) Shanghai Research Institute for Intelligent Autonomous Systems, Tongji University(同济大学智能自主系统上海研究院) Graz University of Technology(格拉茨技术大学) Virtual Vehicle Research GmbH(虚拟车辆研究公司)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 本文提出一种基于时空注意力的逆强化学习框架,用于多智能体任务分配,通过约束奖励推断提升稳定性与效率。

Comments Revised version with substantial new experimental results, improved analysis, and a restructured layout for better clarity

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07848 2026-02-10 cs.LG 88%

MARTI-MARS$^2$: Scaling Multi-Agent Self-Search via Reinforcement Learning for Code Generation

MARTI-MARS$^2$:通过强化学习实现多智能体自搜索的扩展用于代码生成

Shijie Wang, Pengfei Li, Yikun Fu, Kaifeng Liu, Fangyuan Li, Yang Liu, Xiaowei Sun, Zonglin Li, Siyao Zhao, Jian Zhao, Kai Tian, Dong Li, Junqi Gao, Yutong Zhang, Yiqun Chen, Yuqiang Li, Zoe Li, Weinan Zhang, Peng Ye, Shuyue Hu, Lei Bai, Bowen Zhou, Kaiyan Zhang, Biqing Qi

机构 * Shanghai AI Laboratory(上海人工智能实验室) Tsinghua University(清华大学) Harbin Institute of Technology(哈尔滨工业大学) Shanghai Jiao Tong University(上海交通大学) Institute of Automation(自动化研究所) Fudan University(复旦大学) High School Affiliated to Fudan University(复旦大学附属高中) Renmin University of China(中国人民大学) University of Washington(华盛顿大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 MARTI-MARS2通过多智能体强化学习实现代码生成的扩展,突破单智能体限制,提升性能和多样性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07433 2026-02-10 cs.HC cs.AI cs.CY 88%

Multi-Agent Systems Shape Social Norms for Prosocial Behavior Change

多智能体系统塑造社会规范以促进利他行为改变

Yibin Feng, Tianqi Song, Yugin Tan, Zicheng Zhu, Yi-Chieh Lee

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 多智能体系统通过塑造虚拟社会规范促进利他行为改变,实验显示组内智能体更有效提升捐赠意愿和社会规范感知。

Comments 6 pages, 3 figures, CSCW Companion '25 Poster (October 2025, Bergen, Norway). Companion of the Computer-Supported Cooperative Work and Social Computing (CSCW Companion '25), ACM, 2025, ISBN 9798400714801

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18534 2026-02-10 cs.MA cs.AI 88%

MAFE: Enabling Equitable Algorithm Design in Multi-Agent Multi-Stage Decision-Making Systems

MAFE:在多智能体多阶段决策系统中实现公平算法设计

Zachary McBride Lazri, Anirudh Nakra, Ivan Brugere, Danial Dervovic, Antigoni Polychroniadou, Furong Huang, Dana Dachman-Soled, Min Wu

机构 * University of Maryland, College Park, MD 20742(马里兰大学College Park分校) J.P. Morgan AI Research, New York, NY, 10017(摩根大通人工智能研究)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 MAFE通过模拟多智能体多阶段决策系统,促进公平算法设计,揭示公平性、性能与协调之间的权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07072 2026-02-10 cs.SE cs.MA 88%

AgentSpawn: Adaptive Multi-Agent Collaboration Through Dynamic Spawning for Long-Horizon Code Generation

AgentSpawn: 通过动态生成实现长周期代码生成的自适应多智能体协作

Igor Costa

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.SE

AI总结 AgentSpawn通过动态生成实现长周期代码生成的自适应多智能体协作,提升完成率并降低内存开销。

Comments 18 pages, 4 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21464 2026-02-10 cs.CV cs.RO 88%

Residual Vector Quantization For Communication-Efficient Multi-Agent Perception

残差向量量化用于通信高效的多智能体感知

Dereje Shenkut, B. V. K Vijaya Kumar

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 ReVQom通过残差向量量化实现高效多智能体感知,显著降低通信带宽需求,提升实际应用可行性。

Comments Accepted at ICASSP 2026. 5 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08009 2026-02-10 cs.AI cs.CL 79%

Towards Adaptive, Scalable, and Robust Coordination of LLM Agents: A Dynamic Ad-Hoc Networking Perspective

面向自适应、可扩展和鲁棒的LLM代理协调:动态即插即用网络视角

Rui Li, Zeyu Zhang, Xiaohe Bo, Quanyu Dai, Chaozhuo Li, Feng Wen, Xu Chen

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学北京校区人工智能学院) Huawei Technologies Ltd.(华为技术有限公司) Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 多智能体 :agent(abstract);agentic(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出RAPS范式,通过动态即插即用网络方法实现LLM代理的自适应、可扩展和鲁棒协调,通过反应性订阅和贝叶斯声誉机制提升多代理协作的适应性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14893 2026-02-10 cs.CV cs.CL cs.RO 77%

Virtual Community: An Open World for Humans, Robots, and Society

虚拟社区:人类、机器人与社会的开放世界

Qinhong Zhou, Hongxin Zhang, Xiangye Lin, Zheyuan Zhang, Yutian Chen, Wenjun Liu, Zunzhe Zhang, Sunli Chen, Lixing Fang, Qiushi Lyu, Xinyu Sun, Jincheng Yang, Zeyuan Wang, Bao Chi Dang, Zhehuan Chen, Daksha Ladia, Quang Vinh Dang, Jiageng Liu, Chuang Gan

机构 * UMass Amherst(马萨诸塞大学阿默斯特分校) MIT-IBM Watson AI Lab(麻省理工-IBM沃森人工智能实验室) Johns Hopkins University(约翰霍普金斯大学) CMU(卡内基梅隆大学)

专题命中 多智能体 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.CL

AI总结 虚拟社区是一个开放世界平台,旨在研究人类与机器人共存的社会智能,通过多智能体模拟和大规模社区生成,提出两个新挑战以探索开放世界中的协作与规划能力。

Comments website https://virtual-community-ai.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17541 2026-02-10 cs.RO 75%

Distributed Spatial-Temporal Trajectory Optimization for Unmanned-Aerial-Vehicle Swarm

分布式空间-时间轨迹优化用于无人机群

Xiaobo Zheng, Pan Tang, Defu Lin, Shaoming He

机构 * School of Aerospace Engineering, 5th Zhongguancun South Street(航空航天工程学院,中关村南大街5号) No.1 Beijing Dahongmen South Road(北京红门南街1号)

专题命中 多智能体 :agent(abstract);planning(abstract);multi-agent(abstract)

AI总结 本文提出了一种分布式空间-时间轨迹优化框架,利用ADMM和DDP实现无人机群的多智能体共识与快速局部规划,通过参数化DDP和自适应调节准则提升大规模无人机群的轨迹优化效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08389 2026-02-10 cs.MA cs.AI cs.GT cs.LG 73%

Altruism and Fair Objective in Mixed-Motive Markov games

利他主义与混合动机马尔可夫游戏中的公平目标

Yao-hua Franck Xu, Tayeb Lemlouma, Arnaud Braud, Jean-Marie Bonnin

机构 * Orange Labs Lannion(Orange实验室)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出通过比例公平性替代功利目标,促进更公平的合作,设计了公平马尔可夫游戏和Actor-Critic算法,并在社会困境环境中验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06967 2026-02-10 cs.RO cs.AI cs.CL 73%

Leveraging Adaptive Group Negotiation for Heterogeneous Multi-Robot Collaboration with Large Language Models

利用自适应群体谈判实现异构多机器人协作的大型语言模型

Siqi Song, Xuanbing Xie, Zonglin Li, Yuqiang Li, Shijie Wang, Biqing Qi

机构 * Tsinghua University(清华大学) Central South University(中南大学) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 多智能体 :agent(abstract);planning(abstract);分类 cs.AI、cs.CL

AI总结 CLiMRS通过自适应群体谈判框架提升异构多机器人协作效率,实验显示在复杂任务中效率提升超40%。

Comments 20 pages, 12 figures, Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07641 2026-02-10 cs.SE cs.HC 70%

HAIF: A Human-AI Integration Framework for Hybrid Team Operations

HAIF:混合团队操作的人机集成框架

Marc Bara

专题命中 多智能体 :AI agent(abstract);agentic(abstract);分类 cs.SE

AI总结 HAIF框架旨在解决混合团队中AI与人类协作的组织问题,通过协议驱动、可扩展的操作系统,结合四个核心原则和反馈机制,实现无缝集成到现有工作流程中。

Comments 22 pages, 4 figures, 5 tables, 2 appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07274 2026-02-10 cs.AI 70%

TermiGen: High-Fidelity Environment and Robust Trajectory Synthesis for Terminal Agents

TermiGen: 为终端智能体提供高保真的环境和鲁棒轨迹合成

Kaijie Zhu, Yuzhou Nie, Yijiang Li, Yiming Huang, Jialian Wu, Jiang Liu, Ximeng Sun, Zhenfei Yin, Lun Wang, Zicheng Liu, Emad Barsoum, William Yang Wang, Wenbo Guo

机构 * google(谷歌) University of Oxford(牛津大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 TermiGen通过生成高保真的环境和鲁棒轨迹,提升终端智能体在复杂任务中的表现,达到31.3%的通过率,超越现有基线和专有模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08962 2026-02-10 cs.CV cs.RO 67%

Modeling 3D Pedestrian-Vehicle Interactions for Vehicle-Conditioned Pose Forecasting

为车辆条件化姿态预测建模的行人-车辆交互

Guangxun Zhu, Xuan Liu, Nicolas Pugeault, Chongfeng Wei, Edmond S. L. Ho

机构 * School of Computing Science, University of Glasgow(计算科学学院,格拉斯哥大学) James Watt School of Engineering, University of Glasgow(詹姆斯·瓦特工程学院,格拉斯哥大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文提出了一种基于3D车辆条件化的行人姿态预测方法,通过融合车辆信息提升自动驾驶中行人-车辆交互的预测精度。

Comments Accepted for IEEE International Conference on Robotics and Automation (ICRA) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08938 2026-02-10 cs.MA 67%

Teaching an Old Dynamics New Tricks: Regularization-free Last-iterate Convergence in Zero-sum Games via BNN Dynamics

教旧动态新花招:通过BNN动态实现无正则化的零和博弈最后迭代收敛

Tuo Zhang, Leonardo Stella

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文提出通过BNN动态实现无正则化的零和博弈最后迭代收敛,结合反事实加权框架和神经网络近似,提升多智能体学习的适应性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08571 2026-02-10 cs.RO 67%

Head-to-Head autonomous racing at the limits of handling in the A2RL challenge

极限操控下的头对头自动驾驶赛车挑战

Simon Hoffmann, Simon Sagmeister, Tobias Betz, Joscha Bongard, Sascha Büttner, Dominic Ebner, Daniel Esser, Georg Jank, Sven Goblirsch, Alexander Langmann, Maximilian Leitenstern, Levent Ögretmen, Phillip Pitschi, Ann-Kathrin Schwehn, Cornelius Schröder, Marcel Weinmann, Frederik Werner, Boris Lohmann, Johannes Betz, Markus Lienkamp

机构 * Institute of Automotive Technology, TUM(汽车技术研究所,慕尼黑技术大学) Chair of Automatic Control, TUM(自动控制教授座,慕尼黑技术大学) Professorship Autonomous Vehicle Systems, TUM(自主车辆系统教授职位,慕尼黑技术大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 TUM团队通过模拟人类驾驶行为,在极限操控下开发算法赢得A2RL赛事,提升自动驾驶技术与道路安全。

Comments Submitted to Science Robotics for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07836 2026-02-10 eess.SY cs.SY 67%

Convergence Analysis of Continuous-Time Distributed Stochastic Gradient Algorithms

连续时间分布式随机梯度算法的收敛性分析

Jianhua Sun, Kaihong Lu, Xin Yu

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文提出连续时间分布式随机梯度算法,用于解决分布式优化问题,通过布朗运动描述随机性,并证明算法在期望意义上收敛到共同最小值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.02540 2026-02-10 eess.SY cs.SY 67%

Low Complexity Method for Simulation of Epidemics Based on Dijkstra's Algorithm

基于迪杰斯特拉算法的低复杂度流行病模拟方法

Davide Zorzenon, Fabio Molinari, Joerg Raisch

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文提出基于迪杰斯特拉算法的低复杂度流行病模拟方法,通过传染图降低计算复杂性并验证理论结果。

Comments 8 pages, 8 figures, typos corrected

Journal ref Proceedings of 2021 American Control Conference (ACC) (2021) pp. 3018-3025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07385 2026-02-10 cs.GT 50%

Online Contract Design

在线合同设计

Elad Lavi, Hadas Shachnai, Inbal Talgam-Cohen

专题命中 多智能体 :agent(abstract)

AI总结 本文提出了一种在线合同设计算法,在代理奖励为加性时达到1/2的竞争比,同时探讨了XOS结构对算法的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07848 2026-02-10 cs.SI physics.soc-ph 50%

Why We Experience Society Differently: Intrinsic Dispositions as Drivers of Ideological Complexity in Adaptive Social Networks

为何我们对社会体验不同:内在倾向作为适应性社会网络中意识形态复杂性的驱动力

Akshay Gangadhar, Hiroki Sayama

专题命中 多智能体 :agent(abstract)

AI总结 本研究通过分析适应性社会网络模型,揭示了内在行为倾向如何驱动意识形态复杂性,发现不同认知倾向导致个体意见轨迹的非直观动态差异。

Comments Included a causal intervention experiment to test the central hypothesis of the study; other minor revisions were made to the text

详情

展开后加载摘要…

URL PDF HTML 收藏