arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2025-11-24 至 2025-11-24 共收录 6 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 6 篇

2511.16916 2025-11-24 cs.AI 89%

Hybrid Differential Reward: Combining Temporal Difference and Action Gradients for Efficient Multi-Agent Reinforcement Learning in Cooperative Driving

混合差分奖励:结合时序差分和动作梯度用于高效合作驾驶多智能体强化学习

Ye Han, Lijun Zhang, Dejian Meng, Zhuang Zhang

机构 * School of Automotive Studies, Tongji University(交通学院)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract);分类 cs.AI

AI总结 本文提出混合差分奖励机制,结合时序差分和动作梯度,提升多智能体协同驾驶的收敛速度和策略稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17496 2025-11-24 cs.RO cs.MA 89%

MDG: Masked Denoising Generation for Multi-Agent Behavior Modeling in Traffic Environments

MDG:面向交通环境多智能体行为建模的遮蔽去噪生成

Zhiyu Huang, Zewei Zhou, Tianhui Cai, Yun Zhang, Jiaqi Ma

机构 * University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract)

AI总结 MDG通过遮蔽去噪生成方法,实现高效可控的多智能体轨迹生成,适用于自动驾驶和交通模拟中的行为建模。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17165 2025-11-24 cs.AI cs.LG 88%

MIR: Efficient Exploration in Episodic Multi-Agent Reinforcement Learning via Mutual Intrinsic Reward

MIR: 通过互惠内在奖励实现回合制多智能体强化学习中的高效探索

Kesheng Chen, Wenjian Luo, Bang Zhang, Zeping Yin, Zipeng Ye

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

AI总结 MIR通过互惠内在奖励机制,提升多智能体强化学习中稀疏回合制奖励下的探索效率与团队协作性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15036 2025-11-24 cs.MA 88%

Area-Optimal Control Strategies for Heterogeneous Multi-Agent Pursuit

面积最优的异构多智能体追捕策略

Kamal Mammadov, Damith C. Ranasinghe

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 本文提出了一种基于面积最小化的多智能体追捕策略,通过几何区域分析和梯度控制实现高效捕获。

Comments Published as a conference paper at the Fortieth AAAI Conference on Artificial Intelligence (AAAI-26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12188 2025-11-24 cs.AR cs.AI 70%

LLM-DSE: Searching Accelerator Parameters with LLM Agents

LLM-DSE: 使用LLM代理搜索加速器参数

Hanyu Wang, Xinrui Wu, Zijian Ding, Su Zheng, Chengyue Wang, Neha Prakriya, Tony Nowatzki, Yizhou Sun, Jason Cong

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 LLM-DSE通过多代理框架结合LLM与设计空间探索,高效优化HLS指令参数,实现性能提升并减少运行时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16911 2025-11-24 cs.RO cs.MA 50%

Multi-UAV Swarm Obstacle Avoidance Based on Potential Field Optimization

基于势场优化的多无人机群避障

Yendo Hu, Yiliang Wu, Weican Chen

专题命中 多智能体 :planning(abstract)

AI总结 本文提出一种结合改进多机器人编队避障算法与优化单无人机路径规划的混合算法,有效提升多无人机群在静态环境中的避障能力和编队稳定性。

Comments 12 pages, 13 figures, and 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏