arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Michigan(密歇根大学安娜堡分校)

2026-08-24 至 2026-08-24 共收录 3
2608.21175 2026-08-24 cs.RO cs.AI 新提交

SRL-MPC: Shape-Aware Reinforcement Learned Model Predictive Control

SRL-MPC:形状感知强化学习模型预测控制

Ruihua Han, Rui Gao, Zhe Liu, Xinyi Wang, Chang Chen, Shuai Wang, Qi Hao, Jia Pan, Hengshuang Zhao

机构 * The University of Hong Kong(香港大学) Southern University of Science and Technology(南方科技大学) University of Michigan(密歇根大学) Shenzhen Institutes of Advanced Technology(深圳先进技术研究院)

AI总结 针对异构人群与机器人集群的形状感知导航难题,提出SRL-MPC方法,结合MPC的安全泛化性与RL的适应性,实验显示其在安全性、适应性上优于基准方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20784 2026-08-24 cs.RO cs.LG 新提交

Rethinking Demonstration Unlearning in Imitation Learning for Robotics

机器人模仿学习中演示数据遗忘的重新思考

Jiazhuo Li, Yu Zhang, Yiming Fei, Kangkang Dong, Xiaojun Zhu, Houde Liu, Jinze Tao

机构 * University of Michigan(密歇根大学) Zhejiang University(浙江大学) Wuhan University of Technology(武汉理工大学)

AI总结 本研究针对机器人模仿学习的演示数据遗忘问题,提出双维度联合审计方法,在ACT机械臂实验中实现了20次试验18次成功的盲测恢复。

Comments 21 pages, 7 figures, 14 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20518 2026-08-24 cs.AI 新提交

FL-MAESTRO: Multi-Agent LLM Orchestration for Resource-Constrained Federated Learning

FL-MAESTRO:面向资源受限联邦学习的多智能体大语言模型编排框架

Jiajun Wu, Zirui Wang, Jiayu Zhou, Qiang Ye, Steve Drew

机构 * University of Calgary(卡尔加里大学) University of Michigan(密歇根大学)

AI总结 FL-MAESTRO是面向资源受限联邦学习的多智能体LLM编排框架,通过三个专业LLM智能体联合决策,在非IID CIFAR-10基准上,准确率与最强能量感知基线相当,浪费轮次能量从超三分之一降至近零。

Comments Accepted at IEEE GLOBECOM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏