arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2025-11-13 至 2025-11-13 共收录 5 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 5 篇

2511.09515 2025-11-13 cs.RO cs.AI 86%

WMPO: World Model-based Policy Optimization for Vision-Language-Action Models

Fangqi Zhu, Zhengyang Yan, Zicong Hong, Quanxin Shou, Xiao Ma, Song Guo

机构 * Hong Kong University of Science and Technology(香港科学与技术大学) ByteDance Seed(字节跳动种子)

专题命中 模仿学习与强化学习 :world model(title,abstract);manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI

Comments project website: https://wm-po.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09302 2025-11-13 cs.RO 83%

UMIGen: A Unified Framework for Egocentric Point Cloud Generation and Cross-Embodiment Robotic Imitation Learning

Yan Huang, Shoujie Li, Xingting Li, Wenbo Ding

机构 * Shenzhen International Graduate School, Tsinghua University(深圳国际研究生院,清华大学)

专题命中 模仿学习与强化学习 :robotic(title,abstract);manipulation(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.19037 2025-11-13 cs.LG cs.AI cs.RO 67%

Evolutionary Policy Optimization

Jianren Wang, Yifan Su, Abhinav Gupta, Deepak Pathak

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO、cs.AI、cs.LG

Comments Website at https://yifansu1301.github.io/EPO/

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.09852 2025-11-13 cs.RO cs.LG cs.MA 62%

Strategic Coordination of Drones via Short-term Distributed Optimization and Long-term Reinforcement Learning

Chuhao Qin, Evangelos Pournaras

机构 * School of Computer Science, University of Leeds(利兹大学计算机科学学院)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.LG

Comments 23 pages, 16 figures, accepted by Applied Soft Computing

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08926 2025-11-13 cs.MA cs.AI 57%

Achieving Equilibrium under Utility Heterogeneity: An Agent-Attention Framework for Multi-Agent Multi-Objective Reinforcement Learning

Zhuhui Li, Chunbo Luo, Liming Huang, Luyu Qi, Geyong Min

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏