arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2025-12-12 至 2025-12-12 共收录 3 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 3 篇

2512.10925 2025-12-12 cs.LG cs.RO 84%

Digital Twin Supervised Reinforcement Learning Framework for Autonomous Underwater Navigation

数字孪生监督强化学习框架用于自主水下导航

Zamirddine Mari, Mohamad Motasem Nawaf, Pierre Drap

机构 * DGA Techniques Navales - Direction Générale de l’Armement(法国国防总局海军技术部) LIS, CNRS, Aix-Marseille University(里尔研究所、国家科学研究中心、阿维尼昂-马赛大学)

专题命中 模仿学习与强化学习 :navigation(title,abstract);robotics(abstract);分类 cs.RO、cs.LG

AI总结 本文提出基于PPO算法的数字孪生监督强化学习框架,用于提升水下自主导航的鲁棒性和适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10934 2025-12-12 cs.RO cs.LG 81%

Curriculum-Based Reinforcement Learning for Autonomous UAV Navigation in Unknown Curved Tubular Conduit

基于课程的学习强化学习用于自主无人机在未知弯曲管状通道中的导航

Zamirddine Mari, Jérôme Pasquet, Julien Seinturier

机构 * DGA Techniques Navales - Direction Générale de l’Armement(法国国防总局海军技术部) LIRMM, TETIS, CNRS, Université de Montpellier Paul-Valéry(蒙彼利埃大学保罗-瓦莱里耶大学) LIS, CNRS, Université de Toulon(土伦大学)

专题命中 模仿学习与强化学习 :navigation(title,abstract);分类 cs.RO、cs.LG

AI总结 本文提出基于课程学习的强化学习方法,使无人机在未知弯曲管状环境中实现自主导航,通过结合激光雷达和视觉信息,克服部分可观测性挑战,提升导航稳定性与泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10099 2025-12-12 cs.RO cs.LG 81%

Push Smarter, Not Harder: Hierarchical RL-Diffusion Policy for Efficient Nonprehensile Manipulation

推智而非推力:用于高效非抓取操作的分层RL-扩散策略

Steven Caro, Stephen L. Smith

机构 * Department of Electrical and Computer Engineering, University of Waterloo(电子与计算机工程系,滑铁卢大学)

专题命中 模仿学习与强化学习 :manipulation(title,abstract);分类 cs.RO、cs.LG

AI总结 本文提出HeRD,一种分层RL-扩散策略,用于高效非抓取操作,通过分层目标选择与轨迹生成提升成功率和泛化能力。

Comments 8 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏