Dynamics Are Learned, Not Told: Semi-Supervised Discovery of Latent Dynamics Geometries For Zero-Shot Policy Adaptation
动力学是学出来的,不是告诉的:零样本策略适应的潜在动力学几何半监督发现
机构 * Zhiming Xu(徐志明) ; Weitao Zhou(周伟涛) ; Xianghui Pan(潘向辉) ; Nanshan Deng(邓南山) ; Chengju Liu(刘成军) ; Qijun Chen(陈齐军) ; Chenpeng Yao(姚晨鹏)
专题命中 模型式强化学习 :latent dynamics(title);分类 cs.RO
AI总结 针对机器人强化学习中动力学变化导致策略失效的问题,提出基于对比学习的半监督方法,通过构建平滑、任务相关的潜在拓扑结构,实现零样本策略适应,在MuJoCo基准上优于参数中心方法。
Comments Proceedings of the 43rd International Conference on Machine Learning