BridgeV2W: Bridging Video Generation Models to Embodied World Models via Embodiment Masks
BridgeV2W: 通过具身遮罩将视频生成模型与具身世界模型 bridging
机构 * New Laboratory of Pattern Recognition (NLPR), Institute of Automation, Chinese Academy of Sciences(模式识别新实验室(NLPR),自动化研究所,中国科学院) ; School of Artificial Intelligence, University of Chinese Academy of Sciences(人工智能学院,中国科学院大学) ; Shandong University(山东大学)
专题命中 具身推理 :world model(title,abstract);robotics(abstract);分类 cs.RO、cs.CV
AI总结 BridgeV2W 通过具身遮罩将视频生成模型与具身世界模型结合,解决坐标空间动作与像素空间视频的不匹配问题,并提升视频生成质量与跨具身统一性。