Counterfactual World Models via Digital Twin-conditioned Video Diffusion
通过数字孪生条件的视频扩散实现反事实世界模型
机构 * Johns Hopkins University(约翰霍普金斯大学)
专题命中 具身推理 :world model(title,abstract);分类 cs.CV
AI总结 CWMDT通过构建数字孪生和应用大语言模型,实现反事实世界模型,提升对视频正向模拟的控制能力。
视觉与机器人
机器人、具身智能、机器人学习、操作、导航和具身世界模型。
通过数字孪生条件的视频扩散实现反事实世界模型
机构 * Johns Hopkins University(约翰霍普金斯大学)
专题命中 具身推理 :world model(title,abstract);分类 cs.CV
AI总结 CWMDT通过构建数字孪生和应用大语言模型,实现反事实世界模型,提升对视频正向模拟的控制能力。
POMA-3D:点地图方式的3D场景理解
机构 * Imperial College London(伦敦帝国学院)
专题命中 具身推理 :navigation(abstract);分类 cs.CV
AI总结 POMA-3D通过点地图实现3D场景理解,结合自监督学习和多视角对齐策略,提升3D任务表现。
Comments 11 pages, 6 tables, 5 figures