MultiDiffSense: Diffusion-Based Multi-Modal Visuo-Tactile Image Generation Conditioned on Object Shape and Contact Pose
MultiDiffSense: 基于扩散的多模态视觉-触觉图像生成,基于物体形状和接触姿态
机构 * Department of Bioengineering, Imperial-X Initiative, Imperial College London(生物工程系、Imperial-X计划、帝国理工学院伦敦分校) ; CAMS-Oxford Institute, University of Oxford(CAMS-牛津研究所、牛津大学)
AI总结 MultiDiffSense是一种基于扩散的多模态视觉-触觉图像生成模型,通过双条件化实现可控且物理一致的多模态生成,提升了触觉传感数据集的生成效率和跨模态学习能力。
Comments Accepted by 2026 ICRA