Temporal Forcing: 4D Representation Alignment for Vision-Language-Action Models
时序强制:面向视觉-语言-动作模型的四维表示对齐
机构 * Nanjing University(南京大学) ; Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) ; University of Chinese Academy of Sciences(中国科学院大学)
AI总结 该研究针对视觉-语言-动作模型缺乏时序信息的问题,提出 Temporal Forcing 方法,通过历史通路与时序一致的四维几何特征对齐,在 LIBERO 等任务上取得性能提升。