Spatial Forcing: Implicit Spatial Representation Alignment for Vision-language-action Model
机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) ; Tsinghua University(清华大学) ; Westlake University(西湖大学) ; Zhejiang University(浙江大学) ; South China University of Technology(华南理工大学)
专题命中 知识编辑与模型理解 :language model(abstract);foundation model(abstract)