Parameter-Efficient CLIP Adaptation for 3D Understanding via Unified Tokenization
用于3D理解的参数高效CLIP适配:通过统一分词实现
机构 * Fondazione Bruno Kessler(布鲁诺·科塞拉基金会) ; University of Trento(特伦托大学) ; University of Pisa(比萨大学) ; Beijing Forestry University(北京林业大学) ; Shanghai Jiao Tong University(上海交通大学) ; Hong Kong University of Science and Technology (GZ)(香港科技大学) ; Shandong University(山东大学) ; University of California, Merced(加州大学默塞德分校)
专题命中 点云 :point cloud(abstract);分类 cs.CV
AI总结 本文提出参数高效框架UTok3D,通过学习尺度归一化3D分词器,实现冻结CLIP视觉主干在无标注情况下对不同尺度点云的复用,完成3D分割任务。
Comments 14 pages, tokenizer