Illuminating Visual Identity in Universal Multimodal Embeddings
揭示通用多模态嵌入中的视觉身份
机构 * Shanghai Jiao Tong University(上海交通大学) ; Alibaba Group(阿里巴巴集团)
AI总结 该研究针对通用多模态嵌入缺乏视觉身份判别能力的问题,提出视觉身份判别统一形式化,构建MVEB基准,设计身份感知采样的学习框架,提升了UMEs的身份判别能力。
Comments Accepted to CVPR 2026