SignMouth: Leveraging Mouthing Cues for Sign Language Translation by Multimodal Contrastive Fusion
专题命中 跨模态检索 :multimodal(title);分类 cs.CV、cs.AI
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 跨模态检索 :multimodal(title);分类 cs.CV、cs.AI
专题命中 跨模态检索 :multimodal(abstract)
Comments 5 pages, 5 figures