CLIPTime: Time-Aware Multimodal Representation Learning from Images and Text
机构 * Department of Energy Technology(能源技术系) ; Aalborg University(奥尔堡大学)
专题命中 多模态训练与对齐 :multimodal(title,abstract);分类 cs.CV
Comments 11 pages, 8 figures
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
机构 * Department of Energy Technology(能源技术系) ; Aalborg University(奥尔堡大学)
专题命中 多模态训练与对齐 :multimodal(title,abstract);分类 cs.CV
Comments 11 pages, 8 figures
机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) ; Amazon(亚马逊)
专题命中 多模态训练与对齐 :multi-modal(title,abstract);分类 cs.AI
专题命中 多模态训练与对齐 :multi-modal(title,abstract);分类 cs.CL
专题命中 多模态训练与对齐 :multimodal(abstract);分类 cs.CV、cs.CL
Comments To appear in ICCV 2025
专题命中 多模态训练与对齐 :cross-modal(abstract);分类 cs.CV
机构 * Department of Computer Science and Engineering, Michigan State University(计算机科学与工程系,密歇根州立大学)
专题命中 多模态训练与对齐 :multimodal(abstract);分类 cs.CV
Comments Accepted to ICCV 2025. 11 pages, 5 figures
专题命中 多模态训练与对齐 :multimodal(abstract)
机构 * Department of Electrical and Computer Engineering, University of Illinois at Urbana-Champaign(电气与计算机工程系,伊利诺伊大学厄巴纳-香槟分校)
专题命中 多模态训练与对齐 :multi-modal(abstract)
Comments Accepted in IROS 2025