Repeating Words for Video-Language Retrieval with Coarse-to-Fine Objectives
机构 * Fudan University(复旦大学) ; Tencent(腾讯) ; Huawei Noah’s Ark Lab(华为诺亚实验室)
专题命中 视频数据与评测 :video-language(title,abstract);分类 cs.CV
Comments 11 pages, 4 figures
AI 大模型
视频理解、视频生成、视频语言模型和时序视觉推理。
机构 * Fudan University(复旦大学) ; Tencent(腾讯) ; Huawei Noah’s Ark Lab(华为诺亚实验室)
专题命中 视频数据与评测 :video-language(title,abstract);分类 cs.CV
Comments 11 pages, 4 figures
机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) ; S-Lab, Nanyang Technological University(南洋理工大学S实验室) ; Sun Yat-sen University(中山大学) ; The Chinese University of Hong Kong(香港中文大学)
专题命中 视频数据与评测 :video generation(title,abstract);分类 cs.CV
Comments Equal contributions from first two authors. Project page: https://vchitect.github.io/VBench-2.0-project/ Code: https://github.com/Vchitect/VBench