AutoArabic: A Three-Stage Framework for Localizing Video-Text Retrieval Benchmarks
专题命中 视频数据与评测 :text-to-video(abstract);分类 cs.CV
Comments Accepted at ArabicNLP 2025 (EMNLP 2025 workshop)
AI 大模型
视频理解、视频生成、视频语言模型和时序视觉推理。
专题命中 视频数据与评测 :text-to-video(abstract);分类 cs.CV
Comments Accepted at ArabicNLP 2025 (EMNLP 2025 workshop)
机构 * MBZUAI ; University of Houston(德克萨斯大学休斯顿分校) ; McGill University(麦吉尔大学) ; University of Michigan(密歇根大学)
专题命中 视频数据与评测 :long video(abstract)