Open-ended Hierarchical Streaming Video Understanding with Vision Language Models
机构 * Yonsei University(延世大学)
专题命中 视频理解 :video understanding(title,abstract);分类 cs.CV
Comments 17 pages
AI 大模型
视频理解、视频生成、视频语言模型和时序视觉推理。
机构 * Yonsei University(延世大学)
专题命中 视频理解 :video understanding(title,abstract);分类 cs.CV
Comments 17 pages
机构 * Harbin Institute of Technology(哈尔滨理工大学) ; Huawei Noah’s Ark Lab(华为诺亚实验室)
专题命中 视频理解 :video understanding(abstract);分类 cs.CV
机构 * Department of Computer Science, Iowa State University, Ames, IA, USA(计算机科学系,爱荷华州立大学) ; Department of Civil, Construction and Environmental Engineering, Iowa State University, Ames, IA, USA(土木、建设与环境工程系,爱荷华州立大学)
专题命中 视频理解 :video-language(abstract);分类 cs.CV
机构 * Visual Geometry Group, University of Oxford(牛津大学视觉几何组) ; CVIT, IIIT Hyderabad(海得拉巴印度理工学院计算机视觉研究所) ; LIGM, École des Ponts ParisTech(巴黎理工学院路易-狄塞尔数学与计算机科学实验室) ; SAI, Shanghai Jiao Tong University(上海交通大学人工智能研究所)
专题命中 视频理解 :video understanding(abstract);分类 cs.CV
Comments ICCV 2025. Project Page: https://www.robots.ox.ac.uk/vgg/research/shot-by-shot/