Q-Frame: Query-aware Frame Selection and Multi-Resolution Adaptation for Video-LLMs
机构 * MiLM Plus, Xiaomi Inc.(小米公司)
专题命中 视频理解 :video understanding(abstract);分类 cs.CV
Comments Accepted at ICCV 2025
AI 大模型
视频理解、视频生成、视频语言模型和时序视觉推理。
机构 * MiLM Plus, Xiaomi Inc.(小米公司)
专题命中 视频理解 :video understanding(abstract);分类 cs.CV
Comments Accepted at ICCV 2025
机构 * School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院) ; Shanghai Innovation Institute(上海创新研究院) ; Fudan University(复旦大学) ; Shanghai AI Laboratory(上海人工智能实验室)
专题命中 视频理解 :video understanding(abstract);分类 cs.CV
Comments Technical Report. Project Page: https://go2heart.github.io/streamformer
机构 * Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) ; Peng Cheng Laboratory(鹏城实验室) ; Shanghai AI Laboratory(上海人工智能实验室) ; Tongji University(同济大学)
专题命中 视频生成 :text-to-video(title,abstract);video generation(title);分类 cs.CV
机构 * National Key Laboratory of Fundamental Science on Synthetic Vision, Sichuan University, Chengdu, 610065, China(合成视觉基础科学国家重点实验室,四川大学,成都,610065,中国) ; School of Cyber Science and Engineering, Sichuan University, Chengdu, 610065, China(网络科学与工程学院,四川大学,成都,610065,中国) ; College of Computer Science, Sichuan University, Chengdu, 610065, China(计算机科学学院,四川大学,成都,610065,中国)
专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV
机构 * USTC(中国科学技术大学) ; NJU(南京大学) ; THU(清华大学) ; XMU(厦门大学)
专题命中 长视频与时序推理 :video understanding(abstract);long video(abstract);分类 cs.CV
Comments Project page: https://github.com/VITA-MLLM/Sparrow
机构 * Department of Computer Science, University of Exeter(计算机科学系,埃克塞特大学)
专题命中 长视频与时序推理 :long video(abstract);分类 cs.CV
Comments Accepted in MICCAI 2025
机构 * Johns Hopkins University(约翰霍普金斯大学)
专题命中 视频数据与评测 :video reasoning(title,abstract);分类 cs.CV
机构 * Nanjing University(南京大学)
专题命中 视频数据与评测 :video understanding(abstract);long video(abstract);分类 cs.CV
Comments 21 pages, 11 figures
机构 * Department of Machine Learning(机器学习系) ; Mohamed bin Zayed University of Artificial Intelligence(Mohamed bin Zayed人工智能大学)
专题命中 视频数据与评测 :video understanding(abstract);分类 cs.CV
机构 * Harvard AI and Robotics Lab, Harvard University(哈佛人工智能与机器人实验室,哈佛大学) ; Broad Institute(博德研究所) ; Hong Kong Polytechnic University(香港理工大学) ; School of Engineering and Applied Sciences, Harvard University(哈佛大学工程与应用科学学院) ; City University of Hong Kong(香港城市大学) ; Kempner Institute for the Study of Natural and Artificial Intelligence, Harvard University(自然与人工智能研究学院,哈佛大学)
专题命中 视频数据与评测 :text-to-video(abstract);分类 cs.CV
Comments 24 pages, 14 figures, 16 tables
Journal ref ICCV 2025