ResidualViT for Efficient Temporally Dense Video Encoding
机构 * KAUST(科威特科学与技术王国(KAUST)) ; CIIRC CTU(布拉格技术大学智能信息与计算研究中心(CIIRC CTU)) ; Adobe Research(Adobe研究)
专题命中 视频理解 :video understanding(abstract);分类 cs.CV、eess.IV
AI 大模型
视频理解、视频生成、视频语言模型和时序视觉推理。
机构 * KAUST(科威特科学与技术王国(KAUST)) ; CIIRC CTU(布拉格技术大学智能信息与计算研究中心(CIIRC CTU)) ; Adobe Research(Adobe研究)
专题命中 视频理解 :video understanding(abstract);分类 cs.CV、eess.IV
机构 * UC Santa Barbara(加州大学圣芭芭拉分校) ; UC Los Angeles(加州大学洛杉矶分校) ; Amazon AGI(亚马逊人工智能实验室) ; University of Waterloo(滑铁卢大学)
专题命中 视频生成 :video generation(title);text-to-video(abstract);分类 cs.CV
Comments Accepted by ICLR 2025. Project Page: https://t2v-turbo-v2.github.io/
机构 * Technical University of Munich(慕尼黑技术大学)
专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV
Comments Accepted to SIGGRAPH Asia 2025. Project page: see https://mschneider456.github.io/world-explorer, video: see https://youtu.be/N6NJsNyiv6I, code: https://github.com/mschneider456/WorldExplorer
机构 * Johns Hopkins University(约翰霍普金斯大学) ; Carnegie Mellon University(卡内基梅隆大学) ; DEVCOM Army Research Laboratory(DEVCOM陆军研究实验室)
专题命中 视频数据与评测 :video understanding(abstract);分类 cs.CV
Comments ICCV 2025. Project page: https://3dsrbench.github.io