Controllable Hybrid Captioner for Improved Long-form Video Understanding
机构 * Johns Hopkins University Applied Physics Laboratory(约翰霍普金斯大学应用物理实验室)
专题命中 视频理解 :video understanding(title,abstract);分类 cs.CV
AI 大模型
视频理解、视频生成、视频语言模型和时序视觉推理。
机构 * Johns Hopkins University Applied Physics Laboratory(约翰霍普金斯大学应用物理实验室)
专题命中 视频理解 :video understanding(title,abstract);分类 cs.CV
机构 * The Hong Kong Polytechnic University(香港理工大学) ; ARC Lab, Tencent PCG(腾讯PCG ARC实验室) ; Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) ; vivo Mobile Communication Co.(vivo移动通信公司) ; MindWingman Technology (Shenzhen) Co., Ltd.(深圳MindWingman技术有限公司)
专题命中 视频理解 :video-language(abstract);分类 cs.CV
Comments NeurIPS 2025 Camera Ready. Project Page: https://polyu-chenlab.github.io/unipixel/
机构 * School of Computing, Binghamton University(计算学院,宾夕法尼亚州立大学) ; Department of Computer Science, Hong Kong Baptist University(计算机科学系,香港 Baptist 大学)
专题命中 视频理解 :video understanding(abstract);分类 cs.CV
Comments The 6th International Workshop on AI for Social Good in the Connected World (AI4SG)@ IEEE WI-IAT 2025
专题命中 视频生成 :video generation(title,abstract);text-to-video(abstract);分类 cs.CV
专题命中 视频生成 :video generation(title,abstract);分类 cs.CV
Comments The paper is withdrawn due to the need for further revision and verification of experimental results. A revised version will be resubmitted once the updates are completed
机构 * University of Pennsylvania(宾夕法尼亚大学) ; HKU(香港大学) ; HKUST(香港科技大学)
专题命中 视频生成 :video generation(title,abstract);分类 cs.CV
Comments NeurIPS 2025 Camera Ready Version
机构 * Multimedia Laboratory, The Chinese University of Hong Kong(香港中文大学多媒体实验室) ; Kling Team, Kuaishou Technology(快手技术 Kling 团队) ; CPII under InnoHK(创新香港 CPII) ; Zhejiang University(浙江大学) ; Dalian University of Technology(大连理工大学)
专题命中 视频生成 :video generation(abstract);video diffusion(abstract);text-to-video(abstract);分类 cs.CV
Comments Project Page: https://wkbian.github.io/Projects/RelightMaster/
机构 * University of California, Los Angeles(加州大学洛杉矶分校)
专题命中 视频生成 :video generation(abstract);text-to-video(abstract);分类 cs.CV
机构 * Google DeepMind(谷歌DeepMind) ; USC(美国斯克利普斯大学) ; Stanford(斯坦福大学) ; Toyota Research Institute(丰田研究机构)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
Comments Project page: https://pointscoder.github.io/PhysWorld_Web/
机构 * University of California, Berkeley(加州大学伯克利分校) ; University of California, Santa Cruz(加州大学圣克ruz分校) ; University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) ; University of Chicago(芝加哥大学) ; Amazon(亚马逊) ; Information Commissioner’s Office(信息专员办公室)
专题命中 视频生成 :text-to-video(abstract);分类 cs.CV
Comments NeurIPS 2025 Datasets & Benchmarks
机构 * Adobe Research(Adobe研究院) ; The University of Texas at Austin(德克萨斯大学奥斯汀分校)
专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV
Comments NeurIPS 2025 spotlight. Project website: http://self-forcing.github.io/
机构 * Simon Fraser University(西蒙弗雷泽大学)
专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV
Comments 3DV 2026, Project Page: https://mingrui-zhao.github.io/ACT-R/
机构 * The University of Tokyo Hospital(东京大学医院)
专题命中 动作与事件理解 :video-language(abstract);分类 cs.CV
机构 * Massachusetts Institute of Technology(麻省理工学院)
专题命中 长视频与时序推理 :video understanding(abstract);分类 cs.CV
机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) ; The Chinese University of Hong Kong(香港中文大学) ; Shanghai Jiao Tong University(上海交通大学) ; Wuhan University(武汉大学)
专题命中 视频数据与评测 :video understanding(abstract);long video(abstract);分类 cs.CV
机构 * KAUST(卡塔尔科技大学) ; Monash University(墨尔本大学) ; RICE University(里士满大学)
专题命中 视频数据与评测 :video understanding(abstract);long video(abstract);分类 cs.CV
Comments Accepted for oral presentation at the EMNLP 2025 main conference
机构 * Shanghai AI Laboratory(上海人工智能实验室) ; Beijing Institute of Technology(北京理工大学) ; Shanghai Innovation Institute(上海创新研究院) ; Shenzhen MSU-BIT University(深圳MSU-BIT大学) ; The University of Tokyo(东京大学)
专题命中 视频数据与评测 :video generation(abstract);分类 cs.CV
Comments 14 pages, 5 figures