arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

共收录 6808 信号源:cs.CV, eess.IV, cs.MM

1. 视频扩散模型 1308 篇

2501.02690 2025-01-07 cs.CV 83%

GS-DiT: Advancing Video Generation with Pseudo 4D Gaussian Fields through Efficient Dense 3D Point Tracking

Weikang Bian, Zhaoyang Huang, Xiaoyu Shi, Yijin Li, Fu-Yun Wang, Hongsheng Li

专题命中 视频扩散模型 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

Comments Project Page: https://wkbian.github.io/Projects/GS-DiT/

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.13423 2024-12-30 cs.CV 83%

Decoupled Video Generation with Chain of Training-free Diffusion Model Experts

Wenhao Li, Yichao Cao, Xiu Su, Xi Lin, Shan You, Mingkai Zheng, Yi Chen, Chang Xu

专题命中 视频扩散模型 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09828 2024-12-16 cs.CV 83%

MSC: Multi-Scale Spatio-Temporal Causal Attention for Autoregressive Video Diffusion

Xunnong Xu, Mengying Cao

专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);long video(abstract);分类 cs.CV

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.04956 2024-12-13 cs.CV cs.AI 83%

Uncovering Hidden Subspaces in Video Diffusion Models Using Re-Identification

Mischa Dombrowski, Hadrien Reynaud, Bernhard Kainz

专题命中 视频扩散模型 :video diffusion(title,abstract);long video(abstract);分类 cs.CV

Comments 8 pages, 5 tables, 6 figures; v2 Acknowledgements added

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06029 2024-12-10 cs.CV 83%

Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training

Zhenghong Zhou, Jie An, Jiebo Luo

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

Comments Project Page: https://latent-reframe.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04364 2024-12-10 cs.CV cs.AI cs.LG 83%

VideoGuide: Improving Video Diffusion Models without Training Through a Teacher's Guide

Dohun Lee, Bryan S Kim, Geon Yeong Park, Jong Chul Ye

专题命中 视频扩散模型 :video diffusion(title,abstract);text-to-video(abstract);分类 cs.CV

Comments 26 pages, 19 figures, Project Page: https://dohunlee1.github.io/videoguide.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05275 2024-12-09 cs.CV cs.AI 83%

MotionFlow: Attention-Driven Motion Transfer in Video Diffusion Models

Tuna Han Salih Meral, Hidir Yesiltepe, Connor Dunlop, Pinar Yanardag

专题命中 视频扩散模型 :video diffusion(title,abstract);text-to-video(abstract);分类 cs.CV

Comments Project Page: https://motionflow-diffusion.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04448 2024-12-06 cs.CV 83%

MEMO: Memory-Guided Diffusion for Expressive Talking Video Generation

Longtao Zheng, Yifan Zhang, Hanzhong Guo, Jiachun Pan, Zhenxiong Tan, Jiahao Lu, Chuanxin Tang, Bo An, Shuicheng Yan

专题命中 视频扩散模型 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

Comments Project Page: https://memoavatar.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01821 2024-12-03 cs.CV 83%

World-consistent Video Diffusion with Explicit 3D Modeling

Qihang Zhang, Shuangfei Zhai, Miguel Angel Bautista, Kevin Miao, Alexander Toshev, Joshua Susskind, Jiatao Gu

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

Comments 16 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01343 2024-12-03 cs.CV 83%

MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models

Xiaomin Li, Xu Jia, Qinghe Wang, Haiwen Diao, Mengmeng Ge, Pengxiang Li, You He, Huchuan Lu

专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);text-to-video(abstract);分类 cs.CV

Comments Accepted by ACM MM 2024, code will be released in https://github.com/XiaominLi1997/MoTrans

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00773 2024-12-03 cs.CV cs.AI 83%

DIVD: Deblurring with Improved Video Diffusion Model

Haoyang Long, Yan Wang, Wendong Wang

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.09153 2024-11-15 cs.CV cs.RO 83%

VidMan: Exploiting Implicit Dynamics from Video Diffusion Model for Effective Robot Manipulation

Youpeng Wen, Junfan Lin, Yi Zhu, Jianhua Han, Hang Xu, Shen Zhao, Xiaodan Liang

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

Comments Accepted to NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.14864 2024-11-13 cs.CV 83%

Video Diffusion Models are Training-free Motion Interpreter and Controller

Zeqi Xiao, Yifan Zhou, Shuai Yang, Xingang Pan

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

Comments Accepted by NeurIPS 2024. Project Page: https://xizaoqu.github.io/moft/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.04928 2024-11-08 cs.CV cs.AI cs.GR 83%

DimensionX: Create Any 3D and 4D Scenes from a Single Image with Controllable Video Diffusion

Wenqiang Sun, Shuo Chen, Fangfu Liu, Zilong Chen, Yueqi Duan, Jun Zhang, Yikai Wang

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

Comments Project Page: https://chenshuo20.github.io/DimensionX/

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.15735 2024-11-07 cs.CV cs.AI 83%

Identifying and Solving Conditional Image Leakage in Image-to-Video Diffusion Model

Min Zhao, Hongzhou Zhu, Chendong Xiang, Kaiwen Zheng, Chongxuan Li, Jun Zhu

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

Comments NeurIPS 2024. Project page: https://cond-image-leak.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.00225 2024-11-05 cs.CV 83%

Fashion-VDM: Video Diffusion Model for Virtual Try-On

Johanna Karras, Yingwei Li, Nan Liu, Luyang Zhu, Innfarn Yoo, Andreas Lugmayr, Chris Lee, Ira Kemelmacher-Shlizerman

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

Comments Accepted to SIGGRAPH Asia 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.01647 2024-11-05 cs.CV cs.AI 83%

Optical Flow Representation Alignment Mamba Diffusion Model for Medical Video Generation

Zhenbin Wang, Lei Zhang, Lituan Wang, Minjuan Zhu, Zhenwei Zhang

专题命中 视频扩散模型 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.01171 2024-11-05 cs.CV cs.AI 83%

Fast and Memory-Efficient Video Diffusion Using Streamlined Inference

Zheng Zhan, Yushu Wu, Yifan Gong, Zichong Meng, Zhenglun Kong, Changdi Yang, Geng Yuan, Pu Zhao, Wei Niu, Yanzhi Wang

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

Comments Accepted to NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.19593 2024-11-01 cs.CV 83%

Frame by Familiar Frame: Understanding Replication in Video Diffusion Models

Aimon Rahman, Malsha V. Perera, Vishal M. Patel

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.20674 2024-10-23 cs.CV 83%

4Diffusion: Multi-view Video Diffusion Model for 4D Generation

Haiyu Zhang, Xinyuan Chen, Yaohui Wang, Xihui Liu, Yunhong Wang, Yu Qiao

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

Comments NeurIPS 2024. Project Page: https://aejion.github.io/4diffusion/

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10802 2024-10-15 cs.CV cs.AI 83%

Boosting Camera Motion Control for Video Diffusion Transformers

Soon Yau Cheong, Duygu Ceylan, Armin Mustafa, Andrew Gilbert, Chun-Hao Paul Huang

专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);long video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14149 2024-09-30 cs.CV 83%

JVID: Joint Video-Image Diffusion for Visual-Quality and Temporal-Consistency in Video Generation

Hadrien Reynaud, Matthew Baugh, Mischa Dombrowski, Sarah Cechnicka, Qingjie Meng, Bernhard Kainz

专题命中 视频扩散模型 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.13005 2024-09-17 cs.CV 83%

EasyControl: Transfer ControlNet to Video Diffusion for Controllable Generation and Interpolation

Cong Wang, Jiaxi Gu, Panwen Hu, Haoyu Zhao, Yuanfan Guo, Jianhua Han, Hang Xu, Xiaodan Liang

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.11535 2024-08-26 cs.CV 83%

AICL: Action In-Context Learning for Video Diffusion Model

Jianzhi Liu, Junchen Zhu, Lianli Gao, Heng Tao Shen, Jingkuan Song

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11196 2024-08-01 cs.CV 83%

Vid3D: Synthesis of Dynamic 3D Scenes using 2D Video Diffusion

Rishab Parthasarathy, Zachary Ankner, Aaron Gokaslan

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

Comments 14 pages, 10 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.13759 2024-07-26 cs.CV cs.GR 83%

Streetscapes: Large-scale Consistent Street View Generation Using Autoregressive Video Diffusion

Boyang Deng, Richard Tucker, Zhengqi Li, Leonidas Guibas, Noah Snavely, Gordon Wetzstein

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

Comments *Equal Contributions; Fixed few duplicated references from 1st upload; Project Page: https://boyangdeng.com/streetscapes

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.20222 2024-07-12 cs.CV cs.AI 83%

MOFA-Video: Controllable Image Animation via Generative Motion Field Adaptions in Frozen Image-to-Video Diffusion Model

Muyao Niu, Xiaodong Cun, Xintao Wang, Yong Zhang, Ying Shan, Yinqiang Zheng

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

Comments ECCV 2024 ; Project Page: https://myniuuu.github.io/MOFA_Video/ ; Codes: https://github.com/MyNiuuu/MOFA-Video

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16863 2024-06-25 cs.CV 83%

FreeTraj: Tuning-Free Trajectory Control in Video Diffusion Models

Haonan Qiu, Zhaoxi Chen, Zhouxia Wang, Yingqing He, Menghan Xia, Ziwei Liu

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

Comments Project Page: http://haonanqiu.com/projects/FreeTraj.html, Code Repo: https://github.com/arthur-qiu/FreeTraj

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.14130 2024-06-21 cs.CV 83%

ExVideo: Extending Video Diffusion Models via Parameter-Efficient Post-Tuning

Zhongjie Duan, Wenmeng Zhou, Cen Chen, Yaliang Li, Weining Qian

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.08659 2024-06-14 cs.CV 83%

Vivid-ZOO: Multi-View Video Generation with Diffusion Model

Bing Li, Cheng Zheng, Wenxuan Zhu, Jinjie Mai, Biao Zhang, Peter Wonka, Bernard Ghanem

专题命中 视频扩散模型 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

Comments Our project page is at https://hi-zhengcheng.github.io/vividzoo/

详情

展开后加载摘要…

URL PDF HTML 收藏