arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

共收录 6790 信号源:cs.CV, eess.IV, cs.MM

1. 视频扩散模型 1306 篇

2503.16396 2025-03-26 cs.CV 79%

SV4D 2.0: Enhancing Spatio-Temporal Consistency in Multi-View Video Diffusion for High-Quality 4D Generation

Chun-Han Yao, Yiming Xie, Vikram Voleti, Huaizu Jiang, Varun Jampani

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Project page: https://sv4d20.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15851 2025-03-26 cs.CV 79%

Zero-1-to-A: Zero-Shot One Image to Animatable Head Avatars Using Video Diffusion

Zhenglin Zhou, Fan Ma, Hehe Fan, Tat-Seng Chua

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Accepted by CVPR 2025, project page: https://zhenglinzhou.github.io/Zero-1-to-A/

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.18590 2025-03-25 cs.CV cs.GR 79%

DiffusionRenderer: Neural Inverse and Forward Rendering with Video Diffusion Models

Ruofan Liang, Zan Gojcic, Huan Ling, Jacob Munkberg, Jon Hasselgren, Zhi-Hao Lin, Jun Gao, Alexander Keller, Nandita Vijaykumar, Sanja Fidler, Zian Wang

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments CVPR 2025; project page: research.nvidia.com/labs/toronto-ai/DiffusionRenderer/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16068 2025-03-21 cs.CV 79%

PoseTraj: Pose-Aware Trajectory Control in Video Diffusion

Longbin Ji, Lei Zhong, Pengfei Wei, Changjian Li

专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);分类 cs.CV

Comments Code, data and project page: https://robingg1.github.io/Pose-Traj/

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01790 2025-03-19 cs.CV 79%

Ingredients: Blending Custom Photos with Video Diffusion Transformers

Zhengcong Fei, Debang Li, Di Qiu, Changqian Yu, Mingyuan Fan

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.19108 2025-03-19 cs.CV 79%

Timestep Embedding Tells: It's Time to Cache for Video Diffusion Model

Feng Liu, Shiwei Zhang, Xiaofeng Wang, Yujie Wei, Haonan Qiu, Yuzhong Zhao, Yingya Zhang, Qixiang Ye, Fang Wan

专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);分类 cs.CV

Comments Accepted in CVPR 2025. Project: https://liewfeng.github.io/TeaCache

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13272 2025-03-18 cs.CV 79%

Generative Gaussian Splatting: Generating 3D Scenes with Video Diffusion Priors

Katja Schwarz, Norman Mueller, Peter Kontschieder

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.21705 2025-03-17 cs.CV 79%

Tora: Trajectory-oriented Diffusion Transformer for Video Generation

Zhenghao Zhang, Junchao Liao, Menghao Li, Zuozhuo Dai, Bingxue Qiu, Siyu Zhu, Long Qin, Weizhi Wang

专题命中 视频扩散模型 :video generation(title,abstract);分类 cs.CV

Comments CVPR 2025 Conference Proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10626 2025-03-14 cs.CV cs.AI cs.LG cs.RO 79%

NIL: No-data Imitation Learning by Leveraging Pre-trained Video Diffusion Models

Mert Albaba, Chenhao Li, Markos Diomataris, Omid Taheri, Andreas Krause, Michael Black

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10592 2025-03-14 cs.CV 79%

CameraCtrl II: Dynamic Scene Exploration via Camera-controlled Video Diffusion Models

Hao He, Ceyuan Yang, Shanchuan Lin, Yinghao Xu, Meng Wei, Liangke Gui, Qi Zhao, Gordon Wetzstein, Lu Jiang, Hongsheng Li

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Project page: https://hehao13.github.io/Projects-CameraCtrl-II/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09595 2025-03-13 cs.CV 79%

PISA Experiments: Exploring Physics Post-Training for Video Diffusion Models by Watching Stuff Drop

Chenyu Li, Oscar Michel, Xichen Pan, Sainan Liu, Mike Roberts, Saining Xie

专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09566 2025-03-13 cs.CV 79%

TPDiff: Temporal Pyramid Video Diffusion Model

Lingmin Ran, Mike Zheng Shou

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Project page: https://showlab.github.io/TPDiff/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09344 2025-03-13 cs.CV 79%

Unified Dense Prediction of Video Diffusion

Lehan Yang, Lu Qi, Xiangtai Li, Sheng Li, Varun Jampani, Ming-Hsuan Yang

专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);分类 cs.CV

Comments Accepted by CVPR2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05082 2025-03-10 cs.CV 79%

Taming Video Diffusion Prior with Scene-Grounding Guidance for 3D Gaussian Splatting from Sparse Inputs

Yingji Zhong, Zhihao Li, Dave Zhenyu Chen, Lanqing Hong, Dan Xu

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Accepted by CVPR2025. The project page is available at https://zhongyingji.github.io/guidevd-3dgs/

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.15259 2025-03-04 cs.CV cs.AI 79%

StarVid: Enhancing Semantic Alignment in Video Diffusion Models via Spatial and SynTactic Guided Attention Refocusing

Yuanhang Li, Qi Mao, Lan Chen, Zhen Fang, Lei Tian, Xinyan Xiao, Libiao Jin, Hua Wu

专题命中 视频扩散模型 :video diffusion(title);text-to-video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19894 2025-03-03 cs.CV 79%

High-Fidelity Relightable Monocular Portrait Animation with Lighting-Controllable Video Diffusion Model

Mingtao Guo, Guanyu Xing, Yanli Liu

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20307 2025-02-28 cs.CV 79%

Mobius: Text to Seamless Looping Video Generation via Latent Shift

Xiuli Bi, Jianfei Yuan, Bo Liu, Yong Zhang, Xiaodong Cun, Chi-Man Pun, Bin Xiao

专题命中 视频扩散模型 :video generation(title);video diffusion(abstract);分类 cs.CV

Comments Project page: https://mobius-diffusion.github.io/ ; GitHub repository: https://github.com/YisuiTT/Mobius

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.02540 2025-02-25 cs.CV 79%

ViDiT-Q: Efficient and Accurate Quantization of Diffusion Transformers for Image and Video Generation

Tianchen Zhao, Tongcheng Fang, Haofeng Huang, Enshu Liu, Rui Wan, Widyadewi Soedarmadji, Shiyao Li, Zinan Lin, Guohao Dai, Shengen Yan, Huazhong Yang, Xuefei Ning, Yu Wang

专题命中 视频扩散模型 :video generation(title,abstract);分类 cs.CV

Comments Accepted at ICLR 2025, Project Page: https://a-suozhang.xyz/viditq.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.13329 2025-02-24 cs.CV 79%

Generative Video Diffusion for Unseen Novel Semantic Video Moment Retrieval

Dezhao Luo, Shaogang Gong, Jiabo Huang, Hailin Jin, Yang Liu

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments AAAI-25

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03496 2025-02-20 eess.IV cs.GR 79%

FreqPrior: Improving Video Diffusion Models with Frequency Filtering Gaussian Noise

Yunlong Yuan, Yuanfan Guo, Chunwei Wang, Wei Zhang, Hang Xu, Li Zhang

专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);分类 eess.IV

Comments ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11515 2025-02-18 cs.CV 79%

SayAnything: Audio-Driven Lip Synchronization with Conditional Video Diffusion

Junxian Ma, Shiwen Wang, Jian Yang, Junyi Hu, Jian Liang, Guosheng Lin, Jingbo chen, Kai Li, Yu Meng

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10841 2025-02-18 cs.CV 79%

SkyReels-A1: Expressive Portrait Animation in Video Diffusion Transformers

Di Qiu, Zhengcong Fei, Rui Wang, Jialin Bai, Changqian Yu, Mingyuan Fan, Guibin Chen, Xiang Wen

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06155 2025-02-18 cs.CV 79%

Efficient-vDiT: Efficient Video Diffusion Transformers With Attention Tile

Hangliang Ding, Dacheng Li, Runlong Su, Peiyuan Zhang, Zhijie Deng, Ion Stoica, Hao Zhang

专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06782 2025-02-13 cs.CV 79%

Lumina-Video: Efficient and Flexible Video Generation with Multi-scale Next-DiT

Dongyang Liu, Shicheng Li, Yutong Liu, Zhen Li, Kai Wang, Xinyue Li, Qi Qin, Yufei Liu, Yi Xin, Zhongyu Li, Bin Fu, Chenyang Si, Yuewen Cao, Conghui He, Ziwei Liu, Yu Qiao, Qibin Hou, Hongsheng Li, Peng Gao

专题命中 视频扩散模型 :video generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16050 2025-01-29 cs.CV cs.AI 79%

Label-Efficient Data Augmentation with Video Diffusion Models for Guidewire Segmentation in Cardiac Fluoroscopy

Shaoyan Pan, Yikang Liu, Lin Zhao, Eric Z. Chen, Xiao Chen, Terrence Chen, Shanhui Sun

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17470 2025-01-03 cs.CV cs.AI cs.LG 79%

Towards Precise Scaling Laws for Video Diffusion Transformers

Yuanyang Yin, Yaqi Zhao, Mingwu Zheng, Ke Lin, Jiarong Ou, Rui Chen, Victor Shea-Jay Huang, Jiahao Wang, Xin Tao, Pengfei Wan, Di Zhang, Baoqun Yin, Wentao Zhang, Kun Gai

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18613 2024-12-20 cs.CV 79%

CAT4D: Create Anything in 4D with Multi-View Video Diffusion Models

Rundi Wu, Ruiqi Gao, Ben Poole, Alex Trevithick, Changxi Zheng, Jonathan T. Barron, Aleksander Holynski

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Project page: https://cat-4d.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.01476 2024-12-19 cs.CV 79%

DreamPhysics: Learning Physics-Based 3D Dynamics with Video Diffusion Priors

Tianyu Huang, Haoze Zhang, Yihan Zeng, Zhilu Zhang, Hui Li, Wangmeng Zuo, Rynson W. H. Lau

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Accepted by AAAI 2025. Codes are released at: https://github.com/tyhuang0428/DreamPhysics

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11710 2024-12-17 cs.CV cs.AI 79%

Re-Attentional Controllable Video Diffusion Editing

Yuanzhi Wang, Yong Li, Mengyi Liu, Xiaoya Zhang, Xin Liu, Zhen Cui, Antoni B. Chan

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Accepted by AAAI 2025. Codes are released at: https://github.com/mdswyz/ReAtCo

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11402 2024-12-17 cs.CV 79%

Video Diffusion Models are Strong Video Inpainter

Minhyeok Lee, Suhwan Cho, Chajin Shin, Jungho Lee, Sunghun Yang, Sangyoun Lee

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Accepted to AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏