arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

共收录 1306 信号源:cs.CV, eess.IV, cs.MM

1. 视频扩散模型 1306 篇

2503.05978 2025-03-11 cs.CV 57%

MagicInfinite: Generating Infinite Talking Videos with Your Words and Voice

Hongwei Yi, Tian Ye, Shitong Shao, Xuancheng Yang, Jiantong Zhao, Hanzhong Guo, Terrance Wang, Qingyu Yin, Zeke Xie, Lei Zhu, Wei Li, Michael Lingelbach, Daquan Zhou

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

Comments MagicInfinite is publicly accessible at https://www.hedra.com/. More examples are at https://magicinfinite.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05638 2025-03-10 cs.CV cs.AI cs.GR 57%

TrajectoryCrafter: Redirecting Camera Trajectory for Monocular Videos via Diffusion Models

Mark YU, Wenbo Hu, Jinbo Xing, Ying Shan

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

Comments Project webpage: https://trajectorycrafter.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.19233 2025-03-10 cs.CV 57%

Gaussians-to-Life: Text-Driven Animation of 3D Gaussian Splatting Scenes

Thomas Wimmer, Michael Oechsle, Michael Niemeyer, Federico Tombari

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

Comments Project website at https://wimmerth.github.io/gaussians2life.html. Accepted to 3DV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20126 2025-02-28 cs.LG cs.CV 57%

FlexiDiT: Your Diffusion Transformer Can Easily Generate High-Quality Samples with Less Compute

Sotiris Anagnostidis, Gregor Bachmann, Yeongmin Kim, Jonas Kohler, Markos Georgopoulos, Artsiom Sanakoyeu, Yuming Du, Albert Pumarola, Ali Thabet, Edgar Schönfeld

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.02574 2025-02-28 cs.CV cs.AI stat.ML 57%

Solving Video Inverse Problems Using Image Diffusion Models

Taesung Kwon, Jong Chul Ye

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

Comments ICLR 2025; 25 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14994 2025-02-24 cs.CV 57%

LAVID: An Agentic LVLM Framework for Diffusion-Generated Video Detection

Qingyuan Liu, Yun-Yun Tsai, Ruijian Zha, Victoria Li, Pengyuan Shi, Chengzhi Mao, Junfeng Yang

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.05317 2025-02-20 cs.LG cs.AI cs.CV 57%

Accelerating Diffusion Transformers with Token-wise Feature Caching

Chang Zou, Xuyang Liu, Ting Liu, Siteng Huang, Linfeng Zhang

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

Comments ToCa is honored to be accepted by ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12752 2025-02-19 cs.CV 57%

High-Fidelity Novel View Synthesis via Splatting-Guided Diffusion

Xiang Zhang, Yang Zhang, Lukas Mehl, Markus Gross, Christopher Schroers

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11697 2025-02-18 cs.CV 57%

MVTokenFlow: High-quality 4D Content Generation using Multiview Token Flow

Hanzhuo Huang, Yuan Liu, Ge Zheng, Jiepeng Wang, Zhiyang Dou, Sibei Yang

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

Comments ICLR 2025. Project page: https://soolab.github.io/MVTokenFlow

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.19331 2025-02-03 cs.CV 57%

Consistent Video Colorization via Palette Guidance

Han Wang, Yuang Zhang, Yuhong Zhang, Lingxiao Lu, Li Song

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.18982 2025-02-03 cs.CV 57%

OmniPhysGS: 3D Constitutive Gaussians for General Physics-Based Dynamics Generation

Yuchen Lin, Chenguo Lin, Jianjin Xu, Yadong Mu

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

Comments Accepted to ICLR 2025; Project page: https://wgsxm.github.io/projects/omniphysgs/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.14173 2025-01-31 cs.CV 57%

AniDoc: Animation Creation Made Easier

Yihao Meng, Hao Ouyang, Hanlin Wang, Qiuyu Wang, Wen Wang, Ka Leong Cheng, Zhiheng Liu, Yujun Shen, Huamin Qu

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

Comments Project page and code: https://yihao-meng.github.io/AniDoc_demo

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.15368 2025-01-24 cs.CV 57%

Flow-Guided Diffusion for Video Inpainting

Bohai Gu, Yongsheng Yu, Heng Fan, Libo Zhang

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

Comments This paper has been withdrawn as a new iteration of the work has been developed, which includes significant improvements and refinements based on this submission. The withdrawal is made to ensure academic integrity and compliance with publication standards. If you are interested, please refer to the updated work at arXiv:2412.00857

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.03374 2025-01-08 cs.CV cs.AI cs.LG 57%

License Plate Images Generation with Diffusion Models

Mariia Shpir, Nadiya Shvai, Amir Nakib

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

Journal ref Frontiers in Artificial Intelligence and Applications, Vol. 392, 2024, pp. 4594-4601

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.13144 2025-01-03 cs.LG cs.CV 57%

Neural Network Diffusion

Kai Wang, Dongwen Tang, Boya Zeng, Yida Yin, Zhaopan Xu, Yukun Zhou, Zelin Zang, Trevor Darrell, Zhuang Liu, Yang You

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

Comments We introduce a novel approach for parameter generation, named neural network parameter diffusion (\textbf{p-diff}), which employs a standard latent diffusion model to synthesize a new set of parameters

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.14768 2024-12-31 cs.CV cs.AI 57%

AdaDiff: Adaptive Step Selection for Fast Diffusion Models

Hui Zhang, Zuxuan Wu, Zhen Xing, Jie Shao, Yu-Gang Jiang

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

Comments Accepted by AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16700 2024-12-24 cs.CV 57%

TCAQ-DM: Timestep-Channel Adaptive Quantization for Diffusion Models

Haocheng Huang, Jiaxin Chen, Jinyang Guo, Ruiyi Zhan, Yunhong Wang

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.13479 2024-12-19 cs.CV 57%

Real-time One-Step Diffusion-based Expressive Portrait Videos Generation

Hanzhong Guo, Hongwei Yi, Daquan Zhou, Alexander William Bergman, Michael Lingelbach, Yizhou Yu

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10178 2024-12-19 cs.CV cs.AI 57%

SwiftTry: Fast and Consistent Video Virtual Try-On with Diffusion Models

Hung Nguyen, Quang Qui-Vinh Nguyen, Khoi Nguyen, Rang Nguyen

专题命中 视频扩散模型 :long video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09551 2024-12-13 cs.CV 57%

Video Creation by Demonstration

Yihong Sun, Hao Zhou, Liangzhe Yuan, Jennifer J. Sun, Yandong Li, Xuhui Jia, Hartwig Adam, Bharath Hariharan, Long Zhao, Ting Liu

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

Comments Project page at https://delta-diffusion.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18293 2024-12-11 cs.CV 57%

HiFiVFS: High Fidelity Video Face Swapping

Xu Chen, Keke He, Junwei Zhu, Yanhao Ge, Wei Li, Chengjie Wang

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.11814 2024-12-10 cs.CV 57%

Contrastive Sequential-Diffusion Learning: Non-linear and Multi-Scene Instructional Video Synthesis

Vasco Ramos, Yonatan Bitton, Michal Yarom, Idan Szpektor, Joao Magalhaes

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03079 2024-12-06 cs.CV 57%

Align3R: Aligned Monocular Depth Estimation for Dynamic Videos

Jiahao Lu, Tianyu Huang, Peng Li, Zhiyang Dou, Cheng Lin, Zhiming Cui, Zhen Dong, Sai-Kit Yeung, Wenping Wang, Yuan Liu

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

Comments Project Page: https://igl-hkust.github.io/Align3R.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01106 2024-12-03 cs.CV cs.GR 57%

One Shot, One Talk: Whole-body Talking Avatar from a Single Image

Jun Xiang, Yudong Guo, Leipeng Hu, Boyang Guo, Yancheng Yuan, Juyong Zhang

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

Comments Project Page: https://ustc3dv.github.io/OneShotOneTalk/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00397 2024-12-03 cs.CV 57%

DreamDance: Animating Human Images by Enriching 3D Geometry Cues from 2D Poses

Yatian Pang, Bin Zhu, Bin Lin, Mingzhe Zheng, Francis E. H. Tay, Ser-Nam Lim, Harry Yang, Li Yuan

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17697 2024-11-28 cs.CV cs.AI 57%

StableAnimator: High-Quality Identity-Preserving Human Image Animation

Shuyuan Tu, Zhen Xing, Xintong Han, Zhi-Qi Cheng, Qi Dai, Chong Luo, Zuxuan Wu

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.13975 2024-11-22 cs.CV 57%

Transforming Static Images Using Generative Models for Video Salient Object Detection

Suhwan Cho, Minhyeok Lee, Jungho Lee, Sangyoun Lee

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.17343 2024-11-21 cs.CV cs.AI 57%

Q-DiT: Accurate Post-Training Quantization for Diffusion Transformers

Lei Chen, Yuan Meng, Chen Tang, Xinzhu Ma, Jingyan Jiang, Xin Wang, Zhi Wang, Wenwu Zhu

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.10582 2024-11-19 cs.CV 57%

Motion Diffusion-Guided 3D Global HMR from a Dynamic Camera

Jaewoo Heo, Kuan-Chieh Wang, Karen Liu, Serena Yeung-Levy

专题命中 视频扩散模型 :long video(abstract);分类 cs.CV

Comments 15 pages, 2 figures, submitted to TMLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.22901 2024-10-31 cs.CV 57%

HelloMeme: Integrating Spatial Knitting Attentions to Embed High-Level and Fidelity-Rich Conditions in Diffusion Models

Shengkai Zhang, Nianhong Jiao, Tian Li, Chaojie Yang, Chenhui Xue, Boya Niu, Jun Gao

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

Comments 11 pages, 7 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏