arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

共收录 6840 信号源:cs.CV, eess.IV, cs.MM

1. 视频生成 2171 篇

2410.13726 2025-03-27 cs.CV cs.AI 83%

DAWN: Dynamic Frame Avatar with Non-autoregressive Diffusion Framework for Talking Head Video Generation

Hanbo Cheng, Limin Lin, Chenyu Liu, Pengcheng Xia, Pengfei Hu, Jiefeng Ma, Jun Du, Jia Pan

机构 * University of Science and Technology of China(中国科学技术大学) iFLYTEK Research(讯飞研究院)

专题命中 视频生成 :video generation(title,abstract);long video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18386 2025-03-25 cs.CV cs.AI 83%

Resource-Efficient Motion Control for Video Generation via Dynamic Mask Guidance

Sicong Feng, Jielong Yang, Li Peng

机构 * Jiangnan University(江南大学)

专题命中 视频生成 :video generation(title,abstract);text-to-video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17592 2025-03-20 cs.CV 83%

VideoDirector: Precise Video Editing via Text-to-Video Models

Yukun Wang, Longguang Wang, Zhiyuan Ma, Qibin Hu, Kai Xu, Yulan Guo

机构 * Shenzhen Campus of Sun Yat-sen University(中山大学深圳校区) Sun Yat-sen University(中山大学) Tsinghua University(清华大学) National University of Defense Technology(国防科技大学)

专题命中 视频生成 :text-to-video(title,abstract);video diffusion(abstract);分类 cs.CV

Comments 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14070 2025-03-19 cs.CV cs.AI 83%

Fast Autoregressive Video Generation with Diagonal Decoding

Yang Ye, Junliang Guo, Haoyu Wu, Tianyu He, Tim Pearce, Tabish Rashid, Katja Hofmann, Jiang Bian

机构 * Microsoft Research(微软研究院)

专题命中 视频生成 :video generation(title,abstract);long video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10589 2025-03-14 cs.CV 83%

Long Context Tuning for Video Generation

Yuwei Guo, Ceyuan Yang, Ziyan Yang, Zhibei Ma, Zhijie Lin, Zhenheng Yang, Dahua Lin, Lu Jiang

机构 * The Chinese University of Hong Kong(香港中文大学) ByteDance(字节跳动)

专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

Comments Project Page: https://guoyww.github.io/projects/long-context-video/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.14295 2025-03-14 cs.CV 83%

StereoCrafter-Zero: Zero-Shot Stereo Video Generation with Noisy Restart

Jian Shi, Qian Wang, Zhenyu Li, Ramzi Idoughi, Peter Wonka

机构 * KAUST(阿卜杜拉国王科技大学)

专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.05591 2025-03-05 cs.CV 83%

TweedieMix: Improving Multi-Concept Fusion for Diffusion-based Image/Video Generation

Gihyun Kwon, Jong Chul Ye

机构 * KRAFTON Kim Jaechul Graduate School of AI, KAIST(KAIST金哉澈人工智能研究生院)

专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

Comments Github Page: https://github.com/KwonGihyun/TweedieMix

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.14195 2025-02-26 cs.CV 83%

VideoShield: Regulating Diffusion-based Video Generation Models via Watermarking

Runyi Hu, Jie Zhang, Yiming Li, Jiwei Li, Qing Guo, Han Qiu, Tianwei Zhang

机构 * Nanyang Technological University(南洋理工大学) IHPC, A*STAR(新加坡高性能计算研究所(新加坡科研局下属)) Zhejiang University(浙江大学) Tsinghua University(清华大学)

专题命中 视频生成 :video generation(title,abstract);text-to-video(abstract);分类 cs.CV

Comments International Conference on Learning Representations (ICLR) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.04989 2025-02-26 cs.CV cs.LG 83%

SG-I2V: Self-Guided Trajectory Control in Image-to-Video Generation

Koichi Namekata, Sherwin Bahmani, Ziyi Wu, Yash Kant, Igor Gilitschenski, David B. Lindell

机构 * University of Toronto(多伦多大学) Vector Institute(向量研究所)

专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

Comments ICLR 2025. Project page: https://kmcode1.github.io/Projects/SG-I2V/

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10126 2025-02-26 cs.CV 83%

Training-free Camera Control for Video Generation

Chen Hou, Zhibo Chen

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15079 2025-02-24 cs.CV cs.AI cs.CL 83%

Can Hallucination Correction Improve Video-Language Alignment?

Lingjun Zhao, Mingyang Xie, Paola Cascante-Bonilla, Hal Daumé, Kwonjoon Lee

机构 * University of Maryland(马里兰大学) Stony Brook University(石溪大学) Honda Research Institute(本田研究所)

专题命中 视频生成 :video-language(title,abstract);text-to-video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04299 2025-02-07 cs.CV 83%

MotionCanvas: Cinematic Shot Design with Controllable Image-to-Video Generation

Jinbo Xing, Long Mai, Cusuh Ham, Jiahui Huang, Aniruddha Mahapatra, Chi-Wing Fu, Tien-Tsin Wong, Feng Liu

机构 * The Chinese University of Hong Kong(香港中文大学) Adobe Research(奥多比研究院) Monash University(莫纳什大学)

专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

Comments It is best viewed in Acrobat. Project page: https://motion-canvas25.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01690 2025-02-05 cs.CV 83%

HuViDPO:Enhancing Video Generation through Direct Preference Optimization for Human-Centric Alignment

Lifan Jiang, Boxi Wu, Jiahui Zhang, Xiaotong Guan, Shuang Chen

机构 * Zhejiang University(浙江大学)

专题命中 视频生成 :video generation(title,abstract);text-to-video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09982 2025-02-04 cs.CV cs.AI cs.CL cs.LG 83%

RichSpace: Enriching Text-to-Video Prompt Space via Text Embedding Interpolation

Yuefan Cao, Chengyue Gong, Xiaoyu Li, Yingyu Liang, Zhizhou Sha, Zhenmei Shi, Zhao Song

机构 * Zhejiang University(浙江大学) The University of Texas at Austin(德克萨斯大学奥斯汀分校) University of New South Wales(新南威尔士大学) The University of Hong Kong(香港大学) University of Wisconsin-Madison(威斯康星大学麦迪逊分校) Tsinghua University(清华大学) Simons Institute for the Theory of Computing, University of California, Berkeley(加州大学伯克利分校西蒙斯理论计算研究所)

专题命中 视频生成 :text-to-video(title,abstract);video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.16612 2025-01-29 cs.CV 83%

CascadeV: An Implementation of Wurstchen Architecture for Video Generation

Wenfeng Lin, Jiangchuan Wei, Boyuan Liu, Yichen Zhang, Shiyue Yan, Mingyu Guo

机构 * ByteDance(字节跳动)

专题命中 视频生成 :video generation(title,abstract);text-to-video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.07563 2025-01-14 cs.CV 83%

Training-Free Motion-Guided Video Generation with Enhanced Temporal Consistency Using Motion Consistency Loss

Xinyu Zhang, Zicheng Duan, Dong Gong, Lingqiao Liu

机构 * The University of Adelaide(阿德莱德大学) The University of New South Wales(新南威尔士大学)

专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

Comments Project page: https://zhangxinyu-xyz.github.io/SimulateMotion.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.13239 2024-12-30 cs.CV 83%

CustomCrafter: Customized Video Generation with Preserving Motion and Concept Composition Abilities

Tao Wu, Yong Zhang, Xintao Wang, Xianpan Zhou, Guangcong Zheng, Zhongang Qi, Ying Shan, Xi Li

专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

Comments Accepted by AAAI 2025. Project page: https://customcrafter.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15646 2024-12-24 cs.CV 83%

CustomTTT: Motion and Appearance Customized Video Generation via Test-Time Training

Xiuli Bi, Jian Lu, Bo Liu, Xiaodong Cun, Yong Zhang, Weisheng Li, Bin Xiao

专题命中 视频生成 :video generation(title);video diffusion(abstract);text-to-video(abstract);分类 cs.CV

Comments Accepted in AAAI 2025. Project Page: https://customttt.github.io/ Code: https://github.com/RongPiKing/CustomTTT

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09623 2024-12-13 cs.CV 83%

OmniDrag: Enabling Motion Control for Omnidirectional Image-to-Video Generation

Weiqi Li, Shijie Zhao, Chong Mou, Xuhan Sheng, Zhenyu Zhang, Qian Wang, Junlin Li, Li Zhang, Jian Zhang

专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.12347 2024-12-12 cs.CV cs.GR 83%

AniClipart: Clipart Animation with Text-to-Video Priors

Ronghuan Wu, Wanchao Su, Kede Ma, Jing Liao

专题命中 视频生成 :text-to-video(title,abstract);video generation(abstract);分类 cs.CV

Comments IJCV 2024, Project Page: https://aniclipart.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.04966 2024-12-11 cs.CV 83%

NewMove: Customizing text-to-video models with novel motions

Joanna Materzynska, Josef Sivic, Eli Shechtman, Antonio Torralba, Richard Zhang, Bryan Russell

专题命中 视频生成 :text-to-video(title,abstract);video generation(abstract);分类 cs.CV

Comments Project page: this website https://joaanna.github.io/customizing_motion/

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.05630 2024-12-10 cs.CV 83%

Ctrl-V: Higher Fidelity Video Generation with Bounding-Box Controlled Object Motion

Ge Ya Luo, Zhi Hao Luo, Anthony Gosselin, Alexia Jolicoeur-Martineau, Christopher Pal

专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.00769 2024-12-09 cs.CV cs.AI 83%

GameGen-X: Interactive Open-world Game Video Generation

Haoxuan Che, Xuanhua He, Quande Liu, Cheng Jin, Hao Chen

专题命中 视频生成 :video generation(title,abstract);text-to-video(abstract);分类 cs.CV

Comments Homepage: https://gamegen-x.github.io/ Github: https://github.com/GameGen-X/GameGen-X

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.06269 2024-11-20 cs.CV 83%

FastVideoEdit: Leveraging Consistency Models for Efficient Text-to-Video Editing

Youyuan Zhang, Xuan Ju, James J. Clark

专题命中 视频生成 :text-to-video(title,abstract);video generation(abstract);分类 cs.CV

Comments Accepted to WACV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.15241 2024-11-13 cs.CV 83%

GenRec: Unifying Video Generation and Recognition with Diffusion Models

Zejia Weng, Xitong Yang, Zhen Xing, Zuxuan Wu, Yu-Gang Jiang

专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

Comments 19 pages, 6 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.20280 2024-10-29 cs.CV cs.AI 83%

MarDini: Masked Autoregressive Diffusion for Video Generation at Scale

Haozhe Liu, Shikun Liu, Zijian Zhou, Mengmeng Xu, Yanping Xie, Xiao Han, Juan C. Pérez, Ding Liu, Kumara Kahatapitiya, Menglin Jia, Jui-Chieh Wu, Sen He, Tao Xiang, Jürgen Schmidhuber, Juan-Manuel Pérez-Rúa

专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

Comments Project Page: https://mardini-vidgen.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.05338 2024-10-23 cs.CV 83%

MotionClone: Training-Free Motion Cloning for Controllable Video Generation

Pengyang Ling, Jiazi Bu, Pan Zhang, Xiaoyi Dong, Yuhang Zang, Tong Wu, Huaian Chen, Jiaqi Wang, Yi Jin

专题命中 视频生成 :video generation(title,abstract);text-to-video(abstract);分类 cs.CV

Comments 18 pages, 14 figures, https://bujiazi.github.io/motionclone.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.14715 2024-10-22 cs.CV cs.AI 83%

Animating the Past: Reconstruct Trilobite via Video Generation

Xiaoran Wu, Zien Huang, Chonghan Yu

专题命中 视频生成 :video generation(title,abstract);text-to-video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.00769 2024-10-17 cs.CV cs.LG 83%

AnimateLCM: Computation-Efficient Personalized Style Video Generation without Personalized Video Data

Fu-Yun Wang, Zhaoyang Huang, Weikang Bian, Xiaoyu Shi, Keqiang Sun, Guanglu Song, Yu Liu, Hongsheng Li

专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

Comments Accepted as a Short Paper by SIGGRAPH ASIA 2024 Technical Communications. This is a short version of the original work. Project Page: https://animatelcm.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.13248 2024-10-07 cs.CV 83%

Mora: Enabling Generalist Video Generation via A Multi-Agent Framework

Zhengqing Yuan, Yixin Liu, Yihan Cao, Weixiang Sun, Haolong Jia, Ruoxi Chen, Zhaoxu Li, Bin Lin, Li Yuan, Lifang He, Chi Wang, Yanfang Ye, Lichao Sun

专题命中 视频生成 :video generation(title,abstract);text-to-video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏