arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

共收录 6840 信号源:cs.CV, eess.IV, cs.MM

1. 视频生成 2171 篇

2504.18448 2025-04-28 cs.CV 79%

NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration

Haotian Dong, Xin Wang, Di Lin, Yipeng Wu, Qin Chen, Ruonan Liu, Kairui Yang, Ping Li, Qing Guo

机构 * Tianjin University(天津大学) The Hong Kong Polytechnic University(香港理工大学) Shanghai Jiao Tong University(上海交通大学) National University of Singapore(新加坡国立大学)

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16720 2025-04-28 cs.CV 79%

Importance-Based Token Merging for Efficient Image and Video Generation

Haoyu Wu, Jingyi Xu, Hieu Le, Dimitris Samaras

机构 * Stony Brook University(石溪大学) EPFL(苏黎世联邦理工学院)

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17267 2025-04-25 cs.HC cs.MM 79%

MV-Crafter: An Intelligent System for Music-guided Video Generation

Chuer Chen, Shengqi Dang, Yuqi Liu, Nanxuan Zhao, Yang Shi, Nan Cao

专题命中 视频生成 :video generation(title,abstract);分类 cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15932 2025-04-23 cs.CV 79%

Reasoning Physical Video Generation with Diffusion Timestep Tokens via Reinforcement Learning

Wang Lin, Liyu Jia, Wentao Hu, Kaihang Pan, Zhongqi Yue, Wei Zhao, Jingyuan Chen, Fei Wu, Hanwang Zhang

机构 * Zhejiang University(浙江大学) Nanyang Technological University(南洋理工大学) Huawei Singapore Research Center(华为新加坡研究中心)

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.11603 2025-04-21 cs.CV 79%

LaMD: Latent Motion Diffusion for Image-Conditional Video Generation

Yaosi Hu, Zhenzhong Chen, Chong Luo

机构 * School of Remote Sensing and Information Engineering, Wuhan University(武汉大学遥感信息工程学院) Microsoft Research Asia(微软亚洲研究院)

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

Comments accepted by IJCV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10111 2025-04-11 cs.CV 79%

Continual Text-to-Video Retrieval with Frame Fusion and Task-Aware Routing

Zecheng Zhao, Zhi Chen, Zi Huang, Shazia Sadiq, Tong Chen

机构 * The University of Queensland(昆士兰大学) The University of Southern Queensland(南昆士兰大学)

专题命中 视频生成 :text-to-video(title,abstract);分类 cs.CV

Comments Accepted at SIGIR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22231 2025-04-08 cs.CV 79%

CoGen: 3D Consistent Video Generation via Adaptive Conditioning for Autonomous Driving

Yishen Ji, Ziyue Zhu, Zhenxin Zhu, Kaixin Xiong, Ming Lu, Zhiqi Li, Lijun Zhou, Haiyang Sun, Bing Wang, Tong Lu

机构 * Nanjing University(南京大学) Xiaomi EV(小米汽车) Nankai University(南开大学) Peking University(北京大学)

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.11367 2025-04-04 cs.CV 79%

OSV: One Step is Enough for High-Quality Image to Video Generation

Xiaofeng Mao, Zhengkai Jiang, Fu-Yun Wang, Jiangning Zhang, Hao Chen, Mingmin Chi, Yabiao Wang, Wenhan Luo

机构 * Fudan University(复旦大学) Hong Kong University of Science and Technology(香港科技大学) The Chinese University of Hong Kong(香港中文大学) Zhejiang University(浙江大学) Tencent YouTu Lab(腾讯优图实验室)

专题命中 视频生成 :video generation(title);video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11897 2025-04-03 cs.CV cs.AI 79%

DLFR-VAE: Dynamic Latent Frame Rate VAE for Video Generation

Zhihang Yuan, Siyuan Wang, Rui Xie, Hanling Zhang, Tongcheng Fang, Yuzhang Shang, Shengen Yan, Guohao Dai, Yu Wang

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18942 2025-04-02 cs.CV cs.AI 79%

Video-T1: Test-Time Scaling for Video Generation

Fangfu Liu, Hanyang Wang, Yimo Cai, Kaiyan Zhang, Xiaohang Zhan, Yueqi Duan

机构 * Tsinghua University(清华大学) Tencent(腾讯)

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

Comments Project page: https://liuff19.github.io/Video-T1

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23284 2025-04-01 cs.GR cs.CV 79%

SketchVideo: Sketch-based Video Generation and Editing

Feng-Lin Liu, Hongbo Fu, Xintao Wang, Weicai Ye, Pengfei Wan, Di Zhang, Lin Gao

机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学) Hong Kong University of Science and Technology(香港科技大学) Kuaishou Technology(快手科技)

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21765 2025-03-28 cs.CV 79%

Exploring the Evolution of Physics Cognition in Video Generation: A Survey

Minghui Lin, Xiang Wang, Yishan Wang, Shu Wang, Fengqi Dai, Pengxiang Ding, Cunxiang Wang, Zhengrong Zuo, Nong Sang, Siteng Huang, Donglin Wang

机构 * Huazhong University of Science and Technology(华中科技大学) Westlake University(西湖大学) Shandong University(山东大学) Tsinghua University(清华大学) Zhejiang University(浙江大学)

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

Comments A comprehensive list of papers studied in this survey is available at https://github.com/minnie-lin/Awesome-Physics-Cognition-based-Video-Generation

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21144 2025-03-28 cs.CV 79%

ChatAnyone: Stylized Real-time Portrait Video Generation with Hierarchical Motion Diffusion Model

Jinwei Qi, Chaonan Ji, Sheng Xu, Peng Zhang, Bang Zhang, Liefeng Bo

机构 * Tongyi Lab, Alibaba Group(阿里巴巴集团通义实验室)

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

Comments Project Page: https://humanaigc.github.io/chat-anyone/

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.14368 2025-03-25 cs.CV 79%

CAGE: Unsupervised Visual Composition and Animation for Controllable Video Generation

Aram Davtyan, Sepehr Sameni, Björn Ommer, Paolo Favaro

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

Comments Published at AAAI2025; Project website: https://araachie.github.io/cage

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.18600 2025-03-24 cs.CV cs.GR 79%

ZeroHSI: Zero-Shot 4D Human-Scene Interaction by Video Generation

Hongjie Li, Hong-Xing Yu, Jiaman Li, Jiajun Wu

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

Comments Project website: https://awfuact.github.io/zerohsi/ The first two authors contribute equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16819 2025-03-21 cs.CV cs.AI cs.LG 79%

Pathways on the Image Manifold: Image Editing via Video Generation

Noam Rotstein, Gal Yona, Daniel Silver, Roy Velich, David Bensaïd, Ron Kimmel

机构 * Technion - Israel Institute of Technology(以色列理工学院)

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15875 2025-03-21 cs.CV 79%

MiLA: Multi-view Intensive-fidelity Long-term Video Generation World Model for Autonomous Driving

Haiguang Wang, Daqi Liu, Hongwei Xie, Haisong Liu, Enhui Ma, Kaicheng Yu, Limin Wang, Bing Wang

机构 * Nanjing University(南京大学) Xiaomi EV(小米汽车) Westlake University(西湖大学)

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

Comments project website: https://github.com/xiaomi-mlab/mila.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11251 2025-03-17 cs.CV cs.CL 79%

Step-Video-TI2V Technical Report: A State-of-the-Art Text-Driven Image-to-Video Generation Model

Haoyang Huang, Guoqing Ma, Nan Duan, Xing Chen, Changyi Wan, Ranchen Ming, Tianyu Wang, Bo Wang, Zhiying Lu, Aojie Li, Xianfang Zeng, Xinhao Zhang, Gang Yu, Yuhe Yin, Qiling Wu, Wen Sun, Kang An, Xin Han, Deshan Sun, Wei Ji, Bizhu Huang, Brian Li, Chenfei Wu, Guanzhe Huang, Huixin Xiong, Jiaxin He, Jianchang Wu, Jianlong Yuan, Jie Wu, Jiashuai Liu, Junjing Guo, Kaijun Tan, Liangyu Chen, Qiaohui Chen, Ran Sun, Shanshan Yuan, Shengming Yin, Sitong Liu, Wei Chen, Yaqi Dai, Yuchu Luo, Zheng Ge, Zhisheng Guan, Xiaoniu Song, Yu Zhou, Binxing Jiao, Jiansheng Chen, Jing Li, Shuchang Zhou, Xiangyu Zhang, Yi Xiu, Yibo Zhu, Heung-Yeung Shum, Daxin Jiang

机构 * StepFun(阶跃星辰)

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

Comments 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10391 2025-03-14 cs.CV cs.AI 79%

CINEMA: Coherent Multi-Subject Video Generation via MLLM-Based Guidance

Yufan Deng, Xun Guo, Yizhi Wang, Jacob Zhiyuan Fang, Angtian Wang, Shenghai Yuan, Yiding Yang, Bo Liu, Haibin Huang, Chongyang Ma

机构 * ByteDance Intelligent Creation(字节跳动智能创作) Peking Univeristy(北京大学)

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06508 2025-03-12 cs.CV cs.AI 79%

LightMotion: A Light and Tuning-free Method for Simulating Camera Motion in Video Generation

Quanjian Song, Zhihang Lin, Zhanpeng Zeng, Ziyue Zhang, Liujuan Cao, Rongrong Ji

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

Comments 18 pages in total

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07418 2025-03-11 cs.CV 79%

AR-Diffusion: Asynchronous Video Generation with Auto-Regressive Diffusion

Mingzhen Sun, Weining Wang, Gen Li, Jiawei Liu, Jiahui Sun, Wanquan Feng, Shanshan Lao, SiYu Zhou, Qian He, Jing Liu

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06545 2025-03-11 cs.CV 79%

QuantCache: Adaptive Importance-Guided Quantization with Hierarchical Latent and Layer Caching for Video Generation

Junyi Wu, Zhiteng Li, Zheng Hui, Yulun Zhang, Linghe Kong, Xiaokang Yang

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

Comments The code and models will be available at https://github.com/JunyiWuCode/QuantCache

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06053 2025-03-11 cs.CV cs.AI 79%

DropletVideo: A Dataset and Approach to Explore Integral Spatio-Temporal Consistent Video Generation

Runze Zhang, Guoguang Du, Xiaochuan Li, Qi Jia, Liang Jin, Lu Liu, Jingjing Wang, Cong Xu, Zhenhua Guo, Yaqian Zhao, Xiaoli Gong, Rengang Li, Baoyu Fan

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.06070 2025-03-11 cs.CV 79%

ControlNeXt: Powerful and Efficient Control for Image and Video Generation

Bohao Peng, Jian Wang, Yuechen Zhang, Wenbo Li, Ming-Chang Yang, Jiaya Jia

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

Comments controllable generation

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04666 2025-03-07 cs.CV 79%

What Are You Doing? A Closer Look at Controllable Human Video Generation

Emanuele Bugliarello, Anurag Arnab, Roni Paiss, Pieter-Jan Kindermans, Cordelia Schmid

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03689 2025-03-06 cs.CV 79%

DualDiff+: Dual-Branch Diffusion for High-Fidelity Video Generation with Reward Guidance

Zhao Yang, Zezhong Qian, Xiaofan Li, Weixiang Xu, Gongpeng Zhao, Ruohong Yu, Lingsi Zhu, Longjun Liu

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04814 2025-03-06 cs.CV 79%

LiFT: Leveraging Human Feedback for Text-to-Video Model Alignment

Yibin Wang, Zhiyu Tan, Junyan Wang, Xiaomeng Yang, Cheng Jin, Hao Li

专题命中 视频生成 :text-to-video(title,abstract);分类 cs.CV

Comments Project page: https://codegoat24.github.io/LiFT

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.14169 2025-03-04 cs.CV 79%

Autoregressive Video Generation without Vector Quantization

Haoge Deng, Ting Pan, Haiwen Diao, Zhengxiong Luo, Yufeng Cui, Huchuan Lu, Shiguang Shan, Yonggang Qi, Xinlong Wang

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

Comments Accepted to ICLR 2025. Project page at https://github.com/baaivision/NOVA

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20694 2025-03-03 cs.CV cs.AI 79%

WorldModelBench: Judging Video Generation Models As World Models

Dacheng Li, Yunhao Fang, Yukang Chen, Shuo Yang, Shiyi Cao, Justin Wong, Michael Luo, Xiaolong Wang, Hongxu Yin, Joseph E. Gonzalez, Ion Stoica, Song Han, Yao Lu

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19868 2025-02-28 cs.CV 79%

C-Drag: Chain-of-Thought Driven Motion Controller for Video Generation

Yuhao Li, Mirana Claire Angel, Salman Khan, Yu Zhu, Jinqiu Sun, Yanning Zhang, Fahad Shahbaz Khan

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏