arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

共收录 2158 信号源:cs.CV, eess.IV, cs.MM

1. 视频生成 2158 篇

2505.15800 2025-05-27 cs.CV 79%

Interspatial Attention for Efficient 4D Human Video Generation

Ruizhi Shao, Yinghao Xu, Yujun Shen, Ceyuan Yang, Yang Zheng, Changan Chen, Yebin Liu, Gordon Wetzstein

机构 * Tsinghua University(清华大学) Stanford University(斯坦福大学) Ant Research(蚂蚁研究) ByteDance Inc.(字节跳动公司)

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

Comments Project page: https://dsaurus.github.io/isa4d/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18078 2025-05-26 cs.CV 79%

DanceTogether! Identity-Preserving Multi-Person Interactive Video Generation

Junhao Chen, Mingjin Chen, Jianjin Xu, Xiang Li, Junting Dong, Mingze Sun, Puhua Jiang, Hongxiang Li, Yuhang Yang, Hao Zhao, Xiaoxiao Long, Ruqi Huang

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

Comments Our video demos and code are available at https://DanceTog.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17618 2025-05-26 cs.CV cs.AI cs.LG 79%

Scaling Image and Video Generation via Test-Time Evolutionary Search

Haoran He, Jiajun Liang, Xintao Wang, Pengfei Wan, Di Zhang, Kun Gai, Ling Pan

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

Comments 37 pages. Project: https://tinnerhrhe.github.io/evosearch

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14709 2025-05-22 cs.CV cs.AI 79%

FastCar: Cache Attentive Replay for Fast Auto-Regressive Video Generation on the Edge

Xuan Shen, Weize Ma, Yufa Zhou, Enhao Tang, Yanyue Xie, Zhengang Li, Yifan Gong, Quanyi Wang, Henghui Ding, Yiwei Wang, Yanzhi Wang, Pu Zhao, Jun Lin, Jiuxiang Gu

机构 * Northeastern University(东北大学) Nanjing University(南京大学) Duke University(杜克大学) Adobe Research(Adobe研究) NUIST(南京信息工程大学) Fudan University(复旦大学) UCM(乌拉尔联邦大学)

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

Comments Preprint Version

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.08189 2025-05-22 cs.CV 79%

AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance

Zhao Wang, Hao Wen, Lingting Zhu, Chenming Shang, Yujiu Yang, Qi Dou

机构 * The Chinese University of Hong Kong(香港中文大学) Tsinghua University(清华大学) The University of Hong Kong(香港大学)

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

Comments 18 pages, 10 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.06985 2025-05-13 cs.CV 79%

BridgeIV: Bridging Customized Image and Video Generation through Test-Time Autoregressive Identity Propagation

Panwen Hu, Jiehui Huang, Qiang Sun, Xiaodan Liang

机构 * Mohamed bin Zayed University of Artificial Intelligence(莫扎伊德·本·泽亚德人工智能大学) Sun Yat-sen University(孙中山大学) University of Toronto(多伦多大学)

专题命中 视频生成 :video generation(title);text-to-video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04512 2025-05-09 cs.CV 79%

HunyuanCustom: A Multimodal-Driven Architecture for Customized Video Generation

Teng Hu, Zhentao Yu, Zhengguang Zhou, Sen Liang, Yuan Zhou, Qin Lin, Qinglin Lu

机构 * Tencent Hunyuan(腾讯文汇)

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08685 2025-05-06 cs.CV cs.AI 79%

Seaweed-7B: Cost-Effective Training of Video Generation Foundation Model

Team Seawead, Ceyuan Yang, Zhijie Lin, Yang Zhao, Shanchuan Lin, Zhibei Ma, Haoyuan Guo, Hao Chen, Lu Qi, Sen Wang, Feng Cheng, Feilong Zuo, Xuejiao Zeng, Ziyan Yang, Fangyuan Kong, Meng Wei, Zhiwu Qing, Fei Xiao, Tuyen Hoang, Siyu Zhang, Peihao Zhu, Qi Zhao, Jiangqiao Yan, Liangke Gui, Sheng Bi, Jiashi Li, Yuxi Ren, Rui Wang, Huixia Li, Xuefeng Xiao, Shu Liu, Feng Ling, Heng Zhang, Houmin Wei, Huafeng Kuang, Jerry Duncan, Junda Zhang, Junru Zheng, Li Sun, Manlin Zhang, Renfei Sun, Xiaobin Zhuang, Xiaojie Li, Xin Xia, Xuyan Chi, Yanghua Peng, Yuping Wang, Yuxuan Wang, Zhongkai Zhao, Zhuo Chen, Zuquan Song, Zhenheng Yang, Jiashi Feng, Jianchao Yang, Lu Jiang

机构 * ByteDance Seed(字节跳动种子)

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

Comments Technical report (some typos fixed)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18810 2025-04-29 cs.CV cs.AI 79%

Audio-Driven Talking Face Video Generation with Joint Uncertainty Learning

Yifan Xie, Fei Ma, Yi Bin, Ying He, Fei Yu

机构 * Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东人工智能与数字经济发展实验室) Shenzhen University(深圳大学) Tongji University(同济大学)

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

Comments 10 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18448 2025-04-28 cs.CV 79%

NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration

Haotian Dong, Xin Wang, Di Lin, Yipeng Wu, Qin Chen, Ruonan Liu, Kairui Yang, Ping Li, Qing Guo

机构 * Tianjin University(天津大学) The Hong Kong Polytechnic University(香港理工大学) Shanghai Jiao Tong University(上海交通大学) National University of Singapore(新加坡国立大学)

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16720 2025-04-28 cs.CV 79%

Importance-Based Token Merging for Efficient Image and Video Generation

Haoyu Wu, Jingyi Xu, Hieu Le, Dimitris Samaras

机构 * Stony Brook University(石溪大学) EPFL(苏黎世联邦理工学院)

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17267 2025-04-25 cs.HC cs.MM 79%

MV-Crafter: An Intelligent System for Music-guided Video Generation

Chuer Chen, Shengqi Dang, Yuqi Liu, Nanxuan Zhao, Yang Shi, Nan Cao

专题命中 视频生成 :video generation(title,abstract);分类 cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15932 2025-04-23 cs.CV 79%

Reasoning Physical Video Generation with Diffusion Timestep Tokens via Reinforcement Learning

Wang Lin, Liyu Jia, Wentao Hu, Kaihang Pan, Zhongqi Yue, Wei Zhao, Jingyuan Chen, Fei Wu, Hanwang Zhang

机构 * Zhejiang University(浙江大学) Nanyang Technological University(南洋理工大学) Huawei Singapore Research Center(华为新加坡研究中心)

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.11603 2025-04-21 cs.CV 79%

LaMD: Latent Motion Diffusion for Image-Conditional Video Generation

Yaosi Hu, Zhenzhong Chen, Chong Luo

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

Comments accepted by IJCV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10111 2025-04-11 cs.CV 79%

Continual Text-to-Video Retrieval with Frame Fusion and Task-Aware Routing

Zecheng Zhao, Zhi Chen, Zi Huang, Shazia Sadiq, Tong Chen

专题命中 视频生成 :text-to-video(title,abstract);分类 cs.CV

Comments Accepted at SIGIR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22231 2025-04-08 cs.CV 79%

CoGen: 3D Consistent Video Generation via Adaptive Conditioning for Autonomous Driving

Yishen Ji, Ziyue Zhu, Zhenxin Zhu, Kaixin Xiong, Ming Lu, Zhiqi Li, Lijun Zhou, Haiyang Sun, Bing Wang, Tong Lu

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.11367 2025-04-04 cs.CV 79%

OSV: One Step is Enough for High-Quality Image to Video Generation

Xiaofeng Mao, Zhengkai Jiang, Fu-Yun Wang, Jiangning Zhang, Hao Chen, Mingmin Chi, Yabiao Wang, Wenhan Luo

专题命中 视频生成 :video generation(title);video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11897 2025-04-03 cs.CV cs.AI 79%

DLFR-VAE: Dynamic Latent Frame Rate VAE for Video Generation

Zhihang Yuan, Siyuan Wang, Rui Xie, Hanling Zhang, Tongcheng Fang, Yuzhang Shang, Shengen Yan, Guohao Dai, Yu Wang

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18942 2025-04-02 cs.CV cs.AI 79%

Video-T1: Test-Time Scaling for Video Generation

Fangfu Liu, Hanyang Wang, Yimo Cai, Kaiyan Zhang, Xiaohang Zhan, Yueqi Duan

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

Comments Project page: https://liuff19.github.io/Video-T1

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23284 2025-04-01 cs.GR cs.CV 79%

SketchVideo: Sketch-based Video Generation and Editing

Feng-Lin Liu, Hongbo Fu, Xintao Wang, Weicai Ye, Pengfei Wan, Di Zhang, Lin Gao

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21765 2025-03-28 cs.CV 79%

Exploring the Evolution of Physics Cognition in Video Generation: A Survey

Minghui Lin, Xiang Wang, Yishan Wang, Shu Wang, Fengqi Dai, Pengxiang Ding, Cunxiang Wang, Zhengrong Zuo, Nong Sang, Siteng Huang, Donglin Wang

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

Comments A comprehensive list of papers studied in this survey is available at https://github.com/minnie-lin/Awesome-Physics-Cognition-based-Video-Generation

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21144 2025-03-28 cs.CV 79%

ChatAnyone: Stylized Real-time Portrait Video Generation with Hierarchical Motion Diffusion Model

Jinwei Qi, Chaonan Ji, Sheng Xu, Peng Zhang, Bang Zhang, Liefeng Bo

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

Comments Project Page: https://humanaigc.github.io/chat-anyone/

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.14368 2025-03-25 cs.CV 79%

CAGE: Unsupervised Visual Composition and Animation for Controllable Video Generation

Aram Davtyan, Sepehr Sameni, Björn Ommer, Paolo Favaro

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

Comments Published at AAAI2025; Project website: https://araachie.github.io/cage

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.18600 2025-03-24 cs.CV cs.GR 79%

ZeroHSI: Zero-Shot 4D Human-Scene Interaction by Video Generation

Hongjie Li, Hong-Xing Yu, Jiaman Li, Jiajun Wu

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

Comments Project website: https://awfuact.github.io/zerohsi/ The first two authors contribute equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16819 2025-03-21 cs.CV cs.AI cs.LG 79%

Pathways on the Image Manifold: Image Editing via Video Generation

Noam Rotstein, Gal Yona, Daniel Silver, Roy Velich, David Bensaïd, Ron Kimmel

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15875 2025-03-21 cs.CV 79%

MiLA: Multi-view Intensive-fidelity Long-term Video Generation World Model for Autonomous Driving

Haiguang Wang, Daqi Liu, Hongwei Xie, Haisong Liu, Enhui Ma, Kaicheng Yu, Limin Wang, Bing Wang

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

Comments project website: https://github.com/xiaomi-mlab/mila.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11251 2025-03-17 cs.CV cs.CL 79%

Step-Video-TI2V Technical Report: A State-of-the-Art Text-Driven Image-to-Video Generation Model

Haoyang Huang, Guoqing Ma, Nan Duan, Xing Chen, Changyi Wan, Ranchen Ming, Tianyu Wang, Bo Wang, Zhiying Lu, Aojie Li, Xianfang Zeng, Xinhao Zhang, Gang Yu, Yuhe Yin, Qiling Wu, Wen Sun, Kang An, Xin Han, Deshan Sun, Wei Ji, Bizhu Huang, Brian Li, Chenfei Wu, Guanzhe Huang, Huixin Xiong, Jiaxin He, Jianchang Wu, Jianlong Yuan, Jie Wu, Jiashuai Liu, Junjing Guo, Kaijun Tan, Liangyu Chen, Qiaohui Chen, Ran Sun, Shanshan Yuan, Shengming Yin, Sitong Liu, Wei Chen, Yaqi Dai, Yuchu Luo, Zheng Ge, Zhisheng Guan, Xiaoniu Song, Yu Zhou, Binxing Jiao, Jiansheng Chen, Jing Li, Shuchang Zhou, Xiangyu Zhang, Yi Xiu, Yibo Zhu, Heung-Yeung Shum, Daxin Jiang

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

Comments 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10391 2025-03-14 cs.CV cs.AI 79%

CINEMA: Coherent Multi-Subject Video Generation via MLLM-Based Guidance

Yufan Deng, Xun Guo, Yizhi Wang, Jacob Zhiyuan Fang, Angtian Wang, Shenghai Yuan, Yiding Yang, Bo Liu, Haibin Huang, Chongyang Ma

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06508 2025-03-12 cs.CV cs.AI 79%

LightMotion: A Light and Tuning-free Method for Simulating Camera Motion in Video Generation

Quanjian Song, Zhihang Lin, Zhanpeng Zeng, Ziyue Zhang, Liujuan Cao, Rongrong Ji

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

Comments 18 pages in total

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07418 2025-03-11 cs.CV 79%

AR-Diffusion: Asynchronous Video Generation with Auto-Regressive Diffusion

Mingzhen Sun, Weining Wang, Gen Li, Jiawei Liu, Jiahui Sun, Wanquan Feng, Shanshan Lao, SiYu Zhou, Qian He, Jing Liu

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏