arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

共收录 2160 信号源:cs.CV, eess.IV, cs.MM

1. 视频生成 2160 篇

2504.17828 2025-04-28 cs.CV cs.AI 57%

VEU-Bench: Towards Comprehensive Understanding of Video Editing

Bozheng Li, Yongliang Wu, Yi Lu, Jiashuo Yu, Licheng Tang, Jiawang Cao, Wenqing Zhu, Yuyang Sun, Jay Wu, Wenbo Zhu

机构 * Opus AI Research(Opus AI研究机构) Brown University(布朗大学) Southeast University(东南大学) University of Toronto(多伦多大学) Fudan University(复旦大学)

专题命中 视频生成 :video understanding(abstract);分类 cs.CV

Comments Accepted to CVPR2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17788 2025-04-25 cs.CV 57%

Dynamic Camera Poses and Where to Find Them

Chris Rockwell, Joseph Tung, Tsung-Yi Lin, Ming-Yu Liu, David F. Fouhey, Chen-Hsuan Lin

机构 * NVIDIA University of Michigan(密歇根大学) New York University(纽约大学)

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Accepted to CVPR 2025. Project Page: https://research.nvidia.com/labs/dir/dynpose-100k

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.16016 2025-04-23 cs.CV 57%

Efficient Temporal Consistency in Diffusion-Based Video Editing with Adaptor Modules: A Theoretical Framework

Xinyuan Song, Yangfan He, Sida Li, Jianhui Wang, Hongyang He, Xinhang Yuan, Ruoyu Wang, Jiaqi Chen, Keqin Li, Kuan Lu, Menghao Huo, Binxu Li, Pei Liu

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments arXiv admin note: substantial text overlap with arXiv:2501.04606

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13074 2025-04-22 cs.CV 57%

SkyReels-V2: Infinite-length Film Generative Model

Guibin Chen, Dixuan Lin, Jiangping Yang, Chunze Lin, Junchen Zhu, Mingyuan Fan, Hao Zhang, Sheng Chen, Zheng Chen, Chengcheng Ma, Weiming Xiong, Wei Wang, Nuo Pang, Kang Kang, Zhiheng Xu, Yuzhe Jin, Yupeng Liang, Yubing Song, Peng Zhao, Boyuan Xu, Di Qiu, Debang Li, Zhengcong Fei, Yang Li, Yahui Zhou

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments 31 pages,10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.02085 2025-04-22 cs.CV cs.AI 57%

Detecting AI-Generated Video via Frame Consistency

Long Ma, Zhiyuan Yan, Qinglang Guo, Yong Liao, Haiyang Yu, Pengyuan Zhou

机构 * University of Science and Technology of China(中国科学技术大学) Peking University(北京大学) Zhejiang University(浙江大学) Aarhus University(阿鲁斯大学)

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14470 2025-04-22 cs.CV 57%

Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis

Jingjing Ren, Wenbo Li, Zhongdao Wang, Haoze Sun, Bangzhen Liu, Haoyu Chen, Jiaqi Xu, Aoxue Li, Shifeng Zhang, Bin Shao, Yong Guo, Lei Zhu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Huawei Noah’s Ark Lab(华为诺亚实验室) South China University of Technology(华南理工大学) Max Planck Institute for Informatics(马克斯·普朗克研究所(信息学)) The Hong Kong University of Science and Technology(香港科学与技术大学)

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Webpage at https://jingjingrenabc.github.io/turbo2k/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20314 2025-04-22 cs.CV 57%

Wan: Open and Advanced Large-Scale Video Generative Models

Team Wan, Ang Wang, Baole Ai, Bin Wen, Chaojie Mao, Chen-Wei Xie, Di Chen, Feiwu Yu, Haiming Zhao, Jianxiao Yang, Jianyuan Zeng, Jiayu Wang, Jingfeng Zhang, Jingren Zhou, Jinkai Wang, Jixuan Chen, Kai Zhu, Kang Zhao, Keyu Yan, Lianghua Huang, Mengyang Feng, Ningyi Zhang, Pandeng Li, Pingyu Wu, Ruihang Chu, Ruili Feng, Shiwei Zhang, Siyang Sun, Tao Fang, Tianxing Wang, Tianyi Gui, Tingyu Weng, Tong Shen, Wei Lin, Wei Wang, Wei Wang, Wenmeng Zhou, Wente Wang, Wenting Shen, Wenyuan Yu, Xianzhong Shi, Xiaoming Huang, Xin Xu, Yan Kou, Yangyu Lv, Yifei Li, Yijing Liu, Yiming Wang, Yingya Zhang, Yitong Huang, Yong Li, You Wu, Yu Liu, Yulin Pan, Yun Zheng, Yuntao Hong, Yupeng Shi, Yutong Feng, Zeyinzi Jiang, Zhen Han, Zhi-Fan Wu, Ziyu Liu

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments 60 pages, 33 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03572 2025-04-15 cs.CV cs.AI cs.LG cs.RO 57%

Navigation World Models

Amir Bar, Gaoyue Zhou, Danny Tran, Trevor Darrell, Yann LeCun

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments CVPR 2025. Project page: https://www.amirbar.net/nwm/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16199 2025-04-09 cs.CV 57%

VIRES: Video Instance Repainting via Sketch and Text Guided Generation

Shuchen Weng, Haojie Zheng, Peixuan Zhang, Yuchen Hong, Han Jiang, Si Li, Boxin Shi

专题命中 视频生成 :text-to-video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04153 2025-04-08 cs.GR cs.CV 57%

Video4DGen: Enhancing Video and 4D Generation through Mutual Optimization

Yikai Wang, Guangce Liu, Xinzhou Wang, Zilong Chen, Jiafang Li, Xin Liang, Fuchun Sun, Jun Zhu

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Published in TPAMI 2025. Code: https://github.com/yikaiw/Vidu4D, Project page: https://video4dgen.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.02541 2025-04-08 cs.CV 57%

Enhancing Temporal Consistency in Video Editing by Reconstructing Videos with 3D Gaussian Splatting

Inkyu Shin, Qihang Yu, Xiaohui Shen, In So Kweon, Kuk-Jin Yoon, Liang-Chieh Chen

专题命中 视频生成 :video diffusion(abstract);分类 cs.CV

Comments Accepted to TMLR 2025. Project page at https://video-3dgs-project.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03041 2025-04-07 cs.CV 57%

VIP: Video Inpainting Pipeline for Real World Human Removal

Huiming Sun, Yikang Li, Kangning Yang, Ruineng Li, Daitao Xing, Yangbo Xie, Lan Fu, Kaiyu Zhang, Ming Chen, Jiaming Ding, Jiang Geng, Jie Cai, Zibo Meng, Chiuman Ho

专题命中 视频生成 :text-to-video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15119 2025-04-04 cs.CV 57%

Parallelized Autoregressive Visual Generation

Yuqing Wang, Shuhuai Ren, Zhijie Lin, Yujin Han, Haoyuan Guo, Zhenheng Yang, Difan Zou, Jiashi Feng, Xihui Liu

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments CVPR 2025 Accepted - Project Page: https://yuqingwang1029.github.io/PAR-project

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23307 2025-04-01 cs.CV 57%

MoCha: Towards Movie-Grade Talking Character Synthesis

Cong Wei, Bo Sun, Haoyu Ma, Ji Hou, Felix Juefei-Xu, Zecheng He, Xiaoliang Dai, Luxin Zhang, Kunpeng Li, Tingbo Hou, Animesh Sinha, Peter Vajda, Wenhu Chen

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments https://congwei1230.github.io/MoCha/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.17726 2025-03-31 cs.CV cs.AI cs.LG 57%

VidTwin: Video VAE with Decoupled Structure and Dynamics

Yuchi Wang, Junliang Guo, Xinyi Xie, Tianyu He, Xu Sun, Jiang Bian

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Accepted by CVPR 2025; Project page: https://vidtwin.github.io/; Code: https://github.com/microsoft/VidTok/tree/main/vidtwin

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15214 2025-03-31 cs.CV 57%

LeviTor: 3D Trajectory Oriented Image-to-Video Synthesis

Hanlin Wang, Hao Ouyang, Qiuyu Wang, Wen Wang, Ka Leong Cheng, Qifeng Chen, Yujun Shen, Limin Wang

专题命中 视频生成 :video diffusion(abstract);分类 cs.CV

Comments Project page available at https://github.com/ant-research/LeviTor

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06608 2025-03-28 cs.CV cs.AI 57%

TripoSG: High-Fidelity 3D Shape Synthesis using Large-Scale Rectified Flow Models

Yangguang Li, Zi-Xin Zou, Zexiang Liu, Dehu Wang, Yuan Liang, Zhipeng Yu, Xingchao Liu, Yuan-Chen Guo, Ding Liang, Wanli Ouyang, Yan-Pei Cao

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20822 2025-03-28 eess.IV cs.AI cs.GR 57%

Synthetic Video Enhances Physical Fidelity in Video Synthesis

Qi Zhao, Xingyu Ni, Ziyu Wang, Feng Cheng, Ziyan Yang, Lu Jiang, Bohan Wang

专题命中 视频生成 :video generation(abstract);分类 eess.IV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01409 2025-03-28 cs.CV cs.AI 57%

JOG3R: Towards 3D-Consistent Video Generators

Chun-Hao Paul Huang, Niloy Mitra, Hyeonho Jeong, Jae Shin Yoon, Duygu Ceylan

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20523 2025-03-27 cs.CV cs.AI cs.RO 57%

GAIA-2: A Controllable Multi-View Generative World Model for Autonomous Driving

Lloyd Russell, Anthony Hu, Lorenzo Bertoni, George Fedoseev, Jamie Shotton, Elahe Arani, Gianluca Corrado

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20118 2025-03-27 cs.GR cs.AI cs.CV 57%

Zero-Shot Human-Object Interaction Synthesis with Multimodal Priors

Yuke Lou, Yiming Wang, Zhen Wu, Rui Zhao, Wenjia Wang, Mingyi Shi, Taku Komura

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.14526 2025-03-27 cs.CV cs.AI cs.CY cs.LG 57%

Fantastic Copyrighted Beasts and How (Not) to Generate Them

Luxi He, Yangsibo Huang, Weijia Shi, Tinghao Xie, Haotian Liu, Yue Wang, Luke Zettlemoyer, Chiyuan Zhang, Danqi Chen, Peter Henderson

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01441 2025-03-26 cs.CV cs.LG 57%

Improved Training Technique for Latent Consistency Models

Quan Dao, Khanh Doan, Di Liu, Trung Le, Dimitris Metaxas

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Accepted at ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18429 2025-03-25 cs.CV 57%

Teller: Real-Time Streaming Audio-Driven Portrait Animation with Autoregressive Motion Generation

Dingcheng Zhen, Shunshun Yin, Shiyang Qin, Hou Yi, Ziwei Zhang, Siyuan Liu, Gan Qi, Ming Tao

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Accept in CVPR 2025 Conference Submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17029 2025-03-24 cs.CV 57%

AnimatePainter: A Self-Supervised Rendering Framework for Reconstructing Painting Process

Junjie Hu, Shuyong Gao, Qianyu Guo, Yan Wang, Qishan Wang, Yuang Feng, Wenqiang Zhang

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15855 2025-03-21 cs.CV cs.AI 57%

VideoRFSplat: Direct Scene-Level Text-to-3D Gaussian Splatting Generation with Flexible Pose and Multi-View Joint Modeling

Hyojun Go, Byeongjun Park, Hyelin Nam, Byung-Hoon Kim, Hyungjin Chung, Changick Kim

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Project page: https://gohyojun15.github.io/VideoRFSplat/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15417 2025-03-20 cs.CV cs.AI 57%

Temporal Regularization Makes Your Video Generator Stronger

Harold Haodong Chen, Haojian Huang, Xianfeng Wu, Yexin Liu, Yajing Bai, Wen-Jie Shu, Harry Yang, Ser-Nam Lim

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Project: https://haroldchen19.github.io/FluxFlow/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.08976 2025-03-19 cs.CV cs.LG 57%

Identity-Preserving Pose-Guided Character Animation via Facial Landmarks Transformation

Lianrui Mu, Xingze Zhou, Wenjie Zheng, Jiangnan Ye, Haoji Hu

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments 6 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02114 2025-03-19 cs.CV cs.AI 57%

Beyond Generation: Unlocking Universal Editing via Self-Supervised Fine-Tuning

Harold Haodong Chen, Harry Yang, Ser-Nam Lim

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Project: https://haroldchen19.github.io/UES-Page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12535 2025-03-18 cs.CV 57%

SPC-GS: Gaussian Splatting with Semantic-Prompt Consistency for Indoor Open-World Free-view Synthesis from Sparse Inputs

Guibiao Liao, Qing Li, Zhenyu Bao, Guoping Qiu, Kanglin Liu

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Accepted by CVPR2025. The project page is available at https://gbliao.github.io/SPC-GS.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏