arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

共收录 6808 信号源:cs.CV, eess.IV, cs.MM

1. 视频生成 2156 篇

2405.14582 2024-07-19 cs.CV cs.AI 57%

PoseCrafter: One-Shot Personalized Video Synthesis Following Flexible Pose Control

Yong Zhong, Min Zhao, Zebin You, Xiaofeng Yu, Changwang Zhang, Chongxuan Li

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.12798 2024-07-19 cs.CV 57%

Multi-Granularity and Multi-modal Feature Interaction Approach for Text Video Retrieval

Wenjun Li, Shudong Wang, Dong Zhao, Shenghui Xu, Zhaoming Pan, Zhimin Zhang

专题命中 视频生成 :text-to-video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.12002 2024-07-16 cs.CV cs.AI 57%

DreamMotion: Space-Time Self-Similar Score Distillation for Zero-Shot Video Editing

Hyeonho Jeong, Jinho Chang, Geon Yeong Park, Jong Chul Ye

专题命中 视频生成 :video diffusion(abstract);分类 cs.CV

Comments Accepted to ECCV 2024, Project page: https://hyeonho99.github.io/dreammotion/

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.06871 2024-07-10 cs.CV 57%

Rethinking Image-to-Video Adaptation: An Object-centric Perspective

Rui Qian, Shuangrui Ding, Dahua Lin

专题命中 视频生成 :video understanding(abstract);分类 cs.CV

Comments ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.16849 2024-07-09 cs.CV 57%

Sync4D: Video Guided Controllable Dynamics for Physics-Based 4D Generation

Zhoujie Fu, Jiacheng Wei, Wenhao Shen, Chaoyue Song, Xiaofeng Yang, Fayao Liu, Xulei Yang, Guosheng Lin

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Our project page: https://sync4dphys.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.16693 2024-06-28 cs.CV 57%

I2V-Adapter: A General Image-to-Video Adapter for Diffusion Models

Xun Guo, Mingwu Zheng, Liang Hou, Yuan Gao, Yufan Deng, Pengfei Wan, Di Zhang, Yufan Liu, Weiming Hu, Zhengjun Zha, Haibin Huang, Chongyang Ma

专题命中 视频生成 :text-to-video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.06470 2024-06-21 cs.CV cs.AI 57%

Qualitative Failures of Image Generation Models and Their Application in Detecting Deepfakes

Ali Borji

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11331 2024-06-18 cs.CV cs.IR cs.LG 57%

They're All Doctors: Synthesizing Diverse Counterfactuals to Mitigate Associative Bias

Salma Abdel Magid, Jui-Hsien Wang, Kushal Kafle, Hanspeter Pfister

专题命中 视频生成 :text-to-video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11259 2024-06-18 cs.CV cs.AI 57%

NLDF: Neural Light Dynamic Fields for Efficient 3D Talking Head Generation

Niu Guanchen

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2005.10638 2024-06-11 cs.LG eess.IV stat.ML 57%

Recent Developments Combining Ensemble Smoother and Deep Generative Networks for Facies History Matching

Smith W. A. Canchumuni, Jose D. B. Castro, Júlia Potratz, Alexandre A. Emerick, Marco Aurelio C. Pacheco

专题命中 视频生成 :video generation(abstract);分类 eess.IV

Comments 46 pages, 26 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.11568 2024-06-06 cs.CV 57%

EffiVED:Efficient Video Editing via Text-instruction Diffusion Models

Zhenghao Zhang, Zuozhuo Dai, Long Qin, Weizhi Wang

专题命中 视频生成 :text-to-video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.13951 2024-05-24 cs.CV 57%

Text Prompting for Multi-Concept Video Customization by Autoregressive Generation

Divya Kothandaraman, Kihyuk Sohn, Ruben Villegas, Paul Voigtlaender, Dinesh Manocha, Mohammad Babaeizadeh

专题命中 视频生成 :text-to-video(abstract);分类 cs.CV

Comments Paper accepted to AI4CC Workshop at CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.01590 2024-05-14 cs.CV 57%

NeuroCine: Decoding Vivid Video Sequences from Human Brain Activties

Jingyuan Sun, Mingxiao Li, Zijiao Chen, Marie-Francine Moens

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.16687 2024-05-08 cs.CV 57%

NTIRE 2024 Quality Assessment of AI-Generated Content Challenge

Xiaohong Liu, Xiongkuo Min, Guangtao Zhai, Chunyi Li, Tengchuan Kou, Wei Sun, Haoning Wu, Yixuan Gao, Yuqin Cao, Zicheng Zhang, Xiele Wu, Radu Timofte, Fei Peng, Huiyuan Fu, Anlong Ming, Chuanming Wang, Huadong Ma, Shuai He, Zifei Dou, Shu Chen, Huacong Zhang, Haiyi Xie, Chengwei Wang, Baoying Chen, Jishen Zeng, Jianquan Yang, Weigang Wang, Xi Fang, Xiaoxin Lv, Jun Yan, Tianwu Zhi, Yabin Zhang, Yaohui Li, Yang Li, Jingwen Xu, Jianzhao Liu, Yiting Liao, Junlin Li, Zihao Yu, Yiting Lu, Xin Li, Hossein Motamednia, S. Farhad Hosseini-Benvidi, Fengbin Guan, Ahmad Mahmoudi-Aznaveh, Azadeh Mansouri, Ganzorig Gankhuyag, Kihwan Yoon, Yifang Xu, Haotian Fan, Fangyuan Kong, Shiling Zhao, Weifeng Dong, Haibing Yin, Li Zhu, Zhiling Wang, Bingchen Huang, Avinab Saha, Sandeep Mishra, Shashank Gupta, Rajesh Sureddi, Oindrila Saha, Luigi Celona, Simone Bianco, Paolo Napoletano, Raimondo Schettini, Junfeng Yang, Jing Fu, Wei Zhang, Wenzhi Cao, Limei Liu, Han Peng, Weijun Yuan, Zhan Li, Yihang Cheng, Yifan Deng, Haohui Li, Bowen Qu, Yao Li, Shuqing Luo, Shunzhou Wang, Wei Gao, Zihao Lu, Marcos V. Conde, Xinrui Wang, Zhibo Chen, Ruling Liao, Yan Ye, Qiulin Wang, Bing Li, Zhaokun Zhou, Miao Geng, Rui Chen, Xin Tao, Xiaoyu Liang, Shangkun Sun, Xingyuan Ma, Jiaze Li, Mengduo Yang, Haoran Xu, Jie Zhou, Shiding Zhu, Bohan Yu, Pengfei Chen, Xinrui Xu, Jiabin Shen, Zhichao Duan, Erfan Asadi, Jiahe Liu, Qi Yan, Youran Qu, Xiaohui Zeng, Lele Wang, Renjie Liao

专题命中 视频生成 :text-to-video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.14385 2024-05-07 cs.DC cs.LG cs.MM 57%

Generative AI Beyond LLMs: System Implications of Multi-Modal Generation

Alicia Golden, Samuel Hsia, Fei Sun, Bilge Acun, Basil Hosmer, Yejin Lee, Zachary DeVito, Jeff Johnson, Gu-Yeon Wei, David Brooks, Carole-Jean Wu

专题命中 视频生成 :text-to-video(abstract);分类 cs.MM

Comments Published at 2024 IEEE International Symposium on Performance Analysis of Systems and Software (ISPASS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.17608 2024-04-30 cs.SD cs.AI cs.CV cs.LG eess.AS 57%

Synthesizing Audio from Silent Video using Sequence to Sequence Modeling

Hugo Garrido-Lestache Belinchon, Helina Mulugeta, Adam Haile

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.13573 2024-04-30 cs.CV 57%

Exploring AIGC Video Quality: A Focus on Visual Harmony, Video-Text Consistency and Domain Distribution Gap

Bowen Qu, Xiaoyu Liang, Shangkun Sun, Wei Gao

专题命中 视频生成 :text-to-video(abstract);分类 cs.CV

Comments 9 pages, 3 figures, 3 tables. Accepted by CVPR2024 Workshop (3rd place winner of NTIRE2024 Quality Assessment for AI-Generated Content - Track 2 Video)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.16305 2024-04-29 cs.MM cs.SD eess.AS 57%

Semantically consistent Video-to-Audio Generation using Multimodal Language Large Model

Gehui Chen, Guan'an Wang, Xiaowen Huang, Jitao Sang

专题命中 视频生成 :video generation(abstract);分类 cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.13299 2024-04-23 cs.CV 57%

PCQA: A Strong Baseline for AIGC Quality Assessment Based on Prompt Condition

Xi Fang, Weigang Wang, Xiaoxin Lv, Jun Yan

专题命中 视频生成 :text-to-video(abstract);分类 cs.CV

Comments Published in CVPR-2024's NTIRE: New Trends in Image Restoration and Enhancement workshop and challenges

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.16993 2024-03-26 cs.CV 57%

Comp4D: LLM-Guided Compositional 4D Scene Generation

Dejia Xu, Hanwen Liang, Neel P. Bhatt, Hezhen Hu, Hanxue Liang, Konstantinos N. Plataniotis, Zhangyang Wang

专题命中 视频生成 :text-to-video(abstract);分类 cs.CV

Comments Project page: https://vita-group.github.io/Comp4D/

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.16112 2024-03-26 cs.CV cs.AI cs.LG 57%

Opportunities and challenges in the application of large artificial intelligence models in radiology

Liangrui Pan, Zhenyu Zhao, Ying Lu, Kewei Tang, Liyong Fu, Qingchun Liang, Shaoliang Peng

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.09334 2024-03-26 cs.CV 57%

Video Editing via Factorized Diffusion Distillation

Uriel Singer, Amit Zohar, Yuval Kirstain, Shelly Sheynin, Adam Polyak, Devi Parikh, Yaniv Taigman

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.14186 2024-03-22 cs.CV cs.AI cs.GR 57%

StyleCineGAN: Landscape Cinemagraph Generation using a Pre-trained StyleGAN

Jongwoo Choi, Kwanggyoon Seo, Amirsaman Ashtari, Junyong Noh

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Project website: https://jeolpyeoni.github.io/stylecinegan_project/

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.12035 2024-03-19 cs.CV 57%

CoCoCo: Improving Text-Guided Video Inpainting for Better Consistency, Controllability and Compatibility

Bojia Zi, Shihao Zhao, Xianbiao Qi, Jianan Wang, Yukai Shi, Qianyu Chen, Bin Liang, Kam-Fai Wong, Lei Zhang

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.08268 2024-03-14 cs.CV 57%

Follow-Your-Click: Open-domain Regional Image Animation via Short Prompts

Yue Ma, Yingqing He, Hongfa Wang, Andong Wang, Chenyang Qi, Chengfei Cai, Xiu Li, Zhifeng Li, Heung-Yeung Shum, Wei Liu, Qifeng Chen

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Project Page: https://follow-your-click.github.io/ Github Page: https://github.com/mayuelala/FollowYourClick

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.07198 2024-03-13 cs.CV 57%

Action Reimagined: Text-to-Pose Video Editing for Dynamic Human Actions

Lan Wang, Vishnu Boddeti, Sernam Lim

专题命中 视频生成 :video understanding(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.17403 2024-02-28 cs.CV 57%

Sora Generates Videos with Stunning Geometrical Consistency

Xuanyi Li, Daquan Zhou, Chenxu Zhang, Shaodong Wei, Qibin Hou, Ming-Ming Cheng

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments 5 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.17139 2024-02-28 cs.CV cs.AI 57%

Video as the New Language for Real-World Decision Making

Sherry Yang, Jacob Walker, Jack Parker-Holder, Yilun Du, Jake Bruce, Andre Barreto, Pieter Abbeel, Dale Schuurmans

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.01107 2024-02-27 cs.CV cs.AI cs.LG stat.ML 57%

Ground-A-Video: Zero-shot Grounded Video Editing using Text-to-image Diffusion Models

Hyeonho Jeong, Jong Chul Ye

专题命中 视频生成 :text-to-video(abstract);分类 cs.CV

Comments Accepted to ICLR 2024, Project Page: http://ground-a-video.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.05957 2024-02-09 cs.CV cs.LG 57%

DDLP: Unsupervised Object-Centric Video Prediction with Deep Dynamic Latent Particles

Tal Daniel, Aviv Tamar

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments TMLR 2024. Project site: https://taldatech.github.io/ddlp-web

详情

展开后加载摘要…

URL PDF HTML 收藏