arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

2025-09-23 至 2025-09-23 共收录 6 信号源:cs.CV, eess.IV, cs.MM

1. 视频生成 6 篇

2509.16956 2025-09-23 cs.CV 88%

VidCLearn: A Continual Learning Approach for Text-to-Video Generation

Luca Zanchetta, Lorenzo Papa, Luca Maiano, Irene Amerini

机构 * Sapienza University of Rome, Italy(罗马大学萨皮恩扎) ESA philab(欧洲航天局实验室)

专题命中 视频生成 :video generation(title,abstract);text-to-video(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12667 2025-09-23 cs.CV 86%

Safe-Sora: Safe Text-to-Video Generation via Graphical Watermarking

Zihan Su, Xuerui Qiu, Hongbin Xu, Tangyu Jiang, Junhao Zhuang, Chun Yuan, Ming Li, Shengfeng He, Fei Richard Yu

机构 * Tsinghua University(清华大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) South China University of Technology(华南理工大学) Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东人工智能与数字经济实验室) Singapore Management University(新加坡管理学院)

专题命中 视频生成 :video generation(title,abstract);text-to-video(title);分类 cs.CV

Comments Safa-Sora is accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14899 2025-09-23 cs.CV 79%

Uni3C: Unifying Precisely 3D-Enhanced Camera and Human Motion Controls for Video Generation

Chenjie Cao, Jingkai Zhou, Shikai Li, Jingyun Liang, Chaohui Yu, Fan Wang, Xiangyang Xue, Yanwei Fu

机构 * Alibaba DAMO Academy(阿里巴巴达摩院) Fudan University(复旦大学) Hupan Lab(虎扑实验室) Shanghai Innovation Institute(上海创新研究院)

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

Comments Project page: https://github.com/ewrfcas/Uni3C. Accepted by Siggraph Asian 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17190 2025-09-23 cs.CV cs.AI 74%

Echo-Path: Pathology-Conditioned Echo Video Generation

Kabir Hamzah Muhammad, Marawan Elbatel, Yi Qin, Xiaomeng Li

机构 * Hong Kong University of Science and Technology(香港科学与技术大学)

专题命中 视频生成 :video generation(title);分类 cs.CV

Comments 10 pages, 3 figures, MICCAI-AMAI2025 Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15564 2025-09-23 cs.CV 61%

Show-o2: Improved Native Unified Multimodal Models

Jinheng Xie, Zhenheng Yang, Mike Zheng Shou

机构 * Show Lab, National University of Singapore(新加坡国立大学Show实验室) ByteDance(字节跳动)

专题命中 视频生成 :video generation(abstract);分类 cs.CV;video understanding(comments)

Comments NeurIPS 2025. (v3: update to include video understanding, OneIG, and more ablation study results)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21385 2025-09-23 cs.HC 50%

Dynamic Vision from EEG Brain Recordings, How much does EEG know?

Prajwal Singh, Anupam Sharma, Pankaj Pandey, Krishna Miyapuram, Shanmuganathan Raman

专题命中 视频生成 :video generation(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏