arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

2025-08-19 至 2025-08-19 共收录 3 信号源:cs.CV, eess.IV, cs.MM

1. 视频生成 3 篇

2508.12969 2025-08-19 cs.CV 83%

Compact Attention: Exploiting Structured Spatio-Temporal Sparsity for Fast Video Generation

Qirui Li, Guangcong Zheng, Qi Zhao, Jie Li, Bin Dong, Yiwu Yao, Xi Li

机构 * College of Computer Science & Technology, Zhejiang University(计算机科学与技术学院,浙江大学) Huawei Technologies(华为技术)

专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13104 2025-08-19 cs.CV cs.RO 79%

Precise Action-to-Video Generation Through Visual Action Prompts

Yuang Wang, Chao Wen, Haoyu Guo, Sida Peng, Minghan Qin, Hujun Bao, Xiaowei Zhou, Ruizhen Hu

机构 * Xiangjiang Lab(湘江实验室) Zhejiang University(浙江大学) Fudan University(复旦大学) Tsinghua University(清华大学) Shenzhen University(深圳大学)

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

Comments Accepted to ICCV 2025. Project page: https://zju3dv.github.io/VAP/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13013 2025-08-19 cs.CV 57%

EgoTwin: Dreaming Body and View in First Person

Jingqiao Xiu, Fangzhou Hong, Yicong Li, Mengze Li, Wentao Wang, Sirui Han, Liang Pan, Ziwei Liu

机构 * National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学) Hong Kong University of Science and Technology(香港科学与技术大学) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏