arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

2026-01-21 至 2026-01-21 共收录 2 信号源:cs.CV, eess.IV, cs.MM

1. 视频扩散模型 2 篇

2601.12761 2026-01-21 cs.CV 83%

Moaw: Unleashing Motion Awareness for Video Diffusion Models

Moaw:释放视频扩散模型中的运动感知

Tianqi Zhang, Ziyi Wang, Wenzhao Zheng, Weiliang Chen, Yuanhui Huang, Zhengyang Huang, Jie Zhou, Jiwen Lu

机构 * Tsinghua University(清华大学) Beihang University(北航)

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

AI总结 Moaw通过训练视频扩散模型进行运动感知,实现零样本运动迁移,推动生成建模与运动理解的结合。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14255 2026-01-21 cs.CV cs.AI 57%

VideoMaMa: Mask-Guided Video Matting via Generative Prior

VideoMaMa: 通过生成先验进行掩码引导的视频磨皮

Sangbeom Lim, Seoung Wug Oh, Jiahui Huang, Heeji Yoon, Seungryong Kim, Joon-Young Lee

机构 * Korea University(韩国大学) Adobe Research(Adobe研究) KAIST AI(韩国科学技术院人工智能)

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

AI总结 VideoMaMa通过生成先验和分割提示,实现从粗糙掩码到精确磨皮的转换,并构建大规模伪标签数据集提升视频磨皮研究

Comments Project page: https://cvlab-kaist.github.io/VideoMaMa/

详情

展开后加载摘要…

URL PDF HTML 收藏