arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

2025-11-11 至 2025-11-11 共收录 2 信号源:cs.CV, eess.IV, cs.MM

1. 视频扩散模型 2 篇

2506.08009 2025-11-11 cs.CV cs.AI cs.LG 83%

Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion

Xun Huang, Zhengqi Li, Guande He, Mingyuan Zhou, Eli Shechtman

机构 * Adobe Research(Adobe研究院) The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

Comments NeurIPS 2025 spotlight. Project website: http://self-forcing.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08239 2025-11-11 cs.GR cs.CV 57%

ACT-R: Adaptive Camera Trajectories for Single View 3D Reconstruction

Yizhi Wang, Mingrui Zhao, Hao Zhang

机构 * Simon Fraser University(西蒙弗雷泽大学)

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

Comments 3DV 2026, Project Page: https://mingrui-zhao.github.io/ACT-R/

详情

展开后加载摘要…

URL PDF HTML 收藏