arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

2026-01-26 至 2026-01-26 共收录 3 信号源:cs.CV, eess.IV, cs.MM

1. 视频生成 3 篇

2601.16914 2026-01-26 cs.CV cs.AI 79%

LoL: Longer than Longer, Scaling Video Generation to Hour

LoL: 长于更长,将视频生成扩展至小时级

Justin Cui, Jie Wu, Ming Li, Tao Yang, Xiaojie Li, Rui Wang, Andrew Bai, Yuanhao Ban, Cho-Jui Hsieh

机构 * University of Central Florida(中央佛罗里达大学)

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

AI总结 LoL提出一种无需训练的方法,通过多头RoPE抖动缓解视频生成中的sink-collapse问题,实现长时长、高质量的流式视频生成。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16982 2026-01-26 cs.CV cs.LG cs.RO 57%

AnyView: Synthesizing Any Novel View in Dynamic Scenes

AnyView: 动态场景中合成任意新视角

Basile Van Hoorick, Dian Chen, Shun Iwase, Pavel Tokmakov, Muhammad Zubair Irshad, Igor Vasiljevic, Swati Gupta, Fangzhou Cheng, Sergey Zakharov, Vitor Campagnolo Guizilini

机构 * Toyota Research Institute(丰田研究院) Amazon Web Services(亚马逊网络服务)

专题命中 视频生成 :video generation(abstract);分类 cs.CV

AI总结 AnyView通过动态视角合成框架实现任意视角生成,克服了传统方法在高度动态场景中的局限性,提出了新的基准测试并展示了优越的性能。

Comments Project webpage: https://tri-ml.github.io/AnyView/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10072 2026-01-26 cs.CV 57%

ToonifyGB: StyleGAN-based Gaussian Blendshapes for 3D Stylized Head Avatars

ToonifyGB: 基于StyleGAN的高斯混合形状用于3D风格化头身人偶

Rui-Yang Ju, Sheng-Yen Huang, Yi-Ping Hung

机构 * Graduate Institute of Networking and Multimedia(网络与多媒体研究生院)

专题命中 视频生成 :video generation(abstract);分类 cs.CV

AI总结 ToonifyGB通过改进的StyleGAN生成风格化视频并结合高斯混合形状,实现高效渲染多样化风格化的3D头身人偶。

Comments 2-Page Version Accepted as a Poster at IEEE VR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏