arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

2026-01-28 至 2026-01-28 共收录 2 信号源:cs.CV, eess.IV, cs.MM

1. 视频生成 2 篇

2506.01943 2026-01-28 cs.CV 83%

Learning Video Generation for Robotic Manipulation with Collaborative Trajectory Control

基于协作轨迹控制的机器人操作视频生成学习

Xiao Fu, Xintao Wang, Xian Liu, Jianhong Bai, Runsen Xu, Pengfei Wan, Di Zhang, Dahua Lin

机构 * The Chinese University of Hong Kong(香港中文大学) Kuaishou Technology(快手科技) Zhejiang University(浙江大学)

专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

AI总结 RoboMaster通过协作轨迹控制方法,解决多物体交互建模问题,实现机器人操作视频生成的高保真度与多物体交互建模。

Comments ICLR 2026. Project Page: https://fuxiao0719.github.io/projects/robomaster/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17756 2026-01-28 cs.CV cs.AI cs.GR 79%

MV-S2V: Multi-View Subject-Consistent Video Generation

MV-S2V:多视图主体一致视频生成

Ziyang Song, Xinyu Gong, Bangya Liu, Zelin Zhao

机构 * The Hong Kong Polytechnic University(香港理工大学) The University of Texas at Austin(德克萨斯大学) University of Wisconsin-Madison(威斯康星大学麦迪逊分校) Georgia Institute of Technology(佐治亚理工学院)

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

AI总结 本文提出MV-S2V方法,通过多视角参考生成一致的3D主体视频,解决单视角限制并提升视频生成质量。

Comments 13 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏