arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

2025-11-04 至 2025-11-04 共收录 3 信号源:cs.CV, eess.IV, cs.MM

1. 视频生成 3 篇

2511.01775 2025-11-04 cs.CV cs.AI cs.MM 81%

How Far Are Surgeons from Surgical World Models? A Pilot Study on Zero-shot Surgical Video Generation with Expert Assessment

Zhen Chen, Qing Xu, Jinlin Wu, Biao Yang, Yuhao Zhai, Geng Guo, Jing Zhang, Yinlu Ding, Nassir Navab, Jiebo Luo

机构 * Yale University(耶鲁大学) University of Nottingham(诺丁汉大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Department of Neurosurgery, The First Hospital, Shanxi Medical University(山西医科大学第一医院神经外科部) Department of Gastrointestinal Surgery, The Second Qilu Hospital, Shandong University(山东大学第二齐鲁医院胃肠外科部) Technical University of Munich(慕尼黑技术大学) University of Rochester(罗切斯特大学)

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV、cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00107 2025-11-04 cs.CV cs.AI cs.IR 79%

AI Powered High Quality Text to Video Generation with Enhanced Temporal Consistency

Piyushkumar Patel

机构 * Microsoft(微软)

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00248 2025-11-04 cs.CV cs.GR 57%

Object-Aware 4D Human Motion Generation

Shurui Gui, Deep Anil Patel, Xiner Li, Martin Renqiang Min

机构 * Texas A&M University(德克萨斯A&M大学) NEC Laboratories America(NEC美国实验室)

专题命中 视频生成 :video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏