arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

2025-09-29 至 2025-09-29 共收录 2 信号源:cs.CV, eess.IV, cs.MM

1. 动作与事件理解 2 篇

2506.02244 2025-09-29 cs.CV cs.AI 79%

Physics-Guided Motion Loss for Video Generation Model

Bowen Xue, Giuseppe Claudio Guarnera, Shuang Zhao, Zahra Montazeri

机构 * University of Manchester(曼彻斯特大学) University of York(约克大学) University of California, Irvine(加州大学 Irvine 分校)

专题命中 动作与事件理解 :video generation(title);video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21888 2025-09-29 cs.CV 57%

Drag4D: Align Your Motion with Text-Driven 3D Scene Generation

Minjun Kang, Inkyu Shin, Taeyeop Lee, In So Kweon, Kuk-Jin Yoon

机构 * KAIST(韩国科学技术院) ByteDance Seed(字节跳动种子)

专题命中 动作与事件理解 :video diffusion(abstract);分类 cs.CV

Comments version 1

详情

展开后加载摘要…

URL PDF HTML 收藏