arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

2025-08-04 至 2025-08-04 共收录 2 信号源:cs.CV, eess.IV, cs.MM

1. 动作与事件理解 2 篇

2507.19924 2025-08-04 cs.CV 70%

HumanSAM: Classifying Human-centric Forgery Videos in Human Spatial, Appearance, and Motion Anomaly

Chang Liu, Yunfan Ye, Fan Zhang, Qingyang Zhou, Yuchuan Luo, Zhiping Cai

机构 * National University of Defense Technology(国防科技大学) Hunan University(湖南大学)

专题命中 动作与事件理解 :video generation(abstract);video understanding(abstract);分类 cs.CV

Comments ICCV 2025. Project page: https://dejian-lc.github.io/humansam/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00795 2025-08-04 cs.RO 50%

Video Generators are Robot Policies

Junbang Liang, Pavel Tokmakov, Ruoshi Liu, Sruthi Sudhakar, Paarth Shah, Rares Ambrus, Carl Vondrick

机构 * Columbia University(哥伦比亚大学) Toyota Research Institute(丰田研究院)

专题命中 动作与事件理解 :video generation(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏