Can Your Model Separate Yolks with a Water Bottle? Benchmarking Physical Commonsense Understanding in Video Generation Models
专题命中 视频生成 :video generation(title);text-to-video(abstract);分类 cs.CV
AI 大模型
视频理解、视频生成、视频语言模型和时序视觉推理。
专题命中 视频生成 :video generation(title);text-to-video(abstract);分类 cs.CV
机构 * Fudan University(复旦大学) ; DAMO Academy, Alibaba group(阿里集团 DAMO 院) ; Hupan Lab(虎派实验室) ; Nanyang Technological University, Singapore(新加坡南洋理工大学)
专题命中 视频生成 :video generation(title);text-to-video(abstract);分类 cs.CV
Comments ICCV 2025, Project Page: https://henghuiding.github.io/SynFMC/