RISE-Video: Can Video Generators Decode Implicit World Rules?
RISE-Video: 视频生成器能否解码隐含的世界规则?
机构 * Shanghai Jiao Tong University(上海交通大学) ; Tencent Youtu Lab(腾讯优图实验室) ; Xidian University(西安电子科技大学) ; Beijing Normal University(北京师范大学) ; The Chinese University of Hong Kong(香港中文大学)
AI总结 RISE-Video通过多维评估框架评估视频生成模型在隐含世界规则推理能力,揭示其在复杂场景模拟中的不足,推动未来生成模型的发展。
Comments 38 pages, 16 figures, 3 tables; Code: https://github.com/VisionXLab/RISE-Video; HuggingFace: https://huggingface.co/datasets/VisionXLab/RISE-Video