VidComposition: Can MLLMs Analyze Compositions in Compiled Videos?
VidComposition: MLLMs能否分析编译视频中的构成?
机构 * University of Rochester(罗切斯特大学) ; Arizona State University(亚利桑那州立大学)
AI总结 VidComposition通过编排视频和电影级注释评估MLLMs对视频构成的理解能力,揭示了当前模型在复杂编译视频分析中的局限性。
Comments Accepted to CVPR 2025