The Dynamic Prior: Understanding 3D Structures for Casual Dynamic Videos
动态先验:为随意动态视频理解3D结构
机构 * PKU(北京大学) ; NVIDIA(英伟达) ; USC(南加州大学) ; University of Michigan(密歇根大学)
AI总结 本文提出动态先验模型,利用Vision-Language Models和SAM2实现无需任务特定训练的动态物体识别,提升结构3D理解的准确性和鲁棒性。
Comments Code is available at https://github.com/wuzy2115/DYNAPO