Real2SAM2Real: Generative 3D Caches as Complementary Context for Video Diffusion
Real2SAM2Real: 生成式3D缓存作为视频扩散的互补上下文
机构 * University of Maryland(马里兰大学)
专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV
AI总结 提出Real2SAM2Real框架,通过3D提升模型提取可编辑的3D缓存作为几何支架,结合软空间对齐注入和微调策略,实现视频扩散模型对相机轨迹和多实体运动的精确解耦控制。