GTA: Advancing Image-to-3D World Generation via Geometry Then Appearance Video Diffusion
GTA: 通过几何然后外观视频扩散推进图像到3D世界生成
机构 * College of Information Science and Electronic Engineering, Zhejiang University(浙江大学信息科学与电子工程学院)
AI总结 本文提出GTA方法,通过几何先于外观的两阶段框架提升3D场景生成的结构精度和视觉质量,同时引入随机潜在shuffle策略和测试时缩放方案,实验表明其在保真度、视觉质量和几何准确性上优于现有方法。
Comments Accepted by International Journal of Computer Vision (IJCV)