Flow to the Mode: Mode-Seeking Diffusion Autoencoders for State-of-the-Art Image Tokenization
流到模式:用于最新图像标记化的模式寻求扩散自编码器
机构 * Stanford University(斯坦福大学) ; University of Michigan(密歇根大学)
AI总结 FlowMo是一种基于Transformer的扩散自编码器,通过模式匹配和模式寻求阶段实现图像标记化的新SOTA,无需卷积、对抗损失等。
Comments ICCV 2025, 19 pages