AlignTok: Aligning Visual Foundation Encoders to Tokenizers for Diffusion Models
AlignTok: 将预训练视觉编码器对齐到分词器以用于扩散模型
机构 * University of Washington(华盛顿大学) ; Adobe Research(Adobe研究)
专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV
AI总结 AlignTok通过将预训练视觉编码器对齐为分词器,提升扩散模型的生成质量和收敛速度,适用于图像生成任务。
Comments ICLR 2026, Project Page: https://aligntok.github.io/