One Layer Is Enough: Adapting Pretrained Visual Encoders for Image Generation
一层就够:适应预训练视觉编码器进行图像生成
机构 * Apple(苹果公司)
专题命中 文生图 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV
AI总结 FAE通过单层注意力机制将预训练视觉编码器适应到低维潜在空间,实现高效且高质量的图像生成。