Think-Then-Generate: Reasoning-Aware Text-to-Image Diffusion with LLM Encoders
思考-然后-生成:基于LLM编码器的推理感知文本到图像扩散模型
机构 * Shanghai Jiao Tong University(上海交通大学) ; Kuaishou Technology(快手科技) ; Tsinghua University(清华大学)
专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV
AI总结 本文提出基于LLM编码器的推理感知文本到图像扩散模型,通过推理重写提示提升生成质量,达到接近GPT-4的性能。