arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-01-01 至 2026-01-01 共收录 2 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 2 篇

2512.22681 2026-01-01 cs.CV 88%

CritiFusion: Semantic Critique and Spectral Alignment for Faithful Text-to-Image Generation

CritiFusion: 语义批评与频谱对齐用于忠实的文本到图像生成

ZhenQi Chen, TsaiChing Ni, YuanFu Yang

机构 * National Yang Ming Chiao Tung University

专题命中 文生图 :text-to-image(title,abstract);image generation(title);diffusion(abstract);分类 cs.CV

AI总结 CritiFusion通过语义批评和频谱对齐提升文本到图像生成的忠实度和细节质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16443 2026-01-01 cs.CV 88%

Geometric Disentanglement of Text Embeddings for Subject-Consistent Text-to-Image Generation using A Single Prompt

基于几何解耦的文本嵌入去纠缠:利用单一提示进行主题一致的文本到图像生成

Shangxun Li, Youngjung Uh

机构 * Yonsei University(延世大学)

专题命中 文生图 :text-to-image(title,abstract);image generation(title);diffusion(abstract);分类 cs.CV

AI总结 本文提出一种无需训练的方法,通过几何视角优化文本嵌入,解决文本到图像生成中主题一致性不足的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏