arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-12-23 至 2025-12-23 共收录 6 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 6 篇

2512.18675 2025-12-23 cs.CV 88%

AsyncDiff: Asynchronous Timestep Conditioning for Enhanced Text-to-Image Diffusion Inference

AsyncDiff: 异步时间步条件化以提升文本到图像扩散推理

Longhuan Xu, Feng Yin, Cunjian Chen

机构 * Southeast University-Monash University Joint Graduate School(东南大学-墨尔本大学联合研究生院) Southeast University(东南大学) Monash University(墨尔本大学)

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

AI总结 AsyncDiff通过异步时间步条件化提升文本到图像扩散推理性能,采用轻量时间步预测模块和动态缩放参数实现更灵活的噪声控制。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01298 2025-12-23 cs.CV cs.AI 85%

Towards Enhanced Image Generation Via Multi-modal Chain of Thought in Unified Generative Models

通过统一生成模型中的多模态推理链提升图像生成

Yi Wang, Mushui Liu, Wanggui He, Hanyang Yuan, Longxiang Zhang, Ziwei Huang, Guanghao Zhang, Wenkai Fang, Haoze Jiang, Shengxuming Zhang, Dong She, Jinlong Liu, Weilong Dai, Mingli Song, Hao Jiang, Jie Song

机构 * Zhejiang University(浙江大学) Alibaba Group(阿里巴巴集团)

专题命中 文生图 :image generation(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

AI总结 本文通过引入多模态推理链提升统一生成模型的复杂图像生成能力,提出FoXperts架构和MCoT方法,实现更高效的多模态生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18766 2025-12-23 cs.CV 79%

MaskFocus: Focusing Policy Optimization on Critical Steps for Masked Image Generation

MaskFocus: 为掩码图像生成聚焦策略优化

Guohui Zhang, Hu Yu, Xiaoxiao Ma, Yaning Pan, Hang Xu, Feng Zhao

机构 * University of Science and Technology of China(中国科学技术大学) Fudan University(复旦大学)

专题命中 文生图 :image generation(title);text-to-image(abstract);分类 cs.CV

AI总结 MaskFocus通过聚焦关键步骤优化策略,提升掩码图像生成模型的性能。

Comments Code is available at https://github.com/zghhui/MaskFocus

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17860 2025-12-23 cs.CV cs.AI cs.LG 74%

Towards Facilitated Fairness Assessment of AI-based Skin Lesion Classifiers Through GenAI-based Image Synthesis

通过生成式人工智能图像合成促进AI皮肤病变分类器的公平性评估

Ko Watanabe, Stanislav Frolov, Aya Hassan, David Dembinsky, Adriano Lucieri, Andreas Dengel

机构 * DFKI GmbH(德累斯顿理工大学人工智能研究所)

专题命中 文生图 :image synthesis(title);分类 cs.CV

AI总结 本文通过生成式人工智能图像合成方法,评估AI皮肤病变分类器的公平性,验证合成图像在公平性测试中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19680 2025-12-23 cs.CV 57%

VA-$π$: Variational Policy Alignment for Pixel-Aware Autoregressive Generation

VA-$π$: 变分策略对齐用于像素感知自回归生成

Xinyao Liao, Qiyuan He, Kai Xu, Xiaoye Qu, Yicong Li, Wei Wei, Angela Yao

机构 * Huazhong University of Science & Technology(华中科技大学) National University of Singapore(新加坡国立大学)

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

AI总结 VA-$π$通过变分优化和像素空间目标提升自回归生成的质量和多样性。

Comments 21 pages, 24 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19300 2025-12-23 cs.CV 57%

RMLer: Synthesizing Novel Objects across Diverse Categories via Reinforcement Mixing Learning

RMLer: 通过强化混合学习跨多样类别合成新物体

Jun Li, Zikun Chen, Haibo Chen, Shuo Chen, Jian Yang

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

AI总结 RMLer通过强化混合学习框架,有效解决跨类别文本到图像生成中的概念混合问题,提升合成物体的连贯性和保真度。

Comments accepted by AAAI2026

详情

展开后加载摘要…

URL PDF HTML 收藏