arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-02-16 至 2026-02-16 共收录 62 信号源:cs.CV, cs.GR, cs.MM

1. 效率与蒸馏 3 篇

2602.12932 2026-02-16 stat.ML cs.LG 67%

TFTF: Training-Free Targeted Flow for Conditional Sampling

TFTF:无训练目标流用于条件采样

Qianqian Qu, Jun S. Liu

机构 * Zhili College, Tsinghua University, Beijing, China(清华大学紫荆学院) Department of Statistics and Data Science, Tsinghua University, Beijing, China(清华大学统计与数据科学系) Department of Statistics, Harvard University, Cambridge, MA, USA(哈佛大学统计系)

专题命中 效率与蒸馏 :image generation(abstract);text-to-image(abstract)

AI总结 TFTF通过引入随机流和重采样技术,实现无训练条件采样,提升高维和多模态场景下的生成效果。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 其他图像生成 1 篇

2407.20034 2026-02-16 cs.CV 57%

MaskInversion: Localized Embeddings via Optimization of Explainability Maps

MaskInversion: 通过可解释性图的优化生成局部嵌入

Walid Bousselham, Sofian Chaybouti, Christian Rupprecht, Vittorio Ferrari, Hilde Kuehne

机构 * Tuebingen AI Center University of Tuebingen(图宾根人工智能中心 图宾根大学) University of Oxford(牛津大学) Meta MIT-IBM Watson AI Lab(麻省理工-IBM Watson人工智能实验室)

专题命中 其他图像生成 :image generation(abstract);分类 cs.CV

AI总结 MaskInversion通过优化可解释性图生成特定图像区域的嵌入,适用于多种视觉-语言任务。

Comments Project page: https://walidbousselham.com/MaskInversion

详情

展开后加载摘要…

URL PDF HTML 收藏