arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-02-06 至 2026-02-06 共收录 2 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 2 篇

2508.01151 2026-02-06 cs.CV cs.AI 88%

Personalized Safety Alignment for Text-to-Image Diffusion Models

面向文本到图像扩散模型的个性化安全对齐

Yu Lei, Jinbin Bai, Qingyu Shi, Aosong Feng, Hongcheng Gao, Xiao Zhang, Rex Ying

机构 * National University of Singapore(新加坡国立大学) Peking University(北京大学) Yale University(耶鲁大学) Collov Labs(Collov实验室)

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

AI总结 本文提出个性化安全对齐框架PSA,通过用户条件适应提升文本到图像扩散模型的安全性与生成质量,实现安全与质量的动态平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19243 2026-02-06 cs.CV 74%

VisionDirector: Vision-Language Guided Closed-Loop Refinement for Generative Image Synthesis

VisionDirector: 生成图像合成中的视觉-语言引导闭环细化

Meng Chu, Senqiao Yang, Haoxuan Che, Suiyun Zhang, Xichen Zhang, Shaozuo Yu, Haokun Gui, Zhefan Rao, Dandan Tu, Rui Liu, Jiaya Jia

机构 * The Hong Kong University of Science and Technology(香港理工大学) The Chinese University of Hong Kong(香港中文大学) Huawei Research(华为研究)

专题命中 文生图 :image synthesis(title);分类 cs.CV

AI总结 VisionDirector通过视觉-语言引导闭环细化方法,提升生成图像合成中多目标任务的完成度和质量。

详情

展开后加载摘要…

URL PDF HTML 收藏