Beautiful Images, Toxic Words: Understanding and Addressing Offensive Text in Generated Images
美丽的图像,有毒的词语:理解并解决生成图像中的冒犯性文本
专题命中 图像生成评测 :text-to-image(abstract);diffusion(abstract);分类 cs.CV
AI总结 本文提出了一种针对生成图像中冒犯性文本的微调策略,并发布了ToxicBench基准,用于评估和改进文本到图像模型的安全性。
Comments Accepted at AAAI 2026 (AI Alignment Track)