arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-12-10 至 2025-12-10 共收录 4 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 4 篇

2506.05872 2025-12-10 cs.CV 83%

Domain-RAG: Retrieval-Guided Compositional Image Generation for Cross-Domain Few-Shot Object Detection

领域-RAG:跨领域少样本目标检测的检索引导组合图像生成

Yu Li, Xingyu Qiu, Yuqian Fu, Jie Chen, Tianwen Qian, Xu Zheng, Danda Pani Paudel, Yanwei Fu, Xuanjing Huang, Luc Van Gool, Yu-Gang Jiang

机构 * Fudan University(复旦大学) Fuzhou University(福州大学) East China Normal University(华东师范大学) HKUST(GZ)(香港科技大学(广州))

专题命中 文生图 :image generation(title,abstract);text-to-image(abstract);分类 cs.CV

AI总结 Domain-RAG通过检索引导的组合图像生成方法,解决跨领域少样本目标检测中的领域对齐与背景生成问题,实现高质量样本生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.18123 2025-12-10 cs.CR cs.CL 78%

AEIOU: A Unified Defense Framework against NSFW Prompts in Text-to-Image Models

AEIOU:一种针对文本到图像模型中不适宜提示的统一防御框架

Yiming Wang, Jiahao Chen, Qingming Li, Tong Zhang, Rui Zeng, Xing Yang, Shouling Ji

专题命中 文生图 :text-to-image(title,abstract)

AI总结 AEIOU提出了一种针对文本到图像模型中不适宜提示的统一防御框架,通过高效提取NSFW特征实现高准确率和效率,有效应对适应性攻击。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18331 2025-12-10 cs.CV 57%

End-to-End Fine-Tuning of 3D Texture Generation using Differentiable Rewards

使用可微奖励对3D纹理生成进行端到端微调

AmirHossein Zamani, Tianhao Xie, Amir G. Aghdam, Tiberiu Popa, Eugene Belilovsky

机构 * Mila – Quebec AI Institute(魁北克AI研究所) Concordia University(康科迪亚大学)

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

AI总结 本文提出了一种端到端的可微框架,通过可微奖励函数优化3D纹理生成,提升对3D结构的理解和生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22931 2025-12-10 cs.CY 50%

Visual Orientalism in the AI Era: From West-East Binaries to English-Language Centrism

人工智能时代视觉沙文主义:从东西二元对立到英语中心主义

Zhilong Zhao, Yindi Liu

专题命中 文生图 :text-to-image(abstract)

AI总结 本文探讨了人工智能时代视觉沙文主义的演变,揭示AI通过视觉表示强化东西方二元对立,转向英语中心主义,强调需重新审视算法治理与训练数据中的地缘政治结构。

Comments 43 pages, 8 figures, supplementary materials included

详情

展开后加载摘要…

URL PDF HTML 收藏