arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-10-02 至 2025-10-02 共收录 5 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 5 篇

2510.01010 2025-10-02 cs.CV 86%

ImageDoctor: Diagnosing Text-to-Image Generation via Grounded Image Reasoning

Yuxiang Guo, Jiang Liu, Ze Wang, Hao Chen, Ximeng Sun, Yang Zhao, Jialian Wu, Xiaodong Yu, Zicheng Liu, Emad Barsoum

机构 * Johns Hopkins University(约翰霍普金斯大学) AMD(AMD公司)

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00974 2025-10-02 cs.CV 83%

JEPA-T: Joint-Embedding Predictive Architecture with Text Fusion for Image Generation

Siheng Wan, Zhengtao Yao, Zhengdao Li, Junhao Dong, Yanshu Li, Yikai Li, Linshan Li, Haoyan Xu, Yijiang Li, Zhikang Dong, Huacan Wang, Jifeng Shen

机构 * Jiangsu University(江苏大学) University of Southern California(南加州大学) Peking University(北京大学) Nanyang Technological University(南洋理工大学) Brown University(布朗大学) UC San Diego(加州大学圣地亚哥分校) Stony Brook University(石溪大学) University of the Chinese Academy of Sciences(中国科学院大学)

专题命中 文生图 :image generation(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00796 2025-10-02 cs.CV cs.AI 83%

MetaLogic: Robustness Evaluation of Text-to-Image Models via Logically Equivalent Prompts

Yifan Shen, Yangyang Shu, Hye-young Paik, Yulei Sui

机构 * University of New South Wales, Australia(新南威尔士大学,澳大利亚)

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments ICFEM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00045 2025-10-02 cs.CV cs.AI 83%

Beyond the Prompt: Gender Bias in Text-to-Image Models, with a Case Study on Hospital Professions

Franck Vandewiele, Remi Synave, Samuel Delepoulle, Remi Cozot

机构 * Laboratoire d’Informatique Signal et Image de la Côte d’Opale (LISIC)(信号与图像实验室(LISIC)) Université du Littoral Côte d’Opale(沿海大学)

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00046 2025-10-02 cs.CV cs.AI 79%

Reinforcement Learning-Based Prompt Template Stealing for Text-to-Image Models

Xiaotian Zou

机构 * Xiaotian Zou

专题命中 文生图 :text-to-image(title,abstract);分类 cs.CV

Comments 10 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏