arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-09-03 至 2025-09-03 共收录 10 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 10 篇

2509.00177 2025-09-03 cs.CV 89%

Category-level Text-to-Image Retrieval Improved: Bridging the Domain Gap with Diffusion Models and Vision Encoders

Faizan Farooq Khan, Vladan Stojnić, Zakaria Laskar, Mohamed Elhoseiny, Giorgos Tolias

机构 * King Abdullah University of Science and Technology(国王阿卜杜勒-阿齐兹大学科学与技术大学) Visual Recognition Group(视觉识别组) Faculty of Electrical Engineering(电气工程学院) Czech Technical University in Prague(布拉格捷克技术大学)

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments BMVC 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10029 2025-09-03 cs.CV cs.LG 88%

Memory-Efficient Personalization of Text-to-Image Diffusion Models via Selective Optimization Strategies

Seokeon Choi, Sunghyun Park, Hyoungwoo Park, Jeongho Kim, Sungrack Yun

机构 * Qualcomm AI Research(高通人工智能研究)

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments Accepted to ICCV 2025 LIMIT Workshop (4-page short paper). Extended version in preparation

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08346 2025-09-03 cs.CV 83%

Pathology-Aware Adaptive Watermarking for Text-Driven Medical Image Synthesis

Chanyoung Kim, Dayun Ju, Jinyeong Kim, Woojung Han, Roberto Alcover-Couso, Seong Jae Hwang

机构 * Department of Artificial Intelligence, Yonsei University(人工智能系,延世大学) Amazon(亚马逊)

专题命中 文生图 :image synthesis(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.15312 2025-09-03 cs.CV cs.AI 83%

Synergistic Dual Spatial-aware Generation of Image-to-Text and Text-to-Image

Yu Zhao, Hao Fei, Xiangtai Li, Libo Qin, Jiayi Ji, Hongyuan Zhu, Meishan Zhang, Min Zhang, Jianguo Wei

机构 * Tianjin University(天津大学) National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学) Central South University(中南大学) I 2 R & CFAR, A*STAR(I 2 R与CFAR,A*STAR) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05063 2025-09-03 cs.CV cs.CL cs.LG 83%

CytoDiff: AI-Driven Cytomorphology Image Synthesis for Medical Diagnostics

Jan Carreras Boada, Rao Muhammad Umer, Carsten Marr

机构 * Institute of AI for Health, Helmholtz Zentrum München - German Research Center for Environmental Health(人工智能与健康研究所,慕尼黑德国环境健康研究中心) Department of Medicine III, Ludwig-Maximilian-University Hospital(第三医学部,路德维希-马克西米利安大学医院) DKTK, German Cancer Consortium(德国癌症联盟,DKTK) Escola Superior de Comerç Internacional, Universitat Pompeu Fabra (ESCI-UPF)(国际商业学校,庞培法布拉大学(ESCI-UPF))

专题命中 文生图 :image synthesis(title);image generation(abstract);diffusion(abstract);分类 cs.CV

Comments Accepted at ICCV 2025, 7-8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00849 2025-09-03 cs.CL 82%

Prompting Away Stereotypes? Evaluating Bias in Text-to-Image Models for Occupations

Shaina Raza, Maximus Powers, Partha Pratim Saha, Mahveen Raza, Rizwan Qureshi

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15227 2025-09-03 cs.HC cs.AI 75%

GenTune: Toward Traceable Prompts to Improve Controllability of Image Refinement in Environment Design

Wen-Fan Wang, Ting-Ying Lee, Chien-Ting Lu, Che-Wei Hsu, Nil Ponsa Campanyà, Yu Chen, Mike Y. Chen, Bing-Yu Chen

机构 * National Taiwan University(国立台湾大学)

专题命中 文生图 :image generation(abstract);text-to-image(abstract);inpainting(abstract)

Comments Accepted ACM Symposium on User Interface Software and Technology (UIST '25)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.10462 2025-09-03 cs.CV cs.AI cs.GR cs.LG 73%

BloomScene: Lightweight Structured 3D Gaussian Splatting for Crossmodal Scene Generation

Xiaolu Hou, Mingcheng Li, Dingkang Yang, Jiawei Chen, Ziyun Qian, Xiao Zhao, Yue Jiang, Jinjie Wei, Qingyao Xu, Lihua Zhang

专题命中 文生图 :text-to-image(abstract);diffusion(abstract);分类 cs.CV、cs.GR

Comments Accepted by AAAI 2025. Code: https://github.com/SparklingH/BloomScene

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00752 2025-09-03 cs.CV 57%

Multi-Level CLS Token Fusion for Contrastive Learning in Endoscopy Image Classification

Y Hop Nguyen, Doan Anh Phan Huu, Trung Thai Tran, Nhat Nam Mai, Van Toi Giap, Thao Thi Phuong Dao, Trung-Nghia Le

机构 * University of Science, VNU-HCM(越南胡志明市科学大学) Thong Nhat Hospital(通纳特医院)

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

Comments ACM Multimedia 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00549 2025-09-03 cs.CV 57%

A Modality-agnostic Multi-task Foundation Model for Human Brain Imaging

Peirong Liu, Oula Puonti, Xiaoling Hu, Karthik Gopinath, Annabel Sorby-Adams, Daniel C. Alexander, W. Taylor Kimberly, Juan E. Iglesias

专题命中 文生图 :image synthesis(abstract);分类 cs.CV

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏