arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-08-01 至 2025-08-01 共收录 4 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 4 篇

2507.23001 2025-08-01 eess.IV cs.CV 89%

LesionGen: A Concept-Guided Diffusion Model for Dermatology Image Synthesis

Jamil Fayyad, Nourhan Bayasi, Ziyang Yu, Homayoun Najjaran

机构 * University of Victoria, Canada(维多利亚大学,加拿大) University of British Columbia, Canada(不列颠哥伦比亚大学,加拿大) University of Toronto, Canada(多伦多大学,加拿大)

专题命中 文生图 :diffusion(title,abstract);image synthesis(title,abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted at the MICCAI 2025 ISIC Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08727 2025-08-01 cs.LG 82%

Transformed Low-rank Adaptation via Tensor Decomposition and Its Applications to Text-to-image Models

Zerui Tao, Yuhta Takida, Naoki Murata, Qibin Zhao, Yuki Mitsufuji

机构 * RIKEN AIP(RIKEN人工智能研究所) Sony AI(索尼人工智能) Sony Group Corporation(索尼集团)

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract)

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23010 2025-08-01 cs.LG cs.AI cs.CV cs.SD eess.AS 70%

Investigating the Invertibility of Multimodal Latent Spaces: Limitations of Optimization-Based Methods

Siwoo Park

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23343 2025-08-01 cs.CV eess.IV 57%

Who is a Better Talker: Subjective and Objective Quality Assessment for AI-Generated Talking Heads

Yingjie Zhou, Jiezhang Cao, Zicheng Zhang, Farong Wen, Yanwei Jiang, Jun Jia, Xiaohong Liu, Xiongkuo Min, Guangtao Zhai

机构 * Shanghai Jiao Tong University(上海交通大学) PengCheng Laboratory(鹏城实验室) Harvard Medical School(哈佛医学院)

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏