arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-08-08 至 2025-08-08 共收录 6 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 6 篇

2508.05399 2025-08-08 cs.CV cs.AI cs.LG 89%

UNCAGE: Contrastive Attention Guidance for Masked Generative Transformers in Text-to-Image Generation

Wonjun Kang, Byeongkeun Ahn, Minjae Lee, Kevin Galim, Seunghyuk Oh, Hyung Il Koo, Nam Ik Cho

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments Code is available at https://github.com/furiosa-ai/uncage

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04732 2025-08-08 cs.LG cs.GR 89%

LumiGen: An LVLM-Enhanced Iterative Framework for Fine-Grained Text-to-Image Generation

Xiaoqi Dong, Xiangyu Zhou, Nicholas Evans, Yujia Lin

机构 * Dali University(大理大学) Bandırma Onyedi Eylül University(班迪尔马第十七个九月大学)

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);分类 cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04734 2025-08-08 q-bio.QM cs.AI eess.IV 71%

Cross-Domain Image Synthesis: Generating H&E from Multiplex Biomarker Imaging

Jillur Rahman Saurav, Mohammad Sadegh Nasr, Jacob M. Luber

机构 * Department of CSE University of Texas at Arlington Arlington, Texas, USA(计算机科学与工程系 乌德勒支理工大学 美国德克萨斯州阿灵顿)

专题命中 文生图 :image synthesis(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04801 2025-08-08 cs.CV 57%

ACM Multimedia Grand Challenge on ENT Endoscopy Analysis

Trong-Thuan Nguyen, Viet-Tham Huynh, Thao Thi Phuong Dao, Ha Nguyen Thi, Tien To Vu Thuy, Uyen Hanh Tran, Tam V. Nguyen, Thanh Dinh Le, Minh-Triet Tran

机构 * University of Science, VNU-HCM(越南胡志明市科学大学) Vietnam National University(越南国家大学) Thong Nhat Hospital(通那医院) Faculty of Medicine, Pham Ngoc Thach University of Medicine(范 Ngoc Thach 医学院) Cho Ray Hospital(Cho Ray 医院) University of Dayton(Dayton 大学) University of Health Sciences, VNU-HCM(越南胡志明市健康科学大学)

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05476 2025-08-08 eess.IV 50%

MM2CT: MR-to-CT translation for multi-modal image fusion with mamba

Chaohui Gong, Zhiying Wu, Zisheng Huang, Gaofeng Meng, Zhen Lei, Hongbin Liu

专题命中 文生图 :image synthesis(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05432 2025-08-08 cs.AI cs.CY 50%

Whose Truth? Pluralistic Geo-Alignment for (Agentic) AI

Krzysztof Janowicz, Zilong Liu, Gengchen Mai, Zhangyu Wang, Ivan Majic, Alexandra Fortacz, Grant McKenzie, Song Gao

机构 * University of Vienna(维也纳大学) University of Texas at Austin(德克萨斯大学奥斯汀分校) University of Maine(缅因大学) McGill University(麦吉尔大学) University of Wisconsin(威斯康星大学)

专题命中 文生图 :text-to-image(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏