arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-11-11 至 2025-11-11 共收录 125 信号源:cs.CV, cs.GR, cs.MM

1. 图像生成评测 2 篇

2410.05664 2025-11-11 cs.CV cs.LG 88%

Holistic Unlearning Benchmark: A Multi-Faceted Evaluation for Text-to-Image Diffusion Model Unlearning

Saemi Moon, Minjong Lee, Sangdon Park, Dongwoo Kim

机构 * CSE, POSTECH(POSTECH 计算科学与工程系) GSAI, POSTECH(POSTECH 人工智能研究所)

专题命中 图像生成评测 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06740 2025-11-11 cs.CV 74%

SinSEMI: A One-Shot Image Generation Model and Data-Efficient Evaluation Framework for Semiconductor Inspection Equipment

ChunLiang Wu, Xiaochun Li

专题命中 图像生成评测 :image generation(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 效率与蒸馏 2 篇

2506.09612 2025-11-11 cs.CV 70%

Consistent Story Generation: Unlocking the Potential of Zigzag Sampling

Mingxiao Li, Mang Ning, Marie-Francine Moens

机构 * KU Leuven(库勒芬大学) Utrecht University(乌得勒支大学)

专题命中 效率与蒸馏 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments 20 pages, 10 figures

Journal ref published at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06953 2025-11-11 cs.CV 57%

GFix: Perceptually Enhanced Gaussian Splatting Video Compression

Siyue Teng, Ge Gao, Duolikun Danier, Yuxuan Jiang, Fan Zhang, Thomas Davis, Zoe Liu, David Bull

机构 * Visual Information Laboratory, University of Bristol(布里斯托大学视觉信息实验室) University of Bristol(布里斯托大学) School of Informatics, University of Edinburgh(爱丁堡大学信息学院) Visionular Inc.(Visionular公司)

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 其他图像生成 1 篇

2510.26828 2025-11-11 eess.IV cs.AI 71%

Beyond Data Scarcity Optimizing R3GAN for Medical Image Generation from Small Datasets

Tsung-Wei Pan, Chang-Hong Wu, Jung-Hua Wang, Ming-Jer Chen, Yu-Chiao Yi, Tsung-Hsien Lee

专题命中 其他图像生成 :image generation(title)

详情

展开后加载摘要…

URL PDF HTML 收藏