arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-12-19 至 2025-12-19 共收录 2 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 2 篇

2503.09560 2025-12-19 eess.IV cs.CV 89%

StructDiff: Structure-aware Diffusion Model for 3D Fine-grained Medical Image Synthesis

StructDiff: 一种结构感知的扩散模型用于3D细粒度医学图像合成

Jiahao Xia, Yutao Hu, Yaolei Qi, Zhenliang Li, Wenqi Shao, Junjun He, Ying Fu, Longjiang Zhang, Guanyu Yang

机构 * Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications (Southeast University), Ministry of Education, China(新一代人工智能技术及跨学科应用关键实验室(东南大学),中华人民共和国教育部,中国) Jiangsu Province Joint International Research Laboratory of Medical Information Processing, Southeast University, Nanjing, China(江苏省医疗信息处理联合国际研究实验室(东南大学),南京市,中国) Univ Rennes, CHU Rennes, Inserm, LTSI– UMR 1099, F-35000 Rennes, France(里昂大学,里昂大学医院,Inserm,LTSI– UMR 1099,法国里昂,法国) Shanghai AI Laboratory(上海人工智能实验室) School of Computer Science and Technology, Beijing Institute of Technology, Beijing, China(计算机科学与技术学院,北京理工大学,北京,中国) Department of Radiology, Jinling Hospital, Affiliated Hospital of Medical School, Nanjing University, Nanjing, China(放射科,南京大学附属医院,南京大学,南京,中国)

专题命中 文生图 :diffusion(title,abstract);image synthesis(title,abstract);image generation(abstract);分类 cs.CV

AI总结 StructDiff通过结构感知扩散模型解决3D医学图像细粒度生成中的拓扑一致性和细节还原问题,提升下游分割性能。

Comments 17 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16905 2025-12-19 cs.CV 83%

Alchemist: Unlocking Efficiency in Text-to-Image Model Training via Meta-Gradient Data Selection

Alchemist: 通过元梯度数据选择提升文本到图像模型训练效率

Kaixin Ding, Yang Zhou, Xi Chen, Miao Yang, Jiarong Ou, Rui Chen, Xin Tao, Hengshuang Zhao

机构 * The University of Hong Kong(香港大学) South China University of Technology(华南理工大学) Kling Team, Kuaishou Technology(快手科技 Kling 团队)

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 Alchemist通过元梯度数据选择提升文本到图像模型训练效率,实现高效的数据筛选和模型性能提升。

Comments project page: https://kxding.github.io/project/Alchemist/

详情

展开后加载摘要…

URL PDF HTML 收藏