arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-12-03 至 2025-12-03 共收录 4 信号源:cs.CV, cs.GR, cs.MM

1. 个性化与一致性 4 篇

2512.02713 2025-12-03 cs.AI 71%

Training Data Attribution for Image Generation using Ontology-Aligned Knowledge Graphs

利用本体对齐的知识图谱训练数据归因于图像生成

Theodoros Aivalis, Iraklis A. Klampanos, Antonis Troumpoukis, Joemon M. Jose

机构 * National Centre for Scientific Research ``Demokritos''(国家科学研究中心「德莫克里特」) University of Glasgow(格拉斯哥大学)

专题命中 个性化与一致性 :image generation(title)

AI总结 本文提出利用本体对齐的知识图谱方法,通过多模态大语言模型提取图像中的结构化三元组,以追踪生成模型中训练数据的影响,从而提升透明度和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03013 2025-12-03 cs.CV cs.AI cs.GR 62%

In-Context Sync-LoRA for Portrait Video Editing

上下文同步LoRA用于肖像视频编辑

Sagi Polaczek, Or Patashnik, Ali Mahdavi-Amiri, Daniel Cohen-Or

机构 * Tel Aviv University(特拉维夫大学) Simon Fraser University(Simon Fraser大学)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV、cs.GR

AI总结 Sync-LoRA通过上下文LoRA实现肖像视频编辑,保持帧同步和身份一致性,支持多样化的修改如外观变化和物体添加。

Comments Project page: https://sagipolaczek.github.io/Sync-LoRA/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02781 2025-12-03 cs.CV cs.GR cs.LG 62%

LumiX: Structured and Coherent Text-to-Intrinsic Generation

LumiX: 结构化和一致的文本到内在生成

Xu Han, Biao Zhang, Xiangjun Tang, Xianzhi Li, Peter Wonka

机构 * HUST(华中科技大学) KAUST(科威特大学)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV、cs.GR

AI总结 LumiX通过结构化扩散框架实现文本到内在生成,结合查询广播注意力和张量LoRA,提升生成的物理一致性和效率。

Comments The code will be available at https://github.com/xhanxu/LumiX

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.10786 2025-12-03 eess.IV cs.CV cs.LG 57%

ContourDiff: Unpaired Medical Image Translation with Structural Consistency

ContourDiff: 无配对医学图像翻译与结构一致性

Yuwen Chen, Nicholas Konz, Hanxue Gu, Haoyu Dong, Yaqian Chen, Lin Li, Jisoo Lee, Maciej A. Mazurowski

机构 * Department of Electrical and Computer Engineering, Duke University(杜克大学电气与计算机工程系) Department of Biostatistics & Bioinformatics, Duke University(杜克大学生物统计学与生物信息学系) Department of Radiology, Duke University(杜克大学放射学系) Department of Computer Science, Duke University(杜克大学计算机科学系)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 ContourDiff通过空间一致的引导扩散框架,实现了无配对医学图像翻译,保持解剖结构一致性,优于其他方法。

Comments Accepted for publication at the Journal of Machine Learning for Biomedical Imaging (MELBA) https://melba-journal.org/2025:031

Journal ref Machine.Learning.for.Biomedical.Imaging. 3 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏