Towards Generalized Multi-Image Editing for Unified Multimodal Models
面向统一多模态模型的通用多图像编辑
机构 * Western University(西方大学) ; Tencent YouTu Lab(腾讯优图实验室) ; Nanjing University(南京大学)
专题命中 多模态生成 :multimodal(title,abstract);分类 cs.CV
AI总结 本文提出了一种面向统一多模态模型的通用多图像编辑框架,通过可学习的潜在分离器和正弦索引编码提升多图像编辑任务中的视觉一致性和泛化能力。
Comments Project page: https://github.com/Pengchengpcx/MIE-UMM