arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-12-11 至 2025-12-11 共收录 3 信号源:cs.CV, cs.GR, cs.MM

1. 个性化与一致性 3 篇

2512.08294 2025-12-11 cs.CV 85%

OpenSubject: Leveraging Video-Derived Identity and Diversity Priors for Subject-driven Image Generation and Manipulation

OpenSubject: 利用视频衍生的身份和多样性先验进行主体驱动的图像生成与操纵

Yexin Liu, Manyuan Zhang, Yueze Wang, Hongyu Li, Dian Zheng, Weiming Zhang, Changsheng Lu, Xunliang Cai, Yan Feng, Peng Pei, Harry Yang

机构 * HKUST(香港科技大学) Meituan(美团) HKUST(GZ)(香港科技大学(广州))

专题命中 个性化与一致性 :image generation(title,abstract);inpainting(abstract);image synthesis(abstract);分类 cs.CV

AI总结 OpenSubject通过视频衍生的大规模数据集提升主体驱动图像生成与操纵的性能,尤其在复杂场景中表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09417 2025-12-11 cs.CV 70%

DirectSwap: Mask-Free Cross-Identity Training and Benchmarking for Expression-Consistent Video Head Swapping

DirectSwap: 无掩码跨身份训练与基准测试用于表情一致的视频头部交换

Yanan Wang, Shengcai Liao, Panwen Hu, Xin Li, Fan Yang, Xiaodan Liang

机构 * MBZUAI(马克斯·普朗克智能研究院) UAEU(阿拉伯联合酋长国大学) AIQ(人工智能量子研究所) SYSU(南方大学)

专题命中 个性化与一致性 :diffusion(abstract);inpainting(abstract);分类 cs.CV

AI总结 DirectSwap通过无掩码直接视频头部交换框架,结合运动和表情感知重建损失,实现了跨身份视频头部交换的高质量和一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09617 2025-12-11 cs.CV 57%

FROMAT: Multiview Material Appearance Transfer via Few-Shot Self-Attention Adaptation

FROMAT: 通过少样本自注意力适应实现多视图材料外观迁移

Hubert Kompanowski, Varun Jampani, Aaryaman Vasishta, Binh-Son Hua

机构 * Trinity College Dublin(都柏林三一学院) Arcade AI AMD

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 FROMAT通过少样本自注意力适应实现多视图材料外观迁移,提供了一种简单有效的生成方法,提升多视图内容创作的外观多样性。

详情

展开后加载摘要…

URL PDF HTML 收藏