arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-01-06 至 2026-01-06 共收录 3 信号源:cs.CV, cs.GR, cs.MM

1. 个性化与一致性 3 篇

2601.02359 2026-01-06 cs.CV 79%

ExposeAnyone: Personalized Audio-to-Expression Diffusion Models Are Robust Zero-Shot Face Forgery Detectors

ExposeAnyone: 基于音频到表情扩散模型的个性化人脸伪造检测器

Kaede Shiohara, Toshihiko Yamasaki, Vladislav Golyanik

机构 * The University of Tokyo(东京大学) Max Planck Institute for Informatics, SIC(信息研究所马克斯·普朗克研究院)

专题命中 个性化与一致性 :diffusion(title,abstract);分类 cs.CV

AI总结 ExposeAnyone通过基于音频生成表情的自监督扩散模型,实现个性化人脸伪造检测,优于现有方法并具备鲁棒性。

Comments 17 pages, 8 figures, 11 tables; project page: https://mapooon.github.io/ExposeAnyonePage/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00829 2026-01-06 cs.CV 77%

Can Generative Models Actually Forge Realistic Identity Documents?

生成模型真的能伪造逼真的身份文件吗?

Alexander Vinogradov

专题命中 个性化与一致性 :image generation(abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 本文研究了生成模型伪造身份文件的能力,发现其在结构真实性上不足,强调跨领域合作的重要性。

Comments 11 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01352 2026-01-06 cs.CV cs.AI 57%

Slot-ID: Identity-Preserving Video Generation from Reference Videos via Slot-Based Temporal Identity Encoding

Slot-ID: 通过基于槽的时序身份编码从参考视频中生成身份保持的视频

Yixuan Lai, He Wang, Kun Zhou, Tianjia Shao

机构 * State Key Lab of CAD&CG(计算机辅助设计与图形学国家重点实验室) University College London(伦敦大学学院) Zhejiang University(浙江大学)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 Slot-ID通过基于槽的时序身份编码从参考视频生成身份保持的视频,提升大姿态变化下的身份保留和视觉真实性。

详情

展开后加载摘要…

URL PDF HTML 收藏