arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-02-02 至 2026-02-02 共收录 3 信号源:cs.CV, cs.GR, cs.MM

1. 个性化与一致性 3 篇

2601.22507 2026-02-02 cs.CV 85%

DreamVAR: Taming Reinforced Visual Autoregressive Model for High-Fidelity Subject-Driven Image Generation

DreamVAR: 镇压强化视觉自回归模型以实现高保真主体驱动图像生成

Xin Jiang, Jingwen Chen, Yehao Li, Yingwei Pan, Kezhou Chen, Zechao Li, Ting Yao, Tao Mei

机构 * Nanjing University of Science and Technology(南京理工大学) University of Science and Technology of China(中国科学技术大学) HiDream.ai Inc.(HiDream.ai公司)

专题命中 个性化与一致性 :image generation(title,abstract);diffusion(abstract);image synthesis(abstract);分类 cs.CV

AI总结 DreamVAR通过改进的自回归模型和强化学习,实现高保真主体驱动图像生成,优于现有扩散方法。

Comments Accepted By ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.17008 2026-02-02 cs.CV 70%

FlashFace: Human Image Personalization with High-fidelity Identity Preservation

FlashFace: 通过高保真身份保留实现人像个性化

Shilong Zhang, Lianghua Huang, Xi Chen, Yifei Zhang, Zhi-Fan Wu, Yutong Feng, Wei Wang, Yujun Shen, Yu Liu, Ping Luo

机构 * The University of Hong Kong(香港大学) Alibaba Group(阿里巴巴集团) Ant Group(蚂蚁集团)

专题命中 个性化与一致性 :image generation(abstract);text-to-image(abstract);分类 cs.CV

AI总结 FlashFace通过高保真身份保留和解耦整合策略,实现高效的人像个性化与虚拟角色真实化

Comments Project Page:https://jshilong.github.io/flashface-page

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22501 2026-02-02 cs.CV cs.SD 57%

MIRRORTALK: Forging Personalized Avatars Via Disentangled Style and Hierarchical Motion Control

MIRRORTALK: 通过解耦的风格和分层运动控制生成个性化虚拟形象

Renjie Lu, Xulong Zhang, Xiaoyang Qu, Jianzong Wang, Shangfei Wang

机构 * Ping An Technology (Shenzhen) Co., Ltd.(平安科技(深圳)有限公司) University of Science and Technology of China(中国科学技术大学)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 MirrorTalk通过解耦风格与运动控制生成个性化虚拟形象,提升嘴唇同步准确性和个性化表达。

Comments Accepted to 2026 IEEE International Conference on Acoustics, Speech, and Signal Processing (ICASSP 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏