KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation
KSDiff: 关键帧增强型语音感知双路径扩散模型用于面部动画
机构 * School of Computing, National University of Singapore(新加坡国立大学计算机学院)
专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR、cs.MM
AI总结 本文提出KSDiff框架,通过双路径语音编码器和关键帧建立学习模块,提升语音驱动面部动画的唇同步和头部姿态自然度。
Comments Paper accepted at ICASSP 2026, 5 pages, 3 figures, 3 tables