GLDiTalker: Speech-Driven 3D Facial Animation with Graph Latent Diffusion Transformer
GLDiTalker: 基于图潜在扩散变换器的语音驱动3D面部动画
机构 * South China University of Technology(南方科技大学) ; Beihang University(北航) ; Huawei Cloud(华为云) ; Nanjing University(南京大学)
AI总结 GLDiTalker通过图潜在扩散变换器解决语音驱动3D面部动画中的模态不一致问题,提升唇形同步精度和运动多样性。
Comments 9 pages, 5 figures
Journal ref the 34th International Joint Conference on Artificial Intelligence, 2025