Audio-Driven Talking Face Generation with Blink Embedding and Hash Grid Landmarks Encoding
基于眨眼嵌入和哈希网格地标编码的音频驱动说话人脸生成
机构 * Department of Control Science and Engineering, University of Shanghai for Science and Technology(控制科学与工程系,上海科学技术大学) ; School of Psychology and Neuroscience, University of Glasgow(心理学与神经科学学院,格拉斯哥大学)
专题命中 NeRF :NeRF(abstract);分类 cs.CV
AI总结 本文提出基于眨眼嵌入和哈希网格地标编码的音频驱动说话人脸生成方法,通过动态地标变换器和神经辐射场提升生成质量。