ViSAudio: End-to-End Video-Driven Binaural Spatial Audio Generation
ViSAudio:端到端视频驱动的双耳空间音频生成
机构 * Zhejiang University(浙江大学) ; Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) ; Shanghai Jiao Tong University(上海交通大学) ; Shanghai Innovation Institute(上海创新研究院) ; Stanford University(斯坦福大学) ; Beihang University(北航) ; The Chinese University of Hong Kong(香港中文大学)
AI总结 ViSAudio通过端到端双耳空间音频生成框架,从静音视频直接生成高质量空间音频,提升空间沉浸感和适应性。