WavAlign: Enhancing Intelligence and Expressiveness in Spoken Dialogue Models via Adaptive Hybrid Post-Training
WavAlign:通过自适应混合后训练增强口语对话模型的智能与表达性
机构 * Zhejiang University(浙江大学) ; Tongyi Fun Team, Alibaba Group(通义实验室,阿里巴巴集团) ; Beijing University of Technology(北京理工大学)
AI总结 本文提出WavAlign方法,通过自适应混合后训练提升口语对话模型的智能与表达性,通过语义通道约束和显式锚定改进语音生成,避免不可靠的偏好梯度。