HPRO: Hierarchical Progressive Reward Optimization via Preference Extraction for Emotional Text-to-Speech
HPRO:通过偏好提取的分层渐进奖励优化用于情感文本到语音
机构 * South China University of Technology, China(华南理工大学,中国) ; Huya Inc., China(欢丫公司,中国) ; Tongyi Fun Team, Alibaba Group, China(通义 Fun 团队,阿里巴巴集团,中国) ; Foshan University, China(佛山大学,中国)
专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL
AI总结 提出HPRO框架,通过HD-Emo编解码器分离内容与情感偏好,并分层对齐帧、词、句级别目标,解决信息冲突和尺度差距,提升情感表现力同时保持语言清晰度。
Comments 7 pages, 3 figures, 3 tables; Preprint