MMEDIT: A Unified Framework for Multi-Type Audio Editing via Audio Language Model
MMEDIT: 一种基于音频语言模型的多类型音频编辑统一框架
机构 * MoE Key Lab of Artificial Intelligence, X-LANCE Lab, Shanghai Jiao Tong University(人工智能莫埃实验室、X-LANCE实验室、上海交通大学) ; Shanghai AI Laboratory(上海人工智能实验室) ; Nanjing University(南京大学)
专题命中 指令微调 :language model(title)
AI总结 MMEdit提出一种基于音频语言模型的统一框架,通过扩展任务定义和设计数据合成管道,实现多类型音频编辑的高精度与高保真度。
Comments Under review