arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Xiaohongshu(小红书)

2026-08-26 至 2026-08-26 共收录 1
2608.24168 2026-08-26 cs.CL cs.SD 新提交

FireRedAudio: A General-Purpose Audio Language Model with Decoupled Continuous Representations for Understanding and Generation

FireRedAudio:一种具有解耦连续表示的通用音频语言模型,用于理解与生成

Junjie Li, Xuelong Geng, Kun Xie, Feiyu Shen, Yichen Wu, Ziqi Dai, Yichen Han, Yan Jia, Kai Huang, Junjie Chen, Yixuan Li, Manzhen Wei, Fenglong Xie, Lei Xie, Xu Tang, Yao Hu

机构 * Xiaohongshu(小红书)

AI总结 FireRedAudio是首个公开的统一音频-语言模型,采用解耦连续表示,支持音频理解、多语种ASR、各类TTS及语音编辑,性能优于相关模型。

Comments 20 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏