A$^2$-LLM: An End-to-end Conversational Audio Avatar Large Language Model
A$^2$-LLM:一种端到端的对话音频虚拟形象大语言模型
机构 * State Key Laboratory of Information Photonics(信息光子学国家重点实验室) ; Optical Communications, Beijing University of Posts(邮电大学光学通信学院) ; Zhongguancun Institute of Artificial Intelligence, Beijing, China(中关村人工智能研究院) ; School of Finance and Statistics, East China Normal University, Shanghai, China(东华大学金融与统计学院)
专题命中 效率与部署 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG
AI总结 A$^2$-LLM通过统一框架联合推理语言、音频语调和3D面部运动,实现端到端的情感表达对话虚拟形象,提升实时效率与情感表现力。
Comments 13 pages, 3 figures