Object-AVEdit: An Object-level Audio-Visual Editing Model
机构 * Institute of Artificial Intelligence (TeleAI)(人工智能研究院) ; China Telecom(中国电信) ; Gaoling School of Artificial Intelligence(东城区人工智能学院) ; Renmin University of China(中国人民大学) ; Beijing University of Posts and Telecommunications(北京邮电大学) ; Tencent Data Platform(腾讯数据平台) ; Tsinghua University(清华大学) ; Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) ; Huawei Noah’s Ark Lab(华为诺亚实验室) ; The University of Hong Kong(香港大学)
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.AI、cs.MM