机构
*
School of Computer Science, Peking University(北京大学计算机科学学院)
;
Kuaishou Technology(快手科技)
;
Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所)
;
Department of Computer Science and Engineering, Southern University of Science and Technology(南方科技大学计算机科学与工程系)
TAViS: Text-bridged Audio-Visual Segmentation with Foundation Models
TAViS: 基于文本的音频视觉分割与基础模型
Ziyang Luo, Nian Liu, Xuguang Yang, Salman Khan, Rao Muhammad Anwer, Hisham Cholakkal, Fahad Shahbaz Khan, Junwei Han
机构
*
Northwestern Polytechnical University(西北工业大学)
;
Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)
;
Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(合肥综合国家科学中心人工智能研究院)