2602.16008
2026-02-19
cs.SD
cs.AI
cs.CL
cs.LG
62%
MAEB: Massive Audio Embedding Benchmark
MAEB:大规模音频嵌入基准
Adnan El Assadi, Isaac Chung, Chenghao Xiao, Roman Solomatin, Animesh Jha, Rahul Chand, Silky Singh, Kaitlyn Wang, Ali Sartaz Khan, Marc Moussa Nasser, Sufen Fong, Pengfei He, Alan Xiao, Ayush Sunil Munot, Aditya Shrivastava, Artem Gazizov, Niklas Muennighoff, Kenneth Enevoldsen
机构
*
Carleton University(卡尔顿大学)
;
Durham University(杜伦大学)
;
Stanford University(斯坦福大学)
;
Aarhus University(奥胡斯大学)
;
Indian Institute of Technology, Kharagpur(印度理工学院,卡里格普)
;
Harvard University(哈佛大学)
专题命中
音频语音多模态
:cross-modal(abstract);分类 cs.CL、cs.AI
AI总结
MAEB是一个涵盖多语言音频任务的基准,揭示了不同模型在音频与语言任务上的性能差异,展示了音频编码器在跨模态任务中的表现关联性。