IFEval-Audio: Benchmarking Instruction-Following Capability in Audio-based Large Language Models
机构 * Nanyang Technological University (NTU)(南洋理工大学) ; MiroMind(米罗Mind) ; Institute for Infocomm Research (I 2 R)(信息与通信研究院) ; A*STAR(科技研究局)
专题命中 VLM训练与架构 :vision-language model(abstract)
Comments Link: https://github.com/AudioLLMs/AudioBench/tree/main/IFEval-Audio