OMHBench: Benchmarking Balanced and Grounded Omni-Modal Multi-Hop Reasoning
OMHBench: 多模态多跳推理的基准测试
机构 * Hanyang University(翰阳大学) ; NAVER Cloud(NAVER云) ; Knowledge Work Inc.(知识工作公司) ; Beijing Academy of Artificial Intelligence(北京人工智能研究院) ; Sony AI(索尼人工智能)
AI总结 OMHBench通过平衡的多模态多跳推理评估框架,揭示了多模态大语言模型在多模态接地方面的不均衡性,发现专有模型与开源模型性能差距显著,且对推理路径变化敏感。
Comments ACL 2026 Findings