OMHBench: Benchmarking Balanced and Grounded Omni-Modal Multi-Hop Reasoning
OMHBench: 多模态多跳推理的基准测试
Seunghee Kim, Ingyu Bang, Seokgyu Jang, Changhyeon Kim, Sanghwan Bae, Jihun Choi, Richeng Xuan, Taeuk Kim
机构
*
Hanyang University(翰阳大学)
;
NAVER Cloud(NAVER云)
;
Knowledge Work Inc.(知识工作公司)
;
Beijing Academy of Artificial Intelligence(北京人工智能研究院)
;
Sony AI(索尼人工智能)
专题命中
视觉推理
:grounding(abstract);multimodal large language model(abstract)
Benchmarking and Evaluating VLMs for Software Architecture Diagram Understanding
对软件架构图理解的VLMs基准测试与评估
Shuyin Ouyang, Jie M. Zhang, Jingzhi Gong, Gunel Jahangirova, Mohammad Reza Mousavi, Jack Johns, Beum Seuk Lee, Adam Ziolkowski, Botond Virginas, Joost Noppen
机构
*
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Peking University(北京大学)
;
Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)