ChartArena: Benchmarking Chart Parsing across Languages, Scenarios, and Formats
ChartArena: 跨语言、场景和格式的图表解析基准测试
机构 * Large Language Model Department, Tencent(腾讯大语言模型部门) ; Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) ; Shenzhen Loop Area Institute(深圳河套学院) ; Nankai University(南开大学)
专题命中 Agent评测 :agent(abstract)
AI总结 提出ChartArena,一个覆盖8种图表族、3种视觉场景的双语基准,通过人机协作标注和格式无关评估协议,系统评估26个多模态大模型的图表解析能力,揭示前沿模型差距与挑战。
Comments 23 pages