Indi-RomCoM: Code-Mixed Benchmark for Evaluating LLMs on Romanized Indic-English Instructions
Indi-RomCoM:评估LLM在罗马化印度语-英语混合指令上的基准测试
机构 * Shiv Nadar University Chennai(金奈希夫·纳达尔大学) ; Google Cloud AI Research(谷歌云人工智能研究) ; IIT Madras(印度理工学院马德拉斯分校)
专题命中 评测与基准 :LLM(title_cn,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
AI总结 提出Indi-RomCoM基准,用于评估大语言模型在罗马化印度语-英语混合指令上的表现,涵盖7个任务、4种语言和3种混合强度,发现模型性能随混合密度增加而下降。