From Generation to Judgment: Opportunities and Challenges of LLM-as-a-judge
Dawei Li, Bohan Jiang, Liangjie Huang, Alimohammad Beigi, Chengshuai Zhao, Zhen Tan, Amrita Bhattacharjee, Yuxuan Jiang, Canyu Chen, Tianhao Wu, Kai Shu, Lu Cheng, Huan Liu
机构
*
Arizona State University(亚利桑那州立大学)
;
University of Illinois Chicago(伊利诺伊大学芝加哥分校)
;
University of Maryland, Baltimore County(马里兰大学巴尔的摩县分校)
;
Northwestern University(西北大学)
;
University of California, Berkeley(加州大学伯克利分校)
;
Emory University(埃默里大学)
专题命中
评测与基准
:LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
机构
*
Peking University(北京大学)
;
National University of Singapore(新加坡国立大学)
;
Institute of Science Tokyo(东京科学研究院)
;
Nanjing University(南京大学)
;
Westlake University(西湖大学)
;
Southeast University(东南大学)
专题命中
评测与基准
:LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
机构
*
State Key Laboratory of Virtual Reality Technology and Systems, School of Computer Science and Engineering, Beihang University, Beijing, China(虚拟现实技术与系统国家重点实验室,计算机科学与工程学院,北京航空航天大学)
;
Hangzhou Innovation Institute of Beihang University, Zhejiang Key Laboratory of Industrial Big Data and Robot Intelligent Systems, Hangzhou, China(北京航空航天大学杭州创新研究院,浙江省工业大数据与机器人智能系统重点实验室)
;
Center for AI Business Innovation, Department of Management Science and Systems, University at Buffalo, Buffalo, New York, USA(人工智能商业创新中心,管理科学与系统系,布法罗大学)
;
University of North Texas, Denton, Texas, USA(德克萨斯大学达文波特分校)
;
Zhongguancun Laboratory, Beijing, China(中关村实验室)
专题命中
评测与基准
:LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG
Comments28 pages, 32 figures, accepted to the Findings of EMNLP 2025
Haoye Tian, Chong Wang, BoYang Yang, Lyuye Zhang, Yang Liu
机构
*
School of Computer Science and Engineering, Nanyang Technological University(南洋理工大学计算机科学与工程学院)
;
Jisuan Institute of Technology, Beijing JudaoYouda Network Technology Co. Ltd.(智算技术研究所,北京judaoYouda网络技术有限公司)
专题命中
评测与基准
:LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond
Muhammad Huzaifah, Geyu Lin, Tianchi Liu, Hardik B. Sailor, Kye Min Tan, Tarun K. Vangani, Qiongqiong Wang, Jeremy H. M. Wong, Jinyang Wu, Nancy F. Chen, Ai Ti Aw
机构
*
MERaLiON Team(MERaLiON团队)
;
Institute for Infocomm Research (I 2 R), A*STAR, Singapore(信息通信研究所(I2R),A*STAR,新加坡)
专题命中
评测与基准
:foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI