An LLM-as-Judge Metric for Bridging the Gap with Human Evaluation in SE Tasks
机构 * Singapore Management University(新加坡国立管理学院) ; DGIST(韩国高等智能科学研究院) ; Monash University(墨尔本大学) ; Nanjing University of Aeronautics and Astronautics(南京航空航天大学) ; Huawei Software Engineering Application Technology Lab(华为软件工程应用技术实验室) ; Zhejiang University(浙江大学)
专题命中 代码评测 :code generation(abstract);program repair(abstract);分类 cs.SE、cs.CL、cs.AI
Comments 13 pages