McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models
Tian Lan, Xiangdong Su, Xu Liu, Ruirui Wang, Ke Chang, Jiang Li, Guanglai Gao
机构
*
College of Computer Science, Inner Mongolia University(内蒙古大学计算机科学学院)
;
National & Local Joint Engineering Research Center of Intelligent Information Processing Technology for Mongolian(蒙古语智能信息处理技术国家与地方联合工程研究中心)
;
Inner Mongolia Key Laboratory of Multilingual Artificial Intelligence Technology(内蒙古多语种人工智能技术重点实验室)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);分类 cs.CL
CommentsAccepted by ACL2025 Findings
Journal refIn Findings of the Association for Computational Linguistics: ACL 2025, pages 6033-6056, Vienna, Austria. Association for Computational Linguistics
Yingjie Zhou, Jiezhang Cao, Farong Wen, Li Xu, Yanwei Jiang, Jun Jia, Ronghui Li, Xiaohong Liu, Yu Zhou, Xiongkuo Min, Jie Guo, Zicheng Zhang, Guangtao Zhai
机构
*
Shanghai Jiao Tong University(上海交通大学)
;
PengCheng Laboratory(鹏城实验室)
;
Harvard Medical School(哈佛医学院)
;
Shanghai AI Laboratory(上海人工智能实验室)
;
China University of Mining and Technology(中国矿业大学)
专题命中
评测与基准
:LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI
机构
*
Department of Computer Science and Engineering, The Chinese University of Hong Kong(计算机科学与工程系,香港中文大学)
;
LIGHTSPEED STUDIOS
;
National University of Singapore(新加坡国立大学)
;
Tencent(腾讯)
专题命中
评测与基准
:language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL
CommentsThe reduced version of this paper has been accepted at ACL 2025
Adapting Vision-Language Models Without Labels: A Comprehensive Survey
Hao Dong, Lijun Sheng, Jian Liang, Ran He, Eleni Chatzi, Olga Fink
机构
*
ETH Zürich(苏黎世联邦理工学院)
;
University of Science and Technology of China(中国科学技术大学)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
EPFL(苏黎世联邦理工学院)
Can Vision Language Models Understand Mimed Actions?
Hyundong Cho, Spencer Lin, Tejas Srinivasan, Michael Saxon, Deuksin Kwon, Natali T. Chavez, Jonathan May
机构
*
Information Sciences Institute(信息科学研究所)
;
Institute for Creative Technologies(创意技术研究所)
;
Department of Computer Science(计算机科学系)
;
University of Southern California(南加州大学)
;
University of California, Santa Barbara(加州大学圣巴巴拉分校)
;
Aristotle University of Thessaloniki(希腊雅典纳大学)
机构
*
School of Computer Science and Technology, University of Chinese Academy of Sciences(计算机科学与技术学院,中国科学院大学)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(人工智能学院,中国科学院大学)
;
CAS Center for Excellence in Brain Science and Intelligence Technology(脑科学与智能技术卓越中心)
GrandJury: A Collaborative Machine Learning Model Evaluation Protocol for Dynamic Quality Rubrics
Arthur Cho
机构
*
Memoirji LLC(Memiorji公司)
专题命中
评测与基准
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
Comments14 pages (incl. arXiv cover), 1 table, code & dataset links inside. Open-source implementation available on PyPI (grandjury package) and GitHub. Dataset available on Hugging Face under CC-BY-4.0 license
Evaluating the Use of LLMs for Documentation to Code Traceability
Ebube Alor, SayedHassan Khatoonabadi, Emad Shihab
机构
*
Data-driven Analysis of Software (DAS) Lab Department of Computer Science \& Software Engineering Concordia University Montréal QC Canada
;
Concordia University
专题命中
评测与基准
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
机构
*
Business School, Hunan University(湖南大学商学院)
;
Computer Network Information Center, Chinese Academy of Sciences(中国科学院计算机网络信息中心)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
School of Computer Science and Information Engineering, Hefei University of Technology(合肥工业大学计算机科学与信息工程学院)
;
School of Business, Hunan University(湖南大学商学院)
;
Thrust of Artificial Intelligence, The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)人工智能研究所)
;
Department of Computer Science and Engineering, The Hong Kong University of Science and Technology Hong Kong SAR(香港科技大学(香港)计算机科学与工程学院)
专题命中
评测与基准
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI