Comprehensive Evaluation of Large Language Model Responses: A Multi-Factor Scoring System
大语言模型回答的综合评估:一种多因素评分系统
Yiming Gai, Junde Lu, Xuefei Huang
机构
*
School of Computer Science and Engineering, Beihang University, Beijing, China(北京航空航天大学计算机科学与工程学院)
;
Data Science and Intelligent Computing Laboratory, Hangzhou International Innovation Institute, Beihang University, Hangzhou, Zhejiang(北京航空航天大学杭州国际创新研究院数据科学与智能计算实验室)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI
LEMUR 2: Unlocking Neural Network Diversity for AI
LEMUR 2:释放人工智能的神经网络多样性
Tolgay Atinc Uzun, Waleed Khalid, Saif U Din, Sai Revanth Mulukuledu, Akashdeep Singh, Chandini Vysyaraju, Raghuvir Duvvuri, Avi Goyal, Yashkumar Rajeshbhai Lukhi, Muhammad A. Hussain, Krunal Jesani, Usha Shrestha, Yash Mittal, Roman Kochnev, Pritam Kadam, Mohsin Ikram, Harsh R. Moradiya, Alice Arslanian, Dmitry Ignatov, Radu Timofte
机构
*
University of Würzburg(维尔茨堡大学)
专题命中
评测与基准
:LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.LG
机构
*
College of Health Solutions, Arizona State University(亚利桑那州立大学健康解决方案学院)
;
School of Computing and Augmented Intelligence, Arizona State University(亚利桑那州立大学计算与增强智能学院)
;
School of Nutritional Sciences and Wellness, University of Arizona(亚利桑那大学营养科学与健康学院)
专题命中
评测与基准
:LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.LG
CommentsIEEE Open Journal of Engineering in Medicine and Biology (Volume: 7), Date of Publication: 28 May 2026. Page(s): 232-240
Journal refIEEE Open Journal of Engineering in Medicine and Biology (Volume: 7), Date of Publication: 28 May 2026. Page(s): 232-240; Electronic ISSN: 2644-1276
AI Chatbot Suicide Risk Detection and Response: Human Validation Study of the Open-Source VERA-MH Safety Evaluation
人工智能聊天机器人自杀风险检测与应对:开源VERA-MH安全评估的人工验证研究
Kate H. Bentley, Luca Belli, Adam M. Chekroud, Emily J. Ward, Emily R. Dworkin, Emily Van Ark, Kelly M. Johnston, Will Alexander, Millard Brown, Matt Hawrilenko
机构
*
Spring Health
;
Harvard Medical School(哈佛医学院)
;
UC Berkeley(加州大学伯克利分校)
;
Yale University(耶鲁大学)
专题命中
评测与基准
:LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI
A knowledge-augmented dataset of high-risk driving scenarios with LLM annotations for autonomous driving
一个用于自动驾驶的具有大语言模型注释的高风险驾驶场景知识增强数据集
Heye Huang, Jingguang Li, Zhiyuan Zhou, Paul Liang, Mingyu Wu, Kitae Jang, Jianqiang Wang
机构
*
Korea Advanced Institute of Science and Technology(韩国科学技术院)
;
Fudan University(复旦大学)
;
Massachusetts Institute of Technology(麻省理工学院)
;
Shanghai Jiao Tong University(上海交通大学)
;
Tsinghua University(清华大学)
专题命中
评测与基准
:LLM(title);large language model(abstract);language model(abstract);分类 cs.LG
Informing AI Policy Assessment using Large-Scale Simulation of Interventions
利用大规模干预模拟为AI政策评估提供信息
Julia Barnett, Kimon Kieslich, Natali Helberger, Nicholas Diakopoulos
机构
*
Northwestern University USA
;
University of Amsterdam, The Netherlands \& University of Hohenheim Germany
;
University of Amsterdam The Netherlands
;
Northwestern University
;
University of Amsterdam, The Netherlands \& University of Hohenheim
;
University of Amsterdam
CommentsThis work is published in the proceedings of the ACM Conference on Fairness, Accountability, and Transparency (FAccT) 2026. 15 pages plus end matter and appendix
Journal refIn Proceedings of the 2026 ACM Conference on Fairness, Accountability, and Transparency (FAccT '26). Association for Computing Machinery, New York, NY, USA, 3942-3978
Healthier LLMs: Retrieval-Augmented Generation for Public Health Question Answering
更健康的语言模型:用于公共卫生问答的检索增强生成
Felix Feldman, Joshua Harris, Timothy Laurence, Leo Loman, Ollie Higgins, Fan Grayson, Poonam Soma, Bethany Pace-Bonello, Michael Borowitz, Toby Nonnenmacher
专题命中
评测与基准
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
Named-Entity Recognition in the Crime Domain (CrimeNER): Case Study and Dataset
犯罪领域中的命名实体识别(CrimeNER):案例研究与数据集
Miguel Lopez-Duran, Julian Fierrez, Aythami Morales, Daniel DeAlcala, Gonzalo Mancera, Javier Irigoyen, Ruben Tolosana, Oscar Delgado, Francisco Jurado, Alvaro Ortigosa
机构
*
BiometricsAI, Universidad Autónoma de Madrid(生物度AI,马德里自治大学)
专题命中
评测与基准
:large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
VLM-Aware Meta-Optic Front-End Design for Frozen Vision-Language Models
面向冻结视觉语言模型的VLM感知元光学前端设计
Chanik Kang, Raphaël Pestourie, Haejun Chung
机构
*
Department of Artificial Intelligence, Hanyang University(汉阳大学人工智能系)
;
School of Computational Science and Engineering, Georgia Institute of Technology(佐治亚理工学院计算科学与工程学院)
;
Department of Electronic Engineering, Hanyang University(汉阳大学电子工程系)
机构
*
Monash University(墨尔本大学)
;
Stanford University(斯坦福大学)
;
University of Washington(华盛顿大学)
;
Griffith University(格里菲斯大学)
;
Princeton University(普林斯顿大学)
;
Allen Institute for Artificial Intelligence(人工智能研究院)