Evaluating AI Alignment in LLMs: Output Analysis of Value Priorities Across 75 Models with Human Benchmarking
评估大语言模型中的AI对齐:通过75个模型的人类基准测试分析价值优先级
Gabriel Rongyang Lau, Wei Yan Low, Seow Min Koh, Fiona Fui-Hoon Nah, Andree Hartanto
机构
*
School of Social Sciences, Nanyang Technological University(南洋理工大学社会科学学院)
;
Interdisciplinary Graduate Programme, Nanyang Technological University(南洋理工大学跨学科研究生项目)
;
Faculty of Arts and Social Sciences, National University of Singapore(新加坡国立大学人文与社会科学学院)
;
School of Computing and Information Systems, Singapore Management University(新加坡管理学院计算与信息学院)
;
School of Social Sciences, Singapore Management University(新加坡管理学院社会科学学院)
Estimating Item Difficulty with Large Language Models as Experts
利用大语言模型作为专家估算项目难度
Diana Kolesnikova, Kirill Fedyanin, Abe D. Hofman, Matthieu J. S. Brinkhuis, Maria Bolsinova
机构
*
Department of Methodology and Statistics, Tilburg University(蒂尔堡大学方法学与统计学系)
;
Smart Business Technologies(智能商务技术公司)
;
Department of Psychological Methods, University of Amsterdam(阿姆斯特丹大学心理方法系)
;
Prowise Learn, Amsterdam(Prowise Learn公司,阿姆斯特丹)
;
Department of Information and Computing Sciences, Utrecht University(乌得勒支大学信息与计算科学系)
Testable and Actionable Calibration for Full Swap Regret
可检验且可操作的全面交换懊悔校准
Konstantina Bairaktari, Lunjia Hu, Huy L. Nguyen, Jonathan Ullman
机构
*
Department of Computer Science, Aarhus University(阿arhus大学计算机科学系)
;
Khoury College of Computer Sciences, Northeastern University(东北大学计算机科学学院)
;
Northeastern University(东北大学)
机构
*
Columbia University(哥伦比亚大学)
;
Columbia University School of Professional Studies(哥伦比亚大学专业研究学院)
;
Department of Statistics(统计学系)
;
Columbia University Department of Computer Science(哥伦比亚大学计算机科学系)
CommentsCopyright 2026 IEEE. Published in ICASSP 2026 - 2026 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP), scheduled for 4-8 May 2026 in Barcelona, Spain
A Survey on Foundation Models for Personalized Federated Intelligence
面向个性化联邦智能的基础模型综述
Yu Qiao, Huy Q. Le, Avi Deb Raha, Phuong-Nam Tran, Apurba Adhikary, Mengchun Zhang, Loc X. Nguyen, Eui-Nam Huh, Dusit Niyato, Choong Seon Hong
机构
*
School of Computing, Kyung Hee University(韩国庆熙大学计算机学院)
;
Noakhali Science and Technology University(诺阿克利科学与技术大学)
;
Korea Advanced Institute of Science and Technology(韩国科学技术院)
;
College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院)
机构
*
Shanghai Academy of Artificial Intelligence for Science, Shanghai, China.(上海人工智能科学研究院)
;
School of Biomedical Engineering, Shanghai Jiao Tong University, Shanghai, China.(上海交通大学生物医学工程学院)
;
Incubation Institute, Fudan University, Shanghai, China.(复旦大学孵化院)
Evaluating Cognitive Age Alignment in Interactive AI Agents
评估交互式AI代理的认知年龄对齐
Yifan Shen, Jiawen Zhang, Jian Xu, Junho Kim, Ismini Lourentzou, Xu Cao, Meihuan Huang
机构
*
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
Shenzhen Children's Hospital(深圳儿童医院)
;
Peking University(北京大学)
;
Hong Kong Polytechnic University(香港理工大学)
SHED: Style-Homogenized Embedding Alignment for Domain Generalization
SHED: 风格均质化嵌入对齐用于领域泛化
Kai Gan, Tong Wei
机构
*
School of Computer Science and Engineering, Southeast University, Nanjing 210096, China(1 东南大学计算机科学与工程学院,南京 210096,中国)
;
Key Laboratory of Computer Network and Information Integration (Southeast University), Ministry of Education, China(2 教育部计算机网络与信息集成重点实验室(东南大学),中国)
CommentsPreprint manuscript, 16 pages, 4 figures, 3 tables. This manuscript presents a residual-bounded 2.5D CT/CTA restoration framework for conservative medical image enhancement and evaluates it using image-recovery, baseline comparison, Monte Carlo stability, anatomical localization, and external low-dose CT testing