Uncertainty Drives Social Bias Changes in Quantized Large Language Models
不确定性驱动量化大语言模型中的社会偏见变化
Stanley Z. Hua, Sanae Lotfi, Irene Y. Chen
机构
*
UC Berkeley(伯克利大学)
;
Centre for Computational Medicine at The Hospital for Sick Children(儿童医院计算医学中心)
;
UCSF(旧金山大学)
;
Meta Superintelligence Labs(Meta超智能实验室)
专题命中
知识编辑与模型理解
:large language model(title,abstract);language model(title,abstract);post-training(abstract);分类 cs.CL
机构
*
Johns Hopkins University(约翰霍普金斯大学)
;
Emory University(埃默里大学)
;
University of Washington(华盛顿大学)
;
University of California San Diego(加州大学圣地亚哥分校)
;
University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)
;
University of Southern California(南加州大学)
;
Washington University in St. Louis(圣路易斯华盛顿大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
East China Normal University(华东师范大学)
;
Stanford University(斯坦福大学)
;
University of California, Berkeley(加州大学伯克利分校)
;
University of Michigan(密歇根大学)
;
Carnegie Mellon University(卡内基梅隆大学)
Dependable Artificial Intelligence with Reliability and Security (DAIReS): A Unified Syndrome Decoding Approach for Hallucination and Backdoor Trigger Detection
具备可靠性和安全性的人工智能(DAIReS):一种统一的综合解码方法用于幻觉和后门触发检测
Hema Karnam Surendrababu, Nithin Nagaraj
专题命中
知识编辑与模型理解
:large language model(abstract);language model(abstract)