OpenAI's GPT-OSS-20B Model and Safety Alignment Issues in a Low-Resource Language
机构 * University of Huddersfield(赫德菲尔德大学)
专题命中 幻觉与事实性 :alignment(title,abstract);safety(title,abstract);分类 cs.CL、cs.AI
Comments 6 pages, 4 tables
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
机构 * University of Huddersfield(赫德菲尔德大学)
专题命中 幻觉与事实性 :alignment(title,abstract);safety(title,abstract);分类 cs.CL、cs.AI
Comments 6 pages, 4 tables
机构 * Simula Research Laboratory(Simula研究实验室) ; University of York(约克大学) ; Aarhus University(奥胡斯大学) ; Aristotle University of Thessaloniki(塞萨洛尼基亚里士多德大学) ; Southwest University(西南大学) ; Norwegian University of Science and Technology(挪威科学与技术大学)
专题命中 幻觉与事实性 :safety(abstract);trustworthy(abstract)
机构 * Carnegie Mellon University(卡内基梅隆大学) ; FEUP(费拉尔大学) ; INESC-ID(葡萄牙里斯本信息技术与创新研究中心)
专题命中 幻觉与事实性 :safety(abstract);分类 cs.AI、cs.LG
Comments 9 main pages, 13 appendix pages
机构 * AI Safety Research(人工智能安全研究) ; Convai Innovations(Convai创新)
专题命中 幻觉与事实性 :alignment(abstract);分类 cs.CL、cs.AI
专题命中 幻觉与事实性 :safety(abstract);分类 cs.CL
Comments This paper is accepted for presentation in TRB annual meeting 2026. The version presented here is the preprint version before peer review process
机构 * Beijing Academy of Artificial Intelligence (BAAI)(北京人工智能研究院)
专题命中 幻觉与事实性 :alignment(abstract)
Comments 15 pages