Contrastive Knowledge Transfer and Robust Optimization for Secure Alignment of Large Language Models
专题命中 安全评测 :alignment(title,abstract);safety(abstract);trustworthy(abstract);分类 cs.CL
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
专题命中 安全评测 :alignment(title,abstract);safety(abstract);trustworthy(abstract);分类 cs.CL
机构 * University of Pisa(比萨大学)
专题命中 安全评测 :trustworthy(title,abstract);分类 cs.AI
机构 * University of Texas at Dallas(德克萨斯大学达拉斯分校)
专题命中 安全评测 :trustworthy(title,abstract);分类 cs.AI
机构 * Florida International University(佛罗里达国际大学)
专题命中 安全评测 :trustworthy(abstract);分类 cs.AI、cs.LG
专题命中 安全评测 :alignment(abstract);分类 cs.CY
专题命中 安全评测 :alignment(abstract);分类 cs.AI
机构 * University of California, Davis(加州大学戴维斯分校) ; Arm(ARM公司) ; Samsung(三星) ; Qualcomm(高通) ; California State University, Sacramento(加州州立大学萨克拉门托分校) ; Gilmet Labs(Gilmet实验室) ; NVIDIA(英伟达) ; AMD(超微半导体)
专题命中 安全评测 :safety(abstract);分类 cs.LG
Comments 16 pages, 5 figures, 6 tables
机构 * Independent Researcher(独立研究者)
专题命中 安全评测 :safety(abstract);分类 cs.LG
机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
专题命中 安全评测 :alignment(abstract);分类 cs.CL
Comments EMNLP 2025 Main