SAFENLIDB: A Privacy-Preserving Safety Alignment Framework for LLM-based Natural Language Database Interfaces
专题命中 隐私与版权 :alignment(title,abstract);safety(title);DPO(abstract);分类 cs.CL
Comments AAAI 2026 Extended Version
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
专题命中 隐私与版权 :alignment(title,abstract);safety(title);DPO(abstract);分类 cs.CL
Comments AAAI 2026 Extended Version
机构 * School of Software Technology, Zhejiang University(浙江大学软件学院) ; College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) ; State Key Laboratory of Mathematical Engineering and Advanced Computing(数学工程与先进计算国家重点实验室) ; Chinese Academy of Engineering(中国工程院) ; College of Cyber Security, Jinan University(暨南大学网络安全学院)
专题命中 隐私与版权 :safety(abstract);分类 cs.AI
Comments 68 pages,9 figures
专题命中 隐私与版权 :trustworthy(abstract);分类 cs.CL