Context-Aware Hierarchical Learning: A Two-Step Paradigm towards Safer LLMs
上下文感知的分层学习:一种更安全LLM的两阶段范式
机构 * Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) ; Harbin Institute of Technology(哈尔滨工业大学) ; Great Bay University(大贝大学) ; Zhejiang University(浙江大学)
AI总结 本文提出上下文感知分层学习(CAHL)以提升LLM对工具完成攻击的鲁棒性,通过动态平衡语义理解和指令约束,有效增强模型安全性。