LookAhead Tuning: Safer Language Models via Partial Answer Previews
LookAhead Tuning: 通过部分答案预览实现更安全的语言模型
Kangwei Liu, Mengru Wang, Yujie Luo, Lin Yuan, Mengshu Sun, Lei Liang, Zhiqiang Zhang, Jun Zhou, Bryan Hooi, Shumin Deng
机构
*
Zhejiang University(浙江大学)
;
Zhejiang University - Ant Group Joint Laboratory of Knowledge Graph(浙江大学-蚂蚁集团知识图谱联合实验室)
;
Ant Group(蚂蚁集团)
;
National University of Singapore(新加坡国立大学)
专题命中
预训练与数据
:language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG