From Specialization to Generalization: Instruction-tuned LLMs for Robust Harmful Content Mitigation
从专业化到通用化:用于稳健有害内容缓解的指令调优大语言模型
Lukas Edman, Daryna Dementieva, Alexander Fraser
机构
*
School of Computation, Information and Technology, TU Munich(慕尼黑工业大学计算、信息与技术学院)
;
Munich Center for Machine Learning(慕尼黑机器学习中心)
;
Munich Data Science Institute(慕尼黑数据科学研究所)
专题命中
指令微调
:LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);instruction tuning(abstract)