Towards Self-Robust LLMs: Intrinsic Prompt Noise Resistance via CoIPO
迈向自适应鲁棒大语言模型:通过CoIPO实现内在提示噪声抵抗力
机构 * Zhejiang University(浙江大学) ; Tsinghua University(清华大学) ; Meituan LongCat Interaction Team(美团LongCat交互团队) ; ETH Zürich(苏黎世联邦理工学院)
AI总结 本文提出CoIPO方法,通过对比学习提升大语言模型对提示噪声的内在鲁棒性,实验表明其在NoisyPromptBench上表现优于现有方法。