NeuronTune: Fine-Grained Neuron Modulation for Balanced Safety-Utility Alignment in LLMs
NeuronTune:用于大语言模型中安全-效用平衡对齐的细粒度神经元调制
机构 * Birong Pan, Mayi Xu, Qiankun Pi, Jianhao Chen, Yuanyuan Zhu, Ming Zhong, Tieyun Qian(作者)
专题命中 安全训练 :alignment(title,abstract);safety(title,abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 NeuronTune是一种细粒度神经元调制框架,通过定位安全关键与效用保留神经元并动态控制干预范围,实现了大语言模型安全与效用的平衡优化,性能优于现有最先进技术。
Comments This work was accepted by WISE2026