Prompt-Based Value Steering of Large Language Models
基于提示的价值引导大型语言模型
专题命中 安全训练 :alignment(abstract);分类 cs.CL、cs.AI
AI总结 本文提出了一种基于提示的价值引导方法,通过评估提示候选者对生成文本的价值引导能力,展示在不修改模型的情况下实现价值对齐的可行性。
Comments 9 pages, 1 figure, 4 tables. Presented at the 3rd International Workshop on Value Engineering in AI (VALE 2025), 28th European Conference on AI. To appear in Springer LNCS