Three Concrete Challenges and Two Hopes for the Safety of Unsupervised Elicitation
三个具体挑战和两个希望:对无监督引导的安全性
专题命中 幻觉与事实性 :safety(title);分类 cs.AI、cs.LG
AI总结 本文探讨了无监督引导技术在面对特定数据集挑战时的局限性,并提出了未来研究的优先方向。
Comments 19 pages, 9 figures
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
三个具体挑战和两个希望:对无监督引导的安全性
专题命中 幻觉与事实性 :safety(title);分类 cs.AI、cs.LG
AI总结 本文探讨了无监督引导技术在面对特定数据集挑战时的局限性,并提出了未来研究的优先方向。
Comments 19 pages, 9 figures
AgentDR: 通过基于LLM的代理进行动态推荐:利用隐式物品-物品关系
机构 * Amazon(亚马逊) ; University of Michigan(密歇根大学)
专题命中 幻觉与事实性 :alignment(abstract);分类 cs.AI
AI总结 AgentDR通过基于LLM的代理利用隐式物品-物品关系,结合记忆机制和提示策略,提升动态推荐的全排名性能和相关性。
Comments 12 pages, accepted by WWW'26 as long paper