Understanding the Process of Human-AI Value Alignment
理解人机价值对齐的过程
机构 * University of Bath(巴斯大学)
AI总结 本文通过系统文献综述,探讨人工智能中价值对齐的核心方法与挑战,提出更精确的定义,识别六个关键主题以指导未来研究。
Comments 39 pages, 7 figures
Journal ref JAIR, Vol 85, Article 29 (March 2026)
期刊&会议
Journal of Artificial Intelligence Research · 期刊 · Artificial Intelligence
理解人机价值对齐的过程
机构 * University of Bath(巴斯大学)
AI总结 本文通过系统文献综述,探讨人工智能中价值对齐的核心方法与挑战,提出更精确的定义,识别六个关键主题以指导未来研究。
Comments 39 pages, 7 figures
Journal ref JAIR, Vol 85, Article 29 (March 2026)
基于洛伦兹支配的可扩展多目标强化学习与公平性保证
机构 * University of Amsterdam(阿姆斯特丹大学)
AI总结 本文提出一种结合公平性保证的多目标强化学习算法,通过洛伦兹支配识别公平奖励分布,提升多目标问题的可扩展性,在西安和阿姆斯特丹两个大型城市中展示出优于传统方法的性能。
Comments 32 pages. Published in Journal of Artificial Intelligence Research, Vol. 85, Article 31
Journal ref Journal of Artificial Intelligence Research, Vol. 85, Article 31. Publication date: March 2026