CORDA: A Benchmark for Hierarchical Harm-Centric Moral Reasoning in Large Language Models
CORDA:面向大语言模型的以伤害为核心的分层道德推理基准
机构 * University of the Witwatersrand(威特沃特斯兰德大学)
专题命中 推理评测 :reasoning(title,abstract);分类 cs.AI
AI总结 研究提出CORDA基准,评估大语言模型的以伤害为核心的分层道德推理,发现多数模型优先避免直接个人伤害,部分模型无法遵循指定优先级,该基准填补了LLM道德评估的核心空白。
Comments 8 pages, 6 figures. Accepted at the Fourth International Workshop on Value Engineering in AI (VALE 2026), affiliated with IJCAI-ECAI 2026