Not All Proofs Are Equal: Evaluating LLM Proof Quality Beyond Correctness
并非所有证明都平等:超越正确性的LLM证明质量评估
机构 * INSAIT(INSAIT研究所) ; Sofia University "St. Kliment Ohridski"(索菲亚大学"圣克莱孟·奥赫里迪斯基") ; ETH Zurich(苏黎世联邦理工学院)
AI总结 本文提出ProofRank基准,评估证明的简洁性、计算便捷性、认知简单性、多样性及适应性,揭示正确性之外的证明质量差异及优劣权衡。
Comments 9 main text pages, 36 total pages, Accepted at ICML 2026 AI for Math workshop