Quantum-Audit: Evaluating the Reasoning Limits of LLMs on Quantum Computing
量子审计:评估大语言模型在量子计算上的推理极限
机构 * Fordham University(福特汉姆大学) ; University of Michigan-Dearborn(密歇根大学-迪尔本分校) ; Stevens Institute of Technology(史蒂文斯理工学院)
AI总结 Quantum-Audit通过2700个问题评估大语言模型在量子计算概念理解上的推理能力,发现顶级模型在专家问题上表现不如LLM生成问题,且在高级主题上准确率显著下降。
Comments 18 pages