Benchmarking Multi-Step Legal Reasoning and Analyzing Chain-of-Thought Effects in Large Language Models
对多步骤法律推理进行基准测试并分析思维链效应在大型语言模型中的表现
机构 * School of Artificial Intelligence, Beihang University, Beijing, China(北京航空航天大学人工智能学院) ; KoGuan School of Law, Shanghai Jiao Tong University, Shanghai, China(上海交通大学KoGuan法学院) ; School of Criminal Law, China University of Political Science and Law, Beijing, China(中国政法大学刑事法律学院)
专题命中 复杂问题求解 :reasoning(title,abstract);chain-of-thought(title,abstract);分类 cs.AI
AI总结 本文提出MSLR数据集,用于评估大型语言模型在多步骤法律推理中的表现,并通过实验展示自主生成的思维链提示提升了推理质量。
Comments 21 pages, 7 figures