Advancing Multi-Step Mathematical Reasoning in Large Language Models through Multi-Layered Self-Reflection with Auto-Prompting
通过多层自反思与自动提示推进大语言模型的多步数学推理
André de Souza Loureiro, Jorge Valverde-Rebaza, Julieta Noguez, David Escarcega, Ricardo Marcacini
机构
*
Luiz de Queiroz College of Agriculture University of São Paulo(圣保罗大学农业学院)
;
School of Engineering and Sciences Tecnologico de Monterrey(蒙特雷技术学院工程与科学学院)
;
Institute of Mathematics and Computer Sciences University of São Paulo(圣保罗大学数学与计算机科学研究所)
CommentsAccepted for publication in: European Conference on Machine Learning and Principles and Practice of Knowledge Discovery in Databases (ECML PKDD 2025). Research Track
Pentest-R1: Towards Autonomous Penetration Testing Reasoning Optimized via Two-Stage Reinforcement Learning
He Kong, Die Hu, Jingguo Ge, Liangxiong Li, Hui Li, Tong Li
机构
*
State Key Laboratory of Cyberspace Security Defense, Institute of Information Engineering, Chinese Academy of Sciences(中国科学院网络空间安全防御重点实验室,信息工程研究所)
;
School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络与安全学院)
A Comprehensive Survey on Trustworthiness in Reasoning with Large Language Models
Yanbo Wang, Yongcan Yu, Jian Liang, Ran He
机构
*
School of Artificial Intelligence, University of Chinese Academy of Sciences(人工智能学院,中国科学院大学)
;
NLPR & MAIS, Institute of Automation, Chinese Academy of Sciences(神经语言处理与机器智能中心,中国科学院自动化研究所)
Implicit Reasoning in Large Language Models: A Comprehensive Survey
Jindong Li, Yali Fu, Li Fan, Jiahong Liu, Yao Shu, Chengwei Qin, Menglin Yang, Irwin King, Rex Ying
机构
*
Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
Jilin University(吉林大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
Yale University(耶鲁大学)
XFinBench: Benchmarking LLMs in Complex Financial Problem Solving and Reasoning
Zhihan Zhang, Yixin Cao, Lizi Liao
机构
*
School of Computing and Information Systems, Singapore Management University(计算与信息系统学院,新加坡管理大学)
;
Institute of Trustworthy Embodied AI, Fudan University(可信具身人工智能研究院,复旦大学)
Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model
Bowen Ding, Yuhan Chen, Futing Wang, Lingfeng Ming, Tao Lin
机构
*
Zhejiang University(浙江大学)
;
Boston University(波士顿大学)
;
ByteDance(字节跳动)
;
School of Engineering, Westlake University(西溪大学工程学院)
;
Research Center for Industries of the Future, Westlake University(西溪大学未来产业研究中心)
机构
*
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
School of Mathematics, Harbin Institute of Technology(哈尔滨工业大学数学学院)
;
Department of Control Science and Engineering, Harbin Institute of Technology(哈尔滨工业大学控制科学与工程学院)