In-Token Rationality Optimization: Towards Accurate and Concise LLM Reasoning via Self-Feedback
专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.CL
Comments AAAI 2026 Oral
AI 大模型
大模型数学、逻辑、规划、多步推理和测试时计算能力。
专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.CL
Comments AAAI 2026 Oral
机构 * David S. Hippocampus Department of Computer Science Cranberry-Lemon University(Cranberry-Lemon大学计算机科学系) ; University of Southern California(南加州大学) ; DEVCOM Army Research Office(陆军研究办公室)
专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.LG
机构 * Ant Group(蚂蚁集团) ; Nanyang Technological University(南洋理工大学)
专题命中 数学推理 :reasoning(abstract);分类 cs.CL
Comments Accepted by IEEE Symposium on Security and Privacy (S&P) 2026
专题命中 数学推理 :reasoning(abstract);分类 cs.AI
Comments AAAI 2026 (Oral). This is the extended preprint of the copyrighted version at AAAI