arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 3246 信号源:cs.CL, cs.AI, cs.LG

1. 数学推理 3246 篇

2509.24068 2025-11-24 cs.LG cs.AI 62%

A Small Math Model: Recasting Strategy Choice Theory in an LLM-Inspired Architecture

一个小数学模型:在LLM启发式架构中重构策略选择理论

Roussel Rahman, Jeff Shrager

机构 * Stanford University(斯坦福大学) Bennu Climate, Inc.(Bennu气候公司)

专题命中 数学推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一个基于LLM架构的小数学模型,重构策略选择理论,扩展其功能并研究数学推理中的数字特征与关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.20039 2025-11-21 cs.CL cs.LG 62%

AutoJudge: Judge Decoding Without Manual Annotation

AutoJudge: 无需人工标注的判断解码

Roman Garipov, Fedor Velikonivtsev, Ivan Ermakov, Ruslan Svirschevski, Vage Egiazarian, Max Ryabinin

机构 * HSE University(俄罗斯高等经济学院) Yandex IST Austria(国际应用数学研究所) Together AI

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.LG

AI总结 AutoJudge通过任务特定的损失性推测解码加速LLM推理,无需人工标注,实现显著速度提升并牺牲少量准确性。

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16080 2025-11-21 cs.PL cs.AI cs.LG 62%

Operon: Incremental Construction of Ragged Data via Named Dimensions

Operon:通过命名维度逐步构建不规则数据

Sungbin Moon, Jiho Park, Suyoung Hwang, Donghyun Koh, Seunghyun Moon, Minhyeong Lee

专题命中 数学推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 Operon通过命名维度形式化方法,实现对不规则数据的逐步构建,提升大规模数据处理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24021 2025-11-18 cs.CL cs.AI 62%

SelecTKD: Selective Token-Weighted Knowledge Distillation for LLMs

Haiduo Huang, Jiangcheng Song, Yadong Zhang, Pengju Ren

机构 * Institute of Artificial Intelligence and Robotics(人工智能与机器人研究院)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09873 2025-11-14 cs.CL cs.LG 62%

HierRouter: Coordinated Routing of Specialized Large Language Models via Reinforcement Learning

Nikunj Gupta, Bill Guo, Rajgopal Kannan, Viktor K. Prasanna

机构 * David S. Hippocampus Department of Computer Science Cranberry-Lemon University(Cranberry-Lemon大学计算机科学系) University of Southern California(南加州大学) DEVCOM Army Research Office(陆军研究办公室)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03222 2025-11-10 cs.LG cs.CL 62%

Low-probability Tokens Sustain Exploration in Reinforcement Learning with Verifiable Reward

Guanhua Huang, Tingqiang Xu, Mingze Wang, Qi Yi, Xue Gong, Siheng Li, Ruibin Xiong, Kejiao Li, Yuhao Jiang, Bo Zhou

机构 * LLM Department, Tencent(腾讯大模型部门) Tsinghua University(清华大学) Peking University(北京大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00102 2025-11-04 cs.LG cs.AI 62%

Automated Discovery of Conservation Laws via Hybrid Neural ODE-Transformers

Vivan Doshi

机构 * Independent Researcher(独立研究者)

专题命中 数学推理 :verifier(abstract);分类 cs.AI、cs.LG

Comments 5th Math-AI Workshop - Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26658 2025-10-31 cs.AI cs.CL 62%

The Era of Agentic Organization: Learning to Organize with Language Models

Zewen Chi, Li Dong, Qingxiu Dong, Yaru Hao, Xun Wu, Shaohan Huang, Furu Wei

机构 * Microsoft Research(微软研究院)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25776 2025-10-31 cs.CL cs.LG 62%

StreetMath: Study of LLMs' Approximation Behaviors

Chiung-Yi Tseng, Somshubhra Roy, Maisha Thasin, Danyang Zhang, Blessing Effiong

机构 * LuxMuse AI(LuxMuse人工智能公司) Department of Electrical and Computer Engineering, North Carolina State University(北卡罗来纳州立大学电气与计算机工程系) Department of Mathematics, University of Waterloo(滑铁卢大学数学系) Vokram Group(Vokram集团) Department of Computer Science, Saint Louis University(圣路易斯大学计算机科学系)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01369 2025-10-31 cs.LG cs.AI 62%

Incentivizing LLMs to Self-Verify Their Answers

Fuxiang Zhang, Jiacheng Xu, Chaojie Wang, Ce Cui, Yang Liu, Bo An

机构 * Nanyang Technological University, Singapore(南洋理工大学,新加坡) Skywork AI

专题命中 数学推理 :reasoning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14604 2025-10-31 cs.CL cs.AI 62%

Let LRMs Break Free from Overthinking via Self-Braking Tuning

Haoran Zhao, Yuchen Yan, Yongliang Shen, Haolei Xu, Wenqi Zhang, Kaitao Song, Jian Shao, Weiming Lu, Jun Xiao, Yueting Zhuang

机构 * Zhejiang University(浙江大学) Tianjin University(天津大学) Microsoft Research Asia(微软亚洲研究院)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

Comments Accepted to NeurIPS 2025; Camera ready version, 10 pages. Github:https://github.com/ZJU-REAL/Self-Braking-Tuning Project Page: https://ZJU-REAL.github.io/SBT

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.12571 2025-10-30 cs.CE cs.AI cs.CL 62%

Large Language Models for Combinatorial Optimization of Design Structure Matrix

Shuo Jiang, Min Xie, Jianxi Luo

机构 * City University of Hong Kong(香港城市大学)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

Journal ref Proc. Des. Soc. 5 (2025) 2201-2210

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10978 2025-10-29 cs.LG cs.AI 62%

Group-in-Group Policy Optimization for LLM Agent Training

Lang Feng, Zhenghai Xue, Tingcong Liu, Bo An

机构 * Nanyang Technological University(南洋理工大学) Skywork AI

专题命中 数学推理 :reasoning(abstract);分类 cs.AI、cs.LG

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22852 2025-10-28 cs.LG cs.AI 62%

Encoder-Decoder Diffusion Language Models for Efficient Training and Inference

Marianne Arriola, Yair Schiff, Hao Phung, Aaron Gokaslan, Volodymyr Kuleshov

机构 * Department of Computer Science, Cornell University(计算机科学系,康奈尔大学)

专题命中 数学推理 :reasoning(abstract);分类 cs.AI、cs.LG

Comments NeurIPS 2025. We provide the code at https://github.com/kuleshov-group/e2d2

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22798 2025-10-28 cs.CL cs.LG 62%

VEHME: A Vision-Language Model For Evaluating Handwritten Mathematics Expressions

Thu Phuong Nguyen, Duc M. Nguyen, Hyotaek Jeon, Hyunwook Lee, Hyunmin Song, Sungahn Ko, Taehwan Kim

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.LG

Comments EMNLP 2025. Project Website: https://vehme.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05605 2025-10-28 cs.CL cs.LG 62%

Evolving LLMs' Self-Refinement Capability via Synergistic Training-Inference Optimization

Yongcheng Zeng, Xinyu Cui, Xuanfa Jin, Qirui Mi, Guoqing Liu, Zexu Sun, Mengyue Yang, Dong Li, Weiyu Ma, Ning Yang, Jian Zhao, Jianye Hao, Haifeng Zhang, Jun Wang

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) University of Science and Technology of China(中国科学技术大学) Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学耿家庄人工智能学院) University of Bristo, UK(英国布里斯托大学) Zhongguancun Academy, China(中关村学院) Huawei Noah’s Ark Lab, China(华为诺亚实验室) University College London, UK(伦敦大学学院)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03325 2025-10-27 cs.CL cs.AI 62%

Electronic Circuit Principles of Large Language Models

Qiguang Chen, Libo Qin, Jinhao Liu, Dengyun Peng, Jiaqi Wang, Mengkang Hu, Zhi Chen, Wanxiang Che, Ting Liu

机构 * Harbin Institute of Technology(哈尔滨工业大学) Central South University(中南大学) The Chinese University of Hong Kong(香港中文大学) The University of Hong Kong(香港大学) ByteDance Seed (China)(字节跳动种子(中国))

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

Comments Manuscript

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20342 2025-10-24 cs.CL cs.AI 62%

Teaching Language Models to Reason with Tools

Chengpeng Li, Zhengyang Tang, Ziniu Li, Mingfeng Xue, Keqin Bao, Tian Ding, Ruoyu Sun, Benyou Wang, Xiang Wang, Junyang Lin, Dayiheng Liu

机构 * University of Science and Technology of China(中国科学技术大学) Alibaba Inc.(阿里巴巴公司) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Shenzhen International Center for Industrial and Applied Mathematics(深圳国际工业与应用数学中心) Shenzhen Research Institute of Big Data(深圳大数据研究院)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

Comments NIPS2025 Accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23679 2025-10-24 cs.LG cs.AI cs.CR 62%

Learning Modular Exponentiation with Transformers

David Demitri Africa, Sara M. Kapoor, Theo Simon Sorg, Challenger Mishra

机构 * Department of Computer Science and Technology(计算机科学与技术系)

专题命中 数学推理 :reasoning(abstract);分类 cs.AI、cs.LG

Comments Accepted at the 5th MATH-AI Workshop, NeurIPS'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19895 2025-10-24 cs.CL cs.AI 62%

Large Language Model enabled Mathematical Modeling

Guoyun Zhang

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18176 2025-10-22 cs.AI cs.LG 62%

Local Coherence or Global Validity? Investigating RLVR Traces in Math Domains

Soumya Rani Samineni, Durgesh Kalwar, Vardaan Gangal, Siddhant Bhambri, Subbarao Kambhampati

机构 * Arizona State University(亚利桑那州立大学)

专题命中 数学推理 :reasoning(abstract);分类 cs.AI、cs.LG

Comments 4 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17921 2025-10-22 cs.CL cs.AI 62%

CLAWS:Creativity detection for LLM-generated solutions using Attention Window of Sections

Keuntae Kim, Eunhye Jeong, Sehyeon Lee, Seohee Yoon, Yong Suk Choi

机构 * Department of Computer Science(计算机科学系) Department of Artificial Intelligence(人工智能系) Department of Future Mobility(未来移动部门)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17733 2025-10-21 cs.CL cs.LG 62%

Train for Truth, Keep the Skills: Binary Retrieval-Augmented Reward Mitigates Hallucinations

Tong Chen, Akari Asai, Luke Zettlemoyer, Hannaneh Hajishirzi, Faeze Brahman

机构 * University of Washington(华盛顿大学) Allen Institute for AI (Ai2)(人工智能研究院) Carnegie Mellon University(卡内基梅隆大学)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02456 2025-10-21 cs.LG cs.AI cs.NA math.NA 62%

Market-Driven Subset Selection for Budgeted Training

Ashish Jha, Valentin Leplat, AH Phan

机构 * Skolkovo Institute of Science and Technology(斯克洛夫诺科学与技术研究所) Innopolis University(因诺波利斯大学)

专题命中 数学推理 :reasoning(abstract);分类 cs.AI、cs.LG

Comments Retitled major revision of the same work (formerly "Market-Based Data Subset Selection -- Principled Aggregation of Multi-Criteria Example Utility"). Abstract and exposition revised; ablations added; theory clarified. Core results unchanged. Supersedes v1; please process as a replacement

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01055 2025-10-20 cs.AI cs.CL cs.CV 62%

VerlTool: Towards Holistic Agentic Reinforcement Learning with Tool Use

Dongfu Jiang, Yi Lu, Zhuofeng Li, Zhiheng Lyu, Ping Nie, Haozhe Wang, Alex Su, Hui Chen, Kai Zou, Chao Du, Tianyu Pang, Wenhu Chen

机构 * University of Waterloo(滑铁卢大学) Sea AI Lab(Sea AI 实验室) University of Toronto(多伦多大学) Shanghai University(上海大学) HKUST(香港科技大学) M-A-P National University of Singapore(新加坡国立大学)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

Comments 32 pages, 5 figures, 13 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12859 2025-10-20 cs.CL cs.AI 62%

PAFT: Prompt-Agnostic Fine-Tuning

Chenxing Wei, Yao Shu, Mingwen Ou, Ying Tiffany He, Fei Richard Yu

机构 * College of Computer Science and Software Engineering, Shenzhen University, China(深圳大学计算机科学与软件工程学院) Tsinghua Shenzhen International Graduate School, Tsinghua University, China(清华大学深圳国际研究生院) Guangdong Lab of AI and Digital Economy (SZ), China(广东人工智能与数字经济实验室(深圳)) Hong Kong University of Science and Technology (Guangzhou), China(香港科技大学(广州)) School of Information Technology, Carleton University, Canada(卡尔顿大学信息科技学院)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

Comments 24 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11944 2025-10-15 cs.CL cs.AI 62%

TopoAlign: A Framework for Aligning Code to Math via Topological Decomposition

Yupei Li, Philipp Borchert, Gerasimos Lampouras

机构 * Imperial College London(帝国学院伦敦分校) Huawei Noah’s Ark Lab(华为诺亚方舟实验室)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11696 2025-10-14 cs.LG cs.CL cs.CV 62%

QeRL: Beyond Efficiency -- Quantization-enhanced Reinforcement Learning for LLMs

Wei Huang, Yi Ge, Shuai Yang, Yicheng Xiao, Huizi Mao, Yujun Lin, Hanrong Ye, Sifei Liu, Ka Chun Cheung, Hongxu Yin, Yao Lu, Xiaojuan Qi, Song Han, Yukang Chen

机构 * NVIDIA MIT(麻省理工学院) HKU(香港大学) THU(清华大学)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.LG

Comments Code is available at https://github.com/NVlabs/QeRL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11653 2025-10-14 cs.LG cs.AI 62%

MATH-Beyond: A Benchmark for RL to Expand Beyond the Base Model

Prasanna Mayilvahanan, Ricardo Dominguez-Olmedo, Thaddäus Wiedemer, Wieland Brendel

专题命中 数学推理 :reasoning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.22578 2025-10-14 cs.LG cs.AI stat.ML 62%

The Hidden Link Between RLHF and Contrastive Learning

Xufei Lv, Kehai Chen, Haoyuan Sun, Xuefeng Bai, Min Zhang, Houde Liu, Kehai Chen

机构 * Tsinghua University(清华大学) Harbin Institute of Technology(哈尔滨工业大学) Soochow University(苏州大学)

专题命中 数学推理 :reasoning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏