arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 2030 信号源:cs.CL, cs.AI, cs.LG

1. 测试时计算 2030 篇

2504.15275 2025-10-24 cs.AI cs.LG 81%

Stop Summation: Min-Form Credit Assignment Is All Process Reward Model Needs for Reasoning

Jie Cheng, Gang Xiong, Ruixi Qiao, Lijun Li, Chao Guo, Junle Wang, Yisheng Lv, Fei-Yue Wang

机构 * State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(多模态人工智能系统国家重点实验室,自动化研究所,中国科学院) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Tencent(腾讯) Faculty of Innovation Engineering, Macau University of Science and Technology(澳门科技大学创新工程学院) DeSci Center of Parallel Intelligence, Obuda University(并行智能德Sci中心,奥布达大学) Research Center for Chinese Economics and Social Security, University of Chinese Academy of Sciences(中国经济社会安全研究中心,中国科学院大学) Institute of Automation, Chinese Academy of Sciences(自动化研究所,中国科学院)

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.AI、cs.LG

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15674 2025-10-20 cs.LG cs.AI 81%

CarBoN: Calibrated Best-of-N Sampling Improves Test-time Reasoning

Yung-Chen Tang, Pin-Yu Chen, Andrea Cavallaro

机构 * EPFL(瑞士联邦理工学院) Idiap Research Institute(Idiap研究所) IBM Research(IBM研究院)

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15444 2025-10-20 cs.LG cs.AI 81%

A Theoretical Study on Bridging Internal Probability and Self-Consistency for LLM Reasoning

Zhi Zhou, Yuhao Tan, Zenan Li, Yuan Yao, Lan-Zhe Guo, Yu-Feng Li, Xiaoxing Ma

机构 * State Key Laboratory of Novel Software Technology, Nanjing University, China(新型软件技术国家重点实验室,南京大学,中国) Department of Computer Science, ETH Zurich, Switzerland(苏黎世联邦理工学院计算机科学系,瑞士) School of Intelligence Science and Technology, Nanjing University, China(智能科学与技术学院,南京大学,中国) School of Artifical Intelligence, Nanjing University, China(人工智能学院,南京大学,中国)

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.AI、cs.LG

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07685 2025-10-10 cs.LG cs.CL 81%

LiveThinking: Enabling Real-Time Efficient Reasoning for AI-Powered Livestreaming via Reinforcement Learning

Yuhan Sun, Zhiwei Huang, Wanqing Cui, Shaopan Xiong, Yazhi Guo, Meiguang Jin, Junfeng Ma

机构 * Taobao \& Tmall Group of Alibaba Hangzhou Zhejiang China Taobao \& Tmall Group of Alibaba Beijing China ROLL Team of Alibaba Hangzhou Zhejiang China Taobao \& Tmall Group of Alibaba ROLL Team of Alibaba

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.CL、cs.LG

Comments 12 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04028 2025-10-07 cs.LG cs.AI 81%

The Debate on RLVR Reasoning Capability Boundary: Shrinkage, Expansion, or Both? A Two-Stage Dynamic View

Xinhao Yao, Lu Yu, Xiaolin Hu, Fengwei Teng, Qing Cui, Jun Zhou, Yong Liu

机构 * Renmin University of China(中国人民大学) Ant Group(蚂蚁集团) Xiamen University(厦门大学)

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01459 2025-10-03 cs.LG cs.CL 81%

LSPO: Length-aware Dynamic Sampling for Policy Optimization in LLM Reasoning

Weizhe Chen, Sven Koenig, Bistra Dilkina

机构 * University of Southern California(南加州大学) University of California, Irvine(加州大学尔湾分校)

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00768 2025-10-03 cs.AI cond-mat.mtrl-sci cs.CL 81%

Aligning Reasoning LLMs for Materials Discovery with Physics-aware Rejection Sampling

Lee Hyun, Sohee Yoon, Jinwoo Park, Sue In Chae, Seongeon Park, Jooyeon Ahn, Yebin Jung, Youjung Chung, Hogeun Chang, Sujin Park, Myeonginn Kang, Jina Kim, Ho-Gyeong Kim, Myeonghun Jeong

机构 * Materials AI Lab (AI Center), Samsung Electronics(材料AI实验室(AI中心),三星电子) Samsung Advanced Institute of Technology (SAIT)(三星先进技术研究所(SAIT))

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.CL、cs.AI

Comments 16 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25604 2025-10-01 cs.CL cs.LG 81%

RFG: Test-Time Scaling for Diffusion Large Language Model Reasoning with Reward-Free Guidance

Tianlang Chen, Minkai Xu, Jure Leskovec, Stefano Ermon

机构 * Stanford University(斯坦福大学)

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.CL、cs.LG

Comments 27 pages, 3 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18535 2025-09-30 cs.CL cs.LG 81%

TRACE Back from the Future: A Probabilistic Reasoning Approach to Controllable Language Generation

Gwen Yidou Weng, Benjie Wang, Guy Van den Broeck

机构 * ucla(美国加州大学洛杉矶分校)

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.CL、cs.LG

Comments Proceedings of the 42nd International Conference on Machine Learning (ICML). 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23291 2025-09-30 cs.CL cs.LG 81%

Scaling Policy Compliance Assessment in Language Models with Policy Reasoning Traces

Joseph Marvin Imperial, Harish Tayyar Madabushi

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22044 2025-09-29 cs.AI cs.CL 81%

A2R: An Asymmetric Two-Stage Reasoning Framework for Parallel Reasoning

Ziqi Wang, Boye Niu, Zhongli Li, Linghui Meng, Jing Liu, Zhi Zheng, Tong Xu, Hua Wu, Haifeng Wang, Enhong Chen

机构 * USTC(中国科学技术大学) Baidu(百度) USYD(悉尼大学)

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.CL、cs.AI

Comments 15 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18536 2025-09-24 cs.CL cs.AI 81%

CCQA: Generating Question from Solution Can Improve Inference-Time Reasoning in SLMs

Jin Young Kim, Ji Won Yoon

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.CL、cs.AI

Comments Published as a main conference paper at EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16201 2025-08-29 cs.CV cs.AI cs.CL 81%

SpecVLM: Enhancing Speculative Decoding of Video LLMs via Verifier-Guided Token Pruning

Yicheng Ji, Jun Zhang, Heming Xia, Jinpeng Chen, Lidan Shou, Gang Chen, Huan Li

机构 * The State Key Laboratory of Blockchain and Data Security(区块链与数据安全国家重点实验室) Hangzhou High-Tech Zone (Binjiang) Institute of Blockchain and Data Security(杭州高新技术区(滨江)区块链与数据安全研究院) Department of Computing, The Hong Kong Polytechnic University(香港理工大学计算机系) School of Computer Science, Beijing University of Posts and Telecommunications(北京邮电大学计算机学院)

专题命中 测试时计算 :verifier(title,abstract);分类 cs.CL、cs.AI

Comments Accepted at EMNLP 2025 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10024 2025-08-15 cs.CL cs.AI cs.IR 81%

RTTC: Reward-Guided Collaborative Test-Time Compute

J. Pablo Muñoz, Jinjie Yuan

机构 * Intel Labs Santa Clara, CA, USA(英特尔圣克拉拉实验室) Intel Corporation Beijing, China(英特尔北京公司)

专题命中 测试时计算 :test-time compute(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04204 2025-08-07 cs.CL cs.AI 81%

ReasoningGuard: Safeguarding Large Reasoning Models with Inference-time Safety Aha Moments

Yuquan Wang, Mi Zhang, Yining Wang, Geng Hong, Xiaoyu You, Min Yang

机构 * Fudan University(复旦大学) Shanghai University of Electric Power(上海电力大学) East China University of Science and Technology(东华大学)

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04348 2025-07-18 cs.AI cs.CL 81%

SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control

Xingyang He, Xiao Ling, Jie Liu

机构 * Xingyang He 1(He Xingyang 1) Xiao Ling 1(Ling Xiao 1) Jie Liu 1(Liu Jie 1)

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02592 2025-07-04 cs.CL cs.AI 81%

WebSailor: Navigating Super-human Reasoning for Web Agent

Kuan Li, Zhongwang Zhang, Huifeng Yin, Liwen Zhang, Litu Ou, Jialong Wu, Wenbiao Yin, Baixuan Li, Zhengwei Tao, Xinyu Wang, Weizhou Shen, Junkai Zhang, Dingchu Zhang, Xixi Wu, Yong Jiang, Ming Yan, Pengjun Xie, Fei Huang, Jingren Zhou

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13056 2025-06-27 cs.AI cs.CV cs.LG 81%

Metis-RISE: RL Incentivizes and SFT Enhances Multimodal Reasoning Model Learning

Haibo Qiu, Xiaohan Lan, Fanfan Liu, Xiaohu Sun, Delian Ruan, Peng Shi, Lin Ma

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.AI、cs.LG

Comments Project Page: https://github.com/MM-Thinking/Metis-RISE

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.19324 2025-06-27 cs.CL cs.AI 81%

Reward-Guided Speculative Decoding for Efficient LLM Reasoning

Baohao Liao, Yuhui Xu, Hanze Dong, Junnan Li, Christof Monz, Silvio Savarese, Doyen Sahoo, Caiming Xiong

机构 * Language Technology Lab, University of Amsterdam(阿姆斯特丹大学语言技术实验室) Salesforce AI Research(Salesforce人工智能研究)

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.CL、cs.AI

Comments 17 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09026 2025-06-16 cs.LG cs.CL 81%

e3: Learning to Explore Enables Extrapolation of Test-Time Compute for LLMs

Amrith Setlur, Matthew Y. R. Yang, Charlie Snell, Jeremy Greer, Ian Wu, Virginia Smith, Max Simchowitz, Aviral Kumar

专题命中 测试时计算 :test-time compute(title);reasoning(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03978 2025-06-10 cs.CL cs.LG 81%

Structured Pruning for Diverse Best-of-N Reasoning Optimization

Hieu Trung Nguyen, Bao Nguyen, Viet Anh Nguyen

机构 * The Chinese University of Hong Kong(香港中文大学)

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.CL、cs.LG

Comments Accepted to ACL Findings 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24864 2025-06-02 cs.CL cs.AI 81%

ProRL: Prolonged Reinforcement Learning Expands Reasoning Boundaries in Large Language Models

Mingjie Liu, Shizhe Diao, Ximing Lu, Jian Hu, Xin Dong, Yejin Choi, Jan Kautz, Yi Dong

机构 * NVIDIA

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.CL、cs.AI

Comments 26 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23474 2025-05-30 cs.AI cs.CL 81%

Socratic-PRMBench: Benchmarking Process Reward Models with Systematic Reasoning Patterns

Xiang Li, Haiyang Yu, Xinghua Zhang, Ziyang Huang, Shizhu He, Kang Liu, Jun Zhao, Fei Huang, Yongbin Li

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Tongyi Lab, Alibaba Group(阿里云实验室)

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23034 2025-05-30 cs.AI cs.LG 81%

Case-Based Reasoning Enhances the Predictive Power of LLMs in Drug-Drug Interaction

Guangyi Liu, Yongqi Zhang, Xunyuan Liu, Quanming Yao

机构 * Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20196 2025-05-27 cs.AI cs.LG 81%

Temporal Sampling for Forgotten Reasoning in LLMs

Yuetai Li, Zhangchen Xu, Fengqing Jiang, Bhaskar Ramasubramanian, Luyao Niu, Bill Yuchen Lin, Xiang Yue, Radha Poovendran

机构 * University of Washington(华盛顿大学) Carnegie Mellon University(卡内基梅隆大学) Western Washington University(西华盛顿大学)

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15134 2025-05-22 cs.LG cs.AI 81%

The Unreasonable Effectiveness of Entropy Minimization in LLM Reasoning

Shivam Agarwal, Zimin Zhang, Lifan Yuan, Jiawei Han, Hao Peng

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07891 2025-05-20 cs.LG cs.AI 81%

SpecReason: Fast and Accurate Inference-Time Compute via Speculative Reasoning

Rui Pan, Yinwei Dai, Zhihao Zhang, Gabriele Oliaro, Zhihao Jia, Ravi Netravali

机构 * Princeton University(普林斯顿大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23219 2025-04-01 eess.AS cs.AI cs.CV cs.LG 81%

Aurelia: Test-time Reasoning Distillation in Audio-Visual LLMs

Sanjoy Chowdhury, Hanan Gani, Nishit Anand, Sayan Nag, Ruohan Gao, Mohamed Elhoseiny, Salman Khan, Dinesh Manocha

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17587 2025-03-25 cs.LG cs.AI 81%

ConSol: Sequential Probability Ratio Testing to Find Consistent LLM Reasoning Paths Efficiently

Jaeyeon Lee, Guantong Qi, Matthew Brady Neeley, Zhandong Liu, Hyun-Hwan Jeong

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01385 2025-03-04 cs.CL cs.DB cs.LG 81%

Q-NL Verifier: Leveraging Synthetic Data for Robust Knowledge Graph Question Answering

Tim Schwabe, Louisa Siebel, Patrik Valach, Maribel Acosta

专题命中 测试时计算 :verifier(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏