arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2025-09-29 至 2025-09-29 共收录 7 信号源:cs.CL, cs.AI, cs.LG

1. 测试时计算 7 篇

2509.21459 2025-09-29 cs.CL cs.AI cs.DB cs.LG 82%

A State-of-the-Art SQL Reasoning Model using RLVR

Alnur Ali, Ashutosh Baheti, Jonathan Chang, Ta-Chung Chi, Brandon Cui, Andrew Drozdov, Jonathan Frankle, Abhay Gupta, Pallavi Koppol, Sean Kulinski, Jonathan Li, Dipendra Misra, Krista Opsahl-Ong, Jose Javier Gonzalez Ortiz, Matei Zaharia, Yue Zhang

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22044 2025-09-29 cs.AI cs.CL 81%

A2R: An Asymmetric Two-Stage Reasoning Framework for Parallel Reasoning

Ziqi Wang, Boye Niu, Zhongli Li, Linghui Meng, Jing Liu, Zhi Zheng, Tong Xu, Hua Wu, Haifeng Wang, Enhong Chen

机构 * USTC(中国科学技术大学) Baidu(百度) USYD(悉尼大学)

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.CL、cs.AI

Comments 15 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23621 2025-09-29 cs.CL 79%

Table-R1: Inference-Time Scaling for Table Reasoning

Zheyuan Yang, Lyuhao Chen, Arman Cohan, Yilun Zhao

机构 * Yale NLP Lab(耶鲁大学自然语言处理实验室) Carnegie Mellon University(卡内基梅隆大学)

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.CL

Comments EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12663 2025-09-29 cs.CL 79%

Demystifying Multilingual Chain-of-Thought in Process Reward Modeling

Weixuan Wang, Minghao Wu, Barry Haddow, Alexandra Birch

机构 * School of Informatics, University of Edinburgh(爱丁堡大学信息学院) Monash University(墨尔本大学)

专题命中 测试时计算 :chain-of-thought(title);reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22101 2025-09-29 cs.CL 77%

Think Right, Not More: Test-Time Scaling for Numerical Claim Verification

Primakov Chungkham, V Venktesh, Vinay Setty, Avishek Anand

机构 * TU Delft(代尔夫特理工大学) Stockholm University(斯德哥尔摩大学) University of Stavanger(斯塔万内尔大学)

专题命中 测试时计算 :reasoning(abstract);test-time compute(abstract);verifier(abstract);分类 cs.CL

Comments Accepted to EMNLP 2025, 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01456 2025-09-29 cs.LG cs.AI cs.CL 67%

Process Reinforcement through Implicit Rewards

Ganqu Cui, Lifan Yuan, Zefan Wang, Hanbin Wang, Yuchen Zhang, Jiacheng Chen, Wendi Li, Bingxiang He, Yuchen Fan, Tianyu Yu, Qixin Xu, Weize Chen, Jiarui Yuan, Huayu Chen, Kaiyan Zhang, Xingtai Lv, Shuo Wang, Yuan Yao, Xu Han, Hao Peng, Yu Cheng, Zhiyuan Liu, Maosong Sun, Bowen Zhou, Ning Ding

机构 * Shanghai AI Lab(上海人工智能实验室) Tsinghua University(清华大学) University of Illinois Urbana-Champaign(伊利诺伊大学香槟分校) Peking University(北京大学) Shanghai Jiaotong University(上海交通大学) CUHK(香港中文大学)

专题命中 测试时计算 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 24 pages. Model&Code&Data available at https://github.com/PRIME-RL/PRIME

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21403 2025-09-29 cs.LG cs.CL 62%

LLMs for Bayesian Optimization in Scientific Domains: Are We There Yet?

Rushil Gupta, Jason Hartford, Bang Liu

机构 * DIRO, Université de Montréal & Institut Courtois(蒙特利尔大学DIRO与Courtois研究所) Mila - Quebec AI Institute(魁北克人工智能研究所) The University of Manchester(曼彻斯特大学) Valence Labs(Valence实验室) Canada CIFAR AI Chair(加拿大CIFAR人工智能主席)

专题命中 测试时计算 :reasoning(abstract);分类 cs.CL、cs.LG

Comments Accepted to EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏