arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2025-09-26 至 2025-09-26 共收录 7 信号源:cs.CL, cs.AI, cs.LG

1. 测试时计算 7 篇

2506.18896 2025-09-26 cs.CL 88%

ReasonFlux-PRM: Trajectory-Aware PRMs for Long Chain-of-Thought Reasoning in LLMs

Jiaru Zou, Ling Yang, Jingwen Gu, Jiahao Qiu, Ke Shen, Jingrui He, Mengdi Wang

机构 * UIUC(伊利诺伊大学香槟分校) Princeton University(普林斯顿大学) Cornell University(康奈尔大学) ByteDance(字节跳动)

专题命中 测试时计算 :reasoning(title,abstract);chain-of-thought(title,abstract);分类 cs.CL

Comments Accepted by NeurIPS 2025. Project: https://github.com/Gen-Verse/ReasonFlux

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21268 2025-09-26 cs.CV 85%

MMR1: Enhancing Multimodal Reasoning with Variance-Aware Sampling and Open Resources

Sicong Leng, Jing Wang, Jiaxi Li, Hao Zhang, Zhiqiang Hu, Boqiang Zhang, Yuming Jiang, Hang Zhang, Xin Li, Lidong Bing, Deli Zhao, Wei Lu, Yu Rong, Aixin Sun, Shijian Lu

机构 * Nanyang Technological University(南洋理工大学) DAMO Academy, Alibaba Group(阿里巴巴集团达摩院) Singapore University of Technology and Design(新加坡科技设计大学)

专题命中 测试时计算 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15882 2025-09-26 cs.LG cs.AI cs.CL eess.SP 85%

Fractional Reasoning via Latent Steering Vectors Improves Inference Time Compute

Sheng Liu, Tianlang Chen, Pan Lu, Haotian Ye, Yizheng Chen, Lei Xing, James Zou

机构 * Stanford University(斯坦福大学)

专题命中 测试时计算 :reasoning(title,abstract);test-time compute(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 18 pages, 5 figures, Project website: https://shengliu66.github.io/fractreason/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18056 2025-09-26 cs.CV 75%

TempSamp-R1: Effective Temporal Sampling with Reinforcement Fine-Tuning for Video LLMs

Yunheng Li, Jing Cheng, Shaoyong Jia, Hangyi Kuang, Shaohui Jiao, Qibin Hou, Ming-Ming Cheng

机构 * VCIP, School of Computer Science, Nankai University(VCIP,计算机科学学院,南开大学) ByteDance Inc.(字节跳动公司)

专题命中 测试时计算 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract)

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02495 2025-09-26 cs.CL cs.AI cs.LG 67%

Inference-Time Scaling for Generalist Reward Modeling

Zijun Liu, Peiyi Wang, Runxin Xu, Shirong Ma, Chong Ruan, Peng Li, Yang Liu, Yu Wu

机构 * DeepSeek-AI Dept. of Computer Sci. & Tech., Tsinghua University(计算机科学与技术系,清华大学) Institute for AI Industry Research (AIR), Tsinghua University(人工智能产业研究院(AIR),清华大学)

专题命中 测试时计算 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Preprint, under review. 44 pages. Models are available at https://huggingface.co/collections/BBQGOD/deepseek-grm-68b4681169dbb97fd30614b5 and https://www.modelscope.cn/collections/DeepSeek-GRM-ff6a2d8babdd4a

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20368 2025-09-26 cs.AI 57%

LATTS: Locally Adaptive Test-Time Scaling

Theo Uscidda, Matthew Trager, Michael Kleinman, Aditya Chattopadhyay, Wei Xia, Stefano Soatto

机构 * CREST-ENSAE, IP Paris(CREST-ENSAE,IP巴黎) AWS AI Labs(AWS人工智能实验室)

专题命中 测试时计算 :verifier(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03136 2025-09-26 cs.CL 57%

Co-Evolving LLM Coder and Unit Tester via Reinforcement Learning

Yinjie Wang, Ling Yang, Ye Tian, Ke Shen, Mengdi Wang

机构 * University of Chicago(芝加哥大学) Princeton University(普林斯顿大学) Peking University(北京大学) ByteDance Seed(字节跳动种子)

专题命中 测试时计算 :CoT(abstract);分类 cs.CL

Comments NeurIPS 2025 Spotlight. Project: https://github.com/Gen-Verse/CURE

详情

展开后加载摘要…

URL PDF HTML 收藏