arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2025-10-28 至 2025-10-28 共收录 26 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 26 篇

2510.22362 2025-10-28 cs.LG cs.CL 86%

Mapping Faithful Reasoning in Language Models

Jiazheng Li, Andreas Damianou, J Rosser, José Luis Redondo García, Konstantina Palla

机构 * King’s College London(伦敦国王学院) Spotify UK(Spotify英国分公司) University of Oxford(牛津大学) Spotify Spain(Spotify西班牙分公司)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.LG

Comments 9 pages, Accepted to the Mechanistic Interpretability Workshop at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13939 2025-10-28 cs.CV 85%

Med-R1: Reinforcement Learning for Generalizable Medical Reasoning in Vision-Language Models

Yuxiang Lai, Jike Zhong, Ming Li, Shitian Zhao, Yuheng Li, Konstantinos Psounis, Xiaofeng Yang

机构 * Department of Computer Science and Informatics, Emory University(计算机科学与信息学系,埃默里大学) Department of Computer Science and Department of Electrical and Computer Engineering, University of Southern California(计算机科学系和电气与计算机工程系,南加州大学) Department of Computer Science, University of Tokyo(计算机科学系,东京大学) Department of Computer Science, Johns Hopkins University(计算机科学系,约翰霍普金斯大学) Department of Biomedical Engineering, Georgia Institute of Technology and Emory University(生物医学工程系,佐治亚理工学院和埃默里大学)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19363 2025-10-28 cs.CL 83%

LoongRL: Reinforcement Learning for Advanced Reasoning over Long Contexts

Siyuan Wang, Gaokai Zhang, Li Lyna Zhang, Ning Shang, Fan Yang, Dongyao Chen, Mao Yang

机构 * Microsoft Research Asia(微软亚洲研究院) Shanghai Jiao Tong University(上海交通大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15510 2025-10-28 cs.CV cs.CL 83%

Visual Thoughts: A Unified Perspective of Understanding Multimodal Chain-of-Thought

Zihui Cheng, Qiguang Chen, Xiao Xu, Jiaqi Wang, Weiyun Wang, Hao Fei, Yidong Wang, Alex Jinpeng Wang, Zhi Chen, Wanxiang Che, Libo Qin

机构 * School of Computer Science and Engineering, Central South University(中南大学计算机科学与工程学院) Research Center for Social Computing and Interactive Robotics, Harbin Institute of Technology(哈尔滨工业大学社会计算与交互机器人研究中心) Institute of Computing and Intelligence, Harbin Institute of Technology, Shenzhen(哈尔滨工业大学深圳研究院计算与智能研究所) Text Computing and Cognitive Intelligence Ministry of Education Engineering Research Center, Guizhou University(贵州大学文字计算与认知智能教育部工程研究中心) Chinese University of Hong Kong(香港中文大学) Shanghai AI Laboratory(上海人工智能实验室) National University of Singapore(新加坡国立大学) Peking University(北京大学) ByteDance Seed (China)(字节跳动种子(中国))

专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);分类 cs.CL

Comments Accepted at NeurIPS 2025;

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.21309 2025-10-28 cs.CL cs.AI cs.LG 82%

Reasoning is Periodicity? Improving Large Language Models Through Effective Periodicity Modeling

Yihong Dong, Ge Li, Xue Jiang, Yongding Tao, Kechi Zhang, Hao Zhu, Huanyu Liu, Jiazheng Ding, Jia Li, Jinliang Deng, Hong Mei

机构 * School of Computer Science, Peking University(北京大学计算机学院) aiXcoder The Hong Kong University of Science and Technology(香港科学与技术大学) Advanced Institute of Big Data(大数据高级研究院)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to NeurIPS'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22832 2025-10-28 cs.AI cs.LG stat.ML 81%

HRM-Agent: Training a recurrent reasoning model in dynamic environments using reinforcement learning

Long H Dang, David Rawlinson

机构 * Melbourne, Australia(澳大利亚墨尔本) Cerenaut AI

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI、cs.LG

Comments 14 pages, 9 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21339 2025-10-28 cs.CL cs.IT cs.LG math.IT 81%

Multi-turn Training with Basic Human Feedback Helps Little on LLM Reasoning

Qiang Liu, Wuganjing Song, Zhenzhou Lin, Feifan Chen, Qiaolong Cai, Chen Li, Yongduo Sui

机构 * Tencent Interactive Entertainment(腾讯互动娱乐) The Hong Kong University of Science and Technology(香港理工大学) Sun Yat-sen University(中山大学)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08221 2025-10-28 cs.LG cs.CL 81%

Part I: Tricks or Traps? A Deep Dive into RL for LLM Reasoning

Zihe Liu, Jiashun Liu, Yancheng He, Weixun Wang, Jiaheng Liu, Ling Pan, Xinyu Hu, Shaopan Xiong, Ju Huang, Jian Hu, Shengyi Huang, Johan Obando-Ceron, Siran Yang, Jiamang Wang, Wenbo Su, Bo Zheng

机构 * Alibaba Group(阿里巴巴集团) Beijing Jiaotong University(北京交通大学) Hong Kong University of Science and Technology(香港理工大学) Nanjing University(南京大学) Peking University(北京大学) OpenRLHF CleanRL Mila

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.LG

Comments 26 pages, 21 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06607 2025-10-28 cs.CL cs.LG 81%

Decoder-Hybrid-Decoder Architecture for Efficient Reasoning with Long Generation

Liliang Ren, Congcong Chen, Haoran Xu, Young Jin Kim, Adam Atkinson, Zheng Zhan, Jiankai Sun, Baolin Peng, Liyuan Liu, Shuohang Wang, Hao Cheng, Jianfeng Gao, Weizhu Chen, Yelong Shen

机构 * Microsoft(微软公司) Stanford University(斯坦福大学)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.LG

Comments Accepted by NeurIPS 2025. Camera-ready Version

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22710 2025-10-28 cs.AI 79%

RaCoT: Plug-and-Play Contrastive Example Generation Mechanism for Enhanced LLM Reasoning Reliability

Kaitong Cai, Jusheng Zhang, Yijia Fan, Jing Yang, Keze Wang

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20014 2025-10-28 cs.CL 79%

Does Rationale Quality Matter? Enhancing Mental Disorder Detection via Selective Reasoning Distillation

Hoyun Song, Huije Lee, Jisu Shin, Sukmin Cho, Changgeon Ko, Jong C. Park

机构 * School of Computing(计算学院) Korea Advanced Institute of Science and Technology(韩国科学技术院)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11521 2025-10-28 cs.CR cs.AI 76%

Detecting Various DeFi Price Manipulations with LLM Reasoning

Juantao Zhong, Daoyuan Wu, Ye Liu, Maoyi Xie, Yang Liu, Yi Li, Ning Liu

机构 * Daoyuan Wu is the co-first author.(达元吴是共同第一作者) Ye Liu is the corresponding author.(叶刘是通讯作者)

专题命中 其他推理 :reasoning(title,comments);分类 cs.AI

Comments Accepted by ASE 2025. Please cite the conference version of this paper, e.g., "Juantao Zhong, Daoyuan Wu, Ye Liu, Maoyi Xie, Yang Liu, Yi Li, Ning Liu. Detecting Various DeFi Price Manipulations with LLM Reasoning. In 40th IEEE/ACM International Conference on Automated Software Engineering (ASE 2025)"

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23408 2025-10-28 cs.AI cs.DC cs.ET cs.LG cs.MA 62%

AutoStreamPipe: LLM Assisted Automatic Generation of Data Stream Processing Pipelines

Abolfazl Younesi, Zahra Najafabadi Samani, Thomas Fahringer

机构 * Departement of Computer Science, University of Innsbruck(因斯布鲁克大学计算机科学系)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI、cs.LG

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22993 2025-10-28 cs.LG cs.CL 62%

Can Language Models Compose Skills In-Context?

Zidong Liu, Zhuoyan Xu, Zhenmei Shi, Yingyu Liang

机构 * The University of Hong Kong(香港大学) University of Wisconsin-Madison(威斯康星大学麦迪逊分校)

专题命中 其他推理 :chain-of-thought(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22729 2025-10-28 cs.AI cs.CL 62%

Critical Insights into Leading Conversational AI Models

Urja Kohli, Aditi Singh, Arun Sharma

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI

Comments 21 pages, 7 tables, 3 figures. Open-access preprint intended for journal or conference submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22679 2025-10-28 cs.AI cs.CL 62%

Do Stop Me Now: Detecting Boilerplate Responses with a Single Iteration

Yuval Kainan, Shaked Zychlinski

机构 * JFrog

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI

Comments 13 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22467 2025-10-28 cs.LG cs.AI 62%

Backward-Friendly Optimization: Training Large Language Models with Approximate Gradients under Memory Constraints

Jing Yang, Kaitong Cai, Yijia Fan, Yufeng Yang, Keze Wang

机构 * Sun Yat-sen University(中山大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23659 2025-10-28 cs.CL cs.AI 62%

Aligning LLMs for Multilingual Consistency in Enterprise Applications

Amit Agarwal, Hansa Meghwani, Hitesh Laxmichand Patel, Tao Sheng, Sujith Ravi, Dan Roth

机构 * Oracle AI

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI

Comments Accepted at EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02366 2025-10-28 cs.LG cs.CL q-fin.TR 62%

Language Model Guided Reinforcement Learning in Quantitative Trading

Adam Darmanin, Vince Vella

机构 * University of Malta(马耳他大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.LG

Comments 12 pages (4 pages appendix and references) and 6 figures. Accepted for presentation at FLLM 2025, Vienna

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07830 2025-10-28 cs.CL cs.AI cs.SI 62%

MOSAIC: Modeling Social AI for Content Dissemination and Regulation in Multi-Agent Simulations

Genglin Liu, Vivian Le, Salman Rahman, Elisa Kreiss, Marzyeh Ghassemi, Saadia Gabriel

机构 * University of California, Los Angeles(加州大学洛杉矶分校) MIT CSAIL(麻省理工学院计算机科学与人工智能实验室)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI

Comments Accepted into EMNLP 2025 Main Conference, Oral Presentation

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10635 2025-10-28 cs.CV cs.AI cs.LG 62%

A Frustratingly Simple Yet Highly Effective Attack Baseline: Over 90% Success Rate Against the Strong Black-box Models of GPT-4.5/4o/o1

Zhaoyi Li, Xiaohan Zhao, Dong-Dong Wu, Jiacheng Cui, Zhiqiang Shen

机构 * VILA Lab, Department of Machine Learning, MBZUAI(VILA实验室,机器学习系,MBZUAI)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI、cs.LG

Comments NeurIPS 2025. Code at: https://github.com/VILA-Lab/M-Attack

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02103 2025-10-28 cs.CL 57%

Superficial Self-Improved Reasoners Benefit from Model Merging

Xiangchi Yuan, Chunhui Zhang, Zheyuan Liu, Dachuan Shi, Leyan Pan, Soroush Vosoughi, Wenke Lee

机构 * Georgia Institute of Technology(佐治亚理工学院) Dartmouth College(达特茅斯学院) University of Notre Dame(诺丁汉大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

Comments EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17394 2025-10-28 cs.CV cs.AI 57%

HiProbe-VAD: Video Anomaly Detection via Hidden States Probing in Tuning-Free Multimodal LLMs

Zhaolin Cai, Fan Li, Ziwei Zheng, Yanjun Qin

机构 * Xinjiang University(新疆大学) Xi'an Jiaotong University(西安交通大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

Comments Accepted by ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22070 2025-10-28 cs.LG cs.CV eess.IV stat.ML 57%

MAGIC-Flow: Multiscale Adaptive Conditional Flows for Generation and Interpretable Classification

Luca Caldera, Giacomo Bottacini, Lara Cavinato

机构 * MOX, Department of Mathematics Politecnico di Milano(米兰理工大学数学系MOX部门)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22892 2025-10-28 cs.RO cs.SY eess.SY 50%

Never Too Rigid to Reach: Adaptive Virtual Model Control with LLM- and Lyapunov-Based Reinforcement Learning

Jingzehua Xu, Yangyang Li, Yangfei Chen, Guanwen Xie, Shuai Zhang

机构 * Department of Engineering, University of Cambridge(剑桥大学工程系) Department of Electrical Engineering and Computer Science, Massachusetts Institute of Technology(麻省理工学院电气工程与计算机科学系) Zhejiang University-University of Illinois Urbana-Champaign Institute, Zhejiang University(浙江大学-伊利诺伊大学厄巴纳-香槟分校联合研究所) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际 Graduate School) Department of Data Science, New Jersey Institute of Technology(新泽西理工学院数据科学系)

专题命中 其他推理 :reasoning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08263 2025-10-28 cs.SE 50%

LLM-Based Detection of Tangled Code Changes for Higher-Quality Method-Level Bug Datasets

Md Nahidul Islam Opu, Shaowei Wang, Shaiful Chowdhury

专题命中 其他推理 :chain-of-thought(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏