arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 5824 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 5824 篇

2505.24342 2025-12-19 cs.CV cs.CL 79%

VAEER: Visual Attention-Inspired Emotion Elicitation Reasoning

VAEER:基于视觉注意力的情感激发推理

Fanhang Man, Xiaoyue Chen, Huandong Wang, Baining Zhao, Han Li, Xinlei Chen

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) Peng Cheng Labotory(鹏城实验室)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL

AI总结 VAEER通过结合注意力启发的提示提取与知识引导推理,实现了多标签情绪激发,展示了在社交媒体和灾难图像上的高精度情绪预测能力。

Comments Currently under review as conference paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14118 2025-12-17 cs.CL 79%

CogMem: A Cognitive Memory Architecture for Sustained Multi-Turn Reasoning in Large Language Models

CogMem:一种用于大型语言模型中持续多轮推理的认知记忆架构

Yiran Zhang, Jincheng Hu, Mark Dras, Usman Naseem

机构 * Macquarie University(麦考瑞大学)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL

AI总结 CogMem通过引入认知启发的记忆增强架构,解决大型语言模型在多轮交互中的推理偏差、任务漂移和记忆衰减问题,提升推理的连贯性和可靠性。

Comments underreview

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12895 2025-12-16 cs.LG 79%

Wait, Wait, Wait... Why Do Reasoning Models Loop?

等等,等等,等等……为什么推理模型会循环?

Charilaos Pipis, Shivam Garg, Vasilis Kontonis, Vaishnavi Shrivastava, Akshay Krishnamurthy, Dimitris Papailiopoulos

机构 * MIT(麻省理工学院) Microsoft Research(微软研究院) University of Wisconsin-Madison(威斯康星大学麦迪逊分校)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.LG

AI总结 研究揭示了推理模型循环的原因,指出学习中的错误是关键因素,并提出温度调节和训练干预可减少循环现象。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06029 2025-12-16 cs.LG 79%

Lethe: Layer- and Time-Adaptive KV Cache Pruning for Reasoning-Intensive LLM Serving

Lethe:面向推理密集型大语言模型服务的层和时间自适应KV缓存剪枝

Hui Zeng, Daming Zhao, Pengfei Yang, WenXuan Hou, Tianyang Zheng, Hui Li, Weiye Ji, Jidong Zhai

专题命中 其他推理 :reasoning(title,abstract);分类 cs.LG

AI总结 Lethe通过引入时空自适应的KV缓存管理框架,在推理密集型大语言模型服务中实现高效的缓存剪枝,提升吞吐量的同时保持生成质量。

Comments aaai26 camera-ready version, 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08820 2025-12-10 cs.CV cs.AI 79%

Training-Free Dual Hyperbolic Adapters for Better Cross-Modal Reasoning

无需训练的双双曲适配器用于更高效的跨模态推理

Yi Zhang, Chun-Wun Cheng, Junyi He, Ke Yu, Yushun Tang, Carola-Bibiane Schönlieb, Zhihai He, Angelica I. Aviles-Rivero

机构 * College of Computer Science and Software Engineering, Shenzhen University(深圳大学计算机科学与软件工程学院) Department of Electrical and Electronic Engineering, Southern University of Science and Technology(南方科技大学电子与电气工程系) Department of Applied Mathematics and Theoretical Physics, University of Cambridge(剑桥大学应用数学与理论物理系) Yau Mathematical Sciences Center, Tsinghua University(清华大学应用数学中心)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本文提出无需训练的双双曲适配器方法,通过双曲空间嵌入提升跨模态推理性能,实现更高效的领域泛化和少样本识别。

Comments Accepted in IEEE Transactions on Multimedia (TMM)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07533 2025-12-09 cs.CR cs.AI 79%

VulnLLM-R: Specialized Reasoning LLM with Agent Scaffold for Vulnerability Detection

VulnLLM-R:基于代理架构的专用推理LLM用于漏洞检测

Yuzhou Nie, Hongwei Li, Chengquan Guo, Ruizhe Jiang, Zhun Wang, Bo Li, Dawn Song, Wenbo Guo

机构 * Department of Computer Science, University of California, Santa Barbara, CA, USA(加州大学圣芭芭拉分校计算机科学系) Department of Computer Science, University of Chicago, Chicago, IL, USA(芝加哥大学计算机科学系) Department of Electrical Engineering and Computer Sciences, University of California, Berkeley, CA, USA(加州大学伯克利分校电子工程与计算机科学系) Department of Computer Science, University of Illinois Urbana-Champaign, Champaign, IL, USA(伊利诺伊大学厄巴纳-香槟分校计算机科学系)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

AI总结 VulnLLM-R通过专用推理模型和代理架构,在漏洞检测中实现高效准确的AI驱动检测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13191 2025-12-09 cs.CL 79%

Grounding Long-Context Reasoning with Contextual Normalization for Retrieval-Augmented Generation

通过上下文归一化增强长上下文推理用于检索增强生成

Jiamin Chen, Yuchen Li, Xinyu Ma, Xinran Chen, Xiaokun Zhang, Shuaiqiang Wang, Chen Ma, Dawei Yin

机构 * City University of Hong Kong(香港城市大学) Baidu Inc.(百度公司)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL

AI总结 通过上下文归一化策略提升RAG在长上下文推理中的鲁棒性和稳定性

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.08519 2025-12-09 cs.CL 79%

Bridging Relevance and Reasoning: Rationale Distillation in Retrieval-Augmented Generation

弥合相关性与推理:检索增强生成中的推理蒸馏

Pengyue Jia, Derong Xu, Xiaopeng Li, Zhaocheng Du, Xiangyang Li, Yichao Wang, Yuhao Wang, Qidong Liu, Maolin Wang, Huifeng Guo, Ruiming Tang, Xiangyu Zhao

机构 * City University of Hong Kong(香港城市大学) University of Science and Technology of China(中国科学技术大学) Huawei Noah’s Ark Lab(华为诺亚实验室)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL

AI总结 RADIO通过推理提取和基于推理的对齐方法,弥合检索增强生成中重排器与生成器之间的相关性差距。

Comments Accepted to ACL 25 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05576 2025-12-08 cs.AI 79%

CureAgent: A Training-Free Executor-Analyst Framework for Clinical Reasoning

CureAgent:一种无需训练的执行-分析框架用于临床推理

Ting-Ting Xie, Yixin Zhang

机构 * Cambridge(剑桥)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

AI总结 CureAgent提出无需训练的执行-分析框架,通过模块化架构和分层集合策略提升临床推理性能,实现CURE-Bench上的最佳表现。

Comments 2nd Place Solution to the CURE-Bench Competition @ NeurIPS 2025. Code available at https://github.com/June01/CureAgent

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00601 2025-12-04 cs.AI 79%

Clinical-R1: Empowering Large Language Models for Faithful and Comprehensive Reasoning with Clinical Objective Relative Policy Optimization

Clinical-R1: 通过临床目标相对策略优化赋能大语言模型进行忠实且全面的推理

Boyang Gu, Hongjian Zhou, Bradley Max Segal, Jinge Wu, Zeyu Cao, Hantao Zhong, Lei Clifton, Fenglin Liu, David A. Clifton

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

AI总结 Clinical-R1通过CRPO方法提升大语言模型在医学领域的推理忠实性和全面性,实现多目标强化学习优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01878 2025-12-02 cs.AI 79%

Graph Distance as Surprise: Free Energy Minimization in Knowledge Graph Reasoning

图距离作为惊喜:知识图谱推理中的自由能最小化

Gaganpreet Jhajj, Fuhua Lin

机构 * School of Computing(计算学院) Information Systems(信息系统) Athabasca University(亚伯达大学)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本文提出利用图距离最小化惊喜来改进知识图谱推理,通过连接自由能原理与KG系统,探索图距离在生成模型中的应用及其对语法结构的影响。

Comments Accepted to NORA Workshop at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00722 2025-12-02 cs.AI 79%

SpeContext: Enabling Efficient Long-context Reasoning with Speculative Context Sparsity in LLMs

SpeContext: 通过推测上下文稀疏性在LLMs中实现高效的长上下文推理

Jiaming Xu, Jiayi Pan, Hanzhen Wang, Yongkang Zhou, Jiancai Ye, Yu Wang, Guohao Dai

机构 * Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

AI总结 SpeContext通过推测上下文稀疏性,在LLMs中实现高效的长上下文推理,显著提升云和边缘环境的吞吐量和速度,同时保持精度。

Comments Accepted by ASPLOS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21743 2025-12-01 cs.CL 79%

Scaling Competence, Shrinking Reasoning: Cognitive Signatures in Language Model Learning

提升能力,缩减推理:语言模型学习中的认知特征

Mukul Singh, Ananya Singha, Arjun Radhakrishna, Sumit Gulwani

机构 * Microsoft(微软)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL

AI总结 该研究通过分析语言模型推理标记的动态变化,揭示了模型在任务学习中的能力发展过程,并提出相关指标用于优化训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01088 2025-12-01 cs.CL 79%

Privacy-Preserving Reasoning with Knowledge-Distilled Parametric Retrieval Augmented Generation

基于知识蒸馏的参数化检索增强生成隐私保护推理

Jinwen Chen, Hainan Zhang, Liang Pang, Yongxin Tong, Haibo Zhou, Yuan Zhan, Wei Lin, Zhiming Zheng

机构 * Beijing Advanced Innovation Center for Future Blockchain and Privacy Computing(北京未来区块链与隐私计算先进创新中心) School of Artificial Intelligence, Beihang University(北京航空航天大学人工智能学院) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院) Meituan(美团)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL

AI总结 DistilledPRAG通过知识蒸馏实现高效参数化RAG,提升隐私保护推理的准确性和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14815 2025-11-27 cs.CL cs.IR 79%

Machine Reading Comprehension using Case-based Reasoning

基于案例推理的机器阅读理解

Dung Thai, Dhruv Agarwal, Mudit Chaudhary, Wenlong Zhao, Rajarshi Das, Manzil Zaheer, Jay-Yoon Lee, Hannaneh Hajishirzi, Andrew McCallum

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL

AI总结 基于案例推理的机器阅读理解方法在准确性和鲁棒性上优于基线模型,能有效识别正确答案及支持证据。

Comments 9 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05185 2025-11-24 cs.CL 79%

Concise Reasoning via Reinforcement Learning

通过强化学习实现简洁推理

Mehdi Fatemi, Banafsheh Rafiee, Mingjie Tang, Kartik Talamadupula

机构 * Wand AI

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL

AI总结 本文通过强化学习提出两阶段方法,减少推理响应长度同时保持准确性,并揭示错误答案驱动冗长的优化副作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12972 2025-11-24 cs.CV cs.AI 79%

Aligning Vision to Language: Annotation-Free Multimodal Knowledge Graph Construction for Enhanced LLMs Reasoning

对齐视觉与语言:无需注释的多模态知识图谱构建以增强大语言模型推理

Junming Liu, Siyuan Meng, Yanting Gao, Song Mao, Pinlong Cai, Guohang Yan, Yirong Chen, Zilin Bian, Ding Wang, Botian Shi

机构 * Tongji University(同济大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) East China Normal University(华东师范大学) Stanford University(斯坦福大学) New York University(纽约大学)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本文提出 VaLiK 方法,通过跨模态信息补充构建无需注释的多模态知识图谱,提升大语言模型推理能力。

Comments 14 pages, 7 figures, 6 tables; Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16664 2025-11-21 cs.CL 79%

Nemotron Elastic: Towards Efficient Many-in-One Reasoning LLMs

Nemotron弹性:迈向高效多任务推理LLM

Ali Taghibakhshi, Sharath Turuvekere Sreenivas, Saurav Muralidharan, Ruisi Cai, Marcin Chochowski, Ameya Sunil Mahabaleshwarkar, Yoshi Suhara, Oluwatobi Olabiyi, Daniel Korzekwa, Mostofa Patwary, Mohammad Shoeybi, Jan Kautz, Bryan Catanzaro, Ashwath Aithal, Nima Tajbakhsh, Pavlo Molchanov

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL

AI总结 Nemotron弹性通过嵌套子模型和多预算优化,实现高效多任务推理LLM,显著降低训练成本并提升部署效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07939 2025-11-19 cs.CR cs.LG 79%

Guided Reasoning in LLM-Driven Penetration Testing Using Structured Attack Trees

Katsuaki Nakano, Reza Fayyazi, Shanchieh Jay Yang, Michael Zuzak

机构 * Department of Electrical and Computer Engineering, Rochester Institute of Technology(罗切斯特理工学院电子与计算机工程系) Institute for Informatics and Applied Technology, Gonzaga University(贡萨加大学信息学与应用技术研究所)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01742 2025-11-18 cs.CV cs.AI 79%

Intention-Guided Cognitive Reasoning for Egocentric Long-Term Action Anticipation

Qiaohui Chu, Haoyu Zhang, Meng Liu, Yisen Feng, Haoxiang Shi, Liqiang Nie

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

Comments Accepted by AAAI-2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10381 2025-11-14 cs.CL 79%

Position: On the Methodological Pitfalls of Evaluating Base LLMs for Reasoning

Jason Chan, Zhixue Zhao, Robert Gaizauskas

机构 * University of Sheffield, UK(谢菲尔德大学)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09682 2025-11-14 cs.AI cs.SD 79%

Rebellion: Noise-Robust Reasoning Training for Audio Reasoning Models

Tiansheng Huang, Virat Shejwalkar, Oscar Chang, Milad Nasr, Ling Liu

机构 * Georgia Institute of Technology(佐治亚理工学院) Google(谷歌) OpenAI

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16905 2025-11-13 cs.AI 79%

MAPS: Multi-Agent Personality Shaping for Collaborative Reasoning

Jian Zhang, Zhiyuan Wang, Zhangqi Wang, Fangzhi Xu, Qika Lin, Lingling Zhang, Rui Mao, Erik Cambria, Jun Liu

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

Comments AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07912 2025-11-12 cs.AI 79%

Neurophysiological Characteristics of Adaptive Reasoning for Creative Problem-Solving Strategy

Jun-Young Kim, Young-Seok Kweon, Gi-Hwan Shin, Seong-Whan Lee

机构 * Dept. of Artificial Intelligence(人工智能系) Korea University(韩国大学) Dept. of Brain and Cognitive Engineering(脑科学与认知工程系)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

Comments 4 pages, 4 figures, 1 table,

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04432 2025-11-07 cs.CL 79%

If I Could Turn Back Time: Temporal Reframing as a Historical Reasoning Task for LLMs

Lars Bungum, Charles Yijia Huang, Abeer Kashar

机构 * NTNU Norway(挪威诺汉大学) University of Waterloo(滑铁卢大学)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL

Comments 8 pages, 1 figure, 3 tables, submitted to aconference

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01866 2025-11-05 cs.DC cs.AI cs.AR 79%

EdgeReasoning: Characterizing Reasoning LLM Deployment on Edge GPUs

Benjamin Kubwimana, Qijing Huang

机构 * NVIDIA

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

Comments Published in the Proceedings of the 2025 IEEE International Symposium on Workload Characterization (IISWC 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00536 2025-11-04 cs.CL 79%

Word Salad Chopper: Reasoning Models Waste A Ton Of Decoding Budget On Useless Repetitions, Self-Knowingly

Wenya Xie, Shaochen, Zhong, Hoang Anh Duy Le, Zhaozhuo Xu, Jianwen Xie, Zirui Liu

机构 * University of Minnesota(明尼苏达大学) Rice University(里士满大学) Stevens Institute of Technology(史蒂文斯理工学院) Lambda, Inc(Lambda公司)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00489 2025-11-04 cs.CL 79%

ToM: Leveraging Tree-oriented MapReduce for Long-Context Reasoning in Large Language Models

Jiani Guo, Zuchao Li, Jie Wu, Qianren Wang, Yun Li, Lefei Zhang, Hai Zhao, Yujiu Yang

机构 * School of Computer Science, Wuhan University, Wuhan, China(武汉大学计算机学院) School of Artificial Intelligence, Wuhan University, Wuhan, China(武汉大学人工智能学院) Tsinghua University(清华大学) Cognitive AI Lab(认知人工智能实验室) School of Computer Science, Shanghai Jiao Tong University, Shanghai, China(上海交通大学计算机学院)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL

Comments EMNLP 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13927 2025-11-04 eess.AS cs.AI cs.SD 79%

DSpAST: Disentangled Representations for Spatial Audio Reasoning with Large Language Models

Kevin Wilkinghoff, Zheng-Hua Tan

机构 * Department of Electronic Systems, Aalborg University, Denmark(电子系统系,奥尔堡大学,丹麦) Pioneer Centre for AI, Denmark(人工智能先锋中心,丹麦)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24388 2025-10-31 cs.CL 79%

ClueAnchor: Clue-Anchored Knowledge Reasoning Exploration and Optimization for Retrieval-Augmented Generation

Hao Chen, Yukun Yan, Sen Mei, Wanxiang Che, Zhenghao Liu, Qi Shi, Xinze Li, Yuchun Fan, Pengcheng Huang, Qiushi Xiong, Zhiyuan Liu, Maosong Sun

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏