arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 5849 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 5849 篇

2409.14673 2024-09-24 cs.CL cs.AI 73%

Instruction Tuning Vs. In-Context Learning: Revisiting Large Language Models in Few-Shot Computational Social Science

Taihang Wang, Xiaoman Xu, Yimin Wang, Ye Jiang

专题命中 其他推理 :chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.09239 2024-09-24 cs.CL cs.AI 73%

Autoregressive + Chain of Thought = Recurrent: Recurrence's Role in Language Models' Computability and a Revisit of Recurrent Transformer

Xiang Zhang, Muhammad Abdul-Mageed, Laks V. S. Lakshmanan

专题命中 其他推理 :reasoning(abstract);CoT(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.06023 2024-07-26 cs.CL cs.AI 73%

Distilling System 2 into System 1

Ping Yu, Jing Xu, Jason Weston, Ilia Kulikov

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.11349 2024-06-07 cs.CL cs.AI 73%

Language Models Don't Learn the Physical Manifestation of Language

Bruce W. Lee, JaeHyuk Lim

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI

Comments ACL 2024 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.11382 2024-06-07 cs.CL cs.AI 73%

Using Large Language Model for End-to-End Chinese ASR and NER

Yuang Li, Jiawei Yu, Min Zhang, Mengxin Ren, Yanqing Zhao, Xiaofeng Zhao, Shimin Tao, Jinsong Su, Hao Yang

专题命中 其他推理 :chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI

Comments 5 pages, 2 figures, Accepted to InterSpeech 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.11120 2024-05-21 cs.AI cs.LG 73%

Latent State Estimation Helps UI Agents to Reason

William E Bishop, Alice Li, Christopher Rawles, Oriana Riva

专题命中 其他推理 :reasoning(abstract);CoT(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.14662 2024-04-24 cs.LG cs.CL cs.PL cs.SE 73%

NExT: Teaching Large Language Models to Reason about Code Execution

Ansong Ni, Miltiadis Allamanis, Arman Cohan, Yinlin Deng, Kensen Shi, Charles Sutton, Pengcheng Yin

专题命中 其他推理 :chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.LG

Comments 35 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.09611 2024-04-22 cs.CV cs.CL cs.LG 73%

MM1: Methods, Analysis & Insights from Multimodal LLM Pre-training

Brandon McKinzie, Zhe Gan, Jean-Philippe Fauconnier, Sam Dodge, Bowen Zhang, Philipp Dufter, Dhruti Shah, Xianzhi Du, Futang Peng, Floris Weers, Anton Belyi, Haotian Zhang, Karanjeet Singh, Doug Kang, Ankur Jain, Hongyu Hè, Max Schwarzer, Tom Gunter, Xiang Kong, Aonan Zhang, Jianyu Wang, Chong Wang, Nan Du, Tao Lei, Sam Wiseman, Guoli Yin, Mark Lee, Zirui Wang, Ruoming Pang, Peter Grasch, Alexander Toshev, Yinfei Yang

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.03776 2024-03-04 cs.CL cs.AI 73%

Large Language Models As MOOCs Graders

Shahriar Golchin, Nikhil Garuda, Christopher Impey, Matthew Wenger

专题命中 其他推理 :chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI

Comments v1.3 preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.05736 2023-12-07 cs.CL cs.LG 73%

LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models

Huiqiang Jiang, Qianhui Wu, Chin-Yew Lin, Yuqing Yang, Lili Qiu

专题命中 其他推理 :chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.LG

Comments Accepted at EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.05028 2023-11-27 cs.AI cs.CL 73%

Revisiting Large Language Models as Zero-shot Relation Extractors

Guozheng Li, Peng Wang, Wenjun Ke

专题命中 其他推理 :chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI

Comments Findings of EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.10227 2023-11-20 cs.AI cs.CL 73%

Think Twice: Perspective-Taking Improves Large Language Models' Theory-of-Mind Capabilities

Alex Wilf, Sihyun Shawn Lee, Paul Pu Liang, Louis-Philippe Morency

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.07328 2023-10-23 cs.CL cs.AI 73%

An Empirical Study of Instruction-tuning Large Language Models in Chinese

Qingyi Si, Tong Wang, Zheng Lin, Xu Zhang, Yanan Cao, Weiping Wang

专题命中 其他推理 :chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.04663 2023-09-13 cs.CL cs.AI 73%

FIAT: Fusing learning paradigms with Instruction-Accelerated Tuning

Xinyi Wang, John Wieting, Jonathan H. Clark

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.08072 2023-07-27 cs.CL cs.AI 73%

Do Emergent Abilities Exist in Quantized Large Language Models: An Empirical Study

Peiyu Liu, Zikang Liu, Ze-Feng Gao, Dawei Gao, Wayne Xin Zhao, Yaliang Li, Bolin Ding, Ji-Rong Wen

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI

Comments 15 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22337 2026-08-25 cs.MM cs.CV cs.SD 新提交 71%

Motion-Aware Reasoning from Speech to Mask Tracks: Runner-up Solution for the MeViS-Audio Track of the 8th LSVOS Challenge 2026

从语音到掩码轨迹的运动感知推理:2026年第8届LSVOS挑战赛MeViS音频赛道亚军方案

Jinxing Zhou, Suiyi Zhao, Yanghao Zhou, Ruohao Guo

专题命中 其他推理 :reasoning(title)

AI总结 该研究提出Speech2MaskTrack方案,整合语音识别、运动定位等技术,在第8届LSVOS挑战赛MeViS音频赛道获亚军,实现语音引导的参考视频对象分割任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17279 2026-08-19 cs.CV 新提交 71%

Key-Frame Reasoning with SAM3: Third Place Solution for the MeViS-Text Track of the 8th LSVOS Challenge

基于SAM3的关键帧推理:第8届LSVOS挑战赛MeViS-Text赛道第三名解决方案

Ce Bian, Xusheng He, Jinrong Zhang, Canyang Wu, Xianjing Han, Jianlong Wu

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Nanyang Technological University(南洋理工大学) Shenzhen Loop Area Institute(深圳河套学院)

专题命中 其他推理 :reasoning(title)

AI总结 该研究提出两阶段无训练方案,依托Gemini-3.1 Pro分解视频事件选关键帧,用SAM3-agent生成掩码并双向传播,获第8届LSVOS挑战赛MeViS-Text赛道第三名。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04175 2026-08-06 cs.CV 新提交 71%

TriCLE: Tri-Modal Vision-Language Reasoning for Edge-Deployed Fine-Grained Clustering

TriCLE:面向边缘部署的细粒度聚类的三模态视觉-语言推理

Kishor Datta Gupta, Md. Mahfuzur Rahman, Fahad Rahman, Ahmed Rafi Hasan, Faysal Mehrab Chowdhury, Mohd Ariful Haque, Roy George

机构 * Clark Atlanta University(克拉克亚特兰大大学) United International University(国际大学) North South University(北南大学)

专题命中 其他推理 :reasoning(title)

AI总结 TriCLE是面向边缘部署的三模态视觉-语言系统,通过生成伪热视图和伪激光雷达深度,结合对齐策略实现细粒度飞机聚类,适配8GB内存边缘设备,验证与测试均取得良好性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27805 2026-07-31 nlin.CD cond-mat.dis-nn 新提交 71%

Chaos in reason: How chain-of-thought LLMs can look for an answer

理性中的混沌:思维链大语言模型(LLMs)如何探寻答案

Gregorio Jaca, Kristóf Benedek, János Török

专题命中 其他推理 :chain-of-thought(title)

AI总结 本研究将非线性动力学与混沌理论工具应用于思维链LLMs,证实其存在混沌标志性特征,明确各Transformer子模块对扰动的作用,揭示其与典型混沌系统的结构相似性及分形特性,指出注意力机制诱导的非线性耦合是混沌行为的关键驱动因素。

Comments 16 pages 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19547 2026-07-23 cs.CV eess.IV 新提交 71%

ChronoStitch: Training-Free Composition of Visual KV Memories for Long-Horizon Temporal Reasoning

ChronoStitch:用于长时程时间推理的视觉键值记忆的免训练组合

Santiram Tiwari, Nishant Sinha, Kunal Kislay

机构 * KGraph AI Solutions Pvt. Ltd.(KGraph人工智能解决方案私人有限公司)

专题命中 其他推理 :reasoning(title)

AI总结 针对长视频问答中视觉KV记忆组合问题,ChronoStitch提出免训练方法,先将键值重基于全局坐标系,解决几何不一致问题,再处理残余内容差距,通过选择性重新计算部分视觉令牌,提升事件排序准确性且运行速度更快。

Comments 6 pages, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09279 2026-07-13 cond-mat.dis-nn 新提交 71%

Transient Reserves, Sink Dampers, and the Failure of Eigenvalue Reasoning in the Attention Propagator

瞬态储备、汇阻尼器以及注意力传播器中特征值推理的失效

Li Hengyu

专题命中 其他推理 :reasoning(title)

AI总结 研究因果变压器注意力矩阵非正规性,通过预解式观点测试其对已训练变压器的预测。利用掩码和投影器分析,发现学习到的非正规性有符号,路由少数群体有瞬态储备,汇多数群体起阻尼作用,特征值预测误差大,预解式特征对相关特性至关重要。

Comments 17 pages, 8 figures. Companion paper: arXiv:2607.06621

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25021 2026-04-08 cs.CV 71%

VideoTIR: Accurate Understanding for Long Videos with Efficient Tool-Integrated Reasoning

VideoTIR:通过高效工具集成推理实现长视频的准确理解

Zhe Gao, Shiyu Shen, Taifeng Chai, Weinong Wang, Haotian Xu, Xing W, Wenbin Li, Qi Fan, Yang Gao, Dacheng Tao

机构 * Nanjing University(南京大学) Nankai University(南开大学) East China Normal University(华东师范大学) Tencent(腾讯) MiroMind Nanyang Technological University(南洋理工大学)

专题命中 其他推理 :reasoning(title)

AI总结 本文提出VideoTIR,通过强化学习优化工具调用策略,提升长视频理解的准确性和效率,结合零样本RL和SFT冷启动方法,减少冗余调用并生成高质量轨迹数据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15459 2026-03-17 cs.IR 71%

Financial Transaction Retrieval and Contextual Evidence for Knowledge-Grounded Reasoning

金融交易检索与上下文证据用于知识引导推理

Artem Sakhno, Daniil Tomilov, Yuliana Shakhvalieva, Inessa Fedorova, Daria Ruzanova, Omar Zoloev, Andrey Savchenko, Maksim Makarenko

专题命中 其他推理 :reasoning(title)

AI总结 本文提出FinTRACE框架,通过交易检索生成可重用的特征表示,结合规则检测器和行为知识库,提升低监督交易分析性能,并通过指令微调LLM实现交易分析的SOTA结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21626 2026-03-04 cs.DC 71%

Multi-Layer Scheduling for MoE-Based LLM Reasoning

多层调度用于基于MoE的LLM推理

Yifan Sun, Gholamreza Haffari, Minxian Xu, Rajkumar Buyya, Adel N. Toosi

专题命中 其他推理 :reasoning(title)

AI总结 本研究提出多层调度框架,针对基于MoE的LLM推理优化,通过请求、引擎和专家层面调度策略,提升吞吐量和效率,实验表明在TTFT和TPOT延迟上分别减少17.8%和13.3%。

Comments 12 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19343 2025-11-25 cs.CV 71%

Syn-GRPO: Self-Evolving Data Synthesis for MLLM Perception Reasoning

Syn-GRPO:面向多模态大语言模型感知推理的自进化数据合成

Qihan Huang, Haofei Zhang, Rong Wei, Yi Wang, Rui Tang, Mingli Song, Jie Song

机构 * Zhejiang University(浙江大学) Manycore Tech Inc.(Manycore科技公司)

专题命中 其他推理 :reasoning(title)

AI总结 Syn-GRPO通过自进化数据合成提升多模态大语言模型的感知推理能力,采用数据服务器与GRPO工作流协同生成高质量多样化训练数据,实验验证其在视觉感知任务中的优越性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16708 2025-10-31 cs.HC 71%

Performance and Metacognition Disconnect when Reasoning in Human-AI Interaction

Daniela Fernandes, Steeven Villa, Salla Nicholls, Otso Haavisto, Daniel Buschek, Albrecht Schmidt, Thomas Kosch, Chenxinran Shen, Robin Welsch

专题命中 其他推理 :reasoning(title)

Comments 27 pages, 10 figures, 6 tables

Journal ref Volume 175, February 2026, 108779

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.12469 2024-08-23 cs.CV 71%

Envisioning Class Entity Reasoning by Large Language Models for Few-shot Learning

Mushui Liu, Fangtai Wu, Bozheng Li, Ziqian Lu, Yunlong Yu, Xi Li

专题命中 其他推理 :reasoning(title)

Comments 9 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.01033 2023-10-31 cs.MA 71%

STV+AGR: Towards Practical Verification of Strategic Ability Using Assume-Guarantee Reasoning

Damian Kurpiewski, Łukasz Mikulski, Wojciech Jamroga

专题命中 其他推理 :reasoning(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
1906.11064 2019-06-27 cs.MA 71%

Reasoning about Hypothetical Agent Behaviours and their Parameters

Stefano V. Albrecht, Peter Stone

专题命中 其他推理 :reasoning(title)

Comments Proceedings of the 16th International Conference on Autonomous Agents and Multiagent Systems (AAMAS), 2017

详情

展开后加载摘要…

URL PDF HTML 收藏
1810.10591 2018-10-26 cs.MA 71%

Reasoning about Norms Revision

Davide Dell'Anna, Mehdi Dastani, Fabiano Dalpiaz

专题命中 其他推理 :reasoning(title)

Comments Appears in the preproceedings of the 29th Benelux Conference on Artificial Intelligence (BNAIC 2017), Groningen, The Netherlands, pp. 281 to 290

详情

展开后加载摘要…

URL PDF HTML 收藏