arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-01-27 至 2026-01-27 共收录 13 信号源:cs.CL, cs.AI, cs.LG

1. 逻辑推理 13 篇

2512.21231 2026-01-27 cs.LG cond-mat.mtrl-sci 79%

MiST: Understanding the Role of Mid-Stage Scientific Training in Developing Chemical Reasoning Models

MiST:理解中期科学训练在开发化学推理模型中的作用

Andres M Bran, Tong Xie, Shai Pranesh, Jeffrey Meng, Xuan Vu Nguyen, Jeremy Goumaz, David Ming Segura, Ruizhi Xu, Dongzhan Zhou, Wenjie Zhang, Bram Hoex, Philippe Schwaller

机构 * Laboratory of Artificial Chemical Intelligence (LIAC), Institute of Chemical Sciences and Engineering (ISIC)(人工化学智能实验室(LIAC)、化学科学与工程研究所) National Centre of Competence in Research (NCCR) Catalysis(催化研究国家级竞争力中心) School of Photovoltaic and Renewable Energy engineering(光伏与可再生能源工程学院) School of Computer Science and Engineering(计算机科学与工程学院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Green Dynamics

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.LG

AI总结 MiST通过中期科学训练提升化学推理模型的潜在可解性,显著提高有机反应命名和无机材料生成任务的准确率,同时产生可解释的推理轨迹。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13470 2026-01-27 cs.CL 79%

Induce, Align, Predict: Zero-Shot Stance Detection via Cognitive Inductive Reasoning

诱导、对齐、预测:通过认知归纳推理实现零样本立场检测

Bowen Zhang, Jun Ma, Fuqiang Niu, Li Dong, Jinzhou Cao, Genan Dai

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.CL

AI总结 本文提出CIRF框架,通过认知归纳推理实现零样本立场检测,实现高效且可解释的推理,在低资源环境下取得新突破。

Comments Accepted at AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17426 2026-01-27 cs.AI cs.LO 79%

A Syllogistic Probe: Tracing the Evolution of Logic Reasoning in Large Language Models

直言探针:追踪大型语言模型中逻辑推理的演变

Zhengqing Zang, Yuqi Ding, Yanmei Gu, Changkai Song, Zhengkai Yang, Guoping Du, Junbo Zhao, Haobo Wang

机构 * Zhejiang University(浙江大学) University of Chinese Academy of Social Sciences(中国社会科学院大学) Ant Group(蚂蚁集团) Chinese Academy of Social Sciences(中国社会科学院)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本研究通过三段论测试揭示大型语言模型在逻辑推理演变中的特性,发现模型规模、思考机制和基础模型对逻辑发展有重要影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14932 2026-01-27 cs.AI 79%

FOL-Traces: Verified First-Order Logic Reasoning Traces at Scale

FOL-Traces: 在大规模上验证的首阶逻辑推理轨迹

Isabelle Lee, Sarah Liaw, Dani Yogatama

机构 * USC(美国大学) Harvard University(哈佛大学)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI

AI总结 FOL-Traces是一个大规模验证的首阶逻辑推理轨迹数据集,用于严格评估结构逻辑推理,通过挑战性任务揭示模型在语法意识和推理过程忠实度上的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18595 2026-01-27 cs.AI cs.LG 79%

A Balanced Neuro-Symbolic Approach for Commonsense Abductive Logic

一种平衡的神经符号方法用于常识归纳逻辑

Joseph Cotnareanu, Didier Chetelat, Yingxue Zhang, Mark Coates

机构 * McGill University(麦吉尔大学) Huawei Noah’s Ark Lab(华为诺亚实验室) International Laboratory on Learning Systems (ILLS)(学习系统国际实验室) MILA(蒙特利尔人工智能实验室)

专题命中 逻辑推理 :reasoning(abstract);planning(abstract);logical reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种平衡神经和符号方法,通过迭代增强逻辑问题中的常识关系,提升复杂推理任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17789 2026-01-27 cs.AI 77%

Neuro-Symbolic Verification on Instruction Following of LLMs

神经符号验证在大语言模型指令遵循上的应用

Yiming Su, Kunzhao Xu, Yanjie Gao, Fan Yang, Cheng Li, Mao Yang, Tianyin Xu

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Science and Technology of China(中国科学技术大学) Microsoft Research(微软研究院)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);verifier(abstract);分类 cs.AI

AI总结 本文提出NSVIF框架,通过神经符号方法验证大语言模型是否遵循指令,实验表明其在指令遵循验证中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18320 2026-01-27 cs.CL cs.AI cs.DB 62%

MultiVis-Agent: A Multi-Agent Framework with Logic Rules for Reliable and Comprehensive Cross-Modal Data Visualization

MultiVis-Agent:一种带有逻辑规则的多智能体框架,用于可靠且全面的跨模态数据可视化

Jinwei Lu, Yuanfeng Song, Chen Zhang, Raymond Chi-Wing Wong

机构 * The Hong Kong Polytechnic University(香港理工大学) The Hong Kong University of Science and Technology(香港科学与技术大学) The Hong Kong University of Science(香港科学大学)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 MultiVis-Agent通过引入逻辑规则的多智能体框架,提升多模态数据可视化的可靠性与全面性,实现高评分和高完成率。

Comments Accepted to SIGMOD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17260 2026-01-27 cs.LG cs.AI 62%

The Viscosity of Logic: Phase Transitions and Hysteresis in DPO Alignment

逻辑的粘度:DPO对齐中的相变与滞后效应

Marco Pollanen

机构 * Department of Mathematics, Trent University, Peterborough, ON, Canada(数学系,特伦特大学,彼得伯勒,加拿大)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 研究发现DPO对齐中β参数的非单调性及滞后效应,揭示能力与边际的反相关性,推动能力解析评估方法的发展。

Comments 10 Pages, 5 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14313 2026-01-27 cs.CL 57%

Teaching Small Language Models to Learn Logic through Meta-Learning

通过元学习让小型语言模型学习逻辑

Leonardo Bertolazzi, Manuel Vargas Guzmán, Raffaella Bernardi, Maciej Malicki, Jakub Szymanik

机构 * University of Trento(特伦托大学) University of Warsaw(华沙大学) Free University of Bozen-Bolzano(博兹纳-博尔扎诺自由大学)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.CL

AI总结 本文通过元学习方法提升小型语言模型在三段论推理任务中的逻辑推理能力,实验表明其在低数据环境下表现优于GPT-4o和o3-mini。

Comments EACL 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18096 2026-01-27 cs.IR 50%

Enhancing LLM-based Recommendation with Preference Hint Discovery from Knowledge Graph

基于知识图谱的偏好提示发现增强大语言模型推荐

Yuting Zhang, Ziliang Pei, Chao Wang, Ying Sun, Fuzhen Zhuang

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文提出基于知识图谱的偏好提示发现模型,通过提取关键属性作为提示,提升大语言模型在推荐任务中的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17833 2026-01-27 cs.CR 50%

An Effective and Cost-Efficient Agentic Framework for Ethereum Smart Contract Auditing

一种高效且成本效益高的以太坊智能合约审计代理框架

Xiaohui Hu, Wun Yu Chan, Yuejie Shi, Qumeng Sun, Wei-Cheng Wang, Chiachih Wu, Haoyu Wang, Ningyu He

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文提出Heimdallr,一种高效且低成本的智能合约审计代理,通过四个创新技术实现高精度检测,减少分析时间和成本,发现多个零日漏洞并保护大量资金。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17762 2026-01-27 cs.SE 50%

Multi-Agent End-to-End Vulnerability Management for Mitigating Recurring Vulnerabilities

多智能体端到端漏洞管理用于缓解重复漏洞

Zelong Zheng, Jiayuan Zhou, Xing Hu, Yi Gao, Shengyi Pan

专题命中 逻辑推理 :reasoning(abstract)

AI总结 MAVM通过多智能体框架实现端到端重复漏洞管理,整合知识库、检测、确认、修复和验证,有效提升漏洞修复准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.09862 2026-01-27 cs.HC cs.CY 50%

Rhetorical XAI: Explaining AI's Benefits as well as its Use via Rhetorical Design

修辞XAI:通过修辞设计解释AI的益处及其使用

Houjiang Liu, Yiheng Su, Matthew Lease

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文提出修辞XAI,通过整合logos、ethos、pathos三种修辞诉求,解决传统XAI在解释AI运作与使用价值间的设计缺口。

Comments Clarify the contextual positioning of our framework in relation to prior XAI design work and expand the review details

详情

展开后加载摘要…

URL PDF HTML 收藏