arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-01-06 至 2026-01-06 共收录 10 信号源:cs.CL, cs.AI, cs.LG

1. 逻辑推理 10 篇

2601.01868 2026-01-06 cs.CL 86%

DermoGPT: Open Weights and Open Data for Morphology-Grounded Dermatological Reasoning MLLMs

DermoGPT: 开放权重和开放数据用于基于形态的皮肤病学推理大语言模型

Jinghan Ru, Siyuan Yan, Yuguo Yin, Yuexian Zou, Zongyuan Ge

机构 * School of Electronic and Computer Engineering, Peking University(电子与计算机工程学院,北京大学) Faculty of Information Technology, Monash University(信息科技学院,莫纳什大学)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title);分类 cs.CL

AI总结 DermoGPT通过开放权重和数据提升皮肤病学推理的MLLM性能,实现与专家诊断流程的一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02043 2026-01-06 cs.AI cs.CL 81%

Simulated Reasoning is Reasoning

模拟推理是推理

Hendrik Kempt, Alon Lavie

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 本文探讨了基础模型如何通过模仿思考过程实现推理,挑战了传统符号推理的必要性,并反思了推理模型的安全性和规范性问题。

Comments 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01490 2026-01-06 cs.CL cs.AI 81%

Distortion Instead of Hallucination: The Effect of Reasoning Under Strict Constraints

扭曲而非虚构:在严格约束下推理的影响

Junichiro Niimi

机构 * Meijo University(名古屋大学) RIKEN(日本研究机构) AIP(Advanced Institute for Propulsion)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 在严格约束下,推理模型通过扭曲事实来减少约束违反,但牺牲了输出的真实性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15401 2026-01-06 cs.CL cs.AI 81%

Problem-Solving Logic Guided Curriculum In-Context Learning for LLMs Complex Reasoning

基于问题解决逻辑的课程化上下文学习用于LLM复杂推理

Xuetao Ma, Wenbin Jiang, Hua Huang

机构 * School of Artificial Intelligence, Beijing Normal University(人工智能学院,北京师范大学)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 本研究提出基于问题解决逻辑的课程化上下文学习方法,通过分析问题解决逻辑选择和排序示例,提升LLM复杂推理能力。

Comments 19 pages, 6 figures, ACL 2025 findings, camera-ready version

Journal ref Findings of the Association for Computational Linguistics: ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01544 2026-01-06 cs.AI 79%

Causal Consistency Regularization: Training Verifiably Sensitive Reasoning in Large Language Models

因果一致性正则化:在大型语言模型中训练可验证的敏感推理

Sanjeda Akter, Ibne Farabi Shihab, Anuj Sharma

机构 * Department of Computer Science, Iowa State University(计算机科学系,爱荷华州立大学) Department of Civil, Construction & Environmental Engineering, Iowa State University(土木、建筑与环境工程系,爱荷华州立大学)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI

AI总结 CSR通过强制因果一致性提升大语言模型的推理忠实性,实现更可靠的结构化领域推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01875 2026-01-06 cs.AI q-bio.QM 79%

Toward Auditable Neuro-Symbolic Reasoning in Pathology: SQL as an Explicit Trace of Evidence

迈向病理学中的可审计神经符号推理:SQL作为证据的显式轨迹

Kewen Cao, Jianxu Chen, Yongbing Zhang, Ye Zhang, Hongxiao Wang

机构 * Capital Normal University, Beijing, China(首都师范大学) Leibniz-Institut für Analytische Wissenschaften-ISAS, Dortmund, Germany(莱比锡分析科学研究所-ISAS) Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学深圳校区)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本文提出一种基于SQL的神经符号推理框架,通过可执行的SQL轨迹实现病理分析的可审计性和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02021 2026-01-06 cs.NI 67%

AgentVNE: LLM-Augmented Graph Reinforcement Learning for Affinity-Aware Multi-Agent Placement in Edge Agentic AI

AgentVNE: 基于大语言模型的图强化学习用于面向亲和力的多智能体部署

Runze Zheng, Yuqing Zheng, Zhengyi Cheng, Long Luo, Haoxiang Luo, Gang Sun, Hongfang Yu, Dusit Niyato

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract)

AI总结 AgentVNE通过结合大语言模型与图强化学习,解决边缘智能体部署中的动态资源分配与亲和力约束问题,提升服务效率与响应速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01298 2026-01-06 cs.LG cs.AI cs.AR cs.DC cs.MA 62%

Warp-Cortex: An Asynchronous, Memory-Efficient Architecture for Million-Agent Cognitive Scaling on Consumer Hardware

Warp-Cortex: 一种异步、内存高效的用于百万智能体认知扩展的消费级硬件架构

Jorge L. Ruiz Williams

机构 * Warp Research(Warp研究)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 Warp-Cortex通过异步架构和内存优化技术,实现百万智能体在消费级硬件上的高效认知扩展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02008 2026-01-06 cs.AI cs.CV 57%

XAI-MeD: Explainable Knowledge Guided Neuro-Symbolic Framework for Domain Generalization and Rare Class Detection in Medical Imaging

XAI-MeD: 可解释知识引导的神经符号框架用于医学影像中的领域泛化和稀有类别检测

Midhat Urooj, Ayan Banerjee, Sandeep Gupta

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI

AI总结 XAI-MeD通过整合临床知识的神经符号框架,提升医学影像中领域泛化和稀有类别检测的性能,实现更鲁棒和可解释的多模态医学AI。

Comments Accepted at AAAI Bridge Program 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01101 2026-01-06 cs.CY 50%

An Agentic Software Framework for Data Governance under DPDP

基于DPDP的数据治理代理软件框架

Apurva Kulkarni, Chandrashekar Ramanathan

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文提出基于DPDP的数据治理代理框架,通过协作代理和动态政策执行实现透明、合规的数据治理。

详情

展开后加载摘要…

URL PDF HTML 收藏