arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-01-14 至 2026-01-14 共收录 9 信号源:cs.CL, cs.AI, cs.LG

1. 逻辑推理 9 篇

2601.08412 2026-01-14 cs.AI 83%

Hybrid Distillation with CoT Guidance for Edge-Drone Control Code Generation

混合指导的蒸馏用于边缘-无人机控制代码生成

Yizhan Feng, Hichem Snoussi, Yuhang Wang, Jing Teng, Abel Cherouat, Tian Wang

专题命中 逻辑推理 :CoT(title);reasoning(abstract);chain-of-thought(abstract);分类 cs.AI

AI总结 本文提出混合指导的蒸馏方法,通过知识蒸馏、思维链指导和监督微调,提升UAV多SDK控制任务的代码生成效率与准确性。

Comments 2nd International Conference on Drones and Unmanned Systems (DAUS' 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08440 2026-01-14 cs.CV 78%

Incentivizing Cardiologist-Like Reasoning in MLLMs for Interpretable Echocardiographic Diagnosis

激励MLLMs实现类似心内科医生的推理以实现可解释的超声心动图诊断

Yi Qin, Lehan Wang, Chenxu Zhao, Alex P. W. Lee, Xiaomeng Li

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 逻辑推理 :reasoning(title,abstract)

AI总结 本文提出CRT和CardiacMind,通过引入心内科医生的思维模式,提升MLLMs在超声心动图诊断中的推理能力,实现48%的诊断性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08169 2026-01-14 cs.CL cs.LG 73%

Relational Knowledge Distillation Using Fine-tuned Function Vectors

基于微调函数向量的关系知识蒸馏

Andrea Kang, Yingnian Wu, Hongjing Lu

机构 * University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.CL、cs.LG

AI总结 通过微调函数向量提升关系知识表示,增强语言模型的类比推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04727 2026-01-14 cs.AI cs.LG 73%

Sequential Enumeration in Large Language Models

大语言模型中的序列枚举

Kuinan Hou, Marco Zorzi, Alberto Testolin

机构 * University of Padova(帕多瓦大学)

专题命中 逻辑推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.AI、cs.LG

AI总结 本文研究了大语言模型在序列枚举任务中的能力,发现其在被提示时可部署计数程序,但无法自发进行计数,揭示了神经方法与符号方法在组合泛化上的差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08045 2026-01-14 cs.SE cs.HC 67%

Cognitive Biases in LLM-Assisted Software Development

大语言模型辅助软件开发中的认知偏差

Xinyi Zhou, Zeinadsadat Saghi, Sadra Sabouri, Rahul Pandita, Mollie McGuire, Souti Chattopadhyay

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract)

AI总结 本文研究了大语言模型辅助软件开发中的认知偏差,通过混合方法分析发现LLM相关行动更易产生新型偏差,并提出15种偏差类别及缓解建议。

Comments 13 pages, 6 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.06745 2026-01-14 cs.CV cs.AI 57%

Symbolic Rule Extraction from Attention-Guided Sparse Representations in Vision Transformers

从注意力引导的稀疏表示中提取符号规则

Parth Padalkar, Gopal Gupta

机构 * The University of Texas at Dallas(德克萨斯大学达拉斯分校)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出从视觉转换器中提取可执行逻辑程序的方法,通过稀疏概念层和逻辑程序生成算法提升模型的可解释性和可验证性。

Journal ref Theory and Practice of Logic Programming 25 (2025) 722-738

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08742 2026-01-14 cs.CL 57%

Inferring Latent Intentions: Attributional Natural Language Inference in LLM Agents

推断潜在意图:在LLM代理中进行归因性自然语言推理

Xin Quan, Jiafeng Xiong, Marco Valentino, André Freitas

机构 * University of Manchester(曼彻斯特大学) University of Sheffield(谢菲尔德大学) Idiap Research Institute(Idiap研究 institute) National Biomarker Centre, CRUK-MI, University of Manchester(国家生物标志物中心,CRUK-MI,曼彻斯特大学)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出归因性NLI框架,通过文本游戏实验展示其在多智能体环境中提升LLM推理能力的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07964 2026-01-14 cs.AI 57%

Executable Ontologies in Game Development: From Algorithmic Control to Semantic World Modeling

可执行本体在游戏开发中的应用:从算法控制到语义世界建模

Alexander Boldachev

专题命中 逻辑推理 :planning(abstract);分类 cs.AI

AI总结 本文提出利用可执行本体实现游戏开发中的语义世界建模,通过数据流条件实现任务中断,解决传统AI架构中的语义-过程鸿沟。

Comments 25 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19804 2026-01-14 cs.CL 57%

Compliance-to-Code: Enhancing Financial Compliance Checking via Code Generation

合规至代码:通过代码生成增强财务合规检查

Siyuan Li, Jian Chen, Rui Yao, Xuming Hu, Peilin Zhou, Weihua Qiu, Simin Zhang, Chucheng Dong, Zhiyao Li, Qipeng Xie, Zixuan Yuan

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Sun Yat-Sen University(孙中山大学) University of California, Riverside(加州大学河滨分校)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.CL

AI总结 Compliance-to-Code通过构建大规模中文金融监管数据集,提升金融合规检查的自动化水平,采用代码生成技术实现法规结构化和合规逻辑验证。

详情

展开后加载摘要…

URL PDF HTML 收藏