arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2025-12-01 至 2025-12-01 共收录 4 信号源:cs.CL, cs.AI, cs.LG

1. 逻辑推理 4 篇

2511.18531 2025-12-01 cs.CR cs.PL 78%

LockForge: Automating Paper-to-Code for Logic Locking with Multi-Agent Reasoning LLMs

LockForge: 基于多智能体推理LLM的逻辑锁纸到代码自动化

Akashdeep Saha, Zeng Wang, Prithwish Basu Roy, Johann Knechtel, Ozgur Sinanoglu, Ramesh Karri

专题命中 逻辑推理 :reasoning(title,abstract)

AI总结 LockForge通过多智能体推理LLM自动化将逻辑锁论文描述转换为可执行代码,解决可重复性难题,提供系统化验证框架和基准测试。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22151 2025-12-01 cs.AI 70%

A perceptual bias of AI Logical Argumentation Ability in Writing

人工智能逻辑论证能力在写作中的感知偏差

Xi Cun, Jifan Ren, Asha Huang, Siyu Li, Ruzhen Song

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.AI

AI总结 本研究探讨人类偏见如何影响对AI逻辑推理能力的评估,发现AI生成文本的评估受预设观念影响,且频繁AI用户更不认为AI削弱独立思考。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05613 2025-12-01 cs.AI 57%

Domain adaptation of large language models for geotechnical applications

大语言模型在地质应用中的领域适应

Lei Fan, Fangxue Liu, Cheng Chen

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI

AI总结 本文系统回顾了大语言模型在地质应用中的领域适应方法,分析了四种关键策略并评估其优劣,指出领域适应LLMs在提升推理准确性方面的作用,同时揭示数据稀缺和可解释性挑战等限制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09185 2025-12-01 cs.CV cs.AI 57%

A Neurosymbolic Framework for Interpretable Cognitive Attack Detection in Augmented Reality

面向增强现实的认知攻击检测的神经符号框架

Rongqian Chen, Allison Andreyev, Yanming Xiu, Joshua Chilukuri, Shunav Sen, Mahdi Imani, Bin Li, Maria Gorlatova, Gang Tan, Tian Lan

机构 * George Washington University(乔治华盛顿大学) Duke University(杜克大学) Pennsylvania State University(宾夕法尼亚州立大学) Northeastern University(东北大学)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出CADAR框架,结合神经网络与符号推理,用于增强现实中的认知攻击检测,通过多模态表示和统计推理提升检测的可解释性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏