arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-02-09 至 2026-02-09 共收录 3 信号源:cs.CL, cs.AI, cs.LG

1. 逻辑推理 3 篇

2602.06687 2026-02-09 cs.CR 85%

Evaluating and Enhancing the Vulnerability Reasoning Capabilities of Large Language Models

评估和增强大型语言模型的漏洞推理能力

Li Lu, Yanjie Zhao, Hongzhou Rao, Kechi Zhang, Haoyu Wang

专题命中 逻辑推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract)

AI总结 DAGVul通过建模漏洞推理为有向无环图生成任务,提升大型语言模型在漏洞检测中的推理能力,实验显示其推理F1分数平均提高18.9%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16184 2026-02-09 cs.AI cs.HC 57%

Emergent Cognitive Convergence via Implementation: Structured Cognitive Loop Reflecting Four Theories of Mind

通过实现产生认知收敛:反映四种心灵理论的结构认知循环

Myung Ho Kim

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI

AI总结 Agentic Flow通过实现约束产生认知收敛,展现结构认知循环如何在实际需求下形成统一认知形式。

Comments This revised version improves conceptual consistency between Agentic Flow and the Structured Cognitive Loop (SCL; arXiv:2510.05107)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06325 2026-02-09 cs.CR cs.SE 50%

Identifying Adversary Tactics and Techniques in Malware Binaries with an LLM Agent

利用LLM代理识别恶意软件二进制中的攻击战术与技术

Zhou Xuan, Xiangzhe Xu, Mingwei Zheng, Louis Zheng-Hua Tan, Jinyao Guo, Tiantai Zhang, Le Yu, Chengpeng Wang, Xiangyu Zhang

专题命中 逻辑推理 :reasoning(abstract)

AI总结 TTPDetect通过结合密集检索与LLM神经检索,利用LLM代理识别恶意软件二进制中的TTPs,实现高精度和召回率。

详情

展开后加载摘要…

URL PDF HTML 收藏