arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-02-25 至 2026-02-25 共收录 5 信号源:cs.CL, cs.AI, cs.LG

1. 逻辑推理 5 篇

2602.21044 2026-02-25 cs.AI 88%

LogicGraph : Benchmarking Multi-Path Logical Reasoning via Neuro-Symbolic Generation and Verification

LogicGraph : 通过神经符号生成与验证进行多路径逻辑推理的基准测试

Yanrui Wu, Lingling Zhang, Xinyu Zhang, Jiayu Chang, Pengyu Li, Xu Jiang, Jingtao Hu, Jun Liu

机构 * School of Computer Science and Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院) Department of Electrical Engineering, Stanford University(斯坦福大学电气工程系) School of Computer Science and Technology, Tiangong University(天津大学计算机科学与技术学院) Ministry of Education Key Laboratory of Intelligent Networks and Network Security, China(中国教育部长智网络与网络安全重点实验室) Shaanxi Province Key Laboratory of Big Data Knowledge Engineering, China(陕西省大数据知识工程重点实验室)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.AI

AI总结 LogicGraph通过神经符号生成与验证方法,系统评估多路径逻辑推理能力,揭示模型在复杂推理中探索多样路径的不足。

Comments 24 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03868 2026-02-25 cs.CL cs.AI cs.CR 73%

What Matters For Safety Alignment?

安全对齐中什么重要?

Xing Li, Hui-Ling Zhen, Lihao Yin, Xianzhi Yu, Zhenhua Dong, Mingxuan Yuan

机构 * Huawei Technologies Co., Ltd.(华为技术有限公司)

专题命中 逻辑推理 :reasoning(abstract);CoT(abstract);分类 cs.CL、cs.AI

AI总结 本文研究了安全对齐中关键因素,发现集成推理和自我反思机制的重要性,揭示了CoT攻击的高成功率及安全风险,强调了安全约束在模型训练中的必要性。

Comments Added more commercial model results, majority voting scores, and theoretical analysis in v2

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19768 2026-02-25 cs.CV 67%

TraceVision: Trajectory-Aware Vision-Language Model for Human-Like Spatial Understanding

TraceVision: 一种具有轨迹感知能力的视觉-语言模型,用于类人空间理解

Fan Yang, Shurong Zheng, Hongyin Zhao, Yufei Zhan, Xin Li, Yousong Zhu, Chaoyang Zhao Ming Tang, Jinqiao Wang

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract)

AI总结 TraceVision通过整合轨迹感知的空间理解,实现了类人空间认知,提升视觉-语言模型在轨迹引导任务中的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04867 2026-02-25 cs.AI cs.HC cs.LG cs.RO 62%

Sensory-Motor Control with Large Language Models via Iterative Policy Refinement

通过迭代策略优化实现大语言模型的感官-运动控制

Jônata Tyska Carvalho, Stefano Nolfi

机构 * Federal University of Santa Catarina (UFSC)(圣卡塔琳娜联邦大学) Institute of Cognitive Sciences and Technologies (ISTC-CNR)(认知科学与技术研究所)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出通过迭代策略优化,利用大语言模型控制具身代理,结合符号知识与子符号感官运动数据实现高效控制。

Comments Final version of the article accepted for publication on Scientific Reports. 29 pages (13 pages are from appendix), 8 figures, 2 tables, code for experiments replication and supplementary material provided at https://github.com/jtyska/llm-robotics-article/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20934 2026-02-25 cs.AI 57%

Architecting AgentOS: From Token-Level Context to Emergent System-Level Intelligence

构建AgentOS:从令牌级上下文到涌现的系统级智能

ChengYou Li, XiaoDong Liu, XiangBao Meng, XinYu Zhao

机构 * Yishu Research(亿舒研究) Fukuoka Institute of Technology(福冈技术学院) National University of Singapore(新加坡国立大学)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出AgentOS框架,通过重构LLM为推理内核,引入深度上下文管理和语义切片机制,旨在构建具备系统级智能的自主认知环境。

Comments 16 pages,9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏