arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-02-16 至 2026-02-16 共收录 4 信号源:cs.CL, cs.AI, cs.LG

1. 逻辑推理 4 篇

2602.12526 2026-02-16 cs.LG cs.CL 88%

Constraint-Rectified Training for Efficient Chain-of-Thought

约束校正训练用于高效的推理链

Qinhang Wu, Sen Lin, Ming Zhang, Yingbin Liang, Ness B. Shroff

机构 * The Ohio State University(俄亥俄州立大学) University of Houston(休斯顿大学) Google(谷歌)

专题命中 逻辑推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);self-correction(abstract)

AI总结 CRT通过约束校正训练提升推理效率,减少冗余并保持准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12889 2026-02-16 cs.CL 79%

BaziQA-Benchmark: Evaluating Symbolic and Temporally Compositional Reasoning in Large Language Models

BaziQA-Benchmark:评估大语言模型中的符号性和时间组合推理

Jiangxi Chen, Qian Liu

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.CL

AI总结 BaziQA-Benchmark通过结构化推理协议评估大语言模型在符号性和时间组合推理中的表现,揭示其在时间难度和推理顺序上的敏感性及系统性缺陷。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12669 2026-02-16 cs.PF 67%

Characterize LSM-tree Compaction Performance via On-Device LLM Inference

通过设备端LLM推理特性化LSM树压缩性能

Jiabiao Ding, Yina Lv, Qiao Li, Zhirong Shen, Chun Jason Xue

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract)

AI总结 本文通过设备端LLM推理特性化LSM树压缩性能,评估不同规模LLM在调优与延迟间的权衡,并针对RocksDB v8.8.1优化键压缩参数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12569 2026-02-16 cs.HC 50%

Editable XAI: Toward Bidirectional Human-AI Alignment with Co-Editable Explanations of Interpretable Attributes

可编辑的可解释性AI:通过可编辑的可解释属性实现双向人机对齐

Haoyang Chen, Jingwen Bai, Fang Tian, Brian Y Lim

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文提出可编辑的XAI方法CoExplain,通过允许用户编写规则来提升人机对齐,实验表明其在理解和控制方面优于传统只读XAI。

详情

展开后加载摘要…

URL PDF HTML 收藏