arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-02-25 至 2026-02-25 共收录 3 信号源:cs.CL, cs.AI, cs.LG

1. 代码与定理证明 3 篇

2602.20973 2026-02-25 cs.CL 79%

Linear Reasoning vs. Proof by Cases: Obstacles for Large Language Models in FOL Problem Solving

线性推理与证明中的反证法:大型语言模型在一阶逻辑问题解决中的障碍

Yuliang Ji, Fuchen Shen, Jian Wu, Qiujie Xie, Yue Zhang

机构 * Nanjing University of Science and Technology(南京理工大学) Westlake University(西湖大学) Zhejiang University(浙江大学)

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.CL

AI总结 本文提出PC-FOL数据集,通过对比线性推理与基于情况的推理,揭示大型语言模型在FOL问题解决中的核心挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20624 2026-02-25 cs.AI cond-mat.stat-mech 57%

Physics-based phenomenological characterization of cross-modal bias in multimodal models

基于物理现象的多模态模型跨模态偏差表征

Hyeongmo Kim, Sohyun Kang, Yerin Choi, Seungyeon Ji, Junhyuk Woo, Hyunsuk Chung, Soyeon Caren Han, Kyungreem Han

机构 * B rain Science Institute(脑科学研究院) Korea Institute of Science and Technology(韩国科学技术院) Department of Physics and Astronomy(物理与天文学系) Department of Computer Science and Engineering(计算机科学与工程系) University of Science and Technology KIST School(科学技术KIST学院)

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

AI总结 本文提出基于物理现象的多模态模型跨模态偏差表征方法,揭示多模态输入可能强化模态主导性。

Comments Best Paper Award at BiasinAI track in AAAI2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11963 2026-02-25 cs.CR cs.AI 57%

MARVEL: Multi-Agent RTL Vulnerability Extraction using Large Language Models

MARVEL:基于大语言模型的多智能体RTL漏洞提取

Luca Collini, Baleegh Ahmad, Joey Ah-kiow, Ramesh Karri

机构 * NYU Tandon School of Engineering(纽约大学Tandon工程学院)

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

AI总结 MARVEL通过多智能体框架利用大语言模型,高效识别RTL代码中的安全漏洞,发现有效漏洞和警告,提升硬件安全验证效率。

Comments Submitted for Peer Review

详情

展开后加载摘要…

URL PDF HTML 收藏