arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 1129 信号源:cs.CL, cs.AI, cs.LG

1. 代码与定理证明 1129 篇

2506.13172 2025-06-18 cs.CL cs.AI 62%

AI-Facilitated Analysis of Abstracts and Conclusions: Flagging Unsubstantiated Claims and Ambiguous Pronouns

Evgeny Markhasin

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.16207 2025-06-10 cs.AI cs.CL cs.PL 62%

From Informal to Formal -- Incorporating and Evaluating LLMs on Natural Language Requirements to Verifiable Formal Proofs

Jialun Cao, Yaojie Lu, Meiziniu Li, Haoyang Ma, Haokun Li, Mengda He, Cheng Wen, Le Sun, Hongyu Zhang, Shengchao Qin, Shing-Chi Cheung, Cong Tian

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) Guangzhou Institute of Technology, Xidian University(西安电子科技大学广州研究院) Chongqing University(重庆大学) ICTT and ISN Laboratory, Xidian University(西安电子科技大学ICTT和ISN实验室)

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.06046 2025-05-30 cs.CR cs.AI cs.CL 62%

LLM for SoC Security: A Paradigm Shift

Dipayan Saha, Shams Tarek, Katayoon Yahyaei, Sujan Kumar Saha, Jingbo Zhou, Mark Tehranipoor, Farimah Farahmandi

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI

Comments 42 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13484 2025-05-21 cs.AI cs.CL 62%

Evaluating Large Language Models for Real-World Engineering Tasks

Rene Heesch, Sebastian Eilermann, Alexander Windmann, Alexander Diedrich, Philipp Rosenthal, Oliver Niggemann

机构 * Helmut Schmidt University(海德堡-哈雷大学)

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07107 2025-04-15 cs.CL cs.LG 62%

Training Neural Networks as Recognizers of Formal Languages

Alexandra Butoi, Ghazal Khalighinejad, Anej Svete, Josef Valvoda, Ryan Cotterell, Brian DuSell

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.LG

Comments 44 pages, 3 figures. ICLR 2025. Official camera-ready version; applies minor corrections to previous version

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16533 2025-03-24 cs.CL cs.AI 62%

From Patient Consultations to Graphs: Leveraging LLMs for Patient Journey Knowledge Graph Construction

Hassan S. Al Khatib, Sudip Mittal, Shahram Rahimi, Nina Marhamati, Sean Bozorgzad

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13508 2025-03-19 cs.CL cs.AI cs.CY 62%

It is Too Many Options: Pitfalls of Multiple-Choice Questions in Generative AI and Medical Education

Shrutika Singh, Anton Alyakin, Daniel Alexander Alber, Jaden Stryker, Ai Phuong S Tong, Karl Sangwon, Nicolas Goff, Mathew de la Paz, Miguel Hernandez-Rovira, Ki Yun Park, Eric Claude Leuthardt, Eric Karl Oermann

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI

Comments 14 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06366 2025-03-11 cs.LG cs.AI math.CO math.RT 62%

Machine Learning meets Algebraic Combinatorics: A Suite of Datasets Capturing Research-level Conjecturing Ability in Pure Mathematics

Herman Chau, Helen Jenne, Davis Brown, Jesse He, Mark Raugas, Sara Billey, Henry Kvinge

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI、cs.LG

Comments 26 pages, comments welcome

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05346 2025-03-10 cs.CL cs.AI cs.SE 62%

AutoIOT: LLM-Driven Automated Natural Language Programming for AIoT Applications

Leming Shen, Qiang Yang, Yuanqing Zheng, Mo Li

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.06209 2025-03-07 cs.LG cs.AI cs.LO 62%

LeanAgent: Lifelong Learning for Formal Theorem Proving

Adarsh Kumarappan, Mo Tiwari, Peiyang Song, Robert Joseph George, Chaowei Xiao, Anima Anandkumar

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00093 2025-03-04 cs.CY cs.AI cs.CL 62%

Rethinking LLM Bias Probing Using Lessons from the Social Sciences

Kirsten N. Morehouse, Siddharth Swaroop, Weiwei Pan

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.21290 2025-03-03 cs.AI cs.LG q-bio.QM 62%

Contextualizing biological perturbation experiments through language

Menghua Wu, Russell Littman, Jacob Levine, Lin Qiu, Tommaso Biancalani, David Richmond, Jan-Christian Huetter

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI、cs.LG

Comments The Thirteenth International Conference on Learning Representations (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18532 2025-02-27 cs.AI cs.LG 62%

CuDIP: Enhancing Theorem Proving in LLMs via Curriculum Learning-based Direct Preference Optimization

Shuming Shi, Ruobing Zuo, Gaolei He, Jianlin Wang, Chenyang Xu, Zhengfeng Yang

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.15797 2025-02-11 cs.LG cs.CL cs.IR 62%

LemmaHead: RAG Assisted Proof Generation Using Large Language Models

Tianbo Yang, Mingqi Yan, Hongyi Zhao, Tianshuo Yang

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09005 2025-01-09 cs.CR cs.AI cs.ET cs.GT cs.LG 62%

Proof-of-Learning with Incentive Security

Zishuo Zhao, Zhixuan Fang, Xuechao Wang, Xi Chen, Hongxu Su, Haibo Xiao, Yuan Zhou

专题命中 代码与定理证明 :verifier(abstract);分类 cs.AI、cs.LG

Comments 20 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01827 2025-01-06 cs.CL cs.AI 62%

The Proof is in the Almond Cookies

Remi van Trijp, Katrien Beuls, Paul Van Eecke

专题命中 代码与定理证明 :planning(abstract);分类 cs.CL、cs.AI

Journal ref In Steels, L. & Porzel, R. (eds). 2024. Narrative-based Understanding of Everyday Activities: A Cookbook. Venice: Venice International University. Pages 59-77

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11427 2024-12-24 cs.LG cs.AI 62%

Towards Scientific Discovery with Generative AI: Progress, Opportunities, and Challenges

Chandan K Reddy, Parshin Shojaee

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI、cs.LG

Comments AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10942 2024-12-17 cs.AI cs.LG 62%

Effective Generative AI: The Human-Algorithm Centaur

Soroush Saghafian, Lihi Idan

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI、cs.LG

Comments To Appear in SI: Future Shock, Harvard Data Science Review (https://hdsr.mitpress.mit.edu/specialissue5)

Journal ref Harvard Data Science Review (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06512 2024-12-10 cs.AI cs.CL cs.SE 62%

The Fusion of Large Language Models and Formal Methods for Trustworthy AI Agents: A Roadmap

Yedi Zhang, Yufan Cai, Xinyue Zuo, Xiaokun Luan, Kailong Wang, Zhe Hou, Yifan Zhang, Zhiyuan Wei, Meng Sun, Jun Sun, Jing Sun, Jin Song Dong

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI

Comments 24 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02975 2024-12-05 cs.LG cs.AI cs.CC cs.DS 62%

Theoretical limitations of multi-layer Transformer

Lijie Chen, Binghui Peng, Hongxun Wu

专题命中 代码与定理证明 :chain-of-thought(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03736 2024-11-26 cs.HC cs.AI cs.LG 62%

CliMB: An AI-enabled Partner for Clinical Predictive Modeling

Evgeny Saveliev, Tim Schubert, Thomas Pouplin, Vasilis Kosmoliaptsis, Mihaela van der Schaar

专题命中 代码与定理证明 :planning(abstract);分类 cs.AI、cs.LG

Comments * Evgeny Saveliev and Tim Schubert contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.12671 2024-11-20 cs.AI cs.CL cs.ET 62%

Neurosymbolic Graph Enrichment for Grounded World Models

Stefano De Giorgis, Aldo Gangemi, Alessandro Russo

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.12074 2024-11-20 cs.CL cs.LG 62%

Mitigating Gender Bias in Contextual Word Embeddings

Navya Yarrabelly, Vinay Damodaran, Feng-Guang Su

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.11595 2024-11-15 cs.CL cs.AI 62%

Examining Inter-Consistency of Large Language Models Collaboration: An In-depth Analysis via Debate

Kai Xiong, Xiao Ding, Yixin Cao, Ting Liu, Bing Qin

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2023 Findings Camera Ready Version

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.07428 2024-11-06 cs.GT cs.AI cs.LG 62%

GemNet: Menu-Based, Strategy-Proof Multi-Bidder Auctions Through Deep Learning

Tonghan Wang, Yanchen Jiang, David C. Parkes

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI、cs.LG

Comments This paper received the Exemplary Paper Award for the AI track at the Twenty-Fifth ACM Conference on Economics and Computation (ACM EC '24), where it appeared as an extended abstract; The first two authors contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.22642 2024-10-31 cs.CL cs.AI 62%

Prove Your Point!: Bringing Proof-Enhancement Principles to Argumentative Essay Generation

Ruiyu Xiao, Lei Wu, Yuhang Gou, Weinan Zhang, Ting Liu

专题命中 代码与定理证明 :planning(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.17503 2024-10-31 cs.SE cs.AI cs.CL cs.PL 62%

Code Repair with LLMs gives an Exploration-Exploitation Tradeoff

Hao Tang, Keya Hu, Jin Peng Zhou, Sicheng Zhong, Wei-Long Zheng, Xujie Si, Kevin Ellis

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.14219 2024-10-21 cs.AI cs.LG cs.LO 62%

Formal Explanations for Neuro-Symbolic AI

Sushmita Paul, Jinqiang Yu, Jip J. Dekker, Alexey Ignatiev, Peter J. Stuckey

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.01940 2024-10-15 cs.CL cs.LG cs.LO 62%

Process-Driven Autoformalization in Lean 4

Jianqiao Lu, Yingjia Wan, Zhengying Liu, Yinya Huang, Jing Xiong, Chengwu Liu, Jianhao Shen, Hui Jin, Jipeng Zhang, Haiming Wang, Zhicheng Yang, Jing Tang, Zhijiang Guo

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.LG

Comments 32 pages, 1 figures, 15 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.00830 2024-09-04 cs.AI cs.CL cs.IR 62%

Building FKG.in: a Knowledge Graph for Indian Food

Saransh Kumar Gupta, Lipika Dey, Partha Pratim Das, Ramesh Jain

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI

Comments 14 pages, 3 figures, 25 references, Formal Ontology in Information Systems Conference 2024 - Integrated Food Ontology Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏