arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 3246 信号源:cs.CL, cs.AI, cs.LG

1. 数学推理 3246 篇

2503.03746 2025-03-06 cs.CL cs.AI 62%

Process-based Self-Rewarding Language Models

Shimao Zhang, Xiao Liu, Xin Zhang, Junxiao Liu, Zheheng Luo, Shujian Huang, Yeyun Gong

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15820 2025-03-05 cs.AI cs.LG stat.ML 62%

Universal AI maximizes Variational Empowerment

Yusuke Hayashi, Koichi Takahashi

专题命中 数学推理 :planning(abstract);分类 cs.AI、cs.LG

Comments 9 pages, no figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01688 2025-03-04 cs.CL cs.LG 62%

When an LLM is apprehensive about its answers -- and when its uncertainty is justified

Petr Sychev, Andrey Goncharov, Daniil Vyazhev, Edvard Khalafyan, Alexey Zaytsev

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08964 2025-02-27 cs.CL cs.AI 62%

Language Imbalance Driven Rewarding for Multilingual Self-improving

Wen Yang, Junhong Wu, Chen Wang, Chengqing Zong, Jiajun Zhang

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

Comments Camera ready version for ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.09365 2025-02-25 cs.AI cs.CL 62%

Concept Distillation from Strong to Weak Models via Hypotheses-to-Theories Prompting

Emmanuel Aboah Boateng, Cassiano O. Becker, Nabiha Asghar, Kabir Walia, Ashwin Srinivasan, Ehi Nosakhare, Soundar Srinivasan, Victor Dibia

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

Comments Accepted to NAACL 2025; 17 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15838 2025-02-25 cs.AI cs.LG 62%

A novel approach to the relationships between data features -- based on comprehensive examination of mathematical, technological, and causal methodology

JaeHong Kim

专题命中 数学推理 :reasoning(abstract);分类 cs.AI、cs.LG

Comments 59 pages, 6 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.03642 2025-02-24 cs.CL cs.LG 62%

Is Free Self-Alignment Possible?

Dyah Adila, Changho Shin, Yijing Zhang, Frederic Sala

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12420 2025-02-20 cs.CL cs.AI 62%

Sens-Merging: Sensitivity-Guided Parameter Balancing for Merging Large Language Models

Shuqi Liu, Han Wu, Bowei He, Xiongwei Han, Mingxuan Yuan, Linqi Song

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00997 2025-02-18 cs.CL cs.AI 62%

MergeME: Model Merging Techniques for Homogeneous and Heterogeneous MoEs

Yuhang Zhou, Giannis Karamanolakis, Victor Soto, Anna Rumshisky, Mayank Kulkarni, Furong Huang, Wei Ai, Jianhua Lu

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

Comments Accepted by NAACL 2025 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.13144 2025-02-18 cs.AI cs.CL 62%

LLMs for Mathematical Modeling: Towards Bridging the Gap between Natural and Mathematical Languages

Xuhan Huang, Qingning Shen, Yan Hu, Anningzhe Gao, Benyou Wang

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

Comments Findings of NAACL2025. Project: https://github.com/FreedomIntelligence/Mamo

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07312 2025-02-12 cs.LG cs.AI 62%

OpenGrok: Enhancing SNS Data Processing with Distilled Knowledge and Mask-like Mechanisms

Lumen AI, Zaozhuang No. 28 Middle School, Shihao Ji, Zihui Song, Fucheng Zhong, Jisen Jia, Zhaobo Wu, Zheyi Cao, Tianhao Xu

专题命中 数学推理 :CoT(abstract);分类 cs.AI、cs.LG

Comments 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.09822 2025-02-11 cs.CL cs.AI 62%

Causal Inference with Large Language Model: A Survey

Jing Ma

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

Comments 12 pages, 2 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.14166 2025-02-10 cs.CL cs.AI 62%

LLM The Genius Paradox: A Linguistic and Math Expert's Struggle with Simple Word-based Counting Problems

Nan Xu, Xuezhe Ma

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

Comments NAACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.21009 2025-02-04 cs.AI cs.LG 62%

AI-Assisted Generation of Difficult Math Questions

Vedant Shah, Dingli Yu, Kaifeng Lyu, Simon Park, Jiatong Yu, Yinghui He, Nan Rosemary Ke, Michael Mozer, Yoshua Bengio, Sanjeev Arora, Anirudh Goyal

专题命中 数学推理 :reasoning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.05078 2025-01-10 cs.LG cs.AI 62%

Analyzing Memorization in Large Language Models through the Lens of Model Attribution

Tarun Ram Menta, Susmit Agrawal, Chirag Agarwal

专题命中 数学推理 :reasoning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.00059 2025-01-03 cs.CL cs.AI 62%

Large Language Models for Mathematical Analysis

Ziye Chen, Hao Qi

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.20891 2024-12-31 cs.CL cs.LG 62%

DoTA: Weight-Decomposed Tensor Adaptation for Large Language Models

Xiaolin Hu, Xiang Cheng, Peiyu Liu, Wei Liu, Jian Luan, Bin Wang, Yong Liu

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.LG

Comments 12 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.13690 2024-12-24 cs.CL cs.AI 62%

DART-Math: Difficulty-Aware Rejection Tuning for Mathematical Problem-Solving

Yuxuan Tong, Xiwen Zhang, Rui Wang, Ruidong Wu, Junxian He

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

Comments NeurIPS 2024. Data and model checkpoints are available at https://github.com/hkust-nlp/dart-math

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06289 2024-12-20 cs.LG cs.AI 62%

S$^{2}$FT: Efficient, Scalable and Generalizable LLM Fine-tuning by Structured Sparsity

Xinyu Yang, Jixuan Leng, Geyang Guo, Jiawei Zhao, Ryumei Nakada, Linjun Zhang, Huaxiu Yao, Beidi Chen

专题命中 数学推理 :reasoning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.06438 2024-12-17 cs.CV cs.CL cs.LG 62%

SOLO: A Single Transformer for Scalable Vision-Language Modeling

Yangyi Chen, Xingyao Wang, Hao Peng, Heng Ji

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.LG

Comments Accepted to TMLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09544 2024-12-13 cs.LG cs.AI math.OC math.ST stat.ML stat.TH 62%

Sail into the Headwind: Alignment via Robust Rewards and Dynamic Labels against Reward Hacking

Paria Rashidinejad, Yuandong Tian

专题命中 数学推理 :reasoning(abstract);分类 cs.AI、cs.LG

Comments 46 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06827 2024-12-11 cs.LG cs.AI 62%

Enhancing LLMs for Physics Problem-Solving using Reinforcement Learning with Human-AI Feedback

Avinash Anand, Kritarth Prasad, Chhavi Kirtani, Ashwin R Nair, Mohit Gupta, Saloni Garg, Anurag Gautam, Snehal Buldeo, Rajiv Ratn Shah

专题命中 数学推理 :reasoning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06176 2024-12-10 cs.LG cs.AI 62%

AlphaVerus: Bootstrapping Formally Verified Code Generation through Self-Improving Translation and Treefinement

Pranjal Aggarwal, Bryan Parno, Sean Welleck

专题命中 数学推理 :verifier(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01109 2024-12-06 cs.AI cs.CE cs.CL 62%

Mixing It Up: The Cocktail Effect of Multi-Task Fine-Tuning on LLM Performance -- A Case Study in Finance

Meni Brief, Oded Ovadia, Gil Shenderovitz, Noga Ben Yoash, Rachel Lemberg, Eitam Sheetrit

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.13729 2024-12-03 cs.CL cs.AI 62%

MathGLM-Vision: Solving Mathematical Problems with Multi-Modal Large Language Model

Zhen Yang, Jinhao Chen, Zhengxiao Du, Wenmeng Yu, Weihan Wang, Wenyi Hong, Zhihuan Jiang, Bin Xu, Jie Tang

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

Comments 30 pages,19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18226 2024-11-28 cs.SE cs.AI cs.LG cs.MA 62%

Feature-Factory: Automating Software Feature Integration Using Generative AI

Ruslan Idelfonso Magana Vsevolodovna

专题命中 数学推理 :planning(abstract);分类 cs.AI、cs.LG

Comments 14 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16489 2024-11-26 cs.CL cs.AI 62%

O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?

Zhen Huang, Haoyang Zou, Xuefeng Li, Yixiu Liu, Yuxiang Zheng, Ethan Chern, Shijie Xia, Yiwei Qin, Weizhe Yuan, Pengfei Liu

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16189 2024-11-26 cs.AI cs.CL cs.MA 62%

Enhancing Multi-Agent Consensus through Third-Party LLM Integration: Analyzing Uncertainty and Mitigating Hallucinations in Large Language Models

Zhihua Duan, Jialin Wang

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.20131 2024-11-19 cs.LG cs.CL 62%

Language Models Need Inductive Biases to Count Inductively

Yingshan Chang, Yonatan Bisk

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.02170 2024-11-18 cs.CL cs.AI cs.MA 62%

A Dynamic LLM-Powered Agent Network for Task-Oriented Agent Collaboration

Zijun Liu, Yanzhe Zhang, Peng Li, Yang Liu, Diyi Yang

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

Comments Published in COLM2024. Code Repo: https://github.com/SALT-NLP/DyLAN

详情

展开后加载摘要…

URL PDF HTML 收藏