2508.01604 2025-08-05 cs.LG 86% Enhancing Math Reasoning in Small-sized LLMs via Preview Difficulty-Aware Intervention Xinhan Di, JoyJiaoW 机构 * Independent, Researcher, China(中国独立研究者) 纠错 专题命中 数学推理 :reasoning(title,abstract);math reasoning(title);分类 cs.LG Comments 7 pages, 1 table, accepted by SIM ICML@2025 Workshop 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2508.01773 2025-08-05 cs.AI cs.CL 81% Uncertainty-Based Methods for Automated Process Reward Data Construction and Output Aggregation in Mathematical Reasoning Jiuzhou Han, Wray Buntine, Ehsan Shareghi 专题命中 数学推理 :reasoning(title,abstract);分类 cs.CL、cs.AI 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2508.00912 2025-08-05 cs.LG cs.AI cs.CR 81% Predictive Auditing of Hidden Tokens in LLM APIs via Reasoning Length Estimation Ziyao Wang, Guoheng Sun, Yexiao He, Zheyu Shen, Bowei Tian, Ang Li 机构 * University of Maryland, College Park(马里兰大学学院公园分校) 纠错 专题命中 数学推理 :reasoning(title,abstract);分类 cs.AI、cs.LG 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2507.22940 2025-08-05 cs.CL cs.AI 81% Trustworthy Reasoning: Evaluating and Enhancing Factual Accuracy in LLM Intermediate Thought Processes Rui Jiao, Yue Zhang, Jinku Li 机构 * School of Cyber Engineering, Xidian University(西安电子科技大学电子工程学院) ; School of Computer Science and Technology, Shandong University(山东大学计算机科学与技术学院) 纠错 专题命中 数学推理 :reasoning(title,abstract);分类 cs.CL、cs.AI 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2508.02587 2025-08-05 cs.LG cs.AI cs.CL 75% Parameter-Efficient Routed Fine-Tuning: Mixture-of-Experts Demands Mixture of Adaptation Modules Yilun Liu, Yunpu Ma, Yuetian Lu, Shuo Chen, Zifeng Ding, Volker Tresp 机构 * Technical University of Munich(慕尼黑技术大学) ; Ludwig Maximilian University of Munich(慕尼黑路德维希-马克西米利安大学) ; University of Cambridge(剑桥大学) 纠错 专题命中 数学推理 :reasoning(abstract);math reasoning(abstract);分类 cs.CL、cs.AI、cs.LG Comments This paper is a preprint under review. arXiv admin note: text overlap with arXiv:2411.08212 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2508.02076 2025-08-05 cs.AI cs.GT 70% Everyone Contributes! Incentivizing Strategic Cooperation in Multi-LLM Systems via Sequential Public Goods Games Yunhao Liang, Yuan Qu, Jingyuan Yang, Shaochong Lin, Zuo-Jun Max Shen 专题命中 数学推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.AI 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2504.07448 2025-08-05 cs.LG cs.AI cs.CL 67% LoRI: Reducing Cross-Task Interference in Multi-Task Low-Rank Adaptation Juzheng Zhang, Jiacheng You, Ashwinee Panda, Tom Goldstein 机构 * University of Maryland(马里兰大学) ; Tsinghua University(清华大学) 纠错 专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG Comments COLM 2025 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2501.05727 2025-08-05 cs.CL cs.AI cs.LG 67% Self-Evolving Critique Abilities in Large Language Models Zhengyang Tang, Ziniu Li, Zhenyang Xiao, Tian Ding, Ruoyu Sun, Benyou Wang, Dayiheng Liu, Fei Huang, Tianyu Liu, Bowen Yu, Junyang Lin 机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) ; Shenzhen Research Institute of Big Data(深圳大数据研究院) ; Shenzhen International Center for Industrial and Applied Mathematics(深圳国际工业与应用数学中心) ; Qwen Team, Alibaba Inc.(阿里云通义团队) 纠错 专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG Comments Accepted by COLM 2025 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2505.13026 2025-08-05 cs.LG cs.AI 62% Step-wise Adaptive Integration of Supervised Fine-tuning and Reinforcement Learning for Task-Specific LLMs Jack Chen, Fazhong Liu, Naruto Liu, Yuhan Luo, Erqu Qin, Harry Zheng, Tian Dong, Haojin Zhu, Yan Meng, Xiao Wang 专题命中 数学推理 :reasoning(abstract);分类 cs.AI、cs.LG 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图