arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of California, Berkeley(加州大学伯克利分校)

2025-12-25 至 2025-12-25 共收录 2
2512.20647 2025-12-25 cs.AI

Reasoning Relay: Evaluating Stability and Interchangeability of Large Language Models in Mathematical Reasoning

推理中继:评估大型语言模型在数学推理中的稳定性与可替换性

Leo Lu, Jonathan Zhang, Sean Chua, Spencer Kim, Kevin Zhu, Sean O'Brien, Vasu Sharma

机构 * Pennsylvania State University(宾夕法尼亚州立大学) Binghamton University(宾夕法尼亚州立大学布林茅尔分校) University of Toronto(多伦多大学) UC Berkeley(加州大学伯克利分校) Algoverse

AI总结 本研究探讨大型语言模型在数学推理中的稳定性与可替换性,通过评估不同模型间推理链的延续性,揭示推理过程的可靠性和一致性。

Comments NeurIPS 2025 Workshop on Socially Responsible and Trustworthy Foundation Models (ResponsibleFM)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06489 2025-12-25 cs.LG stat.ML

Alternating Gradient Flows: A Theory of Feature Learning in Two-layer Neural Networks

交替梯度流:两层神经网络中特征学习的理论

Daniel Kunin, Giovanni Luca Marchetti, Feng Chen, Dhruva Karkada, James B. Simon, Michael R. DeWeese, Surya Ganguli, Nina Miolane

机构 * Stanford University(斯坦福大学) KTH(皇家理工学院) UC Berkeley(加州大学伯克利分校) Imbue(Imbue公司) UC Santa Barbara(加州大学圣塔芭芭拉分校)

AI总结 AGF理论框架揭示了两层神经网络中特征学习的动力学,通过交替梯度过程解释特征获取与损失下降的机制,并统一扩展了线性网络和注意力模型中的分析。

Comments 40 pages, 8 figures, NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏