arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Pennsylvania(宾夕法尼亚大学)

2026-01-01 至 2026-01-01 共收录 3
2512.24587 2026-01-01 stat.ML cs.LG

MultiRisk: Multiple Risk Control via Iterative Score Thresholding

MultiRisk: 多风险控制 via 迭代分数阈值

Sunay Joshi, Yan Sun, Hamed Hassani, Edgar Dobriban

机构 * University of Pennsylvania(宾夕法尼亚大学) New Jersey Institute of Technology(新泽西理工学院)

AI总结 MultiRisk通过迭代分数阈值控制多个风险约束,利用动态规划算法实现对大型语言模型在安全约束下的有效控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24063 2026-01-01 cs.LG

How and Why LLMs Generalize: A Fine-Grained Analysis of LLM Reasoning from Cognitive Behaviors to Low-Level Patterns

LLMs如何泛化:从认知行为到低级模式的细粒度分析

Haoyue Bai, Yiyou Sun, Wenjie Hu, Shi Qiu, Maggie Ziyu Huan, Peiyang Song, Robert Nowak, Dawn Song

机构 * University of Wisconsin, Madison(威斯康星大学麦迪逊分校) University of California, Berkeley(加州大学伯克利分校) University of Pennsylvania(宾夕法尼亚大学) California Institute of Technology(加州理工学院)

AI总结 本文通过细粒度分析揭示LLMs在SFT和RL微调下的泛化差异,提出基于核心技能的基准测试,揭示RL模型在推理稳定性上的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03348 2026-01-01 cs.LG

Dolphin: A Programmable Framework for Scalable Neurosymbolic Learning

Dolphin:一种可编程的可扩展神经符号学习框架

Aaditya Naik, Jason Liu, Claire Wang, Amish Sethi, Saikat Dutta, Mayur Naik, Eric Wong

机构 * University of Pennsylvania(宾夕法尼亚大学) Cornell University(康奈尔大学)

AI总结 DOLPHIN是一种可编程框架,通过在CPU和GPU上分别执行符号推理和概率计算,实现神经符号学习的高效扩展,优于现有方法在复杂基准上的性能。

Journal ref Proceedings of the 42nd International Conference on Machine Learning, PMLR 267:45461-45483, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏