MultiRisk: Multiple Risk Control via Iterative Score Thresholding
MultiRisk: 多风险控制 via 迭代分数阈值
机构 * University of Pennsylvania(宾夕法尼亚大学) ; New Jersey Institute of Technology(新泽西理工学院)
AI总结 MultiRisk通过迭代分数阈值控制多个风险约束,利用动态规划算法实现对大型语言模型在安全约束下的有效控制。
高校专区
MultiRisk: 多风险控制 via 迭代分数阈值
机构 * University of Pennsylvania(宾夕法尼亚大学) ; New Jersey Institute of Technology(新泽西理工学院)
AI总结 MultiRisk通过迭代分数阈值控制多个风险约束,利用动态规划算法实现对大型语言模型在安全约束下的有效控制。
LLMs如何泛化:从认知行为到低级模式的细粒度分析
机构 * University of Wisconsin, Madison(威斯康星大学麦迪逊分校) ; University of California, Berkeley(加州大学伯克利分校) ; University of Pennsylvania(宾夕法尼亚大学) ; California Institute of Technology(加州理工学院)
AI总结 本文通过细粒度分析揭示LLMs在SFT和RL微调下的泛化差异,提出基于核心技能的基准测试,揭示RL模型在推理稳定性上的优势。
Dolphin:一种可编程的可扩展神经符号学习框架
机构 * University of Pennsylvania(宾夕法尼亚大学) ; Cornell University(康奈尔大学)
AI总结 DOLPHIN是一种可编程框架,通过在CPU和GPU上分别执行符号推理和概率计算,实现神经符号学习的高效扩展,优于现有方法在复杂基准上的性能。
Journal ref Proceedings of the 42nd International Conference on Machine Learning, PMLR 267:45461-45483, 2025