A Variational Estimator for $L_p$ Calibration Errors
$L_p$校准误差的变分估计器
机构 * INRIA ; Ecole Normale Supérieure, PSL Research University(巴黎高等师范学院,PSL研究大学) ; UC Berkeley(加州大学伯克利分校)
AI总结 本文提出了一种基于变分框架的$L_p$校准误差估计方法,能够区分过高和过低自信,并避免过估计,通过实验验证其有效性。
作者
Machine Learning
$L_p$校准误差的变分估计器
机构 * INRIA ; Ecole Normale Supérieure, PSL Research University(巴黎高等师范学院,PSL研究大学) ; UC Berkeley(加州大学伯克利分校)
AI总结 本文提出了一种基于变分框架的$L_p$校准误差估计方法,能够区分过高和过低自信,并避免过估计,通过实验验证其有效性。
在线强化学习的样本复杂性:多模型视角
AI总结 本文从多模型视角探讨在线强化学习的样本复杂性,提出算法在不同动态系统中实现策略后悔的理论界,适用于非回合设定下的非线性动力系统。
Comments accepted at ICLR 2026; 37 pages, 6 figures