arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

International Conference on Machine Learning · 会议 · Machine Learning

2025-12-25 至 2025-12-25 共收录 3
2110.03155 2025-12-25 cs.LG

Intrinsic Benefits of Categorical Distributional Loss: Uncertainty-aware Regularized Exploration in Reinforcement Learning

类别分布损失的内在优势:强化学习中的不确定性感知正则化探索

Ke Sun, Yingnan Zhao, Enze Shi, Yafei Wang, Xiaodong Yan, Bei Jiang, Linglong Kong

机构 * University of Alberta, Canada(阿尔伯塔大学) Harbin Engineering University, China(哈尔滨工程大学) Xi’an Jiaotong University, China(西安交通大学)

AI总结 本文提出了一种基于类别分布损失的不确定性感知正则化方法,通过增强奖励信号提升强化学习的探索效率。

Comments NeurIPS 2025; Previous Version in ICML Workshop: Exploration in AI Today (EXAIT) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20631 2025-12-25 cs.LG cs.AI cs.CL

Zero-Training Temporal Drift Detection for Transformer Sentiment Models: A Comprehensive Analysis on Authentic Social Media Streams

无训练时间漂移检测用于Transformer情感模型:对真实社交媒体流的全面分析

Aayam Bansal, Ishaan Gangwani

机构 * Aayam Bansal Ishaan Gangwani

AI总结 本文提出了一种无训练的时间漂移检测方法,通过分析真实社交媒体数据,揭示了Transformer情感模型在事件驱动期间的性能退化,并引入了四种高效的时间漂移度量标准。

Comments ICML NewInML

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20630 2025-12-25 cs.AI

MicroProbe: Efficient Reliability Assessment for Foundation Models with Minimal Data

MicroProbe: 用极少数据高效评估基础模型的可靠性

Aayam Bansal, Ishaan Gangwani

机构 * Aayam Bansal(未知) Ishaan Gangwani(未知)

AI总结 MicroProbe通过仅使用100个精心选择的示例,高效评估基础模型可靠性,比随机采样方法提升23.5%的综合分数,显著降低评估成本并保持高覆盖率。

Comments ICML NewInML

详情

展开后加载摘要…

URL PDF HTML 收藏