arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

International Conference on Learning Representations · 会议 · Machine Learning

2026-06-10 至 2026-06-10 共收录 2
2606.10228 2026-06-10 cs.LG cs.AI cs.RO 新提交

SHAPO: Sharpness-Aware Policy Optimization for Safe Exploration

SHAPO: 面向安全探索的锐度感知策略优化

Kaustubh Mani, Yann Pequignot, Vincent Mai, Liam Paull

机构 * Université de Montréal(蒙特利尔大学) Mila - Québec AI Institute(蒙特利尔人工智能研究所) Université Laval(拉瓦尔大学) IID - Institut Intelligence et Données(智能与数据研究所) LawZero CIFAR AI Chair(CIFAR人工智能主席)

AI总结 提出SHAPO算法,通过锐度感知策略更新隐式重加权梯度,放大罕见不安全动作的影响,抑制安全动作的贡献,从而在欠探索区域实现保守行为,提升安全性与任务性能。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09954 2026-06-10 cs.LG cs.AI 新提交

Does Normalization Choice Matter for Causal Large Time-Series Models?

归一化选择对因果大规模时间序列模型重要吗?

Samy-Melwan Vilhes, Gilles Gasso, Mokhtar Z Alaya

机构 * INSA Rouen Normandie, Univ Rouen Normandie Univ, LITIS UR4108(INSA Rouen Normandie, Rouen Normandie 大学, LITIS UR4108 实验室)

AI总结 研究因果大规模时间序列模型中不同归一化策略对训练收敛和预测性能的影响,发现归一化选择显著影响模型效果。

Journal ref ICLR 2026 Workshop: Time Series in the Age of Large Models, Apr 2026, Rio De Janeiro, Brazil

详情

展开后加载摘要…

URL PDF HTML 收藏