arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

2026-02-11 至 2026-02-11 共收录 1 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. 仿真评测 1 篇

2412.08794 2026-02-11 cs.LG stat.ML 50%

Latent Safety-Constrained Policy Approach for Safe Offline Reinforcement Learning

潜在安全约束策略方法用于安全离线强化学习

Prajwal Koirala, Zhanhong Jiang, Soumik Sarkar, Cody Fleming

机构 * Iowa State University(爱荷华州立大学)

专题命中 仿真评测 :autonomous driving(abstract)

AI总结 本文提出了一种潜在安全约束策略方法,通过条件变分自动编码器和受约束奖励-回报最大化框架,实现了安全离线强化学习中的安全性和奖励优化的平衡。

Journal ref International Conference on Learning Representations (ICLR), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏