Drive As You Like: Multi-Head Diffusion with Reinforcement Learning for Personalized Driving
随心所欲驾驶:基于强化学习的多头部扩散个性化驾驶
机构 * School of Information Technology, Monash University Malaysia(墨尔本大学马来西亚分校信息科技学院) ; Southwest University, China(西南大学)
专题命中 后训练与偏好优化 :LLM(abstract);分类 cs.AI
AI总结 研究旨在解决自动驾驶规划器忽视人类驾驶行为多样性及难以理解用户意图的问题。提出基于强化学习的多策略框架,集成多头部扩散规划器与语义理解,采用两阶段训练范式。实验表明该方法在nuPlan基准测试中性能良好,能满足实时规划并对齐用户意图。
Comments Has been submitted to AAAI 2026