Think When It Matters: Conditional VLM Reasoning for Social Navigation with RL Policies
在重要时刻思考:用于社交导航的基于RL策略的条件VLM推理
机构 * Institut des Systèmes Intelligents et de Robotique (ISIR)(智能系统与机器人研究所)
AI总结 研究社交机器人导航中强化学习策略缺乏语义推理能力的问题,提出HUMA混合架构,动态平衡RL策略与VLM的优势。在基准测试中任务成功率提高,减少碰撞,消融研究验证组件,实际部署证明方法可行。
Comments CoRL 2026 submission. 15 pages, 7 figures