When to ASK: Uncertainty-Gated Language Assistance for Reinforcement Learning
何时提问:用于强化学习的不确定性门控语言帮助
专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI、cs.LG
AI总结 本文提出ASK方法,通过结合小型语言模型和训练好的RL策略,提升模型在分布外任务中的泛化能力,通过不确定性门控机制选择性利用语言模型进行决策,实验显示其在迁移任务中表现稳健。
Comments In Proceedings of International Joint Conference on Neural Networks (IJCNN)