In-Context Reinforcement Learning via Communicative World Models
通过通信世界模型进行上下文强化学习
机构 * Department of Computer and Information Sciences, Fordham University(福特汉姆大学计算机与信息科学系) ; Department of Systems Engineering, City University of Hong Kong(香港城市大学系统工程系) ; IBM Research(IBM研究院)
AI总结 提出CORAL框架,通过将潜在表示学习与控制分离,利用信息代理预训练世界模型并生成通信消息,使控制代理实现零样本适应和样本效率提升。