Three Steps at a Time: Learning Representations from Action Sequences in Contrastive RL
一次三步:对比强化学习中从动作序列学习表示
机构 * ETH Zurich(苏黎世联邦理工学院) ; University of Warsaw(华沙大学) ; Princeton University(普林斯顿大学) ; MPI IS Tubingen(图宾根马克斯·普朗克智能系统研究所) ; Warsaw University of Technology(华沙理工大学) ; IDEAS Research Institute(IDEAS研究所)
AI总结 该研究针对对比强化学习(CRL)将动作建模尺度从单步扩展至动作块,在18个与11个环境中分别实现31.7%、93.1%的性能提升,揭示动作块可改进CRL的评论者表示以提升算法效果。