SAC Flow: Sample-Efficient Reinforcement Learning of Flow-Based Policies via Velocity-Reparameterized Sequential Modeling
SAC Flow: 通过速度重参数化序列建模高效训练基于流的策略
机构 * Tsinghua University(清华大学) ; Carnegie Mellon University(卡内基梅隆大学) ; Li Auto(利汽车) ; Shanghai AI Laboratory(上海人工智能实验室)
AI总结 SAC Flow通过速度重参数化序列建模,高效训练基于流的策略,实现连续控制和机器人操作的高性能表现。