Off-Policy Actor-Critic with Sigmoid-Bounded Entropy for Real-World Robot Learning
基于Sigmoid受限熵的离策略Actor-Critic用于现实世界机器人学习
机构 * Wuhan University(武汉大学)
专题命中 部署与泛化 :VLA(abstract);分类 cs.AI
AI总结 SigEnt-SAC通过Sigmoid受限熵机制,实现低成本、高效率的现实世界机器人强化学习。
Comments 7 pages main text 2 page reference