How Can Reinforcement Learning Achieve Expert-level Placement?
强化学习如何实现专家级布局?
机构 * State Key Laboratory of Novel Software Technology, Nanjing University, China(南京大学新型软件技术国家重点实验室) ; School of Artificial Intelligence, Nanjing University, China(南京大学人工智能学院) ; Huawei Noah’s Ark Lab, China(华为诺亚实验室)
AI总结 针对强化学习在芯片布局中因奖励设计不当而难以达到专家质量的问题,提出从专家布局直接学习奖励模型的方法,通过推断专家轨迹并训练隐式奖励模型,实现从单个设计高效学习并泛化到未见案例。
Comments DAC 2026