arXivDaily arXiv每日学术速递 周一至周五更新

作者

Zhi-Hua Zhou

Machine Learning

2026-06-02 至 2026-06-02 共收录 1
2604.25191 2026-06-02 cs.AR cs.AI cs.LG

How Can Reinforcement Learning Achieve Expert-level Placement?

强化学习如何实现专家级布局?

Ruo-Tong Chen, Ke Xue, Chengrui Gao, Yunqi Shi, Tian Xu, Peng Xie, Siyuan Xu, Mingxuan Yuan, Chao Qian, Zhi-Hua Zhou

机构 * State Key Laboratory of Novel Software Technology, Nanjing University, China(南京大学新型软件技术国家重点实验室) School of Artificial Intelligence, Nanjing University, China(南京大学人工智能学院) Huawei Noah’s Ark Lab, China(华为诺亚实验室)

AI总结 针对强化学习在芯片布局中因奖励设计不当而难以达到专家质量的问题,提出从专家布局直接学习奖励模型的方法,通过推断专家轨迹并训练隐式奖励模型,实现从单个设计高效学习并泛化到未见案例。

Comments DAC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏