GRPO with State Mutations: Improving LLM-Based Hardware Test Plan Generation
GRPO与状态突变:改进基于LLM的硬件测试计划生成
机构 * Electrical Engineering and Computer Science, Massachusetts Institute of Technology, Cambridge, MA(麻省理工学院电子工程与计算机科学系) ; NVIDIA Research, Austin, TX(NVIDIA研究部) ; NVIDIA Research, Taiwan(NVIDIA台湾研究部) ; NVIDIA Research, Santa Clara, CA(NVIDIA圣克拉拉研究部)
专题命中 后训练与偏好优化 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG
AI总结 GRPO-SMu通过改进LLM训练方法,显著提升硬件验证中测试计划生成的准确率和突变检测率。