PCEval: A Benchmark for Evaluating Physical Computing Capabilities of Large Language Models
PCEval: 一个评估大型语言模型物理计算能力的基准
机构 * Department of Immersive Media Engineering(沉浸媒体工程系) ; Sungkyunkwan University(成均馆大学)
专题命中 代码评测 :code generation(abstract);分类 cs.CL、cs.AI
AI总结 PCEval是一个评估大型语言模型物理计算能力的基准,通过自动评估电路生成和硬件交互能力,揭示LLMs在物理布局设计中的不足。
Comments Code and Dataset available at https://github.com/Null99-Dog/PCEval-Dataset