Beyond Text Matching: Towards Reference-Free Evaluation for Human-Oriented Binary Reverse Engineering
超越文本匹配:面向面向人类的二进制逆向工程的无参考评估
专题命中 评测与基准 :LLM(summary_cn,abstract);prompting(abstract);分类 cs.AI
AI总结 本文针对HOBRE的三项任务,首次系统研究LLM-as-a-Judge评估范式,推出无参考基准BinJudgeBench,提出自适应选择最优配置的BinJudge,提升评估相关性并降低API成本。
Comments Accepted by the 41st IEEE/ACM International Conference on Automated Software Engineering (ASE 2026)