When Probing Accuracy Saturates, Fragility Resolves: A Complementary Metric for LLM Pre-Training Analysis
当探测精度饱和时,脆弱性揭示问题:LLM预训练分析的互补度量
机构 * Distiller Labs
专题命中 评测与基准 :LLM(title,title_cn);language model(abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 针对线性探测在预训练中精度快速饱和的问题,提出脆弱性度量,通过激活噪声水平衡量探测鲁棒性,揭示精度无法捕捉的表示结构演化。
Comments 22 pages, 5 figures. Code and datasets at https://github.com/deepsteer/deepsteer