PoTS: Proof-of-Training-Steps for Backdoor Detection in Large Language Models
机构 * Université Paris-Saclay(巴黎-萨克雷大学) ; CEA LIST(法国原子能委员会列表中心) ; Palaiseau, France(法国Palaiseau)
专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);post-training(abstract)
Comments 10 pages, 6 figures, 1 table. Accepted for presentation at FLLM 2025 (Vienna, Nov 2025)