2510.18184
2026-05-12
cs.LG
cs.AI
ActivationReasoning: Logical Reasoning in Latent Activation Spaces
ActivationReasoning: 在潜在激活空间中的逻辑推理
Lukas Helff, Ruben Härle, Wolfgang Stammer, Felix Friedrich, Manuel Brack, Antonia Wüst, Hikaru Shindo, Patrick Schramowski, Kristian Kersting
机构
*
TU Darmstadt(图恩-达姆施塔特大学)
;
Lab1141(Lab1141实验室)
;
Aleph Alpha Research(Aleph Alpha研究)
;
MPI-Inf, SIC(马克斯·普朗克研究所(MPI-Inf))
;
Meta FAIR
;
Adobe Applied Research(Adobe应用研究)
;
DFKI(DFKI研究所)
;
CERTAIN, Germany(德国CERTAIN)
AI总结
本文提出ActivationReasoning框架,通过在LLM的潜在空间中嵌入显式逻辑推理,提升模型的推理能力、可控性和对齐性,验证了在多跳推理、抽象与鲁棒性、自然语言推理及安全任务中的有效性。