Enhancing Multilingual Reasoning via Steerable Model Merging
通过可引导的模型合并增强多语言推理
机构 * Beijing University of Posts and Telecommunications(北京邮电大学) ; Fudan University(复旦大学) ; Beihang University(北京航空航天大学) ; Monash University(墨尔本大学) ; Zhongguancun Laboratory(中关村实验室) ; Nanjing University(南京大学) ; Tsinghua University(清华大学)
AI总结 提出可引导模型合并(ST-Merge)框架,通过门控交叉注意力机制自适应调节源模型贡献,在多语言推理任务中优于强基线。
Comments 12 pages, 7 figures, 8 tables. Accepted by ACL2026 Findings