Ladders in Chaos: When, How, (and Perhaps Why) Does Test-Time Scaling Improve LLM Machine Translation
混沌中的阶梯:测试时缩放何时、如何(或许还有为何)提升大语言模型的机器翻译性能
机构 * University of Amsterdam(阿姆斯特丹大学) ; Vrije Universiteit Amsterdam(阿姆斯特丹自由大学)
AI总结 本研究探究LLM的序列式与并行式测试时缩放在机器翻译中的特性,发现序列式采样性能上限更高,可提升翻译流畅度但在大推理预算下会降准,还分析了其机制与鲁棒性。
Comments Accepted to Findings of EMNLP 2026