Robustness and Reasoning Fidelity of Large Language Models in Long-Context Code Question Answering
大语言模型在长上下文代码问答中的鲁棒性与推理可信度
机构 * IBM Research(IBM研究院)
专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);分类 cs.AI
AI总结 本研究评估了大语言模型在长上下文代码问答中的鲁棒性和推理可信度,通过不同设置测试发现模型在面对干扰信息时表现脆弱,揭示了现有评估的局限性。
Comments 11 pages, 4 Figures, 5 Tables, Work in Progress