Confidence Should Be Calibrated More Than One Turn Deep
置信度应比单轮更深入地校准
机构 * Queen Mary University of London(伦敦玛丽女王大学) ; Xi’an Jiaotong University(西安交通大学)
专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL
AI总结 本文提出多轮校准任务,解决多轮对话中置信度动态校准问题,通过MTCal和ConfChat提升模型在多轮交互中的事实性和一致性。