MLLM-CTBench: A Benchmark for Continual Instruction Tuning with Reasoning Process Diagnosis
MLLM-CTBench: 一个用于持续指令微调的基准,包含推理过程诊断
机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) ; Southeast University(东南大学) ; School of Computing, National University of Singapore(新加坡国立大学计算机学院)
专题命中 推理评测 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI
AI总结 MLLM-CTBench提出一个用于持续指令微调的基准,通过多维评估框架和强化微调方法,分析跨任务知识保留和灾难性遗忘问题。
Comments under review