SurgMLLMBench: A Multimodal Large Language Model Benchmark Dataset for Surgical Scene Understanding
SurgMLLMBench: 一个用于手术场景理解的多模态大语言模型基准数据集
机构 * Samsung Research(三星研究所) ; Center for Humanoid Research, Korea Institute of Science and Technology(人类研究学院,韩国科学技术院) ; Department of plastic surgery, College of medicine, Korea University(医学院整形外科部,韩国大学) ; Department of orthopedic surgery, College of medicine, Korea University(医学院骨科部,韩国大学)
专题命中 视觉问答 :multimodal large language model(title,abstract);visual question answering(abstract);分类 cs.CV、cs.AI
AI总结 SurgMLLMBench是一个用于手术场景理解的多模态大语言模型基准数据集,整合了像素级分割和结构化VQA注释,支持跨领域的全面评估和更丰富的视觉-对话交互。
Comments 10 pages, 5 figures