Can LLM-Generated Text Empower Surgical Vision-Language Pre-training?
LLM生成文本能否增强外科视觉-语言预训练?
机构 * Visual Understanding Research Group, Department of Informatics, King’s College London, UK(视觉理解研究组,信息学院,伦敦国王学院,英国)
专题命中 指令微调 :LLM(title,title_cn);large language model(abstract);language model(abstract);foundation model(abstract)
AI总结 本文提出SurgLIME框架,利用LLM生成的文本进行多模态预训练,以解决标注成本高的问题,通过LoRA适配和自适应置信度估计机制提升模型鲁棒性。
Comments Accepted at CVPRW 2026 (AI4RWC Oral presentationn)