Learning Domain Knowledge in Multimodal Large Language Models through Reinforcement Fine-Tuning
通过强化微调学习多模态大语言模型中的领域知识
机构 * MoE Key Lab of Artificial Intelligence, AI Institute, Shanghai Jiao Tong University, Shanghai, China(人工智能大规模并行计算实验室,人工智能研究院,上海交通大学,上海)
专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.CL
AI总结 本文提出通过强化微调框架在优化层面整合领域知识,提升多模态大语言模型在专门领域任务中的性能。