MC-LLaVA: Multi-Concept Personalized Vision-Language Model
MC-LLaVA:多概念个性化视觉-语言模型
机构 * Peking University(北京大学) ; Intel Labs, China(英特尔实验室,中国)
专题命中 VLM训练与架构 :vision-language model(title,abstract);LLaVA(title,abstract);VLM(abstract);visual question answering(abstract)
AI总结 MC-LLaVA通过多概念指令微调和个性化提示提升视觉-语言模型的多概念个性化能力。