ReGraP-LLaVA: Reasoning enabled Graph-based Personalized Large Language and Vision Assistant
ReGraP-LLaVA:支持推理的基于图的个性化多模态大语言与视觉助手
机构 * Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究所) ; School of Engineering, Westlake University(西湖大学工程学院) ; University of Minnesota – Twin Cities(明尼苏达大学双城分校) ; University of Toronto(多伦多大学)
专题命中 VLM训练与架构 :LLaVA(title,title_cn);MLLM(abstract,abstract_cn);multimodal large language model(abstract);分类 cs.CV、cs.AI
AI总结 针对现有个性化多模态大语言模型忽略概念关联的局限,本文构建ReGraP数据集与基准,提出ReGraP-LLaVA模型,实现个性化关系推理,在对比基准中性能最优。
Comments accepted in EMNLP 2026