Align$^2$LLaVA: Cascaded Human and Large Language Model Preference Alignment for Multi-modal Instruction Curation
Align$^2$LLaVA: 多模态指令编纂的级联人类与大语言模型偏好对齐
机构 * Zhejiang University(浙江大学) ; Alibaba(阿里巴巴)
专题命中 多模态训练与对齐 :multi-modal(title,abstract);multimodal(abstract);MLLM(abstract);分类 cs.AI
AI总结 Align$^2$LLaVA通过级联人类与LLM偏好对齐方法,有效压缩多模态指令数据,提升模型性能。