Visual Representation Alignment for Multimodal Large Language Models
机构 * KAIST AI(韩国科学技术院人工智能研究所) ; New York University(纽约大学) ; Chung-Ang University(Chung-Ang 大学) ; Korea University(韩国大学) ; ETH Zürich(苏黎世联邦理工学院)
专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);foundation model(abstract);instruction tuning(abstract)
Comments Project Page: https://cvlab-kaist.github.io/VIRAL/