Re-Align: Aligning Vision Language Models via Retrieval-Augmented Direct Preference Optimization
机构 * Texas A&M University(德克萨斯大学) ; University of Michigan(密歇根大学) ; UIUC(伊利诺伊大学香槟分校) ; UNC Chapel Hill(北卡罗来纳大学教堂山分校)
专题命中 后训练与偏好优化 :language model(title,abstract);preference optimization(title,abstract);large language model(abstract);RLHF(abstract)
Comments Published at EMNLP 2025