Self-Improving VLM Judges Without Human Annotations
无需人工标注的自改进VLM评判模型
机构 * FAIR at Meta(Meta 的 FAIR) ; University of Washington(华盛顿大学)
专题命中 后训练与偏好优化 :language model(abstract)
AI总结 无需人工标注,通过自训练提升VLM评判模型的准确性和多维度表现
AI 大模型
大语言模型、预训练、指令微调、后训练和语言模型应用。
无需人工标注的自改进VLM评判模型
机构 * FAIR at Meta(Meta 的 FAIR) ; University of Washington(华盛顿大学)
专题命中 后训练与偏好优化 :language model(abstract)
AI总结 无需人工标注,通过自训练提升VLM评判模型的准确性和多维度表现