Faithful-First Reasoning, Planning, and Acting for Multimodal LLMs
多模态大语言模型中的忠实优先推理、规划与行动
机构 * Shanghai Jiao Tong University(上海交通大学) ; The Hong Kong University of Science and Technology(香港科技大学) ; The Australian National University(澳大利亚国立大学) ; Fudan University(复旦大学) ; University of Sydney(悉尼大学)
AI总结 本文提出Faithful-First RPA框架,通过逐步监督提升多模态推理的忠实度,实验表明其在多个基准上提升了24%的感知忠实度,且不降低任务准确性。
Comments Accepted by ACL 2026 Findings