Saliency-R1: Incentivizing Unified Saliency Reasoning Capability in MLLM with Confidence-Guided Reinforcement Learning
Saliency-R1: 通过置信度引导的强化学习激励多模态大语言模型统一的显著性推理能力
机构 * Northwestern Polytechnical University(西北工业大学) ; University of Science and Technology of China(中国科学技术大学)
专题命中 视觉推理 :MLLM(title,abstract);multimodal large language model(abstract);分类 cs.CV
AI总结 Saliency-R1通过置信度引导的强化学习,提升多模态大语言模型在显著性推理任务中的统一能力,实现显著物体检测、显著实例分割和共显著物体检测的高效处理。
Comments Main text (excluding references): 8 pages, 4 figures; Supplementary Materials (excluding references): 9 pages, 10 figures