SCD4VPR: Multi-modal Scene Change Detection for Long-term Visual Place Recognition Database Update
基于视觉-语言表示学习的场景变化检测
机构 * New York University(纽约大学)
专题命中 图文多模态 :multi-modal(title);cross-modal(abstract);分类 cs.CV
AI总结 本文提出LangSCD框架,通过融合语言和视觉信息提升场景变化检测的鲁棒性,引入几何-语义匹配模块和多类标注数据集NYC-CD,实验证明其在多个基准上的优越性能。
Comments 9 pages, 6 figures, 6 tables