See&Trek: Training-Free Spatial Prompting for Multimodal Large Language Model
机构 * HKUST(GZ)(香港科技大学(广州)) ; KU Leuven(比利时鲁文大学) ; EPFL(苏黎世联邦理工学院) ; SZU(深圳大学)
专题命中 视觉推理 :multimodal large language model(title,abstract);MLLM(abstract);分类 cs.CV、cs.AI
Comments Accepted by NeurIPS 2025