Stream3Dv2: Geometric-Semantic Fusion Enhanced Streaming Zero-Shot 3D Scene Understanding
Stream3Dv2:几何-语义融合增强的流式零样本3D场景理解
机构 * Singapore University of Technology and Design(新加坡科技设计大学)
专题命中 空间理解 :point cloud(abstract);分类 cs.CV
AI总结 针对现有开放词汇零样本3D场景理解模型难以处理流式RGB-D输入、易受2D分割掩码噪声影响的问题,提出无训练框架Stream3Dv2,通过几何-语义融合等策略提升性能,在相关任务上优于基准,可与LLM智能体集成用于开放世界具身智能。