Grounding Foundational Vision Models with 3D Human Poses for Robust Action Recognition
机构 * Arizona State University(亚利桑那州立大学) ; Emory University(埃默里大学) ; University of California, Berkeley(加州大学伯克利分校) ; Delft University of Technology(代尔夫特理工大学) ; Algoverse AI Research(Algoverse AI 研究)
专题命中 空间理解 :spatial understanding(abstract);分类 cs.CV、cs.RO
Comments Accepted at NeurIPS 2025 SpaVLE, for code see https://github.com/nbabey20/groundactrec , 9 pages, 1 figure