arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-02-25 至 2026-02-25 共收录 2 信号源:cs.CV, cs.GR, cs.RO

1. 空间理解 2 篇

2602.19768 2026-02-25 cs.CV 79%

TraceVision: Trajectory-Aware Vision-Language Model for Human-Like Spatial Understanding

TraceVision: 一种具有轨迹感知能力的视觉-语言模型,用于类人空间理解

Fan Yang, Shurong Zheng, Hongyin Zhao, Yufei Zhan, Xin Li, Yousong Zhu, Chaoyang Zhao Ming Tang, Jinqiao Wang

专题命中 空间理解 :spatial understanding(title,abstract);分类 cs.CV

AI总结 TraceVision通过整合轨迹感知的空间理解,实现了类人空间认知,提升视觉-语言模型在轨迹引导任务中的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20476 2026-02-25 cs.CV 57%

SceMoS: Scene-Aware 3D Human Motion Synthesis by Planning with Geometry-Grounded Tokens

SceMoS:通过基于几何的令牌规划进行场景感知的3D人体运动合成

Anindita Ghosh, Vladislav Golyanik, Taku Komura, Philipp Slusallek, Christian Theobalt, Rishabh Dabral

机构 * DFKI(德累斯顿人工智能研究所) MPI for Informatics(信息研究所) Saarland Informatics Campus(萨尔州信息校园) University of Hong Kong(香港大学)

专题命中 空间理解 :point cloud(abstract);分类 cs.CV

AI总结 SceMoS通过基于几何的令牌规划,利用2D场景表示实现高效且逼真的3D人体运动合成,减少50%以上可训练参数,提升物理真实性和接触精度。

Comments 13 pages, 6 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏