arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-01-26 至 2026-01-26 共收录 5 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 2 篇

2509.13414 2026-01-26 cs.CV cs.AI cs.LG cs.RO 84%

MapAnything: Universal Feed-Forward Metric 3D Reconstruction

MapAnything: 通用前馈度量3D重建

Nikhil Keetha, Norman Müller, Johannes Schönberger, Lorenzo Porzi, Yuchen Zhang, Tobias Fischer, Arno Knapitsch, Duncan Zauss, Ethan Weber, Nelson Antunes, Jonathon Luiten, Manuel Lopez-Antequera, Samuel Rota Bulò, Christian Richardt, Deva Ramanan, Sebastian Scherer, Peter Kontschieder

机构 * Meta Reality Labs(Meta现实实验室) Carnegie Mellon University(卡内基梅隆大学)

专题命中 三维重建 :3D reconstruction(title,abstract);3D vision(abstract);分类 cs.CV、cs.RO

AI总结 Map Anything是一种统一的前馈模型,通过输入图像和几何信息,直接回归度量3D场景几何,适用于多种3D视觉任务。

Comments 3DV 2026. Project Page: https://map-anything.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16733 2026-01-26 cs.CV eess.SP 57%

Using Shadows in Circular Synthetic Aperture Sonar Imaging for Target Analysis

在圆形合成孔径声呐成像中利用阴影进行目标分析

Yann Le Gall, Nicolas Burlet, Mathieu Simon, Fabien Novella, Samantha Dugelay, Jean-Philippe Malkasse

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出利用CSAS数据中的阴影信息,通过子孔径滤波和固定焦点阴影增强技术,提升目标分析和三维重建的性能。

Journal ref Synthetic Aperture in Sonar and Radar 2023

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 点云 2 篇

2601.16487 2026-01-26 cs.CV 57%

Multi-View Consistent Wound Segmentation With Neural Fields

多视角一致的伤口分割与神经场

Remi Chierchia, Léo Lebrat, David Ahmedt-Aristizabal, Yulia Arzhaeva, Olivier Salvado, Clinton Fookes, Rodrigo Santa Cruz

机构 * School of Electrical Engineering \& Robotics, Queensland University of Technology, Australia Imaging

专题命中 点云 :NeRF(abstract);分类 cs.CV

AI总结 本文提出WoundNeRF,一种基于NeRF SDF的方法,用于从自动注释中稳健地分割伤口,并通过与视觉Transformer和传统算法的比较展示其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10360 2026-01-26 cs.RO 57%

CLASH: Collaborative Large-Small Hierarchical Framework for Continuous Vision-and-Language Navigation

CLASH:协作式大-小层级框架用于连续视觉-语言导航

Liuyi Wang, Zongtao He, Jinlong Li, Ruihao Xia, Mengxian Hu, Chenpeng Yao, Chengju Liu, Yang Tang, Qijun Chen

机构 * Tongji University(同济大学) Key Laboratory of Smart Manufacturing in Energy Chemical Process, Ministry of Education, East China University of Science and Technology(能源化工过程智能制造重点实验室,教育部,东华大学)

专题命中 点云 :spatial understanding(abstract);分类 cs.RO

AI总结 CLASH通过整合反应式小模型规划器与反思式大模型推理器,实现连续视觉-语言导航任务中的高效协作与鲁棒导航,显著提升任务性能和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 新视角合成 1 篇

2512.10940 2026-01-26 cs.CV cs.AI 57%

OmniView: An All-Seeing Diffusion Model for 3D and 4D View Synthesis

OmniView: 一种用于3D和4D视图合成的全视角扩散模型

Xiang Fan, Sharath Girish, Vivek Ramanujan, Chaoyang Wang, Ashkan Mirzaei, Petr Sushko, Aliaksandr Siarohin, Sergey Tulyakov, Ranjay Krishna

机构 * University of Washington(华盛顿大学) Snap Inc.(Snap公司)

专题命中 新视角合成 :novel view synthesis(abstract);分类 cs.CV

AI总结 OmniView是一种统一的扩散模型,能够泛化多种4D一致性任务,通过空间、时间和视图条件的灵活组合提升视频生成质量与相机控制精度。

Comments Project page: https://snap-research.github.io/OmniView/

详情

展开后加载摘要…

URL PDF HTML 收藏