arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2025-12-03 至 2025-12-03 共收录 5 信号源:cs.CV, cs.GR, cs.RO

1. 点云 5 篇

2512.02972 2025-12-03 cs.CV cs.RO 62%

BEVDilation: LiDAR-Centric Multi-Modal Fusion for 3D Object Detection

BEVDilation:以LiDAR为中心的多模态融合用于3D目标检测

Guowen Zhang, Chenhang He, Liyi Chen, Lei Zhang

专题命中 点云 :point cloud(abstract);分类 cs.CV、cs.RO

AI总结 BEVDilation提出以LiDAR为中心的多模态融合方法,通过稀疏体素扩张和语义引导BEV扩张模块提升3D目标检测性能,有效缓解深度误差带来的空间错位问题。

Comments Accept by AAAI26

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02394 2025-12-03 cs.CV 57%

Reproducing and Extending RaDelft 4D Radar with Camera-Assisted Labels

重现并扩展RaDelft 4D雷达与摄像头辅助标签

Kejia Hu, Mohammed Alsakabi, John M. Dolan, Ozan K. Tonguz

机构 * Department of Electrical and Computer Engineering, College of Engineering(电气与计算机工程系) The Robotics Institute, School of Computer Science(机器人研究所)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本研究重现并扩展RaDelft 4D雷达数据集,通过摄像头引导的标签生成方法实现雷达点云的高精度标注,并分析雾度对雷达标签性能的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05858 2025-12-03 cs.RO 57%

ViTaMIn-B: A Reliable and Efficient Visuo-Tactile Bimanual Manipulation Interface

ViTaMIn-B: 一种可靠且高效的视觉-触觉双臂操作接口

Chuanyu Li, Chaoyi Liu, Daotan Wang, Shuyu Zhang, Lusong Li, Zecui Zeng, Fangchen Liu, Jing Xu, Rui Chen

机构 * Tsinghua University(清华大学) University of California, Berkeley(加州大学伯克利分校) JD Explore Academy(JD探索学院) The Hong Kong Polytechnic University(香港理工大学)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 ViTaMIn-B通过DuoTact传感器和6自由度双臂位姿采集技术,实现了高效可靠的双臂操作任务数据采集。

Comments Project page: https://chuanyune.github.io/ViTaMIn-B_page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07561 2025-12-03 cs.CV 57%

Alligat0R: Pre-Training Through Co-Visibility Segmentation for Relative Camera Pose Regression

Alligat0R:通过共视分割进行预训练以实现相对相机姿态回归

Thibaut Loiseau, Guillaume Bourmaud, Vincent Lepetit

机构 * LIGM, Ecole des Ponts, Univ. Gustave Eiffel, CNRS, France(LIGM,巴黎理工大学,埃菲尔大学,CNRS,法国) Univ. Bordeaux, CNRS, Bordeaux INP, IMS, UMR 5218, France(波尔多大学,CNRS,波尔多INP,IMS,UMR 5218,法国)

专题命中 点云 :3D reconstruction(abstract);分类 cs.CV

AI总结 Alligat0R通过共视分割预训练方法在相对相机姿态回归中优于CroCo

Comments NeurIPS 2025 Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10341 2025-12-03 cs.LG 50%

Multi-View Graph Learning with Graph-Tuple

多视图图学习与图元组

Shiyu Chen, Ningyuan Huang, Soledad Villar

机构 * Department of Applied Mathematics and Statistics(应用数学与统计学系) Johns Hopkins University(约翰霍普金斯大学) Flatiron Institute(Flatiron研究所)

专题命中 点云 :point cloud(abstract)

AI总结 本文提出多视图图元组框架,通过异质信息传递架构提升图神经网络的表现力,应用于分子属性预测和宇宙学参数推断,展现其在处理密集图数据中的优势。

Comments Accepted as a poster at the TAG-DS 2025 Workshop (Topology, Algebra, and Geometry in Data Science). OpenReview: https://openreview.net/forum?id=s4ezAuj5xM

详情

展开后加载摘要…

URL PDF HTML 收藏