arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2025-12-02 至 2025-12-02 共收录 11 信号源:cs.CV, cs.GR, cs.RO

1. 点云 11 篇

2510.08512 2025-12-02 cs.CV cs.RO 81%

Have We Scene It All? Scene Graph-Aware Deep Point Cloud Compression

我们是否已经看到了一切?基于场景图的深度点云压缩

Nikolaos Stathoulopoulos, Christoforos Kanellakis, George Nikolakopoulos

机构 * Robotics and AI Group, Department of Computer, Electrical and Space Engineering, Luleå University of Technology(机器人与人工智能组,计算机、电子与航天工程系,卢勒阿大学技术学院)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV、cs.RO

AI总结 本文提出基于场景图的深度点云压缩框架,通过语义感知编码和结构化解码实现高效压缩,保留结构和语义信息,并支持多机器人系统中的下游应用。

Comments Please cite published version. 8 pages, 6 figures

Journal ref IEEE Robotics and Automation Letters, vol. 10, no. 12, pp. 12477-12484, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00803 2025-12-02 cs.CV cs.RO 81%

HiMo: High-Speed Objects Motion Compensation in Point Clouds

HiMo:点云中高速物体运动补偿

Qingwen Zhang, Ajinkya Khoche, Yi Yang, Li Ling, Sina Sharif Mansouri, Olov Andersson, Patric Jensfelt

机构 * Division of Robotics, Perception, and Learning, KTH Royal Institute of Technology(机器人、感知与学习系,皇家理工学院) Scania Group(斯堪尼亚集团) Autonomous Transport Solutions Lab, Scania Group(自主运输解决方案实验室,斯堪尼亚集团)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV、cs.RO

AI总结 HiMo通过SeFlow++实时场景流估计器,解决点云中高速移动物体引起的运动失真问题,提升动态物体的几何一致性和视觉保真度。

Comments 15 pages, 13 figures, Published in Transactions on Robotics (Volume 41)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12170 2025-12-02 cs.CV cs.AI 79%

Rethinking Multimodal Point Cloud Completion: A Completion-by-Correction Perspective

重新思考多模态点云补全:一种补全-修正视角

Wang Luo, Di Wu, Hengyuan Na, Yinlin Zhu, Miao Hu, Guocong Quan

机构 * Wang Luo, Di Wu, Hengyuan Na, Yinlin Zhu, Miao Hu, Guocong Quan(作者)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 PGNet通过补全-修正范式,结合多阶段框架和双特征编码,实现更鲁棒的点云补全,提升重建精度与结构一致性。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01383 2025-12-02 cs.CV 79%

PointNet4D: A Lightweight 4D Point Cloud Video Backbone for Online and Offline Perception in Robotic Applications

PointNet4D: 一种轻量级的4D点云视频主干网络,用于机器人应用中的在线和离线感知

Yunze Liu, Zifan Wang, Peiran Wu, Jiayang Ao

机构 * Tsinghua University(清华大学) University of Bristol(布里斯托大学) The University of Melbourne(墨尔本大学)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 PointNet4D是一种轻量级4D点云视频主干网络,通过混合Mamba-Transformer时间融合模块和4DMAP预训练策略,提升机器人应用中的在线和离线感知性能。

Comments Accepted by WACV2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10799 2025-12-02 cs.CV 79%

GFT: Graph Feature Tuning for Efficient Point Cloud Analysis

GFT:用于高效点云分析的图特征调谐

Manish Dhakal, Venkat R. Dasari, Rajshekhar Sunderraman, Yi Ding

机构 * Department of Computer Science, Georgia State University(计算机科学系,佐治亚州立大学) DEVCOM Army Research Laboratory(陆军研究实验室)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 GFT通过图特征调谐方法,针对点云数据高效减少可训练参数,提升点云分析任务的效率与性能。

Comments Accepted to WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08594 2025-12-02 cs.CV cs.LG 79%

PointNSP: Autoregressive 3D Point Cloud Generation with Next-Scale Level-of-Detail Prediction

PointNSP: 通过下一尺度细节预测实现自回归3D点云生成

Ziqiao Meng, Qichao Wang, Zhiyang Dou, Zixing Song, Zhipeng Zhou, Irwin King, Peilin Zhao

机构 * National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学) University of Hong Kong(香港大学) University of Cambridge(剑桥大学) The Chinese University of Hong Kong(香港中文大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 PointNSP通过下一尺度细节预测实现自回归3D点云生成,首次在自回归范式中达到最先进的生成质量,并在参数、训练和推理效率上超越扩散基线。

Comments 24 pages; Previously this version appeared as arXiv:2510.05613 which was submitted as a new work by accident

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.09065 2025-12-02 cs.CV 79%

STPLS3D: A Large-Scale Synthetic and Real Aerial Photogrammetry 3D Point Cloud Dataset

STPLS3D: 一种大规模合成与真实空摄影测量3D点云数据集

Meida Chen, Qingyong Hu, Zifan Yu, Hugues Thomas, Andrew Feng, Yu Hou, Kyle McCullough, Fengbo Ren, Lucio Soibelman

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 STPLS3D通过程序生成合成3D点云数据,提供大规模标注的空摄影测量数据集,包含16平方公里景观和18种细粒度语义类别,有效解决大规模数据采集与标注的挑战。

Journal ref https://bmvc2022.mpi-inf.mpg.de/429/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01352 2025-12-02 cs.CV 57%

OpenBox: Annotate Any Bounding Boxes in 3D

OpenBox: 任意3D边界框的标注

In-Jae Lee, Mungyeom Kim, Kwonyoung Ryu, Pierre Musacchio, Jaesik Park

机构 * Seoul National University(首尔国立大学) POSTECH

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 OpenBox通过2D视觉基础模型实现无需自我训练的高质量3D边界框标注,提升自动驾驶中物体检测的准确性和效率。

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10209 2025-12-02 cs.CV 57%

LiNeXt: Revisiting LiDAR Completion with Efficient Non-Diffusion Architectures

LiNeXt:重新审视基于高效非扩散架构的LiDAR补全

Wenzhe He, Xiaojun Chen, Ruiqi Wang, Ruihui Li, Huilong Pi, Jiapeng Zhang, Zhuo Tang, Kenli Li

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 LiNeXt通过高效非扩散架构实现快速准确的LiDAR点云补全,提升实时性能并减少计算开销。

Comments 18 pages, 13 figures, Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27680 2025-12-02 cs.CV cs.AI cs.LG 57%

PETAR: Localized Findings Generation with Mask-Aware Vision-Language Modeling for PET Automated Reporting

PETAR:基于掩码感知的视觉-语言建模的局部发现生成用于PET自动报告

Danyal Maqbool, Changhee Lee, Zachary Huemann, Samuel D. Church, Matthew E. Larson, Scott B. Perlman, Tomas A. Romero, Joshua D. Warner, Meghan Lubner, Xin Tie, Jameson Merkow, Junjie Hu, Steve Y. Cho, Tyler J. Bradshaw

机构 * University of Wisconsin–Madison Department of Computer Sciences(威斯康星大学麦迪逊分校计算机科学系) University of Wisconsin–Madison Department Radiology(威斯康星大学麦迪逊分校放射学系) Microsoft(微软公司)

专题命中 点云 :3D vision(abstract);分类 cs.CV

AI总结 PETAR通过引入PETARSeg-11K数据集和PETAR-4B模型,实现基于掩码感知的3D PET自动报告生成,提升医学影像分析的精度与实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01882 2025-12-02 cs.LG 50%

New Spiking Architecture for Multi-Modal Decision-Making in Autonomous Vehicles

多模态决策中自动驾驶车辆的新脉冲架构

Aref Ghoreishee, Abhishek Mishra, Lifeng Zhou, John Walsh, Nagarajan Kandasamy

机构 * Electrical and Computer Engineering Department(电子与计算机工程系)

专题命中 点云 :point cloud(abstract)

AI总结 本文提出了一种基于脉冲神经元的高效多模态决策架构,用于提升自动驾驶车辆的实时决策能力。

详情

展开后加载摘要…

URL PDF HTML 收藏