arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

共收录 7719 信号源:cs.CV, cs.GR, cs.RO

1. 点云 7719 篇

2602.11242 2026-02-13 cs.CV 57%

ReTracing: An Archaeological Approach Through Body, Machine, and Generative Systems

ReTracing:通过身体、机器和生成系统进行考古学研究

Yitong Wang, Yue Yao

机构 * Department of Machine Learning(机器学习系) Carnegie Mellon University(卡内基梅隆大学) SIPA Technology Policy and Innovation(技术政策与创新研究所) Columbia University(哥伦比亚大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 ReTracing通过AI、人类和机器人互动,探索生成系统如何通过编舞运动反映社会文化偏见。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11007 2026-02-12 cs.CV 57%

LaSSM: Efficient Semantic-Spatial Query Decoding via Local Aggregation and State Space Models for 3D Instance Segmentation

LaSSM:通过局部聚合和状态空间模型实现高效的语义-空间查询解码用于3D实例分割

Lei Yao, Yi Wang, Yawen Cui, Moyun Liu, Lap-Pui Chau

机构 * Department of Electrical and Electronic Engineering, The Hong Kong Polytechnic University(电子工程系,香港理工大学) School of Mechanical Science and Engineering, Huazhong University of Science and Technology(机械科学与工程学院,华中科技大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 LaSSM通过局部聚合和状态空间模型实现高效语义-空间查询解码,提升3D实例分割性能。

Comments Accepted at IEEE-TCSVT

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10806 2026-02-12 cs.CV 57%

DMP-3DAD: Cross-Category 3D Anomaly Detection via Realistic Depth Map Projection with Few Normal Samples

DMP-3DAD:通过真实深度图投影实现跨类3D异常检测

Zi Wang, Katsuya Hotta, Koichiro Kamide, Yawen Zou, Jianjian Qin, Chao Zhang, Jun Yu

机构 * Niigata University(Niigata大学) University of Toyama(Toyama大学) Iwate University(Iwate大学) NingboTech University(NingboTech大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 DMP-3DAD通过真实深度图投影实现跨类3D异常检测,无需训练即可高效检测少样本场景下的异常点云。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02186 2026-02-12 cs.CV cs.LG 57%

GeoPurify: A Data-Efficient Geometric Distillation Framework for Open-Vocabulary 3D Segmentation

GeoPurify: 一种数据高效的几何蒸馏框架用于开放词汇3D分割

Weijia Dou, Xu Zhang, Yi Bin, Jian Liu, Bo Peng, Guoqing Wang, Yang Yang, Heng Tao Shen

机构 * Tongji University(同济大学) Tianjin University(天津大学) University of Electronic Science and Technology of China(电子科学与技术大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 GeoPurify通过几何蒸馏和亲和网络提升3D分割的数据效率,实现高效且准确的开放词汇3D分割

Comments Accepted at ICLR 2026. Code available at: https://github.com/tj12323/GeoPurify

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09425 2026-02-11 cs.CV cs.LG 57%

Bridging the Modality Gap in Roadside LiDAR: A Training-Free Vision-Language Model Framework for Vehicle Classification

弥合道路激光雷达的模态差距:一种无需训练的视觉-语言模型框架用于车辆分类

Yiqiao Li, Bo Shang, Jie Wei

机构 * Department of Civil Engineering, City College of New York(城市学院土木工程系) Department of Computer Science, City College of New York(城市学院计算机科学系)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出一种无需训练的视觉-语言模型框架,用于解决道路激光雷达中稀疏点云与密集图像之间的模态差距问题,实现细粒度车辆分类。

Comments 12 pages, 10 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22444 2026-02-10 cs.CV 57%

On Geometry-Enhanced Parameter-Efficient Fine-Tuning for 3D Scene Segmentation

针对3D场景分割的几何增强型参数高效微调

Liyao Tang, Zhe Chen, Dacheng Tao

机构 * The University of Sydney(悉尼大学) La Trobe University(拉特罗布大学) Nanyang Technological University(南洋理工大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出GEM模块,通过整合局部位置编码与轻量级注意力机制,提升3D点云模型的几何感知微调效率和性能。

Comments Neurips 2025; available at https://github.com/LiyaoTang/GEM

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06406 2026-02-09 cs.CV 57%

Point Virtual Transformer

点虚拟变换器

Veerain Sood, Bnalin, Gaurav Pandey

机构 * Texas A \& M University Email Engineering Technology \& Industrial Distribution Texas A \& M University Texas, USA

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 PointViT通过融合真实和虚拟点,提升远距离3D目标检测性能,实现91.16%的3D AP和95.94%的BEV AP。

Comments 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12924 2026-02-09 cs.CV 57%

MATTER: Multiscale Attention for Registration Error Regression

MATTER: 多尺度注意力用于注册误差回归

Shipeng Liu, Ziliang Xiong, Khac-Hoang Ngo, Per-Erik Forssén

机构 * Department of Electrical Engineering, Linköping University, Linköping, Sweden(Linköping大学电子工程系)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 MATTER通过多尺度注意力机制实现点云注册误差的回归,提升注册质量评估的精度与鲁棒性,尤其在异质点云中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04631 2026-02-05 cs.RO 57%

Radar-Inertial Odometry For Computationally Constrained Aerial Navigation

雷达-惯性里程计用于计算受限的空中导航

Jan Michalczyk

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 本研究提出雷达-惯性里程计算法,结合雷达和惯性测量单元数据,用于在资源受限条件下实现无人机的实时导航状态估计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12791 2026-02-05 cs.CV cs.LG 57%

Activation-wise Propagation: A One-Timestep Strategy for Spiking Neural Networks

按激活传播:用于脉冲神经网络的一种单时间步策略

Jian Song, Xiangfei Yang, Shangke Lyu, Donglin Wang

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 AMP2通过动态传播膜电位提升SNN效率和准确性,适用于多种架构和任务。

Comments 10 pages, 7 figures, AAAI26

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02232 2026-02-03 cs.CV 57%

LiFlow: Flow Matching for 3D LiDAR Scene Completion

LiFlow:用于3D激光雷达场景补全的流匹配

Andrea Matteazzi, Dietmar Tutsch

机构 * University of Wuppertal(乌尔姆大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 LiFlow通过流匹配框架改进3D激光雷达场景补全,采用最近邻损失和切封距离损失提升点云对齐效果,实现多指标最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01764 2026-02-03 cs.CV 57%

GDPR-Compliant Person Recognition in Industrial Environments Using MEMS-LiDAR and Hybrid Data

在工业环境中使用MEMS-LiDAR和混合数据实现符合GDPR的人体识别

Dennis Basile, Dennis Sprute, Helene Dörksen, Holger Flatt

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出利用MEMS-LiDAR和混合数据在工业环境中实现符合GDPR的人体识别,通过合成数据增强提升检测性能并减少标注工作量。

Comments Accepted at 19th CIRP Conference on Intelligent Computation in Manufacturing Engineering

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05427 2026-02-03 cs.CV 57%

OpenWorldSAM: Extending SAM2 for Universal Image Segmentation with Language Prompts

OpenWorldSAM: 通过语言提示扩展SAM2实现通用图像分割

Shiting Xiao, Rishabh Kabra, Yuhang Li, Donghyun Lee, Joao Carreira, Priyadarshini Panda

机构 * Yale University(耶鲁大学) Google DeepMind(谷歌DeepMind)

专题命中 点云 :spatial understanding(abstract);分类 cs.CV

AI总结 OpenWorldSAM通过整合轻量级视觉-语言模型,扩展SAM2实现开放词汇图像分割,具备高效、实例意识和强泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15039 2026-02-03 cs.RO 57%

CADGrasp: Learning Contact and Collision Aware General Dexterous Grasping in Cluttered Scenes

CADGrasp: 学习接触和碰撞感知的通用灵巧抓取在杂乱场景中

Jiyao Zhang, Zhiyuan Ma, Tianhao Wu, Zeyuan Chen, Hao Dong

机构 * Center on Frontiers of Computing Studies, School of Computer Science, Peking University(前沿计算研究中心,计算机学院,北京大学) National Key Laboratory for Multimedia Information Processing, School of Computer Science, Peking University(多媒体信息处理国家级重点实验室,计算机学院,北京大学)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 CADGrasp通过两阶段算法实现接触和碰撞感知的灵巧抓取,利用点云输入预测稀疏IBS表示,并结合占用扩散模型和能量函数优化,提升在杂乱场景中的抓取成功率与稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10498 2026-02-03 cs.CV 57%

The Role of World Models in Shaping Autonomous Driving: A Comprehensive Survey

世界模型在塑造自动驾驶中的作用:全面综述

Sifan Tu, Xin Zhou, Dingkang Liang, Xingyu Jiang, Yumeng Zhang, Xiaofan Li, Xiang Bai

机构 * Huazhong University of Science and Technology(华中科技大学) Baidu Inc(百度公司)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文综述了驾驶世界模型在自动驾驶中的作用,分析了其生态系统、分类方法及性能表现,探讨了当前研究的局限性与未来发展方向。

Comments For continuous updates, please follow the repository: https://github.com/LMD0311/Awesome-World-Model

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00110 2026-02-03 cs.CV cs.LG 57%

Observing Health Outcomes Using Remote Sensing Imagery and Geo-Context Guided Visual Transformer

利用遥感图像和地理上下文引导的视觉变换器观察健康结果

Yu Li, Guilherme N. DeSouza, Praveen Rao, Chi-Ren Shyu

专题命中 点云 :spatial understanding(abstract);分类 cs.CV

AI总结 本文提出一种结合地理空间信息的视觉变换器模型,通过引导注意力机制提升遥感图像处理效果,有效预测疾病流行率。

Comments Submitted to IEEE Transactions on Geoscience and Remote Sensing

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23159 2026-02-02 cs.CV 57%

Segment Any Events with Language

通过语言进行任意事件分割

Seungjun Lee, Gim Hee Lee

机构 * Department of Computer Science, National University of Singapore(新加坡国立大学计算机科学系)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 SEAL通过语义感知框架实现开放词汇事件实例分割,支持多粒度级别的事件分割与掩码分类,并在多个基准测试中表现出优越的性能和效率。

Comments ICLR 2026. Project Page: https://0nandon.github.io/SEAL

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22616 2026-02-02 cs.CV 57%

UniGeo: A Unified 3D Indoor Object Detection Framework Integrating Geometry-Aware Learning and Dynamic Channel Gating

UniGeo:一种整合几何感知学习和动态通道门控的统一3D室内目标检测框架

Xing Yi, Jinyang Huang, Feng-Qi Cui, Anyang Tong, Ruimin Wang, Liu Liu, Dan Guo

机构 * School of Computer Science and Information Engineering(计算机科学与信息工程学院) Institute of Advanced Technology(先进技术研究所)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 UniGeo通过几何感知学习和动态通道门控机制,提升稀疏点云场景中3D室内目标检测的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22529 2026-02-02 cs.CV 57%

SHED Light on Segmentation for Dense Prediction

SHED:用于密集预测的分割光照

Seung Hyun Lee, Sangwoo Mo, Stella X. Yu

机构 * University of Michigan(密歇根大学)

专题命中 点云 :3D reconstruction(abstract);分类 cs.CV

AI总结 SHED通过整合分割到密集预测中,提出了一种新的编码器-解码器架构,以提升深度边界锐度、分割连贯性和3D重建质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19228 2026-01-28 cs.CV 57%

Towards Pixel-Level VLM Perception via Simple Points Prediction

通过简单的点预测实现像素级VLM感知

Tianhui Song, Haoyu Lu, Hao Yang, Lin Sui, Haoning Wu, Zaida Zhou, Zhiqi Huang, Yiping Bao, Y. Charles, Xinyu Zhou, Limin Wang

专题命中 点云 :spatial understanding(abstract);分类 cs.CV

AI总结 SimpleSeg通过简单点预测实现多模态大语言模型的像素级感知,无需复杂架构即可获得高精度分割性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.17371 2026-01-28 cs.CG cs.GR cs.NA math.NA 57%

Robust Containment Queries over Collections of Rational Parametric Curves via Generalized Winding Numbers

通过广义环绕数实现对有理参数曲线集合的鲁棒包含查询

Jacob Spainhour, David Gunderman, Kenneth Weiss

专题命中 点云 :point cloud(abstract);分类 cs.GR

AI总结 本文提出了一种基于广义环绕数的鲁棒点包含查询方法,适用于有理参数曲线集合,提高了计算鲁棒性和性能。

Comments 14 pages, 18 figures

Journal ref ACM Transactions on Graphics (TOG), Volume 43, Issue 4, Pages 1 - 14 (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18323 2026-01-27 cs.RO 57%

TC-IDM: Grounding Video Generation for Executable Zero-shot Robot Motion

TC-IDM:为可执行零样本机器人运动实现视频生成

Weishi Mi, Yong Bao, Xiaowei Chi, Xiaozhu Ju, Zhiyuan Qin, Kuangzhi Ge, Kai Tang, Peidong Jia, Shanghang Zhang, Jian Tang

机构 * Beijing Innovation Center of Humanoid Robotics(北京人形机器人创新中心) State Key Laboratory of Multimedia Information Processing(多媒体信息处理国家重点实验室) School of Computer Science, Peking University(北京大学计算机科学学院)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 TC-IDM通过工具中心逆动力学模型实现视频生成,提升机器人零样本任务的执行能力与泛化性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17866 2026-01-27 cs.CV 57%

MV-SAM: Multi-view Promptable Segmentation using Pointmap Guidance

基于点图指导的多视角分割:MV-SAM

Yoonwoo Jeong, Cheng Sun, Yu-Chiang Frank Wang, Minsu Cho, Jaesung Choe

机构 * NVIDIA POSTECH

专题命中 点云 :NeRF(abstract);分类 cs.CV

AI总结 MV-SAM通过点图指导实现多视角分割,提升三维一致性,优于SAM2-Video并在多个基准上表现优异。

Comments Project page, https://jaesung-choe.github.io/mv_sam/index.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16487 2026-01-26 cs.CV 57%

Multi-View Consistent Wound Segmentation With Neural Fields

多视角一致的伤口分割与神经场

Remi Chierchia, Léo Lebrat, David Ahmedt-Aristizabal, Yulia Arzhaeva, Olivier Salvado, Clinton Fookes, Rodrigo Santa Cruz

机构 * School of Electrical Engineering \& Robotics, Queensland University of Technology, Australia Imaging

专题命中 点云 :NeRF(abstract);分类 cs.CV

AI总结 本文提出WoundNeRF,一种基于NeRF SDF的方法,用于从自动注释中稳健地分割伤口,并通过与视觉Transformer和传统算法的比较展示其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10360 2026-01-26 cs.RO 57%

CLASH: Collaborative Large-Small Hierarchical Framework for Continuous Vision-and-Language Navigation

CLASH:协作式大-小层级框架用于连续视觉-语言导航

Liuyi Wang, Zongtao He, Jinlong Li, Ruihao Xia, Mengxian Hu, Chenpeng Yao, Chengju Liu, Yang Tang, Qijun Chen

机构 * Tongji University(同济大学) Key Laboratory of Smart Manufacturing in Energy Chemical Process, Ministry of Education, East China University of Science and Technology(能源化工过程智能制造重点实验室,教育部,东华大学)

专题命中 点云 :spatial understanding(abstract);分类 cs.RO

AI总结 CLASH通过整合反应式小模型规划器与反思式大模型推理器,实现连续视觉-语言导航任务中的高效协作与鲁棒导航,显著提升任务性能和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18944 2026-01-23 cs.CV 57%

DINO in the Room: Leveraging 2D Foundation Models for 3D Segmentation

DINO在房间内:利用2D基础模型进行3D分割

Karim Knaebel, Kadir Yilmaz, Daan de Geus, Alexander Hermans, David Adrian, Timm Linder, Bastian Leibe

机构 * RWTH Aachen University(亚琛工业大学) Eindhoven University of Technology(埃因霍温理工大学) Bosch Center for AI(博世人工智能中心)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 DITR通过整合2D基础模型特征到3D分割模型中,实现了在室内外3D语义分割上的最佳性能。

Comments Accepted to 3DV 2026. Project page at https://vision.rwth-aachen.de/ditr

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16346 2026-01-23 cs.CV cs.AI 57%

From Canopy to Ground via ForestGen3D: Learning Cross-Domain Generation of 3D Forest Structure from Aerial-to-Terrestrial LiDAR

从树冠到地面:通过ForestGen3D实现跨领域生成3D森林结构:从航空到地面LiDAR

Juan Castorena, E. Louise Loudermilk, Scott Pokswinski, Rodman Linn

机构 * Los Alamos National Laboratories(洛斯阿拉莫斯国家实验室) Southern Research Station(南部研究站) Prescribed Fire Laboratory(规定火实验室)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 ForestGen3D通过跨领域生成模型,从航空LiDAR数据推断地面细节,实现高精度的3D森林结构重建,提升生态分析和遥感应用的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15545 2026-01-23 cs.CV 57%

Multi-View Projection for Unsupervised Domain Adaptation in 3D Semantic Segmentation

多视角投影用于无监督领域适应的3D语义分割

Andrew Caunes, Thierry Chateau, Vincent Fremont

机构 * Logiroad, Nantes, France(法国南特Logiroad) LS2N - Ecole Centrale de Nantes, France(法国南特LS2N-中央理工学院)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出了一种基于多视角投影的无监督领域适应方法,通过合成数据集训练2D分割模型并回投影生成3D标签,实现3D语义分割的领域适应和稀有类别分割。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14804 2026-01-22 cs.CV 57%

Symmetry Informative and Agnostic Feature Disentanglement for 3D Shapes

对3D形状的对称信息性和对称无关性特征解耦

Tobias Weißberg, Weikang Wang, Paul Roetzer, Nafie El Amrani, Florian Bernard

机构 * University of Bonn(波恩大学) Lamarr Institute(拉玛尔研究所)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出了一种同时具有对称信息性和对称无关性的特征解耦方法,以提高3D形状分析的鲁棒性和准确性。

Comments Accepted at 3DV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13373 2026-01-21 cs.CV 57%

A Lightweight Model-Driven 4D Radar Framework for Pervasive Human Detection in Harsh Conditions

一种轻量化的模型驱动4D雷达框架,用于在恶劣条件下进行 pervasive 人类检测

Zhenan Liu, Amir Khajepour, George Shaker

机构 * Mechanical \& Mechatronics Engineering University of Waterloo Waterloo, Canada Electrical \& Computer Engineering University of Waterloo Waterloo, Canada

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出了一种基于雷达的轻量模型驱动4D雷达框架,在恶劣环境中实现稳定的人体检测。

Journal ref IEEE PerCom 2026

详情

展开后加载摘要…

URL PDF HTML 收藏