arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-02-12 至 2026-02-12 共收录 20 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 2 篇

2602.06032 2026-02-12 cs.CV 79%

Splat and Distill: Augmenting Teachers with Feed-Forward 3D Reconstruction For 3D-Aware Distillation

Splat和Distill:通过馈送式3D重建增强教师模型以实现3D感知的蒸馏

David Shavin, Sagie Benaim

机构 * Department of Computer Science(计算机科学系) The Hebrew University of Jerusalem(耶路撒冷希伯来大学)

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.CV

AI总结 Splat和Distill通过馈送式3D重建增强教师模型,提升2D VFMs的3D意识和语义丰富性。

Comments Accepted to ICLR 2026

Journal ref ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10121 2026-02-12 physics.geo-ph 50%

Comparison of generative algorithms for conceptual groundwater modeling of coastal volcanic aquifer features with disparate, sparse and extremely imbalanced data

概念性地下水建模中生成算法的比较:用于沿海火山含水层特征的异质、稀疏且极度不平衡数据

Michael J. Friedel

专题命中 三维重建 :point cloud(abstract)

AI总结 本研究提出了一种人工智能辅助的工作流程,通过生成算法整合异质、稀疏且极度不平衡的数据,以提高沿海火山含水层概念性地下水模型的准确性。

Comments 47 pages, 15 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏

2. Gaussian Splatting 8 篇

2508.02172 2026-02-12 cs.CV cs.AI cs.MM 85%

GaussianCross: Cross-modal Self-supervised 3D Representation Learning via Gaussian Splatting

GaussianCross: 通过高斯点撒技术实现跨模态自监督3D表示学习

Lei Yao, Yi Wang, Yi Zhang, Moyun Liu, Lap-Pui Chau

机构 * Hong Kong Polytechnic University(香港理工大学) Huazhong University of Science and Technology(华中科技大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract);point cloud(abstract);分类 cs.CV

AI总结 GaussianCross通过高斯点撒技术实现跨模态自监督3D表示学习,提升3D点云的表示质量和泛化能力。

Comments 14 pages, 8 figures, accepted by MM'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06109 2026-02-12 cs.GR cs.AI cs.CV 84%

LighthouseGS: Indoor Structure-aware 3D Gaussian Splatting for Panorama-Style Mobile Captures

LighthouseGS: 基于室内结构的3D高斯散点式全景式移动捕捉

Seungoh Han, Jaehoon Jang, Hyunsu Kim, Jaeheung Surh, Junhyung Kwak, Hyowon Ha, Kyungdon Joo

机构 * Ulsan National Institute of Science and Technology (UNIST)(乌山国立科学技术研究院)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);novel view synthesis(abstract);分类 cs.CV、cs.GR

AI总结 LighthouseGS通过利用室内结构和几何先验,提升单移动设备全景式捕捉的3D点估计和视图合成性能。

Comments WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10278 2026-02-12 cs.CV cs.AI 83%

ERGO: Excess-Risk-Guided Optimization for High-Fidelity Monocular 3D Gaussian Splatting

ERGO:基于超额风险的高保真单目3D高斯点云优化

Zehua Ma, Hanhui Li, Zhenyu Xie, Xiaonan Luo, Michael Kampffmeyer, Feng Gao, Xiaodan Liang

机构 * Shenzhen Campus of Sun Yat-sen University(中山大学深圳校区) Peking University(北京大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) Guilin University of Electronic Technology(桂林电子科技大学) UiT The Arctic University of Norway(UiT北欧大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 ERGO通过基于超额风险分解的自适应优化框架,提升单目3D高斯点云重建的几何和纹理保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10239 2026-02-12 cs.CV 81%

XSPLAIN: XAI-enabling Splat-based Prototype Learning for Attribute-aware INterpretability

XSPLAIN: 用于属性感知可解释性的基于Splat的原型学习框架

Dominik Galus, Julia Farganus, Tymoteusz Zapala, Mikołaj Czachorowski, Piotr Borycki, Przemysław Spurek, Piotr Syga

机构 * Wrocław University of Science and Technology(沃兹拉夫大学科学与技术学院) Jagiellonian University(雅盖隆大学) IDEAS Research Institute(IDEAS研究 institute)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract);3D reconstruction(abstract);point cloud(abstract)

AI总结 XSPLAIN是一种针对3DGS分类的可解释性框架,通过体素聚合PointNet和可逆正交变换实现特征解耦,提供直观的解释并提升用户信任。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07493 2026-02-12 cs.CV 79%

Thermal odometry and dense mapping using learned odometry and Gaussian splatting

基于学习的热力计与高密度映射:使用学习的热力计和高斯点扩散

Tianhao Zhou, Yujia Chen, Zhihao Zhan, Yuhang Ming, Jianzhu Huai

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 TOM-GS通过结合学习的热力计与高斯点扩散技术,实现了高效的热成像导航与密集地图生成,优于现有方法。

Comments 11 pages, 2 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00437 2026-02-12 cs.CV 79%

ADGaussian: Generalizable Gaussian Splatting for Autonomous Driving via Multi-modal Joint Learning

ADGaussian:通过多模态联合学习实现自动驾驶的通用高斯点云重建

Qi Song, Chenghong Li, Haotong Lin, Sida Peng, Rui Huang

机构 * School of Science and Engineering, The Chinese University of Hong Kong (Shenzhen)(中国香港中文大学(深圳)科学与工程学院) Zhejiang University(浙江大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 ADGaussian通过多模态联合学习实现自动驾驶场景的高斯点云重建,提升零样本泛化能力。

Comments The paper is accepted by ICRA 2026 and the project page can be found at https://maggiesong7.github.io/research/ADGaussian/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05515 2026-02-12 cs.CV 74%

Visibility-Aware Language Aggregation for Open-Vocabulary Segmentation in 3D Gaussian Splatting

面向可见性的语言聚合用于3D高斯平滑中的开放式词汇分割

Sen Wang, Kunyi Li, Siyun Liang, Elena Alegret, Jing Ma, Nassir Navab, Stefano Gasperini

机构 * Technical University of Munich(慕尼黑技术大学) VisualAIs Ludwig Maximilian University of Munich(慕尼黑路德维希-马克西米利安大学) University of Tübingen(图宾根大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title);分类 cs.CV

AI总结 VALA通过计算射线的边际贡献和应用可见性门,提升3D高斯平滑中开放式词汇分割的鲁棒性和一致性

Comments Project page: https://vala3d.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10173 2026-02-12 cs.CV 57%

ArtisanGS: Interactive Tools for Gaussian Splat Selection with AI and Human in the Loop

ArtisanGS: 带有AI和人机协作的高斯点选择交互工具

Clement Fuji Tsang, Anita Hu, Or Perel, Carsten Kolve, Maria Shugrina

机构 * NVIDIA NVIDIA Canada(NVIDIA 加拿大) University of Toronto Canada(多伦多大学 加拿大) NVIDIA France(NVIDIA 法国) University of Toronto(多伦多大学) Institute for Clarity in Documentation Dublin Ohio USA(文档清晰研究所 俄亥俄州 大致) Inria Paris-Rocquencourt(法国巴黎-罗克琴特研究所) Rajiv Gandhi University Doimukh Arunachal Pradesh India(拉吉夫·甘地大学 亚当穆克 阿鲁纳恰尔邦 印度) Tsinghua University Haidian Qu Beijing Shi China(清华大学 海淀区 北京市 中国) Palmer Research Laboratories San Antonio Texas USA(帕勒研究中心 肯塔基州 威斯康星州 美国)

专题命中 Gaussian Splatting :3DGS(abstract);分类 cs.CV

AI总结 ArtisanGS通过交互式工具实现高斯点选择与分割,结合AI与人工干预,提供灵活的局部编辑功能,适用于真实场景中的可控编辑。

Comments 12 pages, includes supplementary material

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 点云 8 篇

2602.10492 2026-02-12 cs.CV cs.RO 81%

End-to-End LiDAR optimization for 3D point cloud registration

端到端激光雷达优化用于3D点云配准

Siddhant Katyan, Marc-André Gardner, Jean-François Lalonde

机构 * Université Laval(拉瓦尔大学) Bentley Systems(贝恩特系统)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV、cs.RO

AI总结 本文提出端到端自适应激光雷达框架,通过动态调整参数优化点云配准,提升精度与效率,并在CARLA模拟中验证其优于固定参数方法的性能。

Comments 36th British Machine Vision Conference 2025, {BMVC} 2025, Sheffield, UK, November 24-27, 2025. Project page: https://lvsn.github.io/e2e-lidar-registration/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10871 2026-02-12 cs.HC cs.CV 79%

Viewpoint Recommendation for Point Cloud Labeling through Interaction Cost Modeling

通过交互成本建模实现点云标注的视角推荐

Yu Zhang, Xinyi Zhao, Chongke Bi, Siming Chen

机构 * School of Data Science, Fudan University(复旦大学数据科学学院) Department of Computer Science, University of Oxford(牛津大学计算机科学系) College of Intelligence and Computing, Tianjin University(天津大学智能与计算学院) Shanghai Key Laboratory of Data Science, Shanghai(上海数据科学重点实验室)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 本文提出通过交互成本建模减少点云标注时间的方法,利用Fitts定律优化视角推荐,提升标注效率。

Comments Accepted to IEEE TVCG

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18301 2026-02-12 cs.CV 79%

Contextual Range-View Projection for 3D LiDAR Point Clouds

基于上下文的视距投影用于3D激光雷达点云

Seyedali Mousavi, Seyedhamidreza Mousavi, Masoud Daneshtalab

机构 * School of Innovation, Design and Engineering(创新、设计与工程学院) Division of Intelligent Future Technologies(智能未来技术系) Mälardalen University(马尔默大学)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 本文提出CAP和CWAP两种机制,通过结合实例中心和类别标签的上下文信息,改进3D激光雷达点云的视距投影,提升实例点保留率和目标类别性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.02818 2026-02-12 cs.CV 74%

Are Dense Labels Always Necessary for 3D Object Detection from Point Cloud?

密集标签是否总是必要于点云中的3D物体检测?

Chenqiang Gao, Chuandong Liu, Jun Shu, Fangcen Liu, Jiang Liu, Luyu Yang, Xinbo Gao, Deyu Meng

机构 * School of Intelligent Systems Engineering, the Shenzhen Campus of Sun Yatsen University(南方科技大学深圳校区智能系统工程学院) School of Computer Science, Wuhan University(武汉大学计算机学院) School of Mathematics and Statistics and Ministry of Education Key Lab of Intelligent Networks and Network Security, Xi’an Jiaotong University(西安交通大学数学与统计学系和教育部智能网络与网络安全重点实验室) School of Communication and Information Engineering, Chongqing University of Posts and Telecommunications(重庆邮电大学通信与信息工程学院) Meta University of Maryland(美国马里兰大学)

专题命中 点云 :point cloud(title);分类 cs.CV

AI总结 本文提出SS3D++方法,通过稀疏注释减少标注成本,在KITTI和Waymo数据集上实现性能媲美或超越全监督方法。

Comments update

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11007 2026-02-12 cs.CV 57%

LaSSM: Efficient Semantic-Spatial Query Decoding via Local Aggregation and State Space Models for 3D Instance Segmentation

LaSSM:通过局部聚合和状态空间模型实现高效的语义-空间查询解码用于3D实例分割

Lei Yao, Yi Wang, Yawen Cui, Moyun Liu, Lap-Pui Chau

机构 * Department of Electrical and Electronic Engineering, The Hong Kong Polytechnic University(电子工程系,香港理工大学) School of Mechanical Science and Engineering, Huazhong University of Science and Technology(机械科学与工程学院,华中科技大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 LaSSM通过局部聚合和状态空间模型实现高效语义-空间查询解码,提升3D实例分割性能。

Comments Accepted at IEEE-TCSVT

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10806 2026-02-12 cs.CV 57%

DMP-3DAD: Cross-Category 3D Anomaly Detection via Realistic Depth Map Projection with Few Normal Samples

DMP-3DAD:通过真实深度图投影实现跨类3D异常检测

Zi Wang, Katsuya Hotta, Koichiro Kamide, Yawen Zou, Jianjian Qin, Chao Zhang, Jun Yu

机构 * Niigata University(Niigata大学) University of Toyama(Toyama大学) Iwate University(Iwate大学) NingboTech University(NingboTech大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 DMP-3DAD通过真实深度图投影实现跨类3D异常检测,无需训练即可高效检测少样本场景下的异常点云。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02186 2026-02-12 cs.CV cs.LG 57%

GeoPurify: A Data-Efficient Geometric Distillation Framework for Open-Vocabulary 3D Segmentation

GeoPurify: 一种数据高效的几何蒸馏框架用于开放词汇3D分割

Weijia Dou, Xu Zhang, Yi Bin, Jian Liu, Bo Peng, Guoqing Wang, Yang Yang, Heng Tao Shen

机构 * Tongji University(同济大学) Tianjin University(天津大学) University of Electronic Science and Technology of China(电子科学与技术大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 GeoPurify通过几何蒸馏和亲和网络提升3D分割的数据效率,实现高效且准确的开放词汇3D分割

Comments Accepted at ICLR 2026. Code available at: https://github.com/tj12323/GeoPurify

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23599 2026-02-12 cs.LG math.RT math.ST stat.ML stat.TH 50%

On Transferring Transferability: Towards a Theory for Size Generalization

关于转移的转移:迈向大小泛化理论

Eitan Levin, Yuxin Ma, Mateo Díaz, Soledad Villar

机构 * Department of Computing and Mathematical Sciences, Caltech(加州理工学院计算与数学科学系) Department of Applied Mathematics and Statistics and the Mathematical Institute for Data Science, Johns Hopkins University(约翰霍普金斯大学应用数学与统计学系及数据科学数学研究所)

专题命中 点云 :point cloud(abstract)

AI总结 本文提出了一种通用框架,用于研究不同维度间的转移性,并通过理论分析和实验验证了大小泛化的能力。

Comments 75 pages, 10 figures, closest to version to be published in NeurIPS

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 空间理解 1 篇

2510.21769 2026-02-12 cs.CV 57%

H2OFlow: Grounding Human-Object Affordances with 3D Generative Models and Dense Diffused Flows

H2OFlow: 通过3D生成模型和密集扩散流接地人类-物体 affordances

Harry Zhang, Luca Carlone

机构 * MIT(麻省理工学院)

专题命中 空间理解 :point cloud(abstract);分类 cs.CV

AI总结 H2OFlow通过3D生成模型和密集扩散流学习人类-物体交互的3D affordances,无需人工标注,有效泛化至现实物体。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. SLAM与定位 1 篇

2202.11496 2026-02-12 eess.IV cs.CV 57%

MITI: SLAM Benchmark for Laparoscopic Surgery

MITI:腹腔手术的SLAM基准测试

Regine Hartwig, Daniel Ostler, Jean-Claude Rosenthal, Hubertus Feußner, Dirk Wilhelm, Dirk Wollherr

专题命中 SLAM与定位 :3D reconstruction(abstract);分类 cs.CV

AI总结 MITI基准测试提供了一套用于评估微创手术中SLAM算法性能的高质量数据集,包含多模态传感器信息和校准数据,旨在推动视觉-惯性算法的发展。

Comments This submission is withdrawn because it is a duplicate of "Constrained Visual-Inertial Localization With Application And Benchmark in Laparoscopic Surgery" (arXiv:2202.11075). The withdrawn version contains less complete information. Readers are directed to the full version

详情

展开后加载摘要…

URL PDF HTML 收藏