arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-08-28 至 2026-08-28 共收录 16 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 1 篇

2608.27301 2026-08-28 cs.GR cs.CV cs.HC 新提交 91%

Comparative Evaluation of 3D Reconstruction Methods for Immersive Visualization of Laboratory Objects

面向实验室对象沉浸式可视化的三维重建方法对比评估

Brian De La Cruz, Aaron Y. Zhao, Maitrey Gramopadhye, Sawyer J. Lazar, Xianming Tan, Daniel Szafir, David S. Lawrence

专题命中 三维重建 :NeRF(summary_cn,abstract);3D reconstruction(title,abstract);Gaussian Splatting(abstract,abstract_cn);分类 cs.CV、cs.GR

AI总结 本研究对比评估了摄影测量法、NeRF等四种三维重建方法,发现基于NeRF的方法生成的实验室物品全息模型保真度最高,可为AR/MR教育环境提供沉浸式学习对象的实用流程。

Comments 36 pages, 18 figures, 16 tables

详情

展开后加载摘要…

URL PDF HTML 收藏

2. Gaussian Splatting 8 篇

2608.26383 2026-08-28 cs.RO 新提交 92%

Cross-Platform Benchmark of Neural 3D Reconstruction for Autonomous Laboratory Robots

面向自主实验室机器人的神经三维重建跨平台基准测试

Yongho Kim, Mengjiao Han, Victor Mateevitsi, Silvio Rizzi, Michael E. Papka, Nicola Ferrier

机构 * Argonne National Laboratory(阿贡国家实验室) University of Illinois Chicago(芝加哥大学伊利诺伊分校) Northwestern University(西北大学)

专题命中 Gaussian Splatting :NeRF(summary_cn,abstract);Gaussian Splatting(summary_cn,abstract);3D reconstruction(title,abstract);分类 cs.RO

AI总结 本研究针对自主实验室机器人的神经三维重建,开展跨平台基准测试,评估NeRF、3D Gaussian Splatting及SAM3D的性能,为构建分层重建流水线提供依据。

Comments This manuscript is peer-reviewed from the committees in the workshop "VAxAutoSci: Visual Analytics in the Age of Autonomous Scientific Discovery" in conjunction with 2026 IEEE Visualization & Visual Analytics

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26868 2026-08-28 cs.CV cs.RO 新提交 91%

CGS-SLAM: Collaborative Gaussian Splatting based SLAM for Multi-Agent Reconstruction

CGS-SLAM:基于协作高斯溅射(Gaussian Splatting)的多智能体重建SLAM算法

Jean-Daniel de Ambrogi, Aladine Chetouani, Vincent Nguyen, Aurélien Chateigner

机构 * Université Sorbonne Paris Nord(巴黎北大学) SAS IMPACT(SAS IMPACT公司) Université d’Orléans(奥尔良大学) INSA CVL(中央卢瓦尔河谷国立应用科学学院)

专题命中 Gaussian Splatting :Gaussian Splatting(title,title_cn);3DGS(summary_cn,abstract);novel view synthesis(abstract);分类 cs.CV、cs.RO

AI总结 该研究针对消费级智能手机无RGB-D输入、多智能体3DGS协作SLAM方法缺失的问题,提出仅用RGB和惯性数据的CGS-SLAM算法,结合局部跟踪、动态关键帧共享与中央服务器子图对齐,在GNSS拒止环境下实现多智能体重建,性能优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26951 2026-08-28 cs.CV cs.AI 新提交 91%

Per-View Gaussian Predictions Enable Training-Free Distractor Filtering in Feed-Forward 3DGS

逐视图高斯预测实现前馈3DGS中无需训练的干扰物过滤

Kangmin Seo, Jae-Pil Heo

机构 * Sungkyunkwan University(成均馆大学)

专题命中 Gaussian Splatting :3DGS(title,title_cn);Gaussian Splatting(abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 该研究针对前馈3DGS中瞬态物体引发的伪影问题,提出无需训练的干扰物过滤流程,可在多模型和基准上提升新视图质量且保留干净场景原始重建。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21695 2026-08-28 cs.CV cs.GR 版本更新 90%

RefracGS: Novel View Synthesis Through Refractive Water Surfaces with 3D Gaussian Ray Tracing

RefracGS:通过折射水表面进行新颖视图合成

Yiming Shao, Qiyu Dai, Chong Gao, Guanbin Li, Yequan Wang, He Sun, Qiong Zeng, Baoquan Chen, Wenzheng Chen

机构 * Shandong University, China(山东大学) Peking University, Beijing, China(北京大学) Sun Yat-sen University, China(中山大学) Beijing Academy of Artificial Intelligence, Beijing, China(北京人工智能研究院)

专题命中 Gaussian Splatting :novel view synthesis(title,abstract);NeRF(abstract,abstract_cn);3DGS(abstract,abstract_cn);Gaussian Splatting(abstract)

AI总结 RefracGS通过3D高斯射线追踪方法,结合折射水面与底层场景的重建,实现高保真新颖视图合成,实验表明其在视觉质量和效率上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26948 2026-08-28 cs.CV 新提交 89%

KISS-GS: 3D Gaussian Splatting Compression Kept Simple

KISS-GS:保持简单的3D高斯溅射压缩

Wieland Morgenstern, Friedrich Elias Branschke, Florian Fleischmann, Adrian Szatmari, Paul Schlack, Florian Barthel, Peter Eisert, Anna Hilsmann

机构 * Fraunhofer HHI(弗劳恩霍夫海因里希·赫兹研究所) Humboldt-Universität zu Berlin(柏林洪堡大学) Technische Universität Berlin(柏林工业大学)

专题命中 Gaussian Splatting :3DGS(summary_cn,abstract);Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 KISS-GS是将压缩与训练解耦的模块化3DGS压缩流程,结合剪枝、SOG-XT编码等技术实现85-319倍压缩,解码依赖Web原生图像格式,率失真性能优于紧密集成方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08575 2026-08-28 cs.CV 版本更新 79%

ReSplat: Learning Recurrent Gaussian Splatting

ReSplat: 学习递归高斯点散射

Haofei Xu, Daniel Barath, Andreas Geiger, Marc Pollefeys

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 ReSplat通过递归高斯点散射方法,利用渲染误差反馈信号实现高效3D重建,减少高斯点数量并提升渲染速度,取得最佳性能。

Comments ECCV 2026, Spotlight. Project page: this https URL (https://haofeixu.github.io/resplat/) Code: this https URL (https://github.com/cvg/resplat)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26656 2026-08-28 cs.CV cs.AI 新提交 77%

CoGeo-GS: Concept-Driven and Geometry-Aware Multi-Object Removal in 3D Scenes

CoGeo-GS:3D场景中基于概念驱动与几何感知的多物体移除方法

Yuanxiang Ni, Xianliang Huang, Chenhang Ma, Chen Xiao, Yuewen Ma, Ruxin Wang, Hao Zhang

机构 * Southern University of Science and Technology(南方科技大学) ByteDance(字节跳动) Zhejiang University(浙江大学) Fudan University(复旦大学) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 针对3D场景多物体移除的挑战,提出CoGeo-GS框架,通过概念感知语义标签与几何感知补全流水线实现可控多物体移除,在视觉质量与重建保真度上优于现有方法。

Comments 6 pages, 4 figures, accepted at ICME 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04802 2026-08-28 cs.CV cs.AI 版本更新 57%

Egosurg: Arbitrary view synthesis for egocentric replay of operating room workflows from ambient cameras

EgoSurg:基于环境相机的手术室工作流程自我中心视角回放的任意视角合成

Han Zhang, Lalithkumar Seenivasan, Jose L. Porras, Roger D. Soberanis-Mukul, Hao Ding, Hongchao Shu, Benjamin D. Killeen, Ankita Ghosh, Lonny Yarmus, Jeffrey K. Jopling, Masaru Ishii, Angela C. Argento, Mathias Unberath

机构 * Johns Hopkins University(约翰霍普金斯大学) Johns Hopkins Medical Institutions(约翰霍普金斯医学机构)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 EgoSurg框架基于环境相机的立体视频重建手术室场景,渲染角色特定的自我中心视角,经评估可实现高质量重建,支持手术安全审查、培训等应用。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 点云 6 篇

2608.02883 2026-08-28 cs.CV 版本更新 79%

Test Time Adaptation Methods for Point Cloud Registration in Laparoscopic Surgery

腹腔镜手术中点云配准的测试时自适应方法

Nina Bodelot, Soufiane Belharbi, Eric Granger

机构 * ETS Montreal(蒙特利尔理工学院) LIVIA(LIVIA实验室)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 该研究针对腹腔镜手术中点云配准的域偏移问题,修改三类测试时自适应方法适配三维配准,经实验验证输入自适应是低延迟且误差降低效果稳定的最优方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27491 2026-08-28 cs.CV 版本更新 79%

SelectAnyTree: A Promptable Instance Segmentation Model for 3D Forest LiDAR Point Clouds

SelectAnyTree: 一种用于3D森林LiDAR点云的可提示实例分割模型

Trung Thanh Nguyen, Daniel Lusk, Kilian Gerberding, Janusch Vajna-Jehle, Tuan-Anh Vu, Duc Viet Le, Tu Vo, Phi Le Nguyen, Yasutomo Kawanishi, Takahiro Komamizu, Ichiro Ide, Julian Frey, Teja Kattenborn

机构 * Nagoya University(名古屋大学) RIKEN(理化学研究所) University of Freiburg(弗莱堡大学) University of California, Los Angeles(加州大学洛杉矶分校) University of Twente(特温特大学) KC Machine Learning Lab(KC机器学习实验室) Hanoi University of Science and Technology(河内科技大学) Ritsumeikan University(立命馆大学)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 提出SelectAnyTree模型,通过点击提示和树冠高度模型引导的首次提示,实现3D森林点云中任意单木的实例分割,在交互和实例级别上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26490 2026-08-28 cs.LG stat.ML 新提交 71%

Bayesian methods and Markov chain Monte Carlo algorithms for curve reconstruction and point cloud data analysis

用于曲线重建与点云数据分析的贝叶斯方法及马尔可夫链蒙特卡洛算法

Asir Intesar Tushar, Ioannis Sgouralis

机构 * University of Tennessee(田纳西大学)

专题命中 点云 :point cloud(title)

AI总结 本文针对点云数据量大、含噪声及缺失信息,现有重建无不确定性量化的问题,提出全贝叶斯框架与适配的MCMC采样器,经合成及LiDAR数据实验,实现精确曲线重建与不确定性量化。

Comments 32 pages and 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27073 2026-08-28 cs.CV cs.RO 新提交 62%

SpatialCrafter: Single Image World Modeling with Generative 3D Proxies

SpatialCrafter:基于生成式3D代理的单图像世界建模

Chuan Fang, Lingteng Qiu, Yixun Liang, Rui Chen, Kunming Luo, Zhaohua Zheng, Tongyuan Bai, Feipeng Tian, Zilong Dong, Zihan Zhou, Ping Tan

机构 * Hong Kong University of Science and Technology(香港科技大学) Tongyi Lab, Alibaba Group(阿里巴巴集团通义实验室) ManyCore Tech Inc.(ManyCore科技公司) Jilin University(吉林大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV、cs.RO

AI总结 SpatialCrafter是解决图像到场景生成问题的两阶段框架,通过3D代理及相关策略提升3D一致性,构建了115K场景的新数据集,性能优于现有方法且鲁棒性强。

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26589 2026-08-28 cs.CV 新提交 57%

DPA-I2P: Depth-Guided Projective Alignment for Image-to-Point-Cloud Registration in Autonomous Driving

DPA-I2P:面向自动驾驶中图像与点云配准的深度引导投影对齐

Wenxin Zhang, Hang Li, Zhiwei Xu, Qiankun Dong, Gang Wang, Tao Li

机构 * Nankai University(南开大学) Haihe Lab of ITAI(海河人工智能与信息技术实验室)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文针对自动驾驶中图像与点云配准的跨模态对应学习难题,提出DPA-I2P方法,通过RMDE、PVL与CQP提升配准性能,在KITTI、nuScenes数据集上较基线方法有显著提升,可迁移性更好。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09828 2026-08-28 cs.CV 版本更新 57%

Latent Spatial Memory for Video World Models

视频世界模型的潜在空间记忆

Weijie Wang, Haoyu Zhao, Yifan Yang, Feng Chen, Zeyu Zhang, Yefei He, Zicheng Duan, Donny Y. Chen, Yuqing Yang, Bohan Zhuang

机构 * Zhejiang University(浙江大学) Microsoft Research(微软研究院) Adelaide University(阿德莱德大学) Monash University(莫纳什大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出潜在空间记忆框架Mirage,通过在扩散潜在空间中直接构建和查询3D缓存,避免像素空间重建,实现高效视频生成,速度提升10.57倍,内存减少55倍。

Comments Project Page: this https URL (https://aka.ms/latent-spatial-memory), Code: this https URL (https://github.com/microsoft/LatentSpatialMemory)

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 其他3D视觉 1 篇

2606.07775 2026-08-28 cs.CV 版本更新 57%

DALE-CT: Depth-Aware 2D Slice Encoders Learn an Anatomical World Model of Chest CT

DALE-CT: 用于计算机断层扫描的深度感知基础模型

Evan W. Damron, Mahmut S. Gokmen, Mitchell A. Klusty, Caroline N. Leach, Emily B. Collier, V. K. Cody Bumgardner

机构 * University of Kentucky(肯塔基大学)

专题命中 其他3D视觉 :3D vision(abstract);分类 cs.CV

AI总结 提出DALE-CT,一种基于LeJEPA的2D切片模型,通过3D深度感知预训练(利用解剖掩膜和异常标注)提升表示质量,在CT多异常检测中达到与3D视觉语言模型近似的性能。

Comments 18 pages, 5 figures, 13 tables

详情

展开后加载摘要…

URL PDF HTML 收藏