arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2025-11-27 至 2025-11-27 共收录 25 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 7 篇

2511.21459 2025-11-27 cs.GR 83%

Resolution Where It Counts: Hash-based GPU-Accelerated 3D Reconstruction via Variance-Adaptive Voxel Grids

关键区域的分辨率:基于哈希的GPU加速3D重建 via 变异自适应体素网格

Lorenzo De Rebotti, Emanuele Giacomini, Giorgio Grisetti, Luca Di Giammarino

专题命中 三维重建 :3D reconstruction(title,abstract);Gaussian Splatting(abstract);分类 cs.GR

AI总结 本文提出一种基于哈希的GPU加速3D重建方法,通过变异自适应体素网格实现高内存效率和实时可扩展性,相比传统方法提升了性能并保持重建精度。

Comments Accepted for publication in ACM Transaction on Graphics. Project site: https://rvp-group.github.io/mrhash/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19031 2025-11-27 cs.RO 79%

Multi-Agent Monocular Dense SLAM With 3D Reconstruction Priors

多智能体单目密集SLAM与3D重建先验

Yuchen Zhou, Haihang Wu

机构 * Xi'an Jiaotong-Liverpool University(西安交通大学利物浦大学) Southeast University(东南大学)

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.RO

AI总结 本文提出首个多智能体单目密集SLAM系统,通过学习3D重建先验提升效率和精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21098 2025-11-27 cs.CV cs.AI cs.GR 62%

Pygmalion Effect in Vision: Image-to-Clay Translation for Reflective Geometry Reconstruction

视觉中的皮格马利翁效应:图像到陶土翻译用于反思几何重建

Gayoung Lee, Junho Kim, Jin-Hwa Kim, Junmo Kim

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.GR

AI总结 本文提出视觉中的皮格马利翁效应,通过图像到陶土的翻译方法,抑制镜面线索并保持几何一致性,实现复杂反射场景下的稳健3D重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.09646 2025-11-27 cs.CV cs.RO 62%

Hamba: Single-view 3D Hand Reconstruction with Graph-guided Bi-Scanning Mamba

Hamba: 基于图引导双扫描Mamba的单视角3D手形重建

Haoye Dong, Aviral Chharia, Wenbo Gou, Francisco Vicente Carrasco, Fernando De la Torre

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.RO

AI总结 Hamba通过图引导双扫描Mamba框架,高效学习关节空间关系,实现更准确的3D手形重建。

Comments NeurIPS 2024; Project Website: https://humansensinglab.github.io/Hamba/

Journal ref NeurIPS, Vancouver, Canada, 2024, pp. 2127-2160

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21113 2025-11-27 cs.CV 57%

FaithFusion: Harmonizing Reconstruction and Generation via Pixel-wise Information Gain

FaithFusion:通过像素级信息增益和谐融合重建与生成

YuAn Wang, Xiaofan Li, Chi Huang, Wenhao Zhang, Hao Li, Bosheng Wang, Xun Sun, Jun Wang

机构 * Baidu Inc.(百度公司) Nanjing University(南京大学)

专题命中 三维重建 :3DGS(abstract);分类 cs.CV

AI总结 FaithFusion通过像素级信息增益融合3DGS与扩散模型,实现高保真的驾驶场景生成。

Comments 16 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20366 2025-11-27 cs.CV 57%

VGGTFace: Topologically Consistent Facial Geometry Reconstruction in the Wild

VGGTFace: 在真实世界中实现拓扑一致的面部几何重建

Xin Ming, Yuxuan Han, Tianyu Huang, Feng Xu

机构 * Xin Ming, Yuxuan Han, Tianyu Huang, Feng Xu(作者)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 VGGTFace通过引入VGGT和Pixel3DMM实现高效拓扑一致的面部几何重建,适用于真实世界多视角图像。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03394 2025-11-27 cs.CV 57%

Learning Normals of Noisy Points by Local Gradient-Aware Surface Filtering

通过局部梯度感知的表面过滤学习噪声点的法线

Qing Li, Huifang Feng, Xun Gong, Yu-Shen Liu

机构 * Southwest Jiaotong University(西南交通大学) Xihua University(西华大学) Tsinghua University(清华大学)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 本文提出一种基于局部梯度感知的表面过滤方法,用于从噪声点云中学习法线,通过隐式函数和投影约束提升法线估计和表面重建性能。

Comments Accepted by ICCV 2025. Project page: https://leoqli.github.io/LGSF/

详情

展开后加载摘要…

URL PDF HTML 收藏

2. NeRF 1 篇

2511.20804 2025-11-27 cs.CV cs.LG 85%

$Δ$-NeRF: Incremental Refinement of Neural Radiance Fields through Residual Control and Knowledge Transfer

Δ-NeRF:通过残差控制和知识迁移实现神经辐射场的增量细化

Kriti Ghosh, Devjyoti Chakraborty, Lakshmish Ramaswamy, Suchendra M. Bhandarkar, In Kee Kim, Nancy O'Hare, Deepak Mishra

专题命中 NeRF :NeRF(title,abstract);3D reconstruction(abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 Δ-NeRF通过残差控制和知识迁移实现NeRF的增量细化,减少训练时间并提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. Gaussian Splatting 6 篇

2505.21890 2025-11-27 cs.CV 87%

Diffusion-Denoised Hyperspectral Gaussian Splatting

扩散去噪超光谱高斯点云

Sunil Kumar Narayanan, Lingjun Zhao, Lu Gan, Yongsheng Chen

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);NeRF(abstract);3DGS(abstract);3D reconstruction(abstract)

AI总结 本文提出DD-HGS方法,通过引入波长敏感的球谐函数、光谱损失和扩散去噪器,实现超光谱场景的3D显式重建,提升3D高斯点云方法的性能。

Comments Accepted to 3DV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21265 2025-11-27 cs.CV 83%

Unlocking Zero-shot Potential of Semi-dense Image Matching via Gaussian Splatting

通过高斯点划技术解锁半密集图像匹配的零样本潜力

Juncheng Chen, Chao Xu, Yanjun Cao

机构 * Zhejiang University(浙江大学) Huzhou Institute of Zhejiang University(浙江大学湖州研究院)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract);分类 cs.CV

AI总结 MatchGS通过高斯点划技术系统修正3DGS几何结构,生成高精度对应标签,提升零样本图像匹配性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11473 2025-11-27 cs.CV 83%

VA-GS: Enhancing the Geometric Representation of Gaussian Splatting via View Alignment

VA-GS: 通过视图对齐增强高斯散射的几何表示

Qing Li, Huifang Feng, Xun Gong, Yu-Shen Liu

机构 * Southwest Jiaotong University(西南交通大学) Xihua University(西华大学) Tsinghua University(清华大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 VA-GS通过视图对齐提升高斯散射的几何表示,结合边缘感知和可见性感知损失,优化表面重建与多视图一致性。

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18389 2025-11-27 cs.CV 83%

FastAvatar: Instant 3D Gaussian Splatting for Faces from Single Unconstrained Poses

FastAvatar: 从单张无约束姿态图像快速重建高质量3D高斯点云人脸

Hao Liang, Zhixuan Ge, Soumendu Majee, Ashish Tiwari, G. M. Dilshan Godaliyadda, Ashok Veeraraghavan, Guha Balakrishnan

机构 * Rice University(里士大学) Samsung Research America(三星研究美国分公司)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract);分类 cs.CV

AI总结 FastAvatar通过两阶段方法快速重建高质量3D人脸,实现逼真渲染与表情动画,提升单图像人脸重建效率与鲁棒性。

Comments 11 pages, 5 figures, website: https://hliang2.github.io/FastAvatar/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07856 2025-11-27 cs.CV 80%

XYZCylinder: Towards Compatible Feed-Forward 3D Gaussian Splatting for Driving Scenes via Unified Cylinder Lifting Method

XYZCylinder: 通过统一圆柱提升方法实现兼容的前馈3D高斯点云生成用于驾驶场景

Haochen Yu, Qiankun Liu, Hongyuan Liu, Jianfei Jiang, Juntao Lyu, Jiansheng Chen, Huimin Ma

专题命中 Gaussian Splatting :Gaussian Splatting(title,comments);3D reconstruction(abstract);分类 cs.CV

AI总结 XYZCylinder通过统一圆柱提升方法实现兼容的前馈3D高斯点云生成,提升驾驶场景重建的兼容性和精度

Comments Feed-Forward, 3D Gaussian Splatting, Project page: https://yuyuyu223.github.io/XYZCYlinder-projectpage/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21367 2025-11-27 cs.CV 57%

Endo-G$^{2}$T: Geometry-Guided & Temporally Aware Time-Embedded 4DGS For Endoscopic Scenes

Endo-G$^{2}$T: 以几何引导和时间感知的时间嵌入4DGS用于内窥镜场景

Yangle Liu, Fengze Li, Kan Liu, Jieming Ma

机构 * University of Liverpool(利物浦大学) Xi'an Jiaotong--Liverpool University(西安交通大学利物浦大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 Endo-G$^{2}$T通过几何引导和时间感知的方法,提升内窥镜场景中4DGS的时间一致性与效率,实现最先进的单目重建性能。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 点云 8 篇

2511.21191 2025-11-27 cs.CV 85%

Scenes as Tokens: Multi-Scale Normal Distributions Transform Tokenizer for General 3D Vision-Language Understanding

场景作为标记:多尺度正常分布变换标记器用于通用3D视觉-语言理解

Yutao Tang, Cheng Zhao, Gaurav Mittal, Rohith Kukkala, Rama Chellappa, Cheng Peng, Mei Chen

机构 * Johns Hopkins University(约翰霍普金斯大学) Microsoft(微软公司)

专题命中 点云 :3D vision(title,abstract);point cloud(abstract);spatial understanding(abstract);分类 cs.CV

AI总结 NDTokenizer3D通过多尺度NDT表示和解码器实现通用3D视觉-语言理解,提升3D场景任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21574 2025-11-27 cs.CV cs.AI 83%

Multimodal Robust Prompt Distillation for 3D Point Cloud Models

多模态鲁棒提示蒸馏用于3D点云模型

Xiang Gu, Liming Lu, Xu Zheng, Anan Du, Yongbin Zhou, Shuchao Pang

机构 * Xiang Gu 1 , Liming Lu 1 1 1 footnotemark: 1 , Xu Zheng 2,3 , Anan Du 4 , Yongbin Zhou 1 , Shuchao Pang 1 2 2 footnotemark: 2(某大学)

专题命中 点云 :point cloud(title,abstract);3D vision(abstract);分类 cs.CV

AI总结 多模态鲁棒提示蒸馏通过多模态知识蒸馏提升3D点云模型的鲁棒性,有效防御多种对抗攻击。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21365 2025-11-27 cs.CV 79%

PFF-Net: Patch Feature Fitting for Point Cloud Normal Estimation

PFF-Net:点云法向量估计的补丁特征拟合

Qing Li, Huifang Feng, Kanle Shi, Yue Gao, Yi Fang, Yu-Shen Liu, Zhizhong Han

机构 * School of Computing and Artificial Intelligence, Southwest Jiaotong University(计算机与人工智能学院,西南交通大学) School of Computer and Software Engineering, Xihua University(计算机与软件工程学院,西华大学) School of Software, Tsinghua University(软件学院,清华大学) Kuaishou Technology(快手科技) Center for Artificial Intelligence and Robotics, New York University Abu Dhabi(人工智能与机器人中心,纽约大学阿布扎克校区) Department of Computer Science, Wayne State University(计算机科学系,韦恩州立大学)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 PFF-Net通过多尺度特征融合和聚合,实现点云法向量估计的高效准确预测。

Comments Accepted by TVCG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05613 2025-11-27 cs.CV cs.AI cs.LG 79%

PointNSP: Autoregressive 3D Point Cloud Generation with Next-Scale Level-of-Detail Prediction

PointNSP: 基于下一尺度细节预测的自回归3D点云生成

Ziqiao Meng, Qichao Wang, Zhiyang Dou, Zixing Song, Zhipeng Zhou, Irwin King, Peilin Zhao

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 PointNSP通过多尺度分解和下一尺度预测,实现自回归3D点云生成,首次在该范式中达到最先进的生成质量,并在效率和可扩展性上超越扩散基线。

Comments This work was intended as a replacement of arXiv:2503.08594 and any subsequent updates will appear there

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08573 2025-11-27 astro-ph.CO cs.LG stat.ML 71%

Reconstructing the local density field with combined convolutional and point cloud architecture

结合卷积和点云架构重建局部密度场

Baptiste Barthe-Gold, Nhat-Minh Nguyen, Leander Thiele

机构 * Ecole Polytechnique Rte de Saclay, 91120 Palaiseau, France(巴黎-萨克雷高等理工学院) Center for Data-Driven Discovery Kavli IPMU, UTIAS, The University of Tokyo(数据驱动发现中心) The University of Tokyo(东京大学)

专题命中 点云 :point cloud(title)

AI总结 本文提出结合卷积和点云架构的神经网络,用于基于暗物质团的异常速度重建局部密度场,提升了小尺度的聚类特征恢复能力。

Comments 6 pages, 4 figures, 1 table. Accepted at the NeurIPS 2025 Workshop: ML4PS. Comments welcome!

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21422 2025-11-27 cs.CV 57%

E-M3RF: An Equivariant Multimodal 3D Re-assembly Framework

E-M3RF:一个等价多模态3D重装配框架

Adeela Islam, Stefano Fiorini, Manuel Lecha, Theodore Tsesmelis, Stuart James, Pietro Morerio, Alessio Del Bue

机构 * Fondazione Istituto Italiano di Tecnologia(意大利技术研究院) University of Genova(热那亚大学) Durham University(杜伦大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 E-M3RF通过多模态特征融合和SE(3)流匹配,有效提升3D碎片重装配的精度与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16833 2025-11-27 cs.CV 57%

Open Vocabulary Monocular 3D Object Detection

开放词汇单目3D物体检测

Jin Yao, Hao Gu, Xuweiyi Chen, Jiayun Wang, Zezhou Cheng

机构 * University of Virginia(弗吉尼亚大学) California Institute of Technology(加州理工学院)

专题命中 点云 :3D vision(abstract);分类 cs.CV

AI总结 本文提出了一种开放词汇单目3D检测方法,通过整合预训练的2D和3D视觉模型,解决3D标注稀缺和语义歧义问题,实现对新类别的零样本检测和已有类别的域内检测。

Comments 3DV 2026, Project page: https://cvlab.cs.virginia.edu/ovmono3d

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20954 2025-11-27 cs.CG cs.DS math.AT 50%

$δ$-core subsampling, strong collapses and TDA

基于强坍缩的$δ$-core子采样方法在拓扑数据分析中的应用

Elias Gabriel Minian

专题命中 点云 :point cloud(abstract)

AI总结 本文提出基于强坍缩的$δ$-core子采样方法,用于拓扑数据分析,通过减少计算复杂度同时保留拓扑特征,并在实验中验证了其有效性。

Comments 14 pages, 8 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 3D生成 1 篇

2412.06698 2025-11-27 cs.CV 79%

Gen-3Diffusion: Realistic Image-to-3D Generation via 2D & 3D Diffusion Synergy

Gen-3Diffusion:通过2D与3D扩散协同实现逼真图像到3D生成

Yuxuan Xue, Xianghui Xie, Riccardo Marin, Gerard Pons-Moll

机构 * University of Tübingen(图宾根大学) Tübingen AI Center(图宾根人工智能中心) Max Planck Institute for Informatics, Saarland Informatics Campus(马克斯·普朗克信息研究所,萨尔兰州信息校园)

专题命中 3D生成 :3D generation(title,abstract);分类 cs.CV

AI总结 Gen-3Diffusion通过2D与3D扩散模型协同生成逼真3D物体和化身,提升多视图一致性和泛化能力。

Comments Accepted to Transaction on Pattern Analysis and Machine Intelligence (T-PAMI). Project Page: https://yuxuan-xue.com/gen-3diffusion. arXiv admin note: substantial text overlap with arXiv:2406.08475

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 空间理解 1 篇

2509.12718 2025-11-27 cs.CV 57%

EvoEmpirBench: Dynamic Spatial Reasoning with Agent-ExpVer

EvoEmpirBench: 基于智能体经验的动态空间推理

Pukun Zhao, Longxiang Wang, Miaowei Wang, Chen Chen, Fanqing Zhou, Haojian Huang

机构 * Guangdong University of Finance and Economics(广东金融学院) Chongqing University(重庆大学) University of Edinburgh(爱丁堡大学) The University of Hong Kong(香港大学)

专题命中 空间理解 :spatial understanding(abstract);分类 cs.CV

AI总结 EvoEmpirBench通过动态空间基准评估模型在部分可观测和动态环境下的空间推理与记忆能力,揭示主流模型的限制并提供未来研究平台。

Comments Accepted by AAAI 2026, 29 pages, 3 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏

7. SLAM与定位 1 篇

2511.21647 2025-11-27 physics.med-ph 50%

Fast 3D Ultrasound Localization Microscopy via Projection-based Processing Framework

基于投影处理框架的快速三维超声定位显微镜

Jingke Zhang, Jingyi Yin, U-Wai Lok, Lijie Huang, Ryan M. DeRuiter, Tao Wu, Kaipeng Ji, Yanzhe Zhao, James D. Krier, Xiang-yang Zhu, Lilach O. Lerman, Chengwu Huang, Shigao Chen

专题命中 SLAM与定位 :3D reconstruction(abstract)

AI总结 本研究提出基于投影处理框架的快速三维超声定位显微镜方法,通过将三维流程转化为二维操作,显著降低计算负担并提升处理效率,实现实时反馈与临床应用的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏