arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2025-12-22 至 2025-12-22 共收录 15 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 5 篇

2512.17459 2025-12-22 cs.CV 74%

3D-RE-GEN: 3D Reconstruction of Indoor Scenes with a Generative Framework

3D-RE-GEN:基于生成框架的室内场景三维重建

Tobias Sautter, Jan-Niklas Dihlmann, Hendrik P. A. Lensch

专题命中 三维重建 :3D reconstruction(title);分类 cs.CV

AI总结 3D-RE-GEN通过生成框架实现单图像室内场景的高质量三维重建,结合多领域模型提升重建精度与实用性。

Comments Project Page: https://3dregen.jdihlmann.com/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17907 2025-12-22 cs.CV 57%

Dexterous World Models

灵巧世界模型

Byungjun Kim, Taeksoo Kim, Junyoung Lee, Hanbyul Joo

机构 * Seoul National University(首尔国立大学) RLWRLD

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 灵巧世界模型通过场景-动作-条件的视频扩散框架,实现静态3D场景与灵巧人类动作的动态交互模拟,推动交互式数字双胞胎的发展。

Comments Project Page: snuvclab.github.io/dwm

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17773 2025-12-22 cs.CV cs.AI 57%

Pix2NPHM: Learning to Regress NPHM Reconstructions From a Single Image

Pix2NPHM:从单张图像回归NPHM重建

Simon Giebenhain, Tobias Kirschstein, Liam Schoneveld, Davide Davoli, Zhe Chen, Matthias Nießner

机构 * Technical University of Munich(慕尼黑技术大学) Woven by Toyota(丰田织造公司) Toyota Motor Europe(丰田欧洲公司)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 Pix2NPHM通过视觉变换器直接从单张图像回归NPHM参数,实现高保真面部3D重建与表情识别。

Comments Project website: https://simongiebenhain.github.io/Pix2NPHM/ , Video: https://www.youtube.com/watch?v=MgpEJC5p1Ts

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09652 2025-12-22 cs.CV cs.LG 57%

GraphCompNet: A Position-Aware Model for Predicting and Compensating Shape Deviations in 3D Printing

GraphCompNet: 一种面向位置的模型,用于预测和补偿3D打印中的形状偏差

Juheon Lee, Lei, Chen, Juan Carlos Catana, Hui Wang, Jun Zeng

机构 * IEEE

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 GraphCompNet通过结合图神经网络和GAN训练范式,实现对3D打印中位置依赖性形状偏差的预测与补偿,提升整体制造精度与适应性。

Comments Accepted manuscript. Final version published in IEEE Transactions on Automation Science and Engineering

Journal ref IEEE Transactions on Automation Science and Engineering 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.14280 2025-12-22 cs.CV 57%

EasyHOI: Unleashing the Power of Large Models for Reconstructing Hand-Object Interactions in the Wild

EasyHOI: 释放大模型潜力以重建真实场景中的手-物体交互

Yumeng Liu, Xiaoxiao Long, Zemin Yang, Yuan Liu, Marc Habermann, Christian Theobalt, Yuexin Ma, Wenping Wang

机构 * The University of Hong Kong(香港大学) ShanghaiTech University(上海科技大学) Hong Kong University of Science and Technology(香港科学大学) Nanyang Technological University(南洋理工大学) Max Planck Institute for Informatics(马克斯·普朗克研究所(信息学)) Texas A&M University(德克萨斯大学奥斯汀分校)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 EasyHOI利用大模型实现单视角下手-物体交互的重建,通过先验引导优化提升重建精度。

Comments Project page: https://lym29.github.io/EasyHOI-page/

详情

展开后加载摘要…

URL PDF HTML 收藏

2. Gaussian Splatting 4 篇

2512.17528 2025-12-22 cs.MM 82%

Voxel-GS: Quantized Scaffold Gaussian Splatting Compression with Run-Length Coding

体素-GS:基于运行长度编码的量化框架高斯点云压缩

Chunyang Fu, Xiangrui Liu, Shiqi Wang, Zhu Li

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);point cloud(abstract)

AI总结 Voxel-GS通过运行长度编码和轻量速率代理实现高斯点云的高效压缩,提升编码速度与压缩比。

Comments Accepted by DCC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17349 2025-12-22 cs.RO 70%

Flying in Clutter on Monocular RGB by Learning in 3D Radiance Fields with Domain Adaptation

在仅用单目RGB图像中飞行的 clutter 问题通过学习3D辐射场并进行域适应

Xijie Huang, Jinhan Li, Tianyue Wu, Xin Zhou, Zhichao Han, Fei Gao

机构 * State Key Laboratory of Industrial Control Technology, Zhejiang University, Hangzhou 310027, China(浙江大学工业控制技术状态重点实验室) Differential Robotics, Hangzhou 311121, China(差异机器人技术)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract);分类 cs.RO

AI总结 本文提出通过学习3D辐射场并结合域适应,使飞行机器人在仅使用单目RGB图像的情况下实现鲁棒的零样本迁移,以应对 clutter 和光照变化的挑战。

Comments 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15355 2025-12-22 cs.CV cs.AI 70%

UniGaussian: Driving Scene Reconstruction from Multiple Camera Models via Unified Gaussian Representations

UniGaussian:通过统一的高斯表示从多种相机模型进行驾驶场景重建

Yuan Ren, Guile Wu, Runhao Li, Zheyuan Yang, Yibo Liu, Xingxin Chen, Tongtong Cao, Bingbing Liu

机构 * Huawei Noah’s Ark Lab(华为诺亚实验室) University of Toronto(多伦多大学) York University(约克大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);point cloud(abstract);分类 cs.CV

AI总结 UniGaussian通过统一的高斯表示从多种相机模型实现驾驶场景重建,解决鱼眼相机的兼容性问题并提升渲染质量和速度。

Comments 3DV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15258 2025-12-22 cs.RO cs.AI 57%

VLA-AN: An Efficient and Onboard Vision-Language-Action Framework for Aerial Navigation in Complex Environments

VLA-AN:一种用于复杂环境空中导航的高效且机载视觉-语言-动作框架

Yuze Wu, Mo Zhu, Xingxing Li, Yuheng Du, Yuxin Fan, Wenjun Li, Zhichao Han, Xin Zhou, Fei Gao

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.RO

AI总结 VLA-AN通过高效机载框架提升无人机在复杂环境中的导航能力,实现8.3倍推理吞吐量提升和98.1%的成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 点云 5 篇

2512.17764 2025-12-22 cs.RO 57%

UniStateDLO: Unified Generative State Estimation and Tracking of Deformable Linear Objects Under Occlusion for Constrained Manipulation

UniStateDLO:统一的生成式状态估计与变形线性物体在遮挡下的跟踪用于受限操作

Kangchen Lv, Mingrui Yu, Shihefeng Wang, Xiangyang Ji, Xiang Li

机构 * Department of Automation, Tsinghua University(自动化系,清华大学)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 UniStateDLO通过深度学习方法实现可变形线性物体在遮挡下的鲁棒状态估计与跟踪,利用扩散模型提升复杂映射的捕捉能力,展现高效的数据利用和仿真到现实的泛化能力。

Comments The first two authors contributed equally. Project page: https://unistatedlo.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17568 2025-12-22 cs.RO 57%

Kinematics-Aware Diffusion Policy with Consistent 3D Observation and Action Space for Whole-Arm Robotic Manipulation

具有一致3D观察和动作空间的运动学感知扩散策略用于全身机械臂操作

Kangchen Lv, Mingrui Yu, Yongyi Jia, Chenyu Zhang, Xiang Li

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 本文提出一种基于一致3D空间的运动学感知扩散策略,用于提高全身机械臂操作的样本效率和空间泛化能力。

Comments The first two authors contributed equally. Project Website: https://kinematics-aware-diffusion-policy.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05144 2025-12-22 cs.CV 57%

SGS-3D: High-Fidelity 3D Instance Segmentation via Reliable Semantic Mask Splitting and Growing

SGS-3D: 通过可靠的语义掩码分割与生长实现高保真的3D实例分割

Chaolei Wang, Yang Luo, Jing Du, Siyu Chen, Yiping Chen, Ting Han

专题命中 点云 :3D vision(abstract);分类 cs.CV

AI总结 SGS-3D通过可靠的语义掩码分割与生长方法,提升3D实例分割的精度和鲁棒性,适用于多样化的室内和室外环境。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17382 2025-12-22 cs.CG 50%

Delaunay-Rips filtration: a study and an algorithm

Delaunay-Rips过滤:一项研究和一个算法

Mattéo Clémot, Julie Digne, Julien Tierny

专题命中 点云 :point cloud(abstract)

AI总结 本文提出了一种更高效的Delaunay-Rips过滤算法,通过理论分析和实验证明其在低维情况下比传统方法更快且内存占用更低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16639 2025-12-22 cs.DS 50%

Fully Dynamic Algorithms for Chamfer Distance

动态环境下计算点集的偏移距离算法

Gramoz Goranci, Shaofeng Jiang, Peter Kiss, Eva Szilagyi, Qiaoyuan Yang

专题命中 点云 :point cloud(abstract)

AI总结 本文提出了一种在动态环境下维护点集偏移距离近似的算法,基于ℓ_p范数(p=1,2)实现高效更新,适用于机器学习等实际应用。

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 3D生成 1 篇

2403.12019 2025-12-22 cs.CV 85%

LN3DIFF++: Scalable Latent Neural Fields Diffusion for Speedy 3D Generation

LN3DIFF++: 可扩展的潜在神经场扩散用于快速3D生成

Yushi Lan, Fangzhou Hong, Shangchen Zhou, Shuai Yang, Xuyi Meng, Yongwei Chen, Zhaoyang Lyu, Bo Dai, Xingang Pan, Chen Change Loy

专题命中 3D生成 :3D generation(title,abstract);3D vision(abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 LN3DIFF++通过3D感知架构和变分自编码器实现快速高质量的3D生成,优于现有方法在推理速度和生成质量上。

Comments TPAMI 2025 version of LN3Diff. Project webpage: https://nirvanalan.github.io/projects/ln3diff/ Code: https://github.com/NIRVANALAN/LN3Diff

Journal ref IEEE Transactions on Pattern Analysis and Machine Intelligence, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏