arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2025-12-23 至 2025-12-23 共收录 28 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 10 篇

2507.14501 2025-12-23 cs.CV 90%

Advances in Feed-Forward 3D Reconstruction and View Synthesis: A Survey

反向馈送3D重建与视角合成的进展:综述

Jiahui Zhang, Yuelei Li, Anpei Chen, Muyu Xu, Kunhao Liu, Jianyuan Wang, Xiao-Xiao Long, Hanxue Liang, Zexiang Xu, Hao Su, Christian Theobalt, Christian Rupprecht, Andrea Vedaldi, Kaichen Zhou, Hanspeter Pfister, Paul Pu Liang, Shijian Lu, Fangneng Zhan

机构 * NTU(国立台湾大学) Caltech(加州理工学院) Westlake University(西湖大学) UCSD(加州大学圣地亚哥分校) University of Oxford(牛津大学) Nanjing University(南京大学) HKU(香港大学) University of Cambridge(剑桥大学) Hillbot MPI for Informatics(信息研究所) Harvard University(哈佛大学) MIT(麻省理工学院)

专题命中 三维重建 :3D reconstruction(title,abstract);3D vision(abstract);NeRF(abstract);Gaussian Splatting(abstract)

AI总结 本文综述了反向馈送方法在3D重建与视角合成中的进展,涵盖多种表示架构及应用,探讨了关键任务和未来研究方向。

Comments A project page associated with this survey is available at https://fnzhan.com/projects/Feed-Forward-3D

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17955 2025-12-23 cs.CV 79%

A Modular Framework for Single-View 3D Reconstruction of Indoor Environments

单视角室内环境3D重建的模块化框架

Yuxiao Li

机构 * Digital Humanities Lab(数字人文实验室) Photogrammetry and Remote Sensing Lab(摄影测量与遥感实验室)

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.CV

AI总结 本文提出了一种基于扩散技术的模块化框架,用于单视角室内环境的3D重建,通过多个核心模块提升重建精度和质量。

Comments Master's thesis

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08930 2025-12-23 cs.CV cs.GR 73%

Selfi: Self Improving Reconstruction Engine via 3D Geometric Feature Alignment

Selfi: 通过3D几何特征对齐实现自改进的重建引擎

Youming Deng, Songyou Peng, Junyi Zhang, Kathryn Heal, Tiancheng Sun, John Flynn, Steve Marschner, Lucy Chai

机构 * Cornell University(康奈尔大学) Google(谷歌) UC Berkeley(加州大学伯克利分校)

专题命中 三维重建 :3D reconstruction(abstract);novel view synthesis(abstract);分类 cs.CV、cs.GR

AI总结 Selfi通过特征对齐提升3D重建精度,利用VGGT输出作为伪地面真实值,实现NVS和姿态估计的高性能表现。

Comments Project Page: https://denghilbert.github.io/selfi/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18655 2025-12-23 cs.CV 70%

SplatBright: Generalizable Low-Light Scene Reconstruction from Sparse Views via Physically-Guided Gaussian Enhancement

SplatBright: 从稀疏视角进行通用低光照场景重建的物理引导高斯增强

Yue Wen, Liang Song, Hesheng Wang

机构 * Shanghai Jiao Tong University(上海交通大学) China DXR Technology CO.,Ltd(中国DXR技术有限公司)

专题命中 三维重建 :3D reconstruction(abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 SplatBright通过物理引导的照明建模和几何-外观解耦,实现了从稀疏视角进行低光照场景重建的通用3D高斯框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18429 2025-12-23 cs.CV eess.IV 70%

E-RGB-D: Real-Time Event-Based Perception with Structured Light

E-RGB-D:基于事件的实时感知与结构光

Seyed Ehsan Marjani Bajestani, Giovanni Beltrame

专题命中 三维重建 :3D reconstruction(abstract);point cloud(abstract);分类 cs.CV

AI总结 E-RGB-D通过结合结构光和事件相机技术,实现高帧率颜色和深度感知,推动计算机视觉在多个领域的应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18161 2025-12-23 cs.CV 70%

Local Patches Meet Global Context: Scalable 3D Diffusion Priors for Computed Tomography Reconstruction

局部片段与全局上下文:用于计算机断层扫描重建的可扩展3D扩散先验

Taewon Yang, Jason Hu, Jeffrey A. Fessler, Liyue Shen

机构 * EECS Department, University of Michigan(密歇根大学电子工程与计算机科学系)

专题命中 三维重建 :3D reconstruction(abstract);3D generation(abstract);分类 cs.CV

AI总结 本文提出一种3D片段基扩散模型,通过学习3D片段先验实现高效高分辨率3D CT重建,优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19390 2025-12-23 cs.RO cs.CV cs.GR 67%

TwinAligner: Visual-Dynamic Alignment Empowers Physics-aware Real2Sim2Real for Robotic Manipulation

TwinAligner: 视觉-动态对齐赋能物理感知的实境到仿真到现实的机器人操控

Hongwei Fan, Hang Dai, Jiyao Zhang, Jinzhou Li, Qiyang Yan, Yujie Zhao, Mingju Gao, Jinghang Wu, Hao Tang, Hao Dong

机构 * CFCS, School of Computer Science, Peking University(计算机学院,北京大学CFCS) PKU-AgiBot Lab(北京大学AgiBot实验室) State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(多媒体信息处理国家重点实验室,计算机学院,北京大学)

专题命中 三维重建 :3DGS(abstract);分类 cs.CV、cs.GR、cs.RO

AI总结 TwinAligner通过视觉和动态对齐技术,解决仿真与现实之间的差距,提升机器人操控的可扩展学习能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19684 2025-12-23 cs.CV cs.RO 62%

Zero-shot Reconstruction of In-Scene Object Manipulation from Video

从视频中进行零样本场景物体操作重建

Dixuan Lin, Tianyou Wang, Zhuoyang Pan, Yufu Wang, Lingjie Liu, Kostas Daniilidis

机构 * University of Pennsylvania(宾夕法尼亚大学) University of Oxford(牛津大学)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV、cs.RO

AI总结 本文提出了一种基于数据驱动模型的零样本方法,用于从视频中重建场景中的物体操作,通过两阶段优化实现手-物体运动的准确重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19560 2025-12-23 cs.CV cs.AI 57%

BabyFlow: 3D modeling of realistic and expressive infant faces

BabyFlow:真实且富有表现力的婴儿面部的3D建模

Antonia Alomar, Mireia Masias, Marius George Linguraru, Federico M. Sukno, Gemma Piella

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 BabyFlow通过归一化流和跨年龄表情迁移,实现婴儿面部的高精度3D建模与表情生成,提升早期发育障碍检测的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.10700 2025-12-23 q-bio.GN math.CO math.MG math.OC 50%

Single-cell 3D genome reconstruction in the haploid setting using rigidity theory

利用刚体理论进行单细胞3D基因组重建(单倍体设置)

Sean Dewar, Georg Grasegger, Kaie Kubjas, Fatemeh Mohammadi, Anthony Nixon

专题命中 三维重建 :3D reconstruction(abstract)

AI总结 本文提出了一种基于半正定规划的3D基因组重建方法,利用刚体理论在单倍体设置下实现单细胞数据的基因组结构解析。

Journal ref Journal of Mathematical Biology, Volume 90, article number 45, (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. Gaussian Splatting 11 篇

2505.04262 2025-12-23 cs.CV 88%

Bridging Geometry-Coherent Text-to-3D Generation with Multi-View Diffusion Priors and Gaussian Splatting

弥合几何一致性文本到3D生成与多视图扩散先验和高斯点云

Feng Yang, Wenliang Qian, Wangmeng Zuo, Hui Li

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3D generation(title,abstract);分类 cs.CV

AI总结 本文提出耦合分数蒸馏框架,通过多视图联合分布先验和高斯点云优化,实现几何一致的文本到3D生成。

Comments Accepted by Neural Networks. The final published version is available at https://doi.org/10.1016/j.neunet.2025.108511

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18692 2025-12-23 cs.CV 85%

EcoSplat: Efficiency-controllable Feed-forward 3D Gaussian Splatting from Multi-view Images

EcoSplat: 可控效率的多视角图像前馈3D高斯点云生成

Jongmin Park, Minh-Quan Viet Bui, Juan Luis Gonzalez Bello, Jaeho Moon, Jihyong Oh, Munchurl Kim

机构 * KAIST(韩国科学技术院) Flawless AI Department of Imaging Science, GSAIM, Chung-Ang University(Chung-Ang 大学影像科学系)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 EcoSplat是一种可控制效率的前馈3D高斯点云生成框架,通过两阶段优化过程实现自适应的3D表示生成,适用于灵活的下游渲染任务。

Comments The first two authors contributed equally to this work (equal contribution). The last two authors advised equally to this work. Please visit our project page at https://kaist-viclab.github.io/ecosplat-site/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.14579 2025-12-23 cs.CV cs.AI 83%

GSRender: Deduplicated Occupancy Prediction via Weakly Supervised 3D Gaussian Splatting

GSRender: 通过弱监督的3D高斯点划法实现去重的占用预测

Qianpu Sun, Changyong Shu, Sifan Zhou, Runxi Cheng, Yongxian Wei, Zichen Yu, Dawei Yang, Sirui Han, Yuan Chun

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Houmo AI Dalian University of Technology(大连理工大学) The Hong Kong University of Science and Technology(香港科学与技术大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);NeRF(abstract);分类 cs.CV

AI总结 GSRender通过弱监督3D高斯点划法和射线补偿模块,有效减少占用预测中的重复问题,提升户外自动驾驶的感知性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01171 2025-12-23 cs.CV 83%

No Pose at All: Self-Supervised Pose-Free 3D Gaussian Splatting from Sparse Views

无姿态:从稀疏视图实现自监督的无姿态3D高斯点云渲染

Ranran Huang, Krystian Mikolajczyk

机构 * Imperial College London(伦敦帝国学院)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 SPFSplat通过自监督方法实现无姿态的3D高斯点云渲染,无需真实姿态信息即可在稀疏视图下实现高质量的视点合成和姿态估计。

Comments Project Page: https://ranrhuang.github.io/spfsplat/

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.00625 2025-12-23 cs.CV cs.GR 81%

Gaussian Building Mesh (GBM): Extract a Building's 3D Mesh with Google Earth and Gaussian Splatting

高斯建筑网格(GBM):利用Google Earth和高斯点散布提取建筑的3D网格

Kyle Gao, Liangzhi Li, Hongjie He, Dening Lu, Linlin Xu, Jonathan Li

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV、cs.GR

AI总结 本文提出一种基于Google Earth和高斯点散布的方法,通过建筑名称、地址或地理坐标提取建筑的3D网格。

Journal ref Remote Sensing Applications: Society and Environment 40 2025 101807

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19648 2025-12-23 cs.CV 79%

4D Gaussian Splatting as a Learned Dynamical System

4D高斯散射作为学习到的动态系统

Arnold Caleb Asiimwe, Carl Vondrick

机构 * Princeton University(普林斯顿大学) Columbia University(哥伦比亚大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 本文提出EvoGS,将4D高斯散射视为学习到的动态系统,通过连续时间演化提升动态场景建模的效率与可控性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05769 2025-12-23 cs.CV 79%

Digital Twin Buildings: 3D Modeling, GIS Integration, and Visual Descriptions Using Gaussian Splatting, ChatGPT/Deepseek, and Google Maps Platform

数字孪生建筑:利用高斯点扩散、ChatGPT/DeepSeek和Google地图平台进行3D建模、GIS集成和视觉描述

Kyle Gao, Dening Lu, Liangzhi Li, Nan Chen, Hongjie He, Linlin Xu, Jonathan Li

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 本文提出了一种基于高斯点扩散、ChatGPT和Google地图平台的数字孪生建筑框架,用于实现建筑的3D建模、GIS集成和视觉描述。

Comments -Fixed minor typo

Journal ref IEEE Geoscience and Remote Sensing Letters 22 (2025) 6013405

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17817 2025-12-23 cs.CV 77%

Chorus: Multi-Teacher Pretraining for Holistic 3D Gaussian Scene Encoding

Chorus:多教师预训练用于整体3D高斯场景编码

Yue Li, Qi Ma, Runyi Yang, Mengjiao Ma, Bin Ren, Nikola Popovic, Nicu Sebe, Theo Gevers, Luc Van Gool, Danda Pani Paudel, Martin R. Oswald

机构 * University of Amsterdam(阿姆斯特丹大学) ETH Zürich(苏黎世联邦理工学院) University of Trento(特伦托大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract);point cloud(abstract);分类 cs.CV

AI总结 Chorus通过多教师预训练方法,实现对3D高斯场景的高效编码,提升多任务表现并实现数据高效监督。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18314 2025-12-23 cs.CV cs.GR 73%

MatSpray: Fusing 2D Material World Knowledge on 3D Geometry

MatSpray:将2D材料知识融合到3D几何中

Philipp Langsteiner, Jan-Niklas Dihlmann, Hendrik P. A. Lensch

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3D reconstruction(abstract);分类 cs.CV、cs.GR

AI总结 MatSpray通过结合学习和投影方法,将2D材料数据融合到3D几何中,提升渲染的真实性和效率。

Comments Project page: https://matspray.jdihlmann.com/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19678 2025-12-23 cs.CV cs.AI 70%

WorldWarp: Propagating 3D Geometry with Asynchronous Video Diffusion

WorldWarp: 通过异步视频扩散传播3D几何

Hanyang Kong, Xingyi Yang, Xiaoxu Zheng, Xinchao Wang

机构 * National University of Singapore(新加坡国立大学) The Hong Kong Polytechnic University(香港理工大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract);分类 cs.CV

AI总结 WorldWarp通过结合3D结构锚和2D生成细化器,利用时空扩散模型实现几何一致的视频生成,解决遮挡和复杂轨迹问题。

Comments Project page: https://hyokong.github.io/worldwarp-page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18386 2025-12-23 cs.CV 57%

RecurGS: Interactive Scene Modeling via Discrete-State Recurrent Gaussian Fusion

RecurGS: 通过离散状态递归高斯融合实现交互式场景建模

Wenhao Hu, Haonan Zhou, Zesheng Li, Liu Liu, Jiacheng Dong, Zhizhong Su, Gaoang Wang

机构 * Zhejiang University(浙江大学) Horizon Robotics Nanyang Technological University(南洋理工大学)

专题命中 Gaussian Splatting :novel view synthesis(abstract);分类 cs.CV

AI总结 RecurGS通过递归融合框架实现离散状态的交互式场景建模,提升3D环境的更新效率和逼真度。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 点云 3 篇

2507.19121 2025-12-23 cs.CV 79%

Preserving Topological and Geometric Embeddings for Point Cloud Recovery

保持拓扑和几何嵌入以恢复点云

Kaiyue Zhou, Zelong Tan, Hongxiao Wang, Ya-Li Li, Shengjin Wang

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 本文提出TopGeoFormer架构,通过融合拓扑和几何嵌入提升点云恢复性能。

Comments Accepted to AAAI 202

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19088 2025-12-23 cs.CV 57%

Retrieving Objects from 3D Scenes with Box-Guided Open-Vocabulary Instance Segmentation

通过框引导的开放词汇实例分割从3D场景中检索物体

Khanh Nguyen, Dasith de Silva Edirimuni, Ghulam Mubashar Hassan, Ajmal Mian

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出了一种基于2D开放词汇检测器引导的3D实例分割方法,用于从RGB图像中快速准确检索稀有物体实例。

Comments Accepted to AAAI 2026 Workshop on New Frontiers in Information Retrieval

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08483 2025-12-23 eess.SP 50%

FMCW Radar Principles and Human Activity Recognition Systems: Foundations, Techniques, and Applications

FMCW雷达原理与人类活动识别系统:基础、技术与应用

Ziqian Bi, Jiawei Xu, Xinyuan Song, Ming Liu

专题命中 点云 :point cloud(abstract)

AI总结 本书系统阐述FMCW雷达原理及人类活动识别技术,涵盖信号处理、深度学习应用及实际案例,适用于雷达领域研究人员和开发者。

Comments 203pages

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 3D生成 1 篇

2504.11734 2025-12-23 cs.GR cs.CV 62%

Recent Advances in 3D Object and Scene Generation: A Survey

近年来3D对象和场景生成的最新进展:综述

Xiang Tang, Ruotong Li, Xiaopeng Fan

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Pengcheng Laboratory(鹏城实验室) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 3D生成 :3D generation(abstract);分类 cs.CV、cs.GR

AI总结 本文综述了3D对象和场景生成的最新进展,分析了主流生成模型和技术路径,指出了当前挑战与未来研究方向。

Comments 35 pages, 7 figures, 6 tables, Project page: https://github.com/xdlbw/Awesome-3D-Object-and-Scene-Generation

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 空间理解 1 篇

2512.19609 2025-12-23 cs.CV cs.AI 57%

MapTrace: Scalable Data Generation for Route Tracing on Maps

MapTrace: 用于地图路线追踪的可扩展数据生成

Artemis Panagopoulou, Aveek Purohit, Achin Kulshrestha, Soroosh Yazdani, Mohit Goyal

机构 * Google XR(谷歌XR) University of Pennsylvania(宾夕法尼亚大学)

专题命中 空间理解 :spatial understanding(abstract);分类 cs.CV

AI总结 MapTrace通过合成数据生成提升地图路线追踪性能,微调模型使成功率提升6.4个百分点,减少路径追踪误差。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. SLAM与定位 1 篇

2403.20034 2025-12-23 cs.CV cs.RO 79%

NeSLAM: Neural Implicit Mapping and Self-Supervised Feature Tracking With Depth Completion and Denoising

NeSLAM: 基于深度补全与去噪的神经隐式映射与自监督特征跟踪

Tianchen Deng, Yanbo Wang, Hongle Xie, Hesheng Wang, Jingchuan Wang, Danwei Wang, Weidong Chen

机构 * Institute of Medical Robotics and Department of Automation, Shanghai Jiao Tong University(上海交通大学医疗机器人研究所和自动化系) Key Laboratory of System Control and Information Processing, Ministry of Education, Shang hai 200240, China(教育部系统控制与信息处理重点实验室,上海200240,中国) School of Electrical and Electronic Engineering, Nanyang Technological University(南洋理工大学电子与电气工程学院)

专题命中 SLAM与定位 :NeRF(abstract);3D reconstruction(abstract);novel view synthesis(abstract);分类 cs.CV、cs.RO

AI总结 NeSLAM通过深度补全与去噪网络和SDF表示,实现高精度的3D重建、鲁棒的相机跟踪和视点合成。

Journal ref IEEE Transactions on Automation Science and Engineering, vol. 22, pp. 12309-12321, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

7. 其他3D视觉 1 篇

2512.18573 2025-12-23 cs.CV cs.AI cs.LG 57%

Placenta Accreta Spectrum Detection Using an MRI-based Hybrid CNN-Transformer Model

基于MRI的混合CNN-Transformer模型用于胎盘黏连谱检测

Sumaiya Ali, Areej Alhothali, Ohoud Alzamzami, Sameera Albasri, Ahmed Abduljabbar, Muhammad Alwazzan

机构 * Department of Computer Science, Faculty of Computing and Information Technology, King Abdulaziz University(计算机科学系,计算与信息科技学院,国王阿卜杜勒阿齐兹大学) Faculty of Medicine, King Abdulaziz University(医学学院,国王阿卜杜勒阿齐兹大学) Department of Radiology, King Abdulaziz University Hospital(放射科,国王阿卜杜勒阿齐兹大学医院)

专题命中 其他3D视觉 :3D vision(abstract);分类 cs.CV

AI总结 本文提出基于MRI的混合CNN-Transformer模型,用于提高胎盘黏连谱检测的准确性和及时性。

详情

展开后加载摘要…

URL PDF HTML 收藏