arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-01-21 至 2026-01-21 共收录 36 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 9 篇

2503.08930 2026-01-21 eess.SP cs.CV cs.RO 81%

Acoustic Neural 3D Reconstruction Under Pose Drift

基于姿态漂移的声学神经3D重建

Tianxiang Lin, Mohamad Qadri, Kevin Zhang, Adithya Pediredla, Christopher A. Metzler, Michael Kaess

机构 * Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.CV、cs.RO

AI总结 本文提出了一种联合优化神经场景表示和声纳姿态的算法,以提升在姿态漂移下的声学3D重建精度。

Comments 8 pages, 8 figures. This paper is accepted by 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13603 2026-01-21 cs.CG 67%

DCCVT: Differentiable Clipped Centroidal Voronoi Tessellation

DCCVT:可微剪裁中心点 Voronoi 分区

Wylliam Cantin Charawi, Adrien Gruson, Jane Wu, Christian Desrosiers, Diego Thomas

专题命中 三维重建 :3D reconstruction(abstract);point cloud(abstract)

AI总结 DCCVT 通过可微剪裁 CVTs 从噪声 SDF 中提取高质量 3D 网格,提升 3D 重建质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12481 2026-01-21 cs.CV cs.GR 62%

NeuralFur: Animal Fur Reconstruction From Multi-View Images

NeuralFur: 从多视角图像中重建动物毛发

Vanessa Sklyarova, Berna Kabadayi, Anastasios Yiannakidis, Giorgio Becherini, Michael J. Black, Justus Thies

机构 * Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所) ETH Zürich(苏黎世联邦理工学院) Technical University of Darmstadt(德累斯顿技术大学) University of Tübingen(图宾根大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.GR

AI总结 NeuralFur通过视觉语言模型指导多视角图像重建,实现不同动物的高保真3D毛发建模。

Comments For additional results and code, please refer to https://neuralfur.is.tue.mpg.de

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12257 2026-01-21 cs.CV cs.AI cs.CG cs.GR 62%

Soft Shadow Diffusion (SSD): Physics-inspired Learning for 3D Computational Periscopy

软阴影扩散(SSD):面向3D计算望远镜的物理启发学习

Fadlullah Raji, John Murray-Bruce

机构 * University of South Florida(佛罗里达州立大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.GR

AI总结 SSD通过物理启发的学习方法,实现了从普通NLOS照片中对隐藏场景的3D重建,具有良好的鲁棒性和泛化能力。

Journal ref European Conference on Computer Vision (ECCV 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13979 2026-01-21 cs.RO 57%

Active Cross-Modal Visuo-Tactile Perception of Deformable Linear Objects

主动跨模态视觉-触觉感知用于可变形线性物体

Raffaele Mazza, Ciro Natale, Pietro Falco

机构 * Dipartimento di Ingegneria, Università degli Studi della Campania Luigi Vanvitelli(工程学院,坎帕尼亚路易吉·范维蒂利大学) Dipartimento di Ingegneria dell’Informazione, Università degli Studi di Padova(信息工程学院,帕多瓦大学)

专题命中 三维重建 :point cloud(abstract);分类 cs.RO

AI总结 本文提出一种结合视觉和触觉的跨模态感知框架,用于重建受遮挡的可变形线性物体的3D形状。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13371 2026-01-21 cs.CV 57%

Spherical Geometry Diffusion: Generating High-quality 3D Face Geometry via Sphere-anchored Representations

球面几何扩散:通过球锚定表示生成高质量3D人脸几何

Junyi Zhang, Yiming Wang, Yunhong Lu, Qichao Wang, Wenzhe Qian, Xiaoyin Xu, David Gu, Min Zhang

专题命中 三维重建 :3D generation(abstract);分类 cs.CV

AI总结 本文提出球面几何扩散方法,通过球锚定表示生成高质量3D人脸几何,结合2D生成模型实现可控生成。

Comments Association for the Advancement of Artificial Intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05839 2026-01-21 cs.CV 57%

GeoSurDepth: Harnessing Foundation Model for Spatial Geometry Consistency-Oriented Self-Supervised Surround-View Depth Estimation

GeoSurDepth:利用基础模型实现以空间几何一致性为导向的自监督周围视图深度估计

Weimin Liu, Wenjun Wang, Joshua H. Meng

机构 * State Key Laboratory of Intelligent Green Vehicle and Mobility, School of Vehicle and Mobility, Tsinghua University, Beijing 100084, China(1 智能绿色车辆与移动国家重点实验室,车辆与移动学院,清华大学,北京100084,中国) California PATH, University of California, Berkeley, CA, United States(2 加州PATH,加州大学伯克利分校,加州,美国)

专题命中 三维重建 :novel view synthesis(abstract);分类 cs.CV

AI总结 GeoSurDepth通过利用基础模型和几何一致性,实现了更鲁棒的自监督周围视图深度估计,验证了其在自动驾驶中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12736 2026-01-21 cs.CV 57%

KaoLRM: Repurposing Pre-trained Large Reconstruction Models for Parametric 3D Face Reconstruction

KaoLRM:重新利用预训练的大型重建模型进行参数化3D人脸重建

Qingtian Zhu, Xu Cao, Zhixiang Wang, Yinqiang Zheng, Takafumi Taketomi

机构 * The University of Tokyo(东京大学) CyberAgent

专题命中 三维重建 :Gaussian Splatting(abstract);分类 cs.CV

AI总结 KaoLRM通过重新利用预训练的大型重建模型的先验知识,结合FLAME基于的2D高斯点散布,实现了更准确且鲁棒的参数化3D人脸重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01969 2026-01-21 cs.CV 57%

MC3D-AD: A Unified Geometry-aware Reconstruction Model for Multi-category 3D Anomaly Detection

MC3D-AD:一种多类3D异常检测的统一几何感知重建模型

Jiayi Cheng, Can Gao, Jie Zhou, Jiajun Wen, Tao Dai, Jinbao Wang

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 MC3D-AD通过统一的几何感知重建模型实现多类3D异常检测,提升重建能力和检测性能。

Comments 7 pages of main text, 3 pages of appendix, accepted to IJCAI 2025

Journal ref https://www.ijcai.org/proceedings/2025/94

详情

展开后加载摘要…

URL PDF HTML 收藏

2. NeRF 1 篇

2507.13861 2026-01-21 cs.CV 57%

PositionIC: Unified Position and Identity Consistency for Image Customization

PositionIC: 统一的位置和身份一致性用于图像定制

Junjie Hu, Tianyang Han, Kai Ma, Jialin Gao, Song Yang, Xianhua He, Junfeng Luo, Xiaoming Wei, Wenqiang Zhang

机构 * MeiGen AI Team, Meituan(美团MeiGen AI团队) Shanghai Key Lab of Intelligent Information Processing, College of Computer Science and Artificial Intelligence, Fudan University(上海智能信息处理关键实验室,计算机科学与人工智能学院,复旦大学) College of Intelligent Robotics and Advanced Manufacturing, Fudan University(智能机器人与先进制造学院,复旦大学)

专题命中 NeRF :NeRF(abstract);分类 cs.CV

AI总结 PositionIC通过统一框架实现高保真、空间可控的多主体图像定制,引入BMPDS数据合成和可视化感知注意力机制,提升空间精度与身份一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. Gaussian Splatting 11 篇

2601.14208 2026-01-21 cs.CV cs.GR cs.LG 88%

Rig-Aware 3D Reconstruction of Vehicle Undercarriages using Gaussian Splatting

基于相机 rig 的车辆底盘 3D 重建使用高斯溅射

Nitin Kulkarni, Akhil Devarashetti, Charlie Cluss, Livio Forte, Dan Buckmaster, Philip Schneider, Chunming Qiao, Alina Vereshchaka

机构 * University at Buffalo(布法罗大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3D reconstruction(title);point cloud(abstract);分类 cs.CV、cs.GR

AI总结 提出一种基于相机 rig 的 3D 重建方法,利用高斯溅射生成逼真的车辆底盘模型,提升检查效率和买家信任度。

Comments 8 pages, 9 figures, Conference: IEEE International Conference on Machine Learning and Applications 2025 (ICMLA 2025): https://www.icmla-conference.org/icmla25/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13948 2026-01-21 cs.CV 85%

Light4GS: Lightweight Compact 4D Gaussian Splatting Generation via Context Model

Light4GS: 通过上下文模型实现轻量级紧凑的4D高斯点云生成

Mufan Liu, Qi Yang, He Huang, Wenjie Huang, Zhenlong Yuan, Zhu Li, Yiling Xu

机构 * School of Information Science and Electronic Engineering, Shanghai Jiao Tong University(信息科学与电子工程学院,上海交通大学) School of Science and Engineering, University of Missouri–Kansas City(科学与工程学院,密苏里大学-堪萨斯城分校) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 Light4GS通过显著性剪枝和深度上下文模型实现轻量级4D高斯点云生成,提升压缩效率和渲染速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06424 2026-01-21 cs.CV 83%

Deblur4DGS: 4D Gaussian Splatting from Blurry Monocular Video

Deblur4DGS:从模糊单目视频中进行4D高斯散射

Renlong Wu, Zhilu Zhang, Mingyang Chen, Zifei Yan, Wangmeng Zuo

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract);分类 cs.CV

AI总结 Deblur4DGS通过引入曝光正则化和多分辨率一致性正则化,从模糊单目视频中高质量重建4D模型,提升视频去模糊、帧插值和稳定效果。

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12814 2026-01-21 cs.CV 83%

CSGaussian: Progressive Rate-Distortion Compression and Segmentation for 3D Gaussian Splatting

CSGaussian:渐进率失真压缩与分割用于3D高斯溅射

Yu-Jen Tseng, Chia-Hao Kao, Jing-Zhong Chen, Alessandro Gnutti, Shao-Yuan Lo, Yen-Yu Lin, Wen-Hsiao Peng

机构 * National Yang Ming Chiao Tung University University of Brescia National Taiwan University

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract);分类 cs.CV

AI总结 CSGaussian提出一种统一框架,通过整合语义学习实现3D高斯溅射的率失真优化压缩与分割,提升场景编辑与操作能力。

Comments Accepted at WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09291 2026-01-21 cs.GR 83%

TIDI-GS: Floater Suppression in 3D Gaussian Splatting for Enhanced Indoor Scene Fidelity

TIDI-GS:在3D高斯散射中消除浮游物以提升室内场景保真度

Sooyeun Yang, Cheyul Im, Jee Won Lee, Jongseong Brad Choi

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract);分类 cs.GR

AI总结 TIDI-GS通过消除3D高斯散射中的浮游物提升室内场景保真度,采用轻量级插件方式改进几何结构和视觉质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04754 2026-01-21 cs.CV 83%

ProFuse: Efficient Cross-View Context Fusion for Open-Vocabulary 3D Gaussian Splatting

ProFuse: 高效的跨视角上下文融合用于开放词汇3D高斯点云渲染

Yen-Jen Chiou, Wei-Tse Cheng, Yuan-Fu Yang

机构 * National Yang Ming Chiao Tung University(国家阳明交通大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract);分类 cs.CV

AI总结 ProFuse通过高效的跨视角上下文融合方法,实现开放词汇3D高斯点云渲染的快速语义附着。

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04984 2026-01-21 cs.CV 79%

OceanSplat: Object-aware Gaussian Splatting with Trinocular View Consistency for Underwater Scene Reconstruction

OceanSplat: 基于三目视图一致性的物体感知高斯点云法用于水下场景重建

Minseong Kweon, Jinsun Park

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 OceanSplat通过三目视图一致性与深度感知调整,实现高保真水下场景重建与恢复。

Comments Accepted to AAAI 2026. Project page: https://oceansplat.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11772 2026-01-21 cs.CV 79%

studentSplat: Your Student Model Learns Single-view 3D Gaussian Splatting

studentSplat: 你的学生模型学习单视图3D高斯散射

Yimu Pan, Hongda Mao, Qingshuang Chen, Yelin Kim

机构 * The Pennsylvania State University(宾夕法尼亚州立大学) Amazon(亚马逊公司)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 studentSplat通过教师-学生架构和外推网络,实现单视图3D场景重建,达到最先进的单视图重建质量并具备自监督深度估计能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12683 2026-01-21 cs.CV eess.IV 74%

GaussianTrimmer: Online Trimming Boundaries for 3DGS Segmentation

GaussianTrimmer: 3DGS 分割的在线边界修剪

Liwei Liao, Ronggang Wang

机构 * Peking University Shenzhen Graduate School(北京大学深圳研究生院)

专题命中 Gaussian Splatting :3DGS(title);分类 cs.CV

AI总结 GaussianTrimmer通过生成虚拟相机和基于2D分割结果的原语层面修剪,提升3D高斯分割的边界质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10231 2026-01-21 cs.CV 57%

SuperGSeg: Open-Vocabulary 3D Segmentation with Structured Super-Gaussians

SuperGSeg: 基于结构化超高斯的开放词汇3D分割

Siyun Liang, Sen Wang, Kunyi Li, Michael Niemeyer, Stefano Gasperini, Hendrik P. A. Lensch, Nassir Navab, Federico Tombari

机构 * Technical University of Munich(慕尼黑技术大学) University of Tübingen(图宾根大学) Google(谷歌) Munich Center for Machine Learning(慕尼黑机器学习中心) VisualAIs(视觉人工智能)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 SuperGSeg通过结构化超高斯实现开放词汇3D分割,结合神经3D高斯体和语言特征蒸馏,提升场景理解与分割性能。

Comments 13 pages, 8 figures. Project page: supergseg.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12020 2026-01-21 cs.CV 57%

DIAMOND-SSS: Diffusion-Augmented Multi-View Optimization for Data-efficient SubSurface Scattering

DIAMOND-SSS: 用于数据高效次表面散射的扩散增强多视图优化

Guillermo Figueroa-Araneda, Iris Diana Jimenez, Florian Hofherr, Manny Ko, Hector Andrade-Loarca, Daniel Cremers

专题命中 Gaussian Splatting :3DGS(abstract);分类 cs.CV

AI总结 DIAMOND-SSS通过扩散模型实现高保真透明重建,利用极稀疏监督生成逼真增强效果,将实际捕获需求降低90%。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 点云 9 篇

2601.12391 2026-01-21 cs.CV 79%

Class-Partitioned VQ-VAE and Latent Flow Matching for Point Cloud Scene Generation

类分区的VQ-VAE与潜在流匹配用于点云场景生成

Dasith de Silva Edirimuni, Ajmal Saeed Mian

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 本文提出类分区VQ-VAE与潜在流匹配模型,实现无需外部数据库的点云场景生成,有效减少重建误差。

Comments Accepted to AAAI 2026, Main Technical Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11099 2026-01-21 cs.CV 79%

SM3D: Mitigating Spectral Bias and Semantic Dilution in Point Cloud State Space Models

SM3D: 缓解点云状态空间模型中的频谱偏差和语义稀释

Bin Liu, Chunyang Wang, Xuelian Liu

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 SM3D通过几何频谱补偿器和语义一致性细化器缓解点云状态空间模型中的频谱偏差和语义稀释问题,提升几何保真度和语义一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12261 2026-01-21 eess.IV cs.CV 79%

DALD-PCAC: Density-Adaptive Learning Descriptor for Point Cloud Lossless Attribute Compression

DALD-PCAC:基于密度适应的学习描述符用于点云无损属性压缩

Chunyang Fu, Ge Li, Wei Gao, Shiqi Wang, Zhu Li, Shan Liu

机构 * City University of Hong Kong(香港城市大学) Peking University Shenzhen Graduate School(北京大学深圳研究生院) University of Missouri-Kansas City(密苏里大学-堪萨斯城分校) Tencent Media Laboratory(腾讯媒体实验室)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 DALD-PCAC通过密度适应学习描述符和注意力机制,实现点云无损属性压缩的高效压缩与鲁棒性提升。

Comments Accepted by TOMM

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12255 2026-01-21 eess.IV cs.CV cs.IT cs.MM math.IT 79%

DeepRAHT: Learning Predictive RAHT for Point Cloud Attribute Compression

DeepRAHT: 基于稀疏张量的端到端预测RAHT点云属性压缩学习

Chunyang Fu, Tai Qin, Shiqi Wang, Zhu Li

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 DeepRAHT通过稀疏张量实现端到端预测RAHT点云属性压缩,提升压缩效率与鲁棒性。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13373 2026-01-21 cs.CV 57%

A Lightweight Model-Driven 4D Radar Framework for Pervasive Human Detection in Harsh Conditions

一种轻量化的模型驱动4D雷达框架,用于在恶劣条件下进行 pervasive 人类检测

Zhenan Liu, Amir Khajepour, George Shaker

机构 * Mechanical \& Mechatronics Engineering University of Waterloo Waterloo, Canada Electrical \& Computer Engineering University of Waterloo Waterloo, Canada

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出了一种基于雷达的轻量模型驱动4D雷达框架,在恶劣环境中实现稳定的人体检测。

Journal ref IEEE PerCom 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13364 2026-01-21 cs.CV 57%

Real-Time 4D Radar Perception for Robust Human Detection in Harsh Enclosed Environments

实时4D雷达感知用于恶劣封闭环境中的可靠人类检测

Zhenan Liu, Yaodong Cui, Amir Khajepour, George Shaker

机构 * University of Waterloo(滑铁卢大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出了一种实时4D毫米波雷达感知方法,通过噪声过滤和基于规则的分类流程,在尘埃环境中实现可靠的人类检测。

Journal ref 2025 IEEE International Symposium on Antennas and Propagation and North American Radio Science Meeting (AP-S/CNC-USNC-URSI)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06467 2026-01-21 cs.CV 57%

Does DINOv3 Set a New Medical Vision Standard? Benchmarking 2D and 3D Classification, Segmentation, and Registration

DINOv3 是否设定了医学视觉的新标准?对2D和3D分类、分割与配准的基准测试

Che Liu, Yinda Chen, Haoyuan Shi, Jinpeng Lu, Bailiang Jian, Jiazhen Pan, Linghan Cai, Jiayi Wang, Jieming Yu, Ziqi Gao, Xiaoran Zhang, Long Bai, Yundi Zhang, Jun Li, Cosmin I. Bercea, Cheng Ouyang, Chen Chen, Zhiwei Xiong, Benedikt Wiestler, Christian Wachinger, James S. Duncan, Daniel Rueckert, Wenjia Bai, Rossella Arcucci

机构 * Imperial College London(伦敦帝国理工学院) University of Science and Technology of China(中国科学技术大学) Dresden University of Technology(德累斯顿技术大学) University of Erlangen-Nuremberg(埃尔兰根-纽伦堡大学) University of Oxford(牛津大学) University of Sheffield(谢菲尔德大学) Technical University of Munich (TUM)(慕尼黑技术大学) Munich Center for Machine Learning(慕尼黑机器学习中心) The Hong Kong University of Science and Technology(香港科学与技术大学) The Chinese University of Hong Kong(香港中文大学) Yale University(耶鲁大学)

专题命中 点云 :3D reconstruction(abstract);分类 cs.CV

AI总结 DINOv3在医学视觉任务中表现出色,但其在深度领域专门化任务中存在性能退化问题。

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12524 2026-01-21 cs.DC 50%

SGCP: A Self-Organized Game-Theoretic Framework For Collaborative Perception

SGCP:一种自组织博弈论框架用于协作感知

Zechuan Gong, Hui Zhang, Yuquan Yang, Wenyu Lu

专题命中 点云 :point cloud(abstract)

AI总结 SGCP通过自组织博弈框架实现车辆协作感知,提升自动驾驶的安全性和感知精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11716 2026-01-21 physics.ins-det cs.LG hep-ex hep-ph 50%

AllShowers: One model for all calorimeter showers

AllShowers: 一个用于所有 calorimeter shower 的模型

Thorsten Buss, Henry Day-Hall, Frank Gaede, Gregor Kasieczka, Katja Krüger

机构 * Institut für Experimentalphysik, Universität Hamburg(实验物理研究所,汉堡大学) Deutsches Elektronen-Synchrotron DESY(德国电子同步辐射实验室DESY)

专题命中 点云 :point cloud(abstract)

AI总结 AllShowers是一种统一的生成模型,能够高效模拟多种粒子类型的calorimeter shower,提升碰撞实验中探测器模拟的保真度和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏