arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-01-27 至 2026-01-27 共收录 27 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 6 篇

2601.17791 2026-01-27 cs.CV 85%

Agreement-Driven Multi-View 3D Reconstruction for Live Cattle Weight Estimation

基于共识的多视图3D重建用于活牛体重估计

Rabin Dulal, Wenfeng Jia, Lihong Zheng, Jane Quinn

机构 * Charles Sturt University(查尔斯·斯特劳特大学)

专题命中 三维重建 :3D reconstruction(title,abstract);point cloud(abstract);3D generation(abstract);分类 cs.CV

AI总结 本文提出基于共识的多视图3D重建方法,用于非接触式活牛体重估计,通过比较经典集成模型与深度学习模型,验证了提高重建质量对农场应用的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17900 2026-01-27 cs.CV 79%

Revisiting 3D Reconstruction Kernels as Low-Pass Filters

重新审视3D重建核作为低通滤波器

Shengjun Zhang, Min Chen, Yibo Wei, Mingyu Dong, Yueqi Duan

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.CV

AI总结 本文提出Jinc核和调制核,通过优化低通滤波特性提升3D重建的渲染性能。

Comments 14 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05208 2026-01-27 cs.CV 79%

MoE3D: A Mixture-of-Experts Module for 3D Reconstruction

MoE3D: 一种用于3D重建的专家混合模块

Zichen Wang, Ang Cao, Liam J. Wang, Jeong Joon Park

机构 * University of Michigan(密歇根大学)

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.CV

AI总结 MoE3D通过专家混合模块提升3D重建精度,有效减少边界伪影并提高整体重建效果,具有高效计算和良好泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17733 2026-01-27 cs.CV cs.GR 73%

Flatten The Complex: Joint B-Rep Generation via Compositional $k$-Cell Particles

扁平化复杂:通过组合k-cell粒子进行联合B-Rep生成

Junran Lu, Yuanqi Li, Hengji Li, Jie Guo, Yanwen Guo

机构 * Nanjing University(南京大学)

专题命中 三维重建 :3D reconstruction(abstract);point cloud(abstract);分类 cs.CV、cs.GR

AI总结 本文提出了一种基于组合k-cell粒子的B-Rep生成方法,通过解耦层次结构实现拓扑与几何的联合生成,提升生成模型的精度和可编辑性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04228 2026-01-27 cs.RO cs.CV 62%

Low Resolution Next Best View for Robot Packing

低分辨率最佳视图用于机器人打包

Giuseppe Fabio Preziosa, Chiara Castellano, Andrea Maria Zanchettin, Marco Faroni, Paolo Rocco

机构 * Politecnico di Milano(米兰理工学院)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.RO

AI总结 本文提出一种低分辨率最佳视图算法,通过平衡位姿冗余和获取密度,以更少的位姿实现高效的机器人打包任务。

Comments Paper accepted at IFAC ROBOTICS 2025

Journal ref IFAC-PapersOnLine (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17720 2026-01-27 cs.CV 57%

Advancing Structured Priors for Sparse-Voxel Surface Reconstruction

推进用于稀疏体素表面重建的结构先验

Ting-Hsun Chi, Chu-Rong Chen, Chi-Tun Hsu, Hsuan-Ting Lin, Sheng-Yu Huang, Cheng Sun, Yu-Chiang Frank Wang

机构 * National Taiwan University(台湾国立大学) NVIDIA

专题命中 三维重建 :Gaussian Splatting(abstract);分类 cs.CV

AI总结 本文提出一种结合3D高斯散射和稀疏体素光栅化优点的体素初始化方法,通过深度几何监督提升稀疏体素表面重建的精度和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. NeRF 1 篇

2601.17350 2026-01-27 cs.CV cs.AI 83%

NeRF-MIR: Towards High-Quality Restoration of Masked Images with Neural Radiance Fields

NeRF-MIR:面向基于神经辐射场的遮挡图像高质量恢复

Xianliang Huang, Zhizhou Zhong, Shuhang Chen, Yi Xu, Juhong Guan, Shuigeng Zhou

机构 * Shanghai Key Lab of Intelligent Information Processing(上海智能信息处理重点实验室) College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与人工智能学院) School of Computer Science and Technology, Tongji University(同济大学计算机科学与技术学院)

专题命中 NeRF :NeRF(title,abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 NeRF-MIR通过PERE和PIRE机制提升遮挡图像恢复质量,采用动态加权损失函数和多视角信息融合,实现更精确的3D场景重建。

Comments 14 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

3. Gaussian Splatting 9 篇

2601.18633 2026-01-27 cs.CV 85%

Splat-Portrait: Generalizing Talking Heads with Gaussian Splatting

Splat-Portrait: 通过高斯点散布通用化谈话头

Tong Shi, Melonie de Almeida, Daniela Ivanova, Nicolas Pugeault, Paul Henderson

机构 * School of Computing Science, University of Glasgow(格拉斯哥大学计算机科学学院)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3D reconstruction(abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 Splat-Portrait通过高斯点散布方法实现了更准确的谈话头生成和新视角合成,无需3D监督或运动先验。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17185 2026-01-27 cs.CV 85%

LGDWT-GS: Local and Global Discrete Wavelet-Regularized 3D Gaussian Splatting for Sparse-View Scene Reconstruction

LGDWT-GS: 基于局部和全局离散小波正则化的稀疏视图场景重建

Shima Salehi, Atharva Agashe, Andrew J. McFarland, Joshua Peeples

机构 * National Institute of Standards and Technology(国家标准与技术研究院) Department of Physics, Colorado State University(科罗拉多州立大学物理系) Electrical Engineering Department, University of Colorado(科罗拉多大学电气工程系)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 LGDWT-GS通过整合局部和全局频率正则化,提升稀疏视图下3D重建的几何稳定性与细节保留能力,并提供多光谱数据集和开源基准测试工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18475 2026-01-27 cs.GR cs.CV 84%

LoD-Structured 3D Gaussian Splatting for Streaming Video Reconstruction

LoD结构的3D高斯点云法对于流媒体视频重建

Xinhui Liu, Can Wang, Lei Liu, Zhenghao Chen, Wei Jiang, Wei Wang, Dong Xu

机构 * School of Computing and Data Science, The University of Hong Kong(计算与数据科学学院,香港大学) Futurewei Technologies Inc(未来科技公司) School of Computer and Information Sciences, The University of Newcastle(计算机与信息科学学院,新castle大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract);分类 cs.CV、cs.GR

AI总结 本文提出StreamLoD-GS框架,通过LoD结构、运动分区和量化残差细化技术,实现流媒体视频的高效重建与高保真渲染。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08710 2026-01-27 cs.CV 83%

SceneSplat++: A Large Dataset and Comprehensive Benchmark for Language Gaussian Splatting

SceneSplat++: 一个大规模数据集和全面的基准用于语言高斯点云

Mengjiao Ma, Qi Ma, Yue Li, Jiahuan Cheng, Runyi Yang, Bin Ren, Nikola Popovic, Mingqiang Wei, Nicu Sebe, Luc Van Gool, Theo Gevers, Martin R. Oswald, Danda Pani Paudel

机构 * Nanjing University of Aeronautics and Astronautics(南京航空航天大学) ETH Zürich(苏黎世联邦理工学院) University of Amsterdam(阿姆斯特丹大学) Johns Hopkins University(约翰·霍普金斯大学) University of Pisa(比萨大学) University of Trento(特伦托大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract);分类 cs.CV

AI总结 SceneSplat++提出一个大规模数据集和基准,评估语言高斯点云方法,展示可推广方法在3D理解中的优势。

Comments 15 pages, codes, data and benchmark are released at https://scenesplatpp.gaussianworld.ai/

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12905 2026-01-27 cs.CV 77%

Matrix-free Second-order Optimization of Gaussian Splats with Residual Sampling

无矩阵二次优化的高斯点云残差采样

Hamza Pehlivan, Andrea Boscolo Camiletto, Lin Geng Foo, Marc Habermann, Christian Theobalt

机构 * Max Planck Institute for Informatics(马克斯·普朗克信息研究所)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 本文提出了一种基于Levenberg-Marquardt和共轭梯度的无矩阵二次优化方法,通过利用高斯点云的稀疏性,显著提高了训练效率和速度,适用于3DGS的优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15871 2026-01-27 cs.CV cs.MM 70%

Zero-Shot Visual Grounding in 3D Gaussians via View Retrieval

通过视图检索实现3D高斯体的零样本视觉定位

Liwei Liao, Xufeng Li, Xiaoyun Zheng, Boning Liu, Feng Gao, Ronggang Wang

机构 * Peking University(北京大学) Peng Cheng Laboratory(鹏城实验室) City University of Hongkong(香港城市大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract);分类 cs.CV

AI总结 本文提出GVR框架,通过视图检索将3DVG转化为2D检索任务,实现零样本3DGS的视觉定位,无需每场景训练和3D标注。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18629 2026-01-27 cs.RO 57%

ExoGS: A 4D Real-to-Sim-to-Real Framework for Scalable Manipulation Data Collection

ExoGS:一种用于可扩展操纵数据收集的4D真实到仿真到真实框架

Yiming Wang, Ruogu Zhang, Minyang Li, Hao Shi, Junbo Wang, Deyi Li, Jieji Ren, Wenhai Liu, Weiming Wang, Hao-Shu Fang

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.RO

AI总结 ExoGS通过无需机器人的4D真实到仿真到真实框架,实现高精度动态交互捕捉与仿真转换,提升操控数据收集效率和策略泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02103 2026-01-27 cs.CV 57%

HeadLighter: Disentangling Illumination in Generative 3D Gaussian Heads via Lightstage Captures

HeadLighter: 通过Lightstage捕获在生成3D高斯头部中解耦照明

Yating Wang, Yuan Sun, Xuan Wang, Ran Yi, Boyao Zhou, Yipengjing Sun, Hongyu Liu, Yinuo Wang, Lizhuang Ma

机构 * Shanghai Jiao Tong University(上海交通大学) AntGroup Research(蚂蚁集团研究)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 HeadLighter通过Lightstage捕获提出了一种新的监督框架,用于解耦生成3D头部模型中的光照与外观,实现高质量生成和实时渲染,同时支持光照和视角编辑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08305 2026-01-27 cs.LG physics.chem-ph physics.comp-ph 50%

ELECTRA: A Cartesian Network for 3D Charge Density Prediction with Floating Orbitals

ELECTRA:一种用于3D电荷密度预测的笛卡尔网络

Jonas Elsborg, Luca Thiede, Alán Aspuru-Guzik, Tejs Vegge, Arghya Bhowmik

机构 * Technical University of Denmark(丹麦技术大学) CAPeX Pioneer Center for Accelerating P2X Materials Discovery(CAPeX先锋中心) University of Toronto(多伦多大学) Vector Institute for Artificial Intelligence(人工智能矢量研究所) Canadian Institute for Advanced Research (CIFAR)(加拿大高级研究 institute)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract)

AI总结 ELECTRA通过笛卡尔张量网络预测漂浮轨道位置,实现高效且准确的3D电荷密度预测,并显著降低DFT计算的SCF迭代次数。

Comments 10 pages, 4 figures, 5 tables, NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 点云 8 篇

2601.17486 2026-01-27 cs.RO 79%

EquiForm: Noise-Robust SE(3)-Equivariant Policy Learning from 3D Point Clouds

EquiForm: 基于3D点云的噪声鲁棒SE(3)等价政策学习

Zhiyuan Zhang, Yu She

机构 * School of Industrial Engineering, Purdue University(工业工程学院,普渡大学)

专题命中 点云 :point cloud(title,abstract);分类 cs.RO

AI总结 EquiForm通过引入噪声鲁棒的几何去噪模块和对比等价对齐目标,提升基于3D点云的政策学习在噪声和遮挡下的鲁棒性与泛化能力。

Comments Project website: https://ZhangZhiyuanZhang.github.io/equiform-website/ Code will be released

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20406 2026-01-27 cs.RO cs.LG 79%

PointMapPolicy: Structured Point Cloud Processing for Multi-Modal Imitation Learning

PointMapPolicy: 结构化点云处理用于多模态模仿学习

Xiaogang Jia, Qian Wang, Anrui Wang, Han A. Wang, Balázs Gyenes, Emiliyan Gospodinov, Xinkai Jiang, Ge Li, Hongyi Zhou, Weiran Liao, Xi Huang, Maximilian Beck, Moritz Reuss, Rudolf Lioutikov, Gerhard Neumann

机构 * Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) Reality Labs, Meta(Meta现实实验室) Johannes Kepler University Linz(林茨约翰尼斯·开普勒大学)

专题命中 点云 :point cloud(title,abstract);分类 cs.RO

AI总结 PointMapPolicy通过结构化点云处理提升多模态模仿学习的精度与泛化能力,利用xLSTM融合点云与RGB数据,在RoboCasa和CALVIN基准中取得最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21539 2026-01-27 cs.CV cs.AI 79%

Equivariant Flow Matching for Point Cloud Assembly

等变流匹配用于点云装配

Ziming Wang, Nan Xue, Rebecka Jörnsten

机构 * CTH(查尔姆斯理工大学) Ant Group(蚂蚁集团)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 本文提出等变扩散装配模型,通过学习相关向量场实现点云装配,有效提升数据效率和处理非重叠输入的能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18323 2026-01-27 cs.RO 57%

TC-IDM: Grounding Video Generation for Executable Zero-shot Robot Motion

TC-IDM:为可执行零样本机器人运动实现视频生成

Weishi Mi, Yong Bao, Xiaowei Chi, Xiaozhu Ju, Zhiyuan Qin, Kuangzhi Ge, Kai Tang, Peidong Jia, Shanghang Zhang, Jian Tang

机构 * Beijing Innovation Center of Humanoid Robotics(北京人形机器人创新中心) State Key Laboratory of Multimedia Information Processing(多媒体信息处理国家重点实验室) School of Computer Science, Peking University(北京大学计算机科学学院)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 TC-IDM通过工具中心逆动力学模型实现视频生成,提升机器人零样本任务的执行能力与泛化性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17866 2026-01-27 cs.CV 57%

MV-SAM: Multi-view Promptable Segmentation using Pointmap Guidance

基于点图指导的多视角分割:MV-SAM

Yoonwoo Jeong, Cheng Sun, Yu-Chiang Frank Wang, Minsu Cho, Jaesung Choe

机构 * NVIDIA POSTECH

专题命中 点云 :NeRF(abstract);分类 cs.CV

AI总结 MV-SAM通过点图指导实现多视角分割,提升三维一致性,优于SAM2-Video并在多个基准上表现优异。

Comments Project page, https://jaesung-choe.github.io/mv_sam/index.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18713 2026-01-27 q-bio.QM cs.AI 50%

Point transformer for protein structural heterogeneity analysis using CryoEM

利用冷冻电镜分析蛋白质结构异质性的点变换器

Muyuan Chen, Muchen Li, Renjie Liao

专题命中 点云 :point cloud(abstract)

AI总结 本文提出Point Transformer用于分析冷冻电镜数据中的蛋白质结构异质性,提升异质性分析性能并实现更直观的动力学表征。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17809 2026-01-27 cs.IT math.IT 50%

A Multi-Modal Fusion Platform for Joint Environment Sensing and Channel Sounding in Highly Dynamic Scenarios

一种多模态融合平台,用于高动态场景中的联合环境感知与信道探测

Xuejian Zhang, Ruisi He, Mi Yang, Zhengyu Zhang, Ziyi Qi

专题命中 点云 :point cloud(abstract)

AI总结 本文提出一种多模态融合平台,用于高动态场景中联合环境感知与信道探测,支持多频段多天线测量和高精度环境感知。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01733 2026-01-27 hep-ex astro-ph.IM cs.LG 50%

Reducing Simulation Dependence in Neutrino Telescopes with Masked Point Transformers

在中微子望远镜中减少模拟依赖性:基于掩码点变换器的方法

Felix J. Yu, Nicholas Kamp, Carlos A. Argüelles

机构 * Department of Physics \& Laboratory of Particle Physics Cosmology, Harvard University, Cambridge, MA, USA

专题命中 点云 :point cloud(abstract)

AI总结 本文提出了一种基于点云变换器和掩码自动编码器的自监督学习方法,用于减少中微子望远镜对模拟数据的依赖,从而提升事件重建和分类的准确性。

Comments 8 pages, 3 figures, presented at the 39th International Cosmic Ray Conference (ICRC2025)

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 新视角合成 1 篇

2502.12138 2026-01-27 cs.CV 57%

FLARE: Feed-forward Geometry, Appearance and Camera Estimation from Uncalibrated Sparse Views

FLARE:从未校准的稀疏视角推断前馈几何、外观和相机姿态

Shangzhan Zhang, Jianyuan Wang, Yinghao Xu, Nan Xue, Christian Rupprecht, Xiaowei Zhou, Yujun Shen, Gordon Wetzstein

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团) University of Oxford(牛津大学) Stanford University(斯坦福大学)

专题命中 新视角合成 :novel view synthesis(abstract);分类 cs.CV

AI总结 FLARE通过前馈模型从少量未校准稀疏视角图像中高效推断出高质量的相机姿态、3D几何和新视角合成。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 空间理解 1 篇

2601.17885 2026-01-27 cs.CV cs.AI cs.RO 62%

PEAfowl: Perception-Enhanced Multi-View Vision-Language-Action for Bimanual Manipulation

PEAfowl:感知增强的多视角视觉-语言-动作用于双臂操作

Qingyu Fan, Zhaoxiang Li, Yi Lu, Wang Chen, Qiu Shen, Xiao-xiao Long, Yinghao Cai, Tao Lu, Shuo Wang, Xun Cao

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Nanjing University(南京大学)

专题命中 空间理解 :spatial understanding(abstract);分类 cs.CV、cs.RO

AI总结 PEAfowl通过增强感知的多视角视觉-语言-动作策略,提升双臂操作在复杂环境中的稳定性和成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏

7. 其他3D视觉 1 篇

2601.17251 2026-01-27 cs.RO 57%

EMPM: Embodied MPM for Modeling and Simulation of Deformable Objects

EMPM:基于具身的MPM用于变形物体建模与仿真

Yunuo Chen, Yafei Hu, Lingfeng Sun, Tushar Kusnur, Laura Herlant, Chenfanfu Jiang

机构 * Robotics and AI Institute(机器人与人工智能研究院) UCLA(加州大学洛杉矶分校)

专题命中 其他3D视觉 :3D vision(abstract);分类 cs.RO

AI总结 EMPM通过基于可微MPM的框架,结合多视角视频重建与在线参数优化,实现对复杂变形物体的高效仿真与操控。

详情

展开后加载摘要…

URL PDF HTML 收藏