arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-08-25 至 2026-08-25 共收录 25 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 2 篇

2608.23206 2026-08-25 cs.CV 新提交 79%

Learning Spherical Occupancy Profiles for Multi-View 3D Reconstruction and Generation

用于多视图三维重建与生成的球形占用轮廓学习

YiHsuan Tsai

机构 * Nanjing University(南京大学)

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.CV

AI总结 该研究提出将逐光线球形占用轮廓作为统一中间表示,训练判别式解码器与生成式流水线,在多视图三维重建任务中取得良好效果,且可迁移至真实照片场景。

Comments 12 pages,5 figures,5 tables. Code and data will be released

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22131 2026-08-25 cs.CV cs.AI 新提交 57%

TRACE: Artifact-Robust Statistical Shape Modeling from Imperfect Surface Scans - A Case Study in Craniosynostosis 3D Photography

TRACE:从不完美表面扫描中构建抗伪影的统计形状模型——以颅缝早闭三维摄影为例

Sanjay Bhandari, Nawazish Khan, Alzbeta Novotna, Tiffany Jeong, Loretta Bowman, Michael Hernandez, Tobi Somorin, Viraj Govani, Jesse Goldstein, Shireen Elhabian

机构 * Scientific Computing and Imaging Institute, University of Utah(犹他大学科学计算与成像研究所) Kahlert School of Computing, University of Utah(犹他大学卡勒特计算学院) Division of Pediatric Plastic Surgery, UPMC Children’s Hospital of Pittsburgh(匹兹堡大学医学中心儿童医院小儿整形外科)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 研究针对临床三维头部摄影的伪影问题,提出TRACE框架,可直接从受污染数据构建抗伪影SSMs,在多骨干网络上均提升了形状模型质量,为颅缝早闭分析提供了可扩展基础。

Comments Accepted at ShapeMI workshop at MICCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

2. Gaussian Splatting 12 篇

2608.23549 2026-08-25 cs.CV 新提交 91%

FixAnything: 3D-Consistent Rendering Refinement via Video Generative Priors

FixAnything:基于视频生成先验的3D一致性渲染优化

Khiem Vuong, Deva Ramanan, Srinivasa Narasimhan

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 Gaussian Splatting :NeRF(summary_cn,abstract);3DGS(summary_cn,abstract);Gaussian Splatting(abstract);point cloud(abstract)

AI总结 FixAnything是一款复用预训练视频生成模型、仅需轻量微调的单一模型,可修复3DGS、NeRF等四种3D表示的渲染伪影,实现3D一致性渲染,替代多个专用优化管线。

Comments Appearing in ECCV 2026. Project page: this https URL (https://fix-anything.github.io)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21849 2026-08-25 cs.CV 新提交 90%

GaussVid: Sparse-View Gaussian Splatting with 3D-Aware Video Diffusion Priors

GaussVid:结合3D感知视频扩散先验的稀疏视图高斯溅射

Xinhui Liu, Can Wang, Wei Jiang, Wei Wang, Dong Xu

机构 * The University of Hong Kong(香港大学) School of Computing and Data Science, The University of Hong Kong(香港大学计算与数据科学学院) Futurewei Technologies Inc(华为主流技术公司)

专题命中 Gaussian Splatting :3DGS(summary_cn,abstract);Gaussian Splatting(title,abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 本研究提出结合3D感知视频扩散先验的GaussVid框架,构建3DGS视频数据集并引入相机条件几何先验,提升稀疏视图3DGS重建的像素、结构保真度与多视图一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21438 2026-08-25 cs.CV cs.MA 新提交 89%

DesignAgent3D: Interactive 3D Scene Editing via Designer-like Multimodal Reasoning

DesignAgent3D:通过类设计师多模态推理实现交互式3D场景编辑

Xiujin Liu, Tianyu Yang, Yilun Zhao, Xiangliang Zhang

机构 * University of Michigan(密歇根大学) University of Notre Dame(圣母大学) Yale University(耶鲁大学)

专题命中 Gaussian Splatting :NeRF(summary_cn,abstract);Gaussian Splatting(summary_cn,abstract);分类 cs.CV

AI总结 DesignAgent3D是一种交互式多模态智能体框架,通过类设计师的规划-感知-行动范式解决文本引导3D场景编辑的缺陷,在NeRF和3D Gaussian Splatting上均优于现有方法,实现了更优的语义对齐、空间定位精度和多视图一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22773 2026-08-25 cs.CV 新提交 89%

LagrangeGS: Non-Conservative Lagrangian System on Dynamic 3D Gaussian Splatting

LagrangeGS:动态3D高斯溅射上的非保守拉格朗日系统

Shogo Sato, Takuhiro Kaneko, Shoichiro Takeda, Tomoyasu Shimada, Riku Inoue, Kazuhiko Murasaki, Ryuichi Tanida

专题命中 Gaussian Splatting :3DGS(summary_cn,abstract);Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 LagrangeGS将动态3DGS建模为非保守拉格朗日系统,通过近似速度-海森矩阵、限制非保守力与时间无关、引入局部刚性对齐,解决了现有方法的三大问题,实现稳定外推、时间可逆性及物理编辑。

Comments Accepted by BMVC2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22465 2026-08-25 cs.CV 新提交 89%

M$^3$ISR: A Multi-Modal Multi-View Benchmark for 3D/4D Gaussian Splatting and Feedforward Compression

M$^3$ISR:面向3D/4D高斯溅射(Gaussian Splatting)与前馈压缩的多模态多视图基准测试

Xinhui Liu, Lei Liu, Zhenghao Chen, Lebin Zhou, Wei Wang, Wei Jiang

机构 * The University of Hong Kong(香港大学) University of Newcastle(纽卡斯尔大学) Santa Clara University(圣克拉拉大学) Futurewei Technologies, Inc.(华为主导未来技术公司)

专题命中 Gaussian Splatting :Gaussian Splatting(title,title_cn);3DGS(abstract,abstract_cn);分类 cs.CV

AI总结 该研究提出面向3D/4D高斯溅射的可控合成基准M$^3$ISR,含25个场景等,设5个赛道,评估发现静态重建质量差异小但存储成本差异大,为相关研究提供测试平台。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22344 2026-08-25 cs.CV 新提交 89%

Fast and Compact 3D Gaussian Splatting with Polarized Opacity Prior

基于偏振不透明度先验的快速紧凑三维高斯溅射

Zi-Ming Wang, Kai-Wen Duan, Kowei Huang, Akihiro Sugimoto, Shang-Hong Lai

机构 * National Tsing Hua University(国立清华大学) National Institute of Informatics(情报通信研究机构)

专题命中 Gaussian Splatting :3DGS(summary_cn,abstract);Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 针对3DGS模型膨胀问题,提出含L2重建损失与偏振不透明度先验的训练框架,以更少高斯实现加速训练并保持相当重建质量,提供紧凑高效的3DGS训练方案

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21685 2026-08-25 cs.RO 新提交 89%

In-Situ Reconstruction of the International Space Station Using 3D Gaussian Splatting and Astrobee

使用3D高斯溅射与Astrobee实现国际空间站的原位重建

Hudson Kim, Ryan Soussan, Brian Coltin, Jordan Kam

机构 * University of California, Berkeley(加利福尼亚大学伯克利分校) KBR Inc.(KBR公司) NASA Ames Research Center(美国国家航空航天局艾姆斯研究中心) California Institute of Technology(加利福尼亚理工学院)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract,abstract_cn);3D reconstruction(abstract);novel view synthesis(abstract)

AI总结 该研究将3D高斯溅射技术应用于国际空间站内部三维重建,基于Astrobee机器人的500张原位图像构建高保真地图,其性能优于Nerfacto、TensoRF等现有方法,可用于快速更新舱内地图。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22906 2026-08-25 cs.CV 新提交 87%

AquaFlow: A Monocular Gaussian Splatting SLAM for Underwater Streaming Reconstruction

AquaFlow:用于水下流式重建的单目高斯溅射SLAM

Yingxiang Xu, Kerui Ren, Wenqi Guo, Changjian Jiang, Tao Lu, Linning Xu, Mulin Yu

机构 * Zhejiang University(浙江大学) Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学) The University of Hong Kong(香港大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract,abstract_cn);3D vision(abstract);分类 cs.CV

AI总结 针对水下场景视觉退化导致的SLAM难题,提出AquaFlow框架,通过微调3D视觉基础模型等技术实现更优的水下重建,在62条水下轨迹数据集上相较WaterSplat-SLAM性能显著提升。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21828 2026-08-25 cs.CV 新提交 84%

Towards Alias-Free 4D Gaussian Representations with Motion-Aware Filtering

面向无混叠的4D高斯表示:结合运动感知滤波

Ankit Dhiman, Kunal A Kathare, Pranav Vignesh, Lokesh R Boregowda, Venkatesh Babu Radhakrishnan

机构 * Indian Institute of Science(印度科学学院) Samsung R&D Institute India - Bangalore(三星印度班加罗尔研发研究院)

专题命中 Gaussian Splatting :NeRF(abstract,abstract_cn);3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 针对动态场景4D表示的混叠问题,提出运动感知3D平滑滤波器,适配各类4D表示,在标准数据集上性能优于现有最优方法。

Comments Accepted to ECCV 2026. Project Page: this https URL (https://maaf-4dgs.github.io/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22888 2026-08-25 cs.CV 新提交 83%

NemoSplat: Feed-Forward 4D Gaussian Splatting for Media-Aware Underwater Reconstruction

NemoSplat:面向介质感知水下重建的前馈式4D高斯溅射方法

Xiaopeng Guo, Wai Chung Tse, Yipeng Zhu, Hanwen Zhang, Huajian Huang, Sai-Kit Yeung

机构 * The Hong Kong University of Science and Technology(香港科技大学) Beijing Institute of Technology(北京理工大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 针对水下环境光散射与动态物体导致的重建难题,提出首个介质感知前馈4D高斯溅射框架NemoSplat,设计可提示动态解缠器与介质感知高斯预测器,构建大规模水下数据集,实现了最优跟踪精度与高保真渲染。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22740 2026-08-25 cs.CV 新提交 81%

Seeing the Unseen: Semantic-in-Gaussian for Sparse-View 3D Generalization

看见不可见:用于稀疏视图三维泛化的高斯语义嵌入方法

Zeyang Bai, Yunpeng Wang, Yunbiao Wang, Jun Xiao

机构 * School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Global Institute of Future Technology, Shanghai Jiao Tong University(上海交通大学全球未来技术研究院)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 本文提出新型通用三维高斯溅射框架SeeU,通过跨视图熵感知模块与条件高斯变换器优化高斯估计,在稀疏视图场景下提升新视图合成的渲染质量与结构完整性,外推设置下PSNR较SOTA方法提升2.44 dB。

Comments Accepted at the ECCV 2026 Workshop on 3DWM

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22102 2026-08-25 cs.CV cs.AI 新提交 74%

Learning Implicit Constitutive Laws for Dynamic 3D Gaussian Splatting from Monocular Videos

从单目视频学习动态3D高斯溅射的隐式本构定律

Xiaoyang Liu, Kai Han

机构 * The University of Hong Kong(香港大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title);分类 cs.CV

AI总结 提出GCA框架,结合LoRA适配与RDGA、CPR模块,从单目动态视频学习隐式本构定律,在多类数据集上性能优于现有方法

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 点云 7 篇

2608.21380 2026-08-25 cs.RO cs.AI cs.CV cs.IT 新提交 81%

RoboShape: Information-Theoretic Point Cloud Representations for Privacy-Aware Robot Perception

RoboShape:面向隐私感知机器人感知的信息论点云表示

Oguzhan Baser, Mirac Sozen, Kaan Kale, Sandeep Chinchali, Sriram Vishwanath

机构 * The University of Texas at Austin(得克萨斯大学奥斯汀分校) Bogazici University(博加齐大学) Georgia Institute of Technology(佐治亚理工学院)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV、cs.RO

AI总结 RoboShape 是一种信息论引导的点云压缩工具,可在保留物体分类效用的同时降低敏感属性泄露,缩小嵌入体积,发布代码库供机器人社区使用。

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21804 2026-08-25 cs.CV cs.DC 新提交 79%

FlashReg: GPU-Accelerated 3-Clique Point Cloud Registration for Real-Time Correspondence-to-Pose Estimation

FlashReg:用于实时对应关系到位姿估计的GPU加速3-团点云配准算法

Ziyang Yu, Xiang Li, Qiong Chang, Jun Miyazaki

机构 * School of Computing(计算机学院) Institute of Science Tokyo(东京科学大学)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 FlashReg是面向GPU的点云配准算法,通过优化图构建与3-团搜索,在保持相当召回率的同时降低延迟、减少内存占用,适用于车载感知的高吞吐量配准后端。

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21468 2026-08-25 cs.CV 新提交 79%

3D Point Cloud from Close-Range Photogrammetry for Defect Characterisation of Rubberised Concrete

用于橡胶混凝土缺陷表征的近程摄影测量生成三维点云

Jiacheng Liu, Mohammed Alnahhal, Ailar Hajimohammadi, Sara Gonizzi Barsanti, Jinling Wang, Mohsen Kalantari

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 本研究针对橡胶混凝土调整近程摄影测量工作流程,结合SfM、MVS算法及RGB引导裂纹提取方法,生成亚毫米级分辨率三维模型,可替代激光雷达用于实验室样本表面检查与变形监测,为后续研究建立几何基准。

Comments 8 pages, 10 figures. Published in the International Archives of the Photogrammetry, Remote Sensing and Spatial Information Sciences, XXV ISPRS Congress 2026, Toronto, Canada

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23486 2026-08-25 cs.CV cs.RO 新提交 62%

GeoWAM: Visual Geometry World Action Models for Autonomous Driving

GeoWAM:面向自动驾驶的视觉几何世界动作模型

Yiren Lu, Xin Ye, Jiaming Liu, Jin Yao, Yi-chung Chen, Liam Merino, Dhruva Dixith Kurra, Min Cai, Tom Lampo, Yu Yin, Danhua Guo, Burhan Yaman

机构 * Uber AV Labs(优步自动驾驶实验室) Case Western Reserve University(凯斯西储大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV、cs.RO

AI总结 该研究提出 GeoWAM,一种用于自动驾驶的视觉几何世界动作模型,通过预训练预测未来场景几何来学习动力学,经评估其生成的驾驶策略比图像基方案更强,确立未来几何预测为自动驾驶有效预训练目标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22821 2026-08-25 cs.CV 新提交 57%

SiZeUp: Fast 3D Proxy from Aerial Images via Depth Ordinal Loss

SiZeUp:基于深度序数损失的航拍图像快速3D代理模型构建方法

Wenjun Zhou, Yunshan Li, Qiaoyu Zhu, Weidan Xiong, Hao Zhang, Daniel Cohen-Or, Hui Huang

机构 * Shenzhen University(深圳大学) Simon Fraser University(西蒙菲莎大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 SiZeUp是一种从校准倾斜航拍图像构建大规模城市3D代理模型的方法,采用“ footprint 高度”表示法与深度序数一致性损失,实现23-52倍加速,适用于大规模城市建模。

Comments Accepted to SIGGRAPH Asia 2026 Conference Papers

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22238 2026-08-25 cs.CV 新提交 57%

Hyper^2: Unleashing Hyperbolic Geometry's Full Potential via Dual-Space Consistency

Hyper^2:通过双空间一致性释放双曲几何的全部潜力

Guantian Zheng, Haiyang Xu, Tianyu Gao

机构 * Nanyang Technological University(南洋理工大学) Harbin Institute of Technology(哈尔滨工业大学) Sichuan University(四川大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文针对点云补全中双曲几何应用的跨几何不匹配问题,提出双空间一致性框架Hyper^2,在SVDFormer上实现显著的Chamfer距离降低,验证了编码器与损失几何一致性的重要性。

Comments 18 pages, 5 figures, 5 tables. Accepted to BMVC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22909 2026-08-25 cs.CL 新提交 50%

Exploring Dowker Homology for Sentence Similarity

探索用于句子相似度的Dowker同调

Marius Huber, Juri Opitz

机构 * University of Zürich(苏黎世大学)

专题命中 点云 :point cloud(abstract)

AI总结 本研究将句子对的词元嵌入视为Transformer潜空间的点云,探究Dowker同调捕捉句子相似度的能力,发现其可用于相似度评估与可视化,推导的单值摘要表现尚可但未优于标准度量。

Comments 12 pages; accepted at "Workshop on Insights from Negative Results in NLP 2026"

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 新视角合成 2 篇

2608.23410 2026-08-25 cs.CV cs.LG 新提交 79%

Photorealistic Novel View Synthesis of Human Faces using Next-Scale Transformers

基于Next-Scale Transformer的人脸真实感新视角合成

Federico Stella, Fei Jiang, Zhongshi Jiang, Zohar Barzelay, Emanuel Garbin, Amin Jourabloo, Liuhao Ge

机构 * École polytechnique fédérale de Lausanne(洛桑联邦理工学院) Meta

专题命中 新视角合成 :novel view synthesis(title,abstract);分类 cs.CV

AI总结 本研究将next-scale自回归范式适配人脸新视角合成,结合Transformer模型实现高保真多视角人脸3D模型生成,较扩散模型需更少专用训练数据,提升了感知与跨视角一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22054 2026-08-25 cs.CV 新提交 57%

Robust Global Structure-from-Motion via View Graph Pruning

通过视图图剪枝实现鲁棒的全局运动恢复结构(Structure-from-Motion, SfM)

Jiamin Xu, Lixing Yao, Weichen Dai, Renshu Gu, Zunjie Zhu, Weiwei Xu, Gang Xu

机构 * Hangzhou Dianzi University(杭州电子科技大学) State Key Lab of CAD&CG, Zhejiang University(浙江大学CAD&CG国家重点实验室)

专题命中 新视角合成 :novel view synthesis(abstract);分类 cs.CV

AI总结 本研究针对全局运动恢复结构(SfM)易受错误边影响的问题,提出子图引导的视图图剪枝框架,经多类数据集实验验证可提升其鲁棒性并优化新视图合成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 空间理解 1 篇

2608.22757 2026-08-25 cs.CV cs.AI 新提交 83%

Object-Uni: A Unified Model for Object-Centric Spatial Understanding and Controllable Generation

Object-Uni:面向以物体为中心的空间理解与可控生成的统一模型

Mining Tan, Yinuo Wang, Ziqi Zhou, Weize Quan, Sifei Li, Jingdong Chen, DanDan Zheng, Libin Wang, Weiming Dong

机构 * School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所MAIS) School of Vehicle and Mobility, Tsinghua University(清华大学车辆与 mobility学院) Ant Group(蚂蚁集团)

专题命中 空间理解 :spatial understanding(title,abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 提出Object-Uni统一模型,通过视角方向抽象与UniSpatial-80K基准,实现以物体为中心的空间理解与可控生成,提升位姿理解及可控生成能力。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. SLAM与定位 1 篇

2608.22029 2026-08-25 cs.LG math-ph q-bio.BM q-bio.QM 新提交 50%

ARCHER: Amortized cross-specimen pose estimation for cryo-electron microscopy

ARCHER:用于冷冻电子显微镜的摊销跨样本姿态估计

Nhan D. Nguyen, Bao Pham

机构 * Pritzker School of Molecular Engineering, University of Chicago(芝加哥大学普利兹克分子工程学院) Department of Computer Science, Rensselaer Polytechnic Institute(伦斯勒理工学院计算机科学系)

专题命中 SLAM与定位 :3D reconstruction(abstract)

AI总结 该研究提出ARCHER模型,通过离散旋转网格建模姿态后验,实现冷冻电镜跨结构通用的零样本姿态估计,在测试结构和实验颗粒上均达到高精度,且保留下游构象信号。

Comments 28 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏