arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2025-12-29 至 2025-12-29 共收录 11 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 3 篇

2512.21185 2025-12-29 cs.CV cs.GR 62%

UltraShape 1.0: High-Fidelity 3D Shape Generation via Scalable Geometric Refinement

UltraShape 1.0:通过可扩展的几何细化实现高保真的3D形状生成

Tanghui Jia, Dongyu Yan, Dehao Hao, Yang Li, Kaiyi Zhang, Xianyi He, Lanjiong Li, Yuhan Wang, Jinnan Chen, Lutao Jiang, Qishen Yin, Long Quan, Ying-Cong Chen, Li Yuan

机构 * Shenzhen Graduate School, Peking University(北京大学深圳研究生院) The Hong Kong University of Science(香港科学大学) National University of Singapore(新加坡国立大学) S-Lab, Nanyang Technological University(南洋理工大学S实验室)

专题命中 三维重建 :3D generation(abstract);分类 cs.CV、cs.GR

AI总结 UltraShape 1.0通过可扩展的几何细化方法实现高质量3D形状生成,采用两阶段流程提升几何质量,支持公开数据集的精细化处理。

Comments 14 pages, 10 figures, Technical Report,

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21691 2025-12-29 cs.CV 57%

Analyzing the Mechanism of Attention Collapse in VGGT from a Dynamics Perspective

从动力学角度分析VGGT中注意力崩溃的机制

Huan Li, Longjun Luo, Yuling Shi, Xiaodong Gu

机构 * Huazhong University of Science and Technology(华中科技大学) Guangdong University of Technology(广东工业大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 VGGT中注意力崩溃现象从动力学角度进行数学解释,揭示token特征流收敛规律及token合并方法对延迟崩溃的作用。

Comments 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21513 2025-12-29 cs.CV 57%

MuS-Polar3D: A Benchmark Dataset for Computational Polarimetric 3D Imaging under Multi-Scattering Conditions

MuS-Polar3D: 一种用于多散射条件下计算极化3D成像的基准数据集

Puyun Wang, Kaimin Yu, Huayang He, Xianyu Wu

机构 * School of Mechanical Engineering and Automation, Fuzhou University(机械工程与自动化学院,福州大学) Research Institute of Highway, Ministry of Transport(交通部公路科学研究院)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 MuS-Polar3D是首个公开的水下极化3D成像基准数据集,通过多散射条件下的极化图像和高精度3D模型,提升水下3D重建的准确性和算法评估的公平性。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. NeRF 1 篇

2512.20129 2025-12-29 cs.HC cs.CV 57%

Dreamcrafter: Immersive Editing of 3D Radiance Fields Through Flexible, Generative Inputs and Outputs

Dreamcrafter: 通过灵活、生成性输入和输出实现沉浸式3D辐射场编辑

Cyrus Vachha, Yixiao Kang, Zach Dive, Ashwat Chidambaram, Anik Gupta, Eunice Jun, Bjoern Hartmann

机构 * UC Berkeley(加州大学伯克利分校)

专题命中 NeRF :Gaussian Splatting(abstract);分类 cs.CV

AI总结 Dreamcrafter通过灵活的生成式输入和输出,实现实时沉浸式3D辐射场编辑,结合模块化架构和多层级控制提升创作效率与沉浸感。

Comments CHI 2025, Project page: https://dream-crafter.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏

3. Gaussian Splatting 3 篇

2509.12759 2025-12-29 cs.CV 85%

A-TDOM: Active TDOM via On-the-Fly 3DGS

A-TDOM:通过实时3DGS进行主动TDOM

Yiwei Xu, Xiang Wang, Yifei Yu, Wentian Gan, Luca Morelli, Giulio Perda, Xin Wang, Zongqian Zhan, Fabio Remondino

机构 * Fondazione Bruno Kessler(布鲁诺·克塞勒基金会)

专题命中 Gaussian Splatting :3DGS(title,abstract);Gaussian Splatting(abstract);point cloud(abstract);分类 cs.CV

AI总结 A-TDOM通过实时3DGS优化实现近实时TDOM生成,提升地理信息更新效率与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05332 2025-12-29 cs.CV 83%

CoMoGaussian: Continuous Motion-Aware Gaussian Splatting from Motion-Blurred Images

CoMoGaussian: 从运动模糊图像中连续的运动感知高斯点云生成

Jungho Lee, Donghyeong Kim, Dogyoon Lee, Suhwan Cho, Minhyeok Lee, Wonjoon Lee, Taeoh Kim, Dongyoon Wee, Sangyoun Lee

机构 * Yonsei University(延世大学) NAVER Cloud(NAVER云)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract);分类 cs.CV

AI总结 CoMoGaussian通过连续运动感知的高斯点云生成方法,实现从运动模糊图像中精确重建3D场景,提升实时渲染效率与重建精度。

Comments Revised Version of CRiM-GS, Project Page: https://Jho-Yonsei.github.io/CoMoGaussian

Journal ref Proceedings of the IEEE/CVF International Conference on Computer Vision (ICCV), 2025, pp. 26415-26424

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14537 2025-12-29 cs.CV 77%

Personalize Your Gaussian: Consistent 3D Scene Personalization from a Single Image

为Gaussian个性化:从单张图像实现一致的3D场景个性化

Yuxuan Wang, Xuanyu Yi, Qingshan Xu, Yuan Zhou, Long Chen, Hanwang Zhang

机构 * Nanyang Technological University(南洋理工大学) Hong Kong University of Science and Technology(香港科学与技术大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract);3D generation(abstract);分类 cs.CV

AI总结 本文提出CP-GS框架,通过逐步传播单视角参考外观到新视角,有效缓解视角偏差,实现高质量3D场景个性化。

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 点云 2 篇

2512.21960 2025-12-29 stat.ME cs.LG 71%

Modeling high dimensional point clouds with the spherical cluster model

用球簇模型建模高维点云

Frédéric Cazals, Antoine Commaret, Louis Goldenberg

机构 * Université C^ote d’Azur(巴黎-萨克勒大学) Inria(法国国家信息与自动化技术研究院) Ecole Polytechnique(巴黎高等理工学院)

专题命中 点云 :point cloud(title)

AI总结 本文提出球簇模型用于高维点云建模,通过严格凸优化问题解决,并展示其在高维数据中的高效性和中位数特性。

Comments Main text: 4 figures, 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00977 2025-12-29 cs.LG q-bio.QM 50%

Modeling Microenvironment Trajectories on Spatial Transcriptomics with NicheFlow

基于空间转录组的NicheFlow微环境轨迹建模

Kristiyan Sakalyan, Alessandro Palma, Filippo Guerranti, Fabian J. Theis, Stephan Günnemann

机构 * School of Computation, Information and Technology, Technical University of Munich(慕尼黑技术大学计算、信息与技术学院) Munich Centre for Machine Learning (MCML)(慕尼黑机器学习中心) Institute of Computational Biology, Helmholtz Munich(海德堡医学院计算生物学研究所) Munich Data Science Institute (MDSI), Technical University of Munich(慕尼黑数据科学研究所) TUM School of Life Sciences Weihenstephan, Technical University of Munich(慕尼黑技术大学生命科学学院)

专题命中 点云 :point cloud(abstract)

AI总结 NicheFlow通过流式生成模型推断空间转录组中细胞微环境的时空轨迹,实现对组织发育和疾病进展的深入理解。

Comments 37 pages, 15 figures, to appear in NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 新视角合成 1 篇

2512.21618 2025-12-29 cs.CV cs.RO 62%

SymDrive: Realistic and Controllable Driving Simulator via Symmetric Auto-regressive Online Restoration

SymDrive: 通过对称自回归在线修复实现逼真且可控的驾驶模拟器

Zhiyuan Liu, Daocheng Fu, Pinlong Cai, Lening Wang, Ying Liu, Yilong Ren, Botian Shi, Jianqiang Wang

机构 * School of Vehicle and Mobility, Tsinghua University(清华大学车辆与移动系统学院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) State Key Lab of Intelligent Transportation System, Beihang University(北航智能交通系统国家重点实验室)

专题命中 新视角合成 :novel view synthesis(abstract);分类 cs.CV、cs.RO

AI总结 SymDrive通过对称自回归在线修复技术,实现了逼真可控的驾驶模拟,解决了高保真渲染与交互式交通编辑的难题。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 空间理解 1 篇

2508.06259 2025-12-29 cs.CV cs.AI 57%

SIFThinker: Spatially-Aware Image Focus for Visual Reasoning

SIFThinker: 基于空间的图像聚焦用于视觉推理

Zhangquan Chen, Ruihui Zhao, Chuwei Luo, Mingze Sun, Xinlei Yu, Yangyang Kang, Ruqi Huang

机构 * ByteDance(字节跳动)

专题命中 空间理解 :spatial understanding(abstract);分类 cs.CV

AI总结 SIFThinker通过结合深度增强的边界框和自然语言,提升视觉推理中的空间理解和细粒度感知能力。

Comments 15 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏