arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-01-01 至 2026-01-01 共收录 18 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 2 篇

2512.24428 2026-01-01 cs.RO 57%

Subsecond 3D Mesh Generation for Robot Manipulation

亚秒级机器人操作用3D网格生成

Qian Wang, Omar Abdellall, Tony Gao, Xiatao Sun, Daniel Rakita

机构 * Office of Naval Research(海军研究办公室)

专题命中 三维重建 :point cloud(abstract);分类 cs.RO

AI总结 本研究提出了一种亚秒级3D网格生成系统,通过集成开放词汇分割、加速扩散生成和稳健点云注册,实现高保真网格的快速生成,用于机器人感知与规划。

Comments In submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23983 2026-01-01 cs.CV 57%

DriveExplorer: Images-Only Decoupled 4D Reconstruction with Progressive Restoration for Driving View Extrapolation

DriveExplorer: 基于图像的解耦4D重建与渐进修复用于驾驶视角外推

Yuang Jia, Jinlong Wang, Jiayi Zhao, Chunlam Li, Shunzhou Wang, Wei Gao

机构 * Guangdong Provincial Key Laboratory of Ultra High Definition Immersive Media Technology(广东省级超高清沉浸媒体技术重点实验室) School of Electronic and Computer Engineering(电子与计算机工程学院) Shenzhen Graduate School, Peking University(北京大学深圳研究生院)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 DriveExplorer通过图像解耦和渐进修复实现驾驶视角外推,利用4D高斯框架和扩散模型提升重建质量。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. Gaussian Splatting 6 篇

2512.24742 2026-01-01 cs.CV 85%

Splatwizard: A Benchmark Toolkit for 3D Gaussian Splatting Compression

Splatwizard:3D高斯散射压缩的基准工具包

Xiang Liu, Yimin Zhou, Jinxiang Wang, Yujun Huang, Shuzhao Xie, Shiyu Qin, Mingyao Hong, Jiawei Li, Yaowei Wang, Zhi Wang, Shu-Tao Xia, Bin Chen

机构 * Tsinghua University(清华大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Pengcheng Laboratory(鹏城实验室) Huawei Technologies Ltd(华为技术有限公司)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 Splatwizard是一个专门用于评估3D高斯散射压缩模型的基准工具包,提供统一框架和自动化性能指标计算,用于评估渲染速度、率失真权衡、内存效率和几何准确性等关键指标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19108 2026-01-01 cs.CV 79%

GaussianImage++: Boosted Image Representation and Compression with 2D Gaussian Splatting

GaussianImage++: 通过2D高斯散射提升图像表示与压缩

Tiantian Li, Xinjie Zhang, Xingtong Ge, Tongda Xu, Dailan He, Jun Zhang, Yan Wang

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 GaussianImage++通过有限的高斯原始体实现高效的图像表示与压缩,结合驱动扭曲的密集化机制和上下文感知滤波器,提升性能并降低内存消耗。

Comments Accepted to AAAI 2026. Code URL:https://github.com/Sweethyh/GaussianImage_plus.git

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24763 2026-01-01 cs.CV 77%

UniC-Lift: Unified 3D Instance Segmentation via Contrastive Learning

UniC-Lift: 通过对比学习实现统一的3D实例分割

Ankit Dhiman, Srinath R, Jaswanth Reddy, Lokesh R Boregowda, Venkatesh Babu Radhakrishnan

专题命中 Gaussian Splatting :NeRF(abstract);Gaussian Splatting(abstract);3DGS(abstract);分类 cs.CV

AI总结 UniC-Lift通过对比学习实现统一的3D实例分割,引入可学习特征嵌入和改进的嵌入到标签过程,提升分割性能并减少训练时间。

Comments Accepted to AAAI 2026. Project Page: https://unic-lift.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02261 2026-01-01 cs.CV 74%

SplatSSC: Decoupled Depth-Guided Gaussian Splatting for Semantic Scene Completion

SplatSSC:解耦深度引导的高斯点云法用于语义场景补全

Rui Qian, Haozhi Cao, Tianchen Deng, Shenghai Yuan, Lihua Xie

专题命中 Gaussian Splatting :Gaussian Splatting(title);分类 cs.CV

AI总结 SplatSSC通过深度引导的初始化策略和解耦高斯聚合器,提升语义场景补全的效率与鲁棒性,实现性能和资源消耗的优化。

Comments Accepted for oral presentation in The 40th Annual AAAI Conference on Artificial Intelligence (AAAI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24986 2026-01-01 cs.GR cs.CV 73%

PhysTalk: Language-driven Real-time Physics in 3D Gaussian Scenes

PhysTalk: 基于语言的实时3D高斯场景物理模拟

Luca Collorone, Mert Kiray, Indro Spinelli, Fabio Galasso, Benjamin Busam

机构 * Sapienza University of Rome(萨皮恩扎罗马大学) Technical University of Munich(慕尼黑技术大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract);分类 cs.CV、cs.GR

AI总结 PhysTalk通过实时物理模拟实现基于语言的3D高斯场景交互式动画,无需离线优化,提升创作效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24018 2026-01-01 cs.CV 57%

Structure-Guided Allocation of 2D Gaussians for Image Representation and Compression

基于结构的2D高斯分配用于图像表示与压缩

Huanxiong Liang, Yunuo Chen, Yicheng Pan, Sixian Wang, Jincheng Dai, Guo Lu, Wenjun Zhang

机构 * Department of Electronic Engineering, Shanghai Jiao Tong University(上海交通大学电子工程系) Key Laboratory of Universal Wireless Communications, Ministry of Education, Beijing University of Posts and Telecommunications(教育部无线通信关键实验室)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 本文提出基于图像结构的2D高斯分配方法,通过自适应量化和几何正则化提升图像表示与压缩效率。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 点云 8 篇

2512.24201 2026-01-01 cs.GR 79%

BATISNet: Instance Segmentation of Tooth Point Clouds with Boundary Awareness

BATISNet: 用于牙点云实例分割的边界感知网络

Yating Cai, Yanghui Xu, Zehua Hu, Jiazhou Chen, Jing Huang

专题命中 点云 :point cloud(title,abstract);分类 cs.GR

AI总结 BATISNet通过引入边界感知损失函数和实例分割模块,提升牙点云分割的鲁棒性和准确性,尤其在复杂临床场景中表现优异。

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24193 2026-01-01 cs.CV cs.AI 79%

PointRAFT: 3D deep learning for high-throughput prediction of potato tuber weight from partial point clouds

PointRAFT:用于从部分点云高通量预测马铃薯块茎重量的3D深度学习

Pieter M. Blok, Haozhou Wang, Hyun Kwon Suh, Peicheng Wang, James Burridge, Wei Guo

机构 * Graduate School of Agricultural and Life Sciences, The University of Tokyo(东京大学农业与生命科学研究生院) Department of Integrative Biological Sciences and Industry, Sejong University(世宗大学整合生物科学与工业系)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 PointRAFT通过高通量点云回归网络,从部分点云直接预测马铃薯块茎重量,显著优于现有方法,适用于3D表型分析和机器人感知。

Comments 14 pages, 7 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24384 2026-01-01 cs.RO cs.CV 62%

Geometric Multi-Session Map Merging with Learned Local Descriptors

几何多会话地图融合与学习局部描述符

Yanlong Ma, Nakul S. Joshi, Christa S. Robison, Philip R. Osteen, Brett T. Lopez

机构 * University of California, Los Angeles(加州大学洛杉矶分校) DEVCOM Army Research Laboratory (ARL)(国防部陆军研究实验室(ARL))

专题命中 点云 :point cloud(abstract);分类 cs.CV、cs.RO

AI总结 本文提出GMLD框架,通过学习局部描述符实现大规模多会话点云地图融合,提升地图对齐的准确性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24605 2026-01-01 cs.CV 57%

MoniRefer: A Real-world Large-scale Multi-modal Dataset based on Roadside Infrastructure for 3D Visual Grounding

MoniRefer: 一种基于道路基础设施的现实世界大规模多模态数据集用于3D视觉定位

Panquan Yang, Junfei Huang, Zongzhangbao Yin, Yingsong Hu, Anni Xu, Xinyi Luo, Xueqi Sun, Hai Wu, Sheng Ao, Zhaoxing Zhu, Chenglu Wen, Cheng Wang

机构 * Xiamen University(厦门大学) Pengcheng Laboratory(鹏城实验室)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出MoniRefer数据集和Moni3DVG方法,用于解决户外监控场景下的3D视觉定位问题。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24603 2026-01-01 cs.CV 57%

Collaborative Low-Rank Adaptation for Pre-Trained Vision Transformers

协同低秩适应用于预训练视觉变换器

Zheng Liu, Jinchao Zhu, Gao Huang

机构 * School of Automation and Electrical Engineering, University of Science and Technology Beijing(北京科技大学自动化与电气工程学院) Beijing Engineering Research Center of Industrial Spectrum Imaging(工业光谱成像工程研究中心) College of Software, Nankai University(南开大学软件学院) Department of Automation, BNRist, Tsinghua University(清华大学自动化系)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出协同低秩适应方法,通过基础空间共享和样本无关多样性增强,提升预训练视觉变换器在点云分析中的性能与参数效率。

Comments 13 tables, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24593 2026-01-01 cs.CV cs.LG 57%

3D Semantic Segmentation for Post-Disaster Assessment

灾害评估中的3D语义分割

Nhut Le, Maryam Rahnemoonfar

机构 * Lehigh University(莱文斯顿大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出利用无人机拍摄的灾后影像构建专用3D数据集,并评估现有模型在灾后场景中的局限性,强调了改进3D分割技术与开发专用基准数据集的必要性。

Comments Accepted by the 2025 IEEE International Geoscience and Remote Sensing Symposium (IGARSS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23972 2026-01-01 cs.RO 57%

SHIELD: Spherical-Projection Hybrid-Frontier Integration for Efficient LiDAR-based Drone Exploration

SHIELD:球面投影混合前沿集成用于高效的基于LiDAR的无人机探索

Liangtao Feng, Zhenchang Liu, Feng Zhang, Xuefeng Ren

机构 * Zhuoyi Intelligent Tech Co, Ltd.(卓奕智能科技有限公司)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 SHIELD通过球面投影和混合前沿方法提升基于LiDAR的无人机探索效率与安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02726 2026-01-01 math.ST stat.TH 50%

Sample complexity and weak limits of nonsmooth multimarginal Schrödinger system with application to optimal transport barycenter

非光滑多边际薛定谔系统的样本复杂性与弱极限及其在最优运输重心中的应用

Pengtao Li, Xiaohui Chen

专题命中 点云 :point cloud(abstract)

AI总结 本文研究了多边际最优运输的样本复杂性与弱极限,提出多边际薛定谔重心作为正则化方法,展示了其统计最优性。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 空间理解 2 篇

2508.13142 2026-01-01 cs.CV cs.CL cs.LG cs.MM cs.RO 62%

Holistic Evaluation of Multimodal LLMs on Spatial Intelligence

多模态大语言模型在空间智能方面的综合评估

Zhongang Cai, Yubo Wang, Qingping Sun, Ruisi Wang, Chenyang Gu, Wanqi Yin, Zhiqian Lin, Zhitao Yang, Chen Wei, Oscar Qian, Hui En Pang, Xuanke Shi, Kewang Deng, Xiaoyang Han, Zukai Chen, Jiaqi Li, Xiangyu Fan, Hanming Deng, Lewei Lu, Bo Li, Ziwei Liu, Quan Wang, Dahua Lin, Lei Yang

专题命中 空间理解 :spatial understanding(abstract);分类 cs.CV、cs.RO

AI总结 本文提出EASI框架,用于评估多模态大语言模型在空间智能方面的综合表现,揭示GPT-5在SI中的优势与不足,并展示专有模型在困难任务上的劣势。

Comments Codebase: https://github.com/EvolvingLMMs-Lab/EASI/ ; Leaderboard: https://huggingface.co/spaces/lmms-lab-si/EASI-Leaderboard

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24532 2026-01-01 cs.AI cs.CL 50%

From Building Blocks to Planning: Multi-Step Spatial Reasoning in LLMs with Reinforcement Learning

从积木到规划:通过强化学习在LLMs中实现多步骤空间推理

Amir Tahmasbi, Sadegh Majidi, Kazem Taram, Aniket Bera

机构 * Department of Computer Science(计算机科学系)

专题命中 空间理解 :spatial understanding(abstract)

AI总结 本文提出了一种两阶段方法,通过强化学习在LLMs中实现多步骤空间推理,通过微调和LoRA适配器提升模型在结构环境中的空间推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏