arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-02-26 至 2026-02-26 共收录 15 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 4 篇

2602.21929 2026-02-26 cs.CV 57%

Geometry-as-context: Modulating Explicit 3D in Scene-consistent Video Generation to Geometry Context

几何作为上下文:调节显式3D以在场景一致视频生成中利用几何上下文

JiaKui Hu, Jialun Liu, Liying Yang, Xinliang Zhang, Kaiwen Li, Shuang Zeng, Yuanwei Li, Haibin Huang, Chi Zhang, Yanye Lu

机构 * Institute of Medical Technology, Peking University(北京大学医学技术学院) TeleAI MUST

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出几何作为上下文的方法,通过自回归模型迭代生成3D场景,提升视频生成的场景一致性和相机控制能力。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21780 2026-02-26 cs.CV 57%

XStreamVGGT: Extremely Memory-Efficient Streaming Vision Geometry Grounded Transformer with KV Cache Compression

XStreamVGGT: 极端内存高效的流式视觉几何 grounded Transformer 与 KV 缓存压缩

Zunhai Su, Weihao Ye, Hansen Feng, Keyu Fan, Jing Zhang, Dahai Yu, Zhengwu Liu, Ngai Wong

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Institute of Artificial Intelligence, Xiamen University(厦门大学人工智能学院) China Star Optoelectronics Technology(中国星电科技) TCL Corporate Research (HK) Co., Ltd.(TCL香港企业研究有限公司) Department of Electrical and Electronic Engineering, The University of Hong Kong(香港大学电子与电气工程系)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 XStreamVGGT通过剪枝和量化技术,实现极内存高效的流式3D重建,显著降低内存消耗并加速推理。

Comments Submission to the Journal of the Society for Information Display

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15487 2026-02-26 cs.LG cs.CV 57%

NTK-Guided Implicit Neural Teaching

NTK引导的隐式神经教学

Chen Zhang, Wei Zuo, Bingyang Cheng, Yikun Wang, Wei-Bin Kou, Yik Chung WU, Ngai Wong

机构 * The University of Hong Kong(香港大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出NTK引导的隐式神经教学方法,通过动态选择坐标加速训练,显著减少训练时间并保持表示质量。

Comments CVPR 2026 (18 pages, 10 figures)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20714 2026-02-26 cs.LG cs.CE 50%

WeirNet: A Large-Scale 3D CFD Benchmark for Geometric Surrogate Modeling of Piano Key Weirs

WeirNet:一种大规模三维CFD基准数据集,用于钢琴键堰的几何替代建模

Lisa Lüddecke, Michael Hohmann, Sebastian Eilermann, Jan Tillmann-Mumm, Pezhman Pourabdollah, Mario Oertel, Oliver Niggemann

机构 * Hydraulic Engineering Section, Civil Engineering, Helmut-Schmidt-University(水利工程系,土木工程,黑姆特-施密特大学) Institute for Artificial Intelligence, Helmut-Schmidt-University(人工智能研究所,黑姆特-施密特大学) Professorship of Computer Science in Mechanical Engineering, Helmut-Schmidt-University(机械工程计算机科学教授职位,黑姆特-施密特大学) Chair for Automation Technology, Helmut-Schmidt-University(自动化技术教授职位,黑姆特-施密特大学) Federal Waterways Engineering and Research Institute(联邦水道工程与研究机构)

专题命中 三维重建 :point cloud(abstract)

AI总结 WeirNet通过大规模三维CFD基准数据集,为钢琴键堰的几何替代建模提供支持,提升水力设计效率。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. NeRF 1 篇

2602.21645 2026-02-26 cs.CV 57%

Lie Flow: Video Dynamic Fields Modeling and Predicting with Lie Algebra as Geometric Physics Principle

Lie Flow:基于李代数的视频动态场建模与预测:作为几何物理原理

Weidong Qiao, Wangmeng Zuo, Hui Li

专题命中 NeRF :NeRF(abstract);分类 cs.CV

AI总结 LieFlow基于SE(3)李群建模视频动态场,通过统一几何空间学习平移和旋转,提升视点合成保真度与物理真实性。

Comments 10pages,5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

3. Gaussian Splatting 2 篇

2602.21874 2026-02-26 cs.HC 67%

Interactive Augmented Reality-enabled Outdoor Scene Visualization For Enhanced Real-time Disaster Response

交互式增强现实赋能的户外场景可视化以提升实时灾害响应

Dimitrios Apostolakis, Georgios Angelidis, Vasileios Argyriou, Panagiotis Sarigiannidis, Georgios Th. Papadopoulos

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract)

AI总结 本文提出了一种基于3DGS的交互式AR界面,用于提升实时灾害响应中的场景可视化与决策效率。

Comments 6 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21668 2026-02-26 cs.CV cs.GR 62%

Space-Time Forecasting of Dynamic Scenes with Motion-aware Gaussian Grouping

动态场景的空间-时间预测与运动感知高斯分组

Junmyeong Lee, Hoseung Choi, Minsu Cho

机构 * Pohang University of Science and Technology (POSTECH)(釜山科学技术大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV、cs.GR

AI总结 MoGaF通过运动感知的高斯分组和优化,实现动态场景的长期预测与空间一致性,提升预测质量和时间稳定性。

Comments 20 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 点云 6 篇

2602.21662 2026-02-26 cs.CV 79%

HybridINR-PCGC: Hybrid Lossless Point Cloud Geometry Compression Bridging Pretrained Model and Implicit Neural Representation

HybridINR-PCGC: 一种融合预训练模型与隐式神经表示的无损点云几何压缩框架

Wenjie Huang, Qi Yang, Shuting Xia, He Huang, Zhu Li, Yiling Xu

机构 * Shanghai Jiao Tong University(上海交通大学) University of Missouri-Kansas City(密苏里大学-堪萨斯城分校)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 HybridINR-PCGC通过融合预训练模型与隐式神经表示,实现高效无损点云压缩,提升压缩率和编码效率。

Comments 8 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21709 2026-02-26 cs.CV 57%

Assessing airborne laser scanning and aerial photogrammetry for deep learning-based stand delineation

评估空中激光扫描和航空摄影测量在基于深度学习的林分 delineation 中的应用

Håkon Næss Sandum, Hans Ole Ørka, Oliver Tomic, Terje Gobakken

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文评估了空中激光扫描和航空摄影测量在基于深度学习的林分 delineation 中的应用,发现不同数据组合在性能上表现相似,且框架对输入数据变化具有鲁棒性。

Comments 20 pages, 4 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21699 2026-02-26 cs.CV 57%

SF3D-RGB: Scene Flow Estimation from Monocular Camera and Sparse LiDAR

SF3D-RGB:从单目相机和稀疏LiDAR估计场景流

Rajai Alhimdiat, Ramy Battrawy, René Schuster, Didier Stricker, Wesam Ashour

机构 * Islamic University of Gaza(加沙伊斯兰大学) German Research Center for Artificial Intelligence (DFKI)(德国人工智能研究中心)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 SF3D-RGB通过结合单目图像和稀疏LiDAR数据,提出了一种端到端深度学习架构,实现了更高效且准确的场景流估计。

Comments Accepted in Computer Vision Conference (CVC) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21589 2026-02-26 cs.CV 57%

SEF-MAP: Subspace-Decomposed Expert Fusion for Robust Multimodal HD Map Prediction

SEF-MAP:子空间分解专家融合用于鲁棒多模态高精度地图预测

Haoxiang Fu, Lingfeng Zhang, Hao Li, Ruibing Hu, Zhengrong Li, Guanjing Liu, Zimu Tan, Long Chen, Hangjun Ye, Xiaoshuai Hao

机构 * National University of Singapore(新加坡国立大学) Xiaomi EV(小米电动车) Chinese University of Hong Kong(香港中文大学) The University of Manchester(曼彻斯特大学) Renmin University of China(中国人民大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 SEF-MAP通过子空间分解和专家融合,提升多模态HD地图预测的鲁棒性和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16069 2026-02-26 cs.CV 57%

Voxel Densification for Serialized 3D Object Detection: Mitigating Sparsity via Pre-serialization Expansion

体素稠密化用于序列化3D物体检测:通过预序列化扩展缓解稀疏性

Qifeng Liu, Dawei Zhao, Yabo Dong, Linzhi Shang, Liang Xiao, Juan Wang, Kunkong Zhao, Dongming Lu, Qi Zhu

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出体素稠密化模块,通过预序列化扩展提升3D物体检测精度,实验显示在多个数据集上均优于基线模型。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16071 2026-02-26 cs.LG cs.AI 50%

MNO: Multiscale Neural Operator for 3D Computational Fluid Dynamics

MNO:用于三维计算流体动力学的多尺度神经算子

Qinxuan Wang, Chuang Wang, Mingyu Zhang, Jingwei Sun, Peipei Yang, Shuo Tang, Shiming Xiang

机构 * School of Artifcial Intelligence, University of Chinese Academy of Sciences, Beijing 100049, China(人工智能学院,中国科学院大学,北京)

专题命中 点云 :point cloud(abstract)

AI总结 MNO通过多尺度架构在三维非结构化点云上实现高效计算流体动力学模拟,显著提升预测精度。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 新视角合成 2 篇

2601.18970 2026-02-26 cs.CV 57%

Pay Attention to Where You Looked

关注你所注视的地方

Alex Berian, JhihYang Wu, Daniel Brignac, Natnael Daba, Abhijit Mahalanobis

专题命中 新视角合成 :novel view synthesis(abstract);分类 cs.CV

AI总结 本文提出了一种自适应视角加权机制,通过调整源视角的重要性来提升少样本NVS的合成质量与真实感。

Comments ICIP 2025 Workshop on Generative AI for World Simulations and Communications

Journal ref International Conference on Image Processing 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21341 2026-02-26 cs.CV cs.AI 57%

Scaling View Synthesis Transformers

视图合成变换器的扩展

Evan Kim, Hyunwoo Ryu, Thomas W. Mitchel, Vincent Sitzmann

机构 * MIT(麻省理工学院) Adobe(Adobe公司)

专题命中 新视角合成 :novel view synthesis(abstract);分类 cs.CV

AI总结 本文提出了一种可扩展的视图合成模型,通过系统研究扩展规律,实现了计算最优的NVS模型,并在减少训练计算的情况下超越了现有最先进方法。

Comments Project page: https://www.evn.kim/research/svsm

Journal ref Conference on Computer Vision and Pattern Recognition (CVPR), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏