arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-08-27 至 2026-08-27 共收录 21 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 3 篇

2608.25401 2026-08-27 cs.CV cs.AI 新提交 85%

PIVOT: A Multi-Trajectory Dataset and Testbed for Pose, Intrinsics, and Novel Viewpoint Evaluation in Real-World 3D Reconstruction

PIVOT:面向真实世界3D重建中姿态、内参和新视点评估的多轨迹数据集与测试平台

Mary Raymond

专题命中 三维重建 :3D reconstruction(title);3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 PIVOT是用于研究真实世界3D重建中姿态、内参等因素的多轨迹数据集与测试平台,其基准测试揭示了新视点合成方法在不同轨迹、姿态及内参下的性能差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10415 2026-08-27 cs.CV cs.RO 版本更新 76%

Point2Pose: Occlusion-Recovering 6D Pose Tracking and 3D Reconstruction for Multiple Unknown Objects Via 2D Point Trackers

Point2Pose:基于2D点跟踪器的遮挡恢复多未知物体6D姿态跟踪与3D重建

Tzu-Yuan Lin, Ho Jae Lee, Kevin Doherty, Yonghyeon Lee, Sangbae Kim

专题命中 三维重建 :3D reconstruction(title);分类 cs.CV、cs.RO

AI总结 Point2Pose利用2D点跟踪器实现多未知物体的6D姿态跟踪与3D重建,在完全遮挡后能快速恢复,无需CAD模型或类别先验。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25632 2026-08-27 astro-ph.CO 新提交 50%

Distinguishing cold and self-interacting dark matter through topological analysis

通过拓扑分析区分冷暗物质与自相互作用暗物质

Adrian Szpilfidel, Clotilde Laigle, Pierre Boldrini, Moritz Fischer, Dmitri Pogosyan

专题命中 三维重建 :3D reconstruction(abstract)

AI总结 该研究利用属统计量分析Darkium宇宙学模拟数据,发现密度场拓扑特征对暗物质自相互作用敏感,可作为区分自相互作用暗物质与冷暗物质的观测探针。

Comments 12 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. Gaussian Splatting 7 篇

2603.07587 2026-08-27 cs.CV 版本更新 93%

3DGS-HPC: Distractor-free 3D Gaussian Splatting with Hybrid Patch-wise Classification

3DGS-HPC: 无干扰的3D高斯散射与混合逐块分类

Jiahao Chen, Yipeng Qin, Ganlong Zhao, Xin Li, Wenping Wang, Guanbin Li

机构 * Sun Yat-sen University(中山大学) Texas A&M University(德克萨斯农工大学) Cardiff University(卡迪夫大学) Centre for Perceptual and Interactive Intelligence(感知与交互智能中心)

专题命中 Gaussian Splatting :3DGS(title,title_cn);Gaussian Splatting(title,abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 3DGS-HPC通过结合逐块分类策略和混合分类度量标准,有效抑制干扰因素,提升基于3DGS的新视角合成性能。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25483 2026-08-27 cs.CV 新提交 89%

Gaussian Splatting Underwater: A Controlled Cross-Regime Study

水下高斯溅射:一项受控跨场景研究

Olaya Álvarez-Tuñón, Stella Graßhof

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract,abstract_cn);3D reconstruction(abstract);分类 cs.CV

AI总结 本文通过受控实验对比5款公开代码的高斯溅射相关系统,探究其在不同浊度、光照的水下场景的表现,发现性能更多依赖设置而非架构,相关代码已公开。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25956 2026-08-27 cs.CV 新提交 83%

4DGS-WAM: Bridging Past and Future with an Object-Centric World Action Model based on 4D Gaussian Splatting

4DGS-WAM:基于4D高斯溅射的以对象为中心的世界动作模型,连接过去与未来

Yueen Ma, Zenglin Xu, Irwin King

机构 * The Chinese University of Hong Kong(香港中文大学) Shanghai Academy of AI for Science(上海人工智能科学研究院) Fudan University(复旦大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);point cloud(abstract);分类 cs.CV

AI总结 本研究提出基于4D高斯溅射的以对象为中心的世界动作模型4DGS-WAM,将2D观测转为持久4D表示,复用静态内容以聚焦动态对象演化,在KITTI-MOT上完成短程预测与过去重建评估。

Comments This is a work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25472 2026-08-27 cs.CV physics.med-ph 新提交 79%

PAGS: Autofocusing Photoacoustic Tomography via Speed-of-Sound-Adaptive Gaussian Splatting

PAGS:基于声速自适应高斯溅射的光声断层扫描自动聚焦

Jiarui Ge, Jintao Ma, Bangxu Fan, Jinyan Zhang, Xiaokang Yang, Shuai Na, Xiaoyun Yuan

机构 * Shanghai Jiao Tong University(上海交通大学) Peking University(北京大学) National Biomedical Imaging Center(国家生物医学成像中心) Academy for Advanced Interdisciplinary Studies, Peking University(北京大学前沿交叉学科研究院) PKU–Nanjing Institute of Translational Medicine(北京大学南京转化医学研究院)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 PAGS是基于声速自适应高斯溅射的可微分框架,无需声速先验,通过联合优化高斯光声源与声速场,提升了异质介质下光声断层扫描的重建清晰度与稀疏视图鲁棒性,且计算效率更高。

Comments 13 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26236 2026-08-27 eess.IV cs.CV eess.SP 版本更新 79%

Rendering Novel Views of MRI Using 3D Gaussian Splatting

使用3D高斯泼溅渲染MRI的新视图

Robin Y. Park, Mark C. Eid, Rhydian Windsor, Amir Jamaludin, Ana I.L. Namburete, João F. Henriques, Andrew Zisserman

机构 * Visual Geometry Group, University of Oxford(视觉几何组,牛津大学) Oxford Machine Learning in NeuroImaging Lab, University of Oxford(牛津大学神经影像学机器学习实验室)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 通过3D高斯泼溅从稀疏各向异性MRI重建体积并采样与目标解剖对齐的平面,生成更优的放射学分级视图,相比原始扫描和体素插值方法提高了椎管狭窄分级准确性。

Comments Spotlight at AI4M3D workshop at ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10712 2026-08-27 cs.CV 版本更新 70%

Compact Feed-Forward 3D Gaussians via Saliency-Guided Primitive Merging

基于显著性引导基元合并的紧凑前馈三维高斯模型

Tim-Felix Fassch, Jochen Kall, Cyrill Stachniss

机构 * Bosch Research(博世研究院) University of Bonn(波恩大学) Lamarr Institute for Machine Learning and Artificial Intelligence(拉马尔机器学习与人工智能研究院)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract,abstract_cn);分类 cs.CV

AI总结 该研究针对前馈三维高斯方法基元冗余问题,提出显著性引导的基元合并流水线,可在仅1/20高斯数量下保留视觉质量,实现高效紧凑的三维场景表示与渲染。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.09993 2026-08-27 cs.CV 版本更新 70%

3DGAA: Realistic and Robust 3D Gaussian-based Adversarial Attack for Autonomous Driving

3DGAA:面向自动驾驶的逼真且鲁棒的基于3D高斯的对抗攻击

Yixun Zhang, Lizhi Wang, Junjun Zhao, Wending Zhao, Feng Zhou, Yonghao Dang, Jianqin Yin

机构 * School of Intelligent Engineering and Automation, Beijing University of Posts and Telecommunications, China(智能工程与自动化学院,北京邮电大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract,abstract_cn);分类 cs.CV

AI总结 本文提出3DGAA框架,通过3D高斯溅射实现视图一致、几何保持的可打印对抗包裹,在CARLA仿真等测试中显著降低自动驾驶车辆相机感知的检测性能,为安全评估与防御设计提供支撑。

Comments TIFS

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 点云 8 篇

2608.25799 2026-08-27 cs.RO 新提交 57%

AGRO-Nav: Autonomous Graph-based Orchard Navigation

AGRO-Nav:基于自主图的果园导航

Ho Young Yun, Jaemin Yu, Duksu Kim

机构 * School of Computer Engineering, Korea University of Technology and Education (KOREATECH)(韩国技术教育大学计算机工程学院(KOREATECH))

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 针对果园半结构化环境中网格规划器易偏离行中心的问题,提出 AGRO-Nav 框架,通过 SLAM 点云构建拓扑图并结合 Dijkstra 搜索等算法规划路径,在真实和仿真环境中均表现出更高精度与规划效率。

Comments 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25418 2026-08-27 cs.CV 新提交 57%

Bootstrapping a 4D LiDAR Annotation Tool from Video Foundation Models

基于视频基础模型引导的4D激光雷达标注工具

Jihun Kim, Hyun-Kurl Jang, Hyemin Yang, Jinnyeong Yang, Hyeokjun Kweon, Kuk-Jin Yoon

机构 * KAIST(韩国科学技术院) Chung-Ang University(中央大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 研究针对4D激光雷达标注成本高、难扩展的问题,提出LiDAR-SAM2框架,借助SAM2自动生成标注,大幅降低3D/4D场景理解的标注负担。

Comments ECCV 2026 Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13584 2026-08-27 cs.RO 版本更新 57%

UNRIO: Uncertainty-Aware Velocity Learning for Radar-Inertial Odometry

UNRIO:面向雷达-惯性里程计的不确定性感知速度学习

Jui-Te Huang, Tianshu Huang, Anthony Rowe, Michael Kaess

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 UNRIO通过直接处理雷达IQ信号预测体坐标系速度,结合Transformer架构和GRT框架,在多模式下实现不确定性估计与姿态图融合,有效提升横向运动轨迹中的里程计精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21256 2026-08-27 cs.CV 版本更新 57%

LaGen: Towards Autoregressive LiDAR Scene Generation

LaGen:迈向自主驾驶的自回归激光雷达场景生成

Sizhuo Zhou, Xiaosong Jia, Fanrui Zhang, Junjie Li, Juyong Zhang, Yukang Feng, Jianwen Sun, Songbur Wong, Junqi You, Junchi Yan

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai Innovation Institute(上海创新研究院) Shanghai Jiao Tong University(上海交通大学) Fudan University(复旦大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出LaGen,首个支持长时交互生成的自回归框架,能基于单帧输入生成高保真4D激光雷达场景,并通过场景解耦和噪声调节模块提升生成质量。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25084 2026-08-27 cs.LG math.NA 新提交 50%

The Frame Kernel Method for Multiscale Operator Learning

用于多尺度算子学习的框架核方法

Branden Frieden, Ryan Whitehead, M. Keith Ballard, Robert M. Kirby, Varun Shankar

机构 * Kahlert School of Computing, University of Utah(犹他大学卡勒特计算机学院) U.S. Air Force Research Laboratory(美国空军研究实验室)

专题命中 点云 :point cloud(abstract)

AI总结 该研究提出原生多尺度算子学习的框架核方法,用于多尺度PDE代理建模,其精度优于流行神经算子,可实现后验多尺度分解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25145 2026-08-27 math.OC stat.ML 新提交 50%

Barycentric Weak Inner-Product Gromov-Wasserstein

Youssef Mroueh

专题命中 点云 :point cloud(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25065 2026-08-27 math.PR 新提交 50%

Detection of first homology via random geometric graphs in the thermodynamic regime

热力学 regime 下通过随机几何图检测一阶同调

Christian Gorski

专题命中 点云 :point cloud(abstract)

AI总结 该研究针对紧致黎曼流形上的随机几何图,提出仅需 O(n) 条边的方法,在热力学超临界 regime 下可高概率推断其一阶同调群,确定了正确尺度并证明结果最优。

Comments 34 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25878 2026-08-27 math.AP math.AG math.MG 版本更新 50%

Many-point tropical relaxation and the Monge--Ampère equation

多点热带松弛与蒙日 - 安培方程

Nikita Kalinin, Ernesto Lupercio, Higinio Serrano, Mikhail Shkolnikov

专题命中 点云 :point cloud(abstract)

AI总结 研究平面亚历山德罗夫蒙日 - 安培方程,构建关联驱动的热带逼近,通过结合多种方法,得到\(N^{-1/2}F_N\)的收敛性、曲率估计等结果,还包括随机点云极限、协方差及对角线相关结论。

Comments 67 pages, 3 figures. Revised exposition and proof clarifications; corrected numerical appendix. Main results unchanged

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 新视角合成 1 篇

2601.16296 2026-08-27 cs.CV cs.AI cs.LG 版本更新 57%

Memory-V2V: Memory-Augmented Video-to-Video Diffusion for Consistent Multi-Turn Editing

Memory-V2V: 通过记忆增强的视频到视频扩散模型实现一致的多轮编辑

Dohun Lee, Chun-Hao Paul Huang, Xuelin Chen, Jong Chul Ye, Duygu Ceylan, Hyeonho Jeong

机构 * Adobe Research(Adobe研究实验室) KAIST AI(韩国科学技术院人工智能研究所) Adobe Internship(Adobe实习) Project Lead(项目负责人)

专题命中 新视角合成 :novel view synthesis(abstract);分类 cs.CV

AI总结 Memory-V2V通过引入外部记忆模块,解决多轮视频编辑中的跨轮一致性问题,提升编辑连贯性并保持视觉质量,优于现有基线模型。

Comments 38 pages, 22 figures, ECCV 2026, Project page: this https URL (https://dohunlee1.github.io/MemoryV2V)

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 3D生成 1 篇

2509.23841 2026-08-27 cs.CV 版本更新 57%

Towards Fine-Grained Text-to-3D Quality Assessment: A Benchmark and A Two-Stage Rank-Learning Metric

面向细粒度文本到3D质量评估:一个基准和两阶段排名学习指标

Bingyang Cui, Yujie Zhang, Qi Yang, Zhu Li, Yiling Xu

机构 * Shanghai Jiao Tong University(上海交通大学) University of Missouri-Kansas City(密苏里大学-堪萨斯城分校)

专题命中 3D生成 :3D generation(abstract);分类 cs.CV

AI总结 针对T23DQA的基准缺失与指标缺陷,本文推出组合式T23D生成基准T23D-CompBench,并提出两阶段排名学习指标Rank2Score,其性能优于现有指标且可作为奖励函数优化生成模型。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. SLAM与定位 1 篇

2606.00307 2026-08-27 cs.RO 版本更新 57%

ScaRF-SLAM: Scale-Consistent Reconstruction with Feed-Forward Models and Classical Visual SLAM

ScaRF-SLAM: 基于前馈模型与经典视觉SLAM的尺度一致重建

Yuhao Zhang, Yifu Tao, Frank Dellaert, Maurice Fallon

机构 * Oxford Robotics Institute, University of Oxford(牛津大学机器人研究所) College of Computing, Georgia Institute of Technology(佐治亚理工学院计算机学院)

专题命中 SLAM与定位 :point cloud(abstract);分类 cs.RO

AI总结 提出一种解耦框架,将经典特征SLAM用于鲁棒跟踪,几何基础模型仅用于建图,通过尺度优化和子图融合实现高质量一致密集重建,在建筑级数据集上重建精度提升10%-20%。

Comments Accepted to IEEE Robotics and Automation Letters (RA-L) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏