arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2025-11-04 至 2025-11-04 共收录 25 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 5 篇

2406.08894 2025-11-04 cs.CV 83%

OpenMaterial: A Large-scale Dataset of Complex Materials for 3D Reconstruction

Zheng Dang, Jialu Huang, Fei Wang, Mathieu Salzmann

机构 * CVLab, EPFL, Switzerland(苏黎世联邦理工学院计算机视觉实验室) Xi’an Jiaotong University, China(西安交通大学)

专题命中 三维重建 :3D reconstruction(title,abstract);novel view synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25173 2025-11-04 cs.CV 70%

D$^2$GS: Dense Depth Regularization for LiDAR-free Urban Scene Reconstruction

Kejing Xia, Jidong Jia, Ke Jin, Yucai Bai, Li Sun, Dacheng Tao, Youjian Zhang

机构 * Wuhan University(武汉大学) Shanghai Jiaotong University(上海交通大学) TongJi University(同济大学) Bosch(博世) Nanyang Technological University(南洋理工大学)

专题命中 三维重建 :Gaussian Splatting(abstract);point cloud(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00362 2025-11-04 cs.CV cs.AI cs.GR 62%

Oitijjo-3D: Generative AI Framework for Rapid 3D Heritage Reconstruction from Street View Imagery

Momen Khandoker Ope, Akif Islam, Mohd Ruhul Ameen, Abu Saleh Musa Miah, Md Rashedul Islam, Jungpil Shin

机构 * University of Rajshahi(拉贾沙希大学) Marshall University(马歇尔大学) University of Aizu(御所大学) University of Asia Pacific(亚洲太平洋大学)

专题命中 三维重建 :3D generation(abstract);分类 cs.CV、cs.GR

Comments 6 Pages, 4 figures, 2 Tables, Submitted to ICECTE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24464 2025-11-04 cs.CV 57%

Kineo: Calibration-Free Metric Motion Capture From Sparse RGB Cameras

Charles Javerliat, Pierre Raimbaud, Guillaume Lavoué

机构 * École Centrale de Lyon, CNRS, INSA Lyon, Université Claude Bernard Lyon 1, Université Lumière Lyon 2, LIRIS, UMR5205, ENISE(Lyon中央理工学院、国家科学研究中心、里昂国立应用科学学院、克莱门特-伯纳德大学里昂1分校、里昂2大学、LIRIS、UMR5205、ENISE)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01206 2025-11-04 cs.CV cs.AI 57%

EndoGMDE: Generalizable Monocular Depth Estimation with Mixture of Low-Rank Experts for Diverse Endoscopic Scenes

Liangjing Shao, Chenkang Du, Benshuang Chen, Xueli Liu, Xinrong Chen

机构 * Department of Electronic Engineering, The Chinese University of Hong Kong(香港中文大学电子工程系) College of Biomedical Engineering, Fudan University(复旦大学生物医学工程学院) Shanghai Key laboratory of Medical Image Computing and Computer Assisted Intervention(上海医学影像计算与计算机辅助手术重点实验室) ENT Institute and Department of Otolaryngology, Eye & ENT Hospital of Fudan University(复旦大学眼耳鼻喉科医院耳鼻喉科及耳鼻喉科研究所)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

Comments 12 pages, 12 figures, 7 tables. Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏

2. Gaussian Splatting 4 篇

2504.00159 2025-11-04 cs.CV 89%

SonarSplat: Novel View Synthesis of Imaging Sonar via Gaussian Splatting

Advaith V. Sethuraman, Max Rucker, Onur Bagoren, Pou-Chun Kung, Nibarkavi N. B. Amutha, Katherine A. Skinner

机构 * Department of Robotics, University of Michigan(机器人学系,密歇根大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);novel view synthesis(title,abstract);3D reconstruction(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11252 2025-11-04 cs.GR cs.CV 86%

Anti-Aliased 2D Gaussian Splatting

Mae Younes, Adnane Boukhayma

机构 * INRIA France(法国INRIA) University of Rennes(里昂大学) CNRS(国家科学研究中心) IRISA(里莫斯岛研究所)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract);novel view synthesis(abstract);分类 cs.CV、cs.GR

Comments NeurIPS 2025. Code will be available at https://github.com/maeyounes/AA-2DGS

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.19588 2025-11-04 cs.CV 77%

Gaussian Splashing: Direct Volumetric Rendering Underwater

Nir Mualem, Roy Amoyal, Oren Freifeld, Derya Akkaynak

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract);3D reconstruction(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00998 2025-11-04 cs.RO 57%

GauDP: Reinventing Multi-Agent Collaboration through Gaussian-Image Synergy in Diffusion Policies

Ziye Wang, Li Kang, Yiran Qin, Jiahua Ma, Zhanglin Peng, Lei Bai, Ruimao Zhang

机构 * Sun Yat-sen University(中山大学) The University of Hong Kong(香港大学) Shanghai Jiao Tong University(上海交通大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 Gaussian Splatting :point cloud(abstract);分类 cs.RO

Comments Accepted by NeurIPS 2025. Project page: https://ziyeeee.github.io/gaudp.io/

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 点云 12 篇

2509.14591 2025-11-04 cs.CV 79%

Bidirectional Feature-aligned Motion Transformation for Efficient Dynamic Point Cloud Compression

Xuan Deng, Xingtao Wang, Xiandong Meng, Longguang Wang, Tiange Zhang, Xiaopeng Fan, Debin Zhao

机构 * School of Computer Science and Technology, Harbin Institute of Technology(哈尔滨工业大学计算机科学与技术学院) Peng Cheng Laboratory(鹏城实验室) Sun Yat-sen University(中山大学)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

Comments 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.02300 2025-11-04 math.AT cs.CG cs.LG 78%

Point-Level Topological Representation Learning on Point Clouds

Vincent P. Grande, Michael T. Schaub

机构 * rwth Aachen University(亚琛工业大学)

专题命中 点云 :point cloud(title,abstract)

Comments 47 pages, 18 figures, comments welcome

Journal ref International Conference on Machine Learning (ICML 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01186 2025-11-04 cs.RO cs.CV 73%

LiDAR-VGGT: Cross-Modal Coarse-to-Fine Fusion for Globally Consistent and Metric-Scale Dense Mapping

Lijie Wang, Lianjie Guo, Ziyi Xu, Qianhao Wang, Fei Gao, Xieyuanli Chen

机构 * State Key Laboratory of Industrial Control Technology, Institute of Cyber-Systems and Control, Zhejiang University(工业控制技术国家重点实验室,系统与控制研究院,浙江大学) Differential Robot Technology Co., Ltd.(差分机器人技术有限公司) College of Intelligence Science and Technology, National University of Defense Technology(智能科学与技术学院,国防科技大学)

专题命中 点云 :3D vision(abstract);point cloud(abstract);分类 cs.CV、cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15530 2025-11-04 cs.RO cs.CV cs.LG 62%

VO-DP: Semantic-Geometric Adaptive Diffusion Policy for Vision-Only Robotic Manipulation

Zehao Ni, Yonghao He, Lingfeng Qian, Jilei Mao, Fa Fu, Wei Sui, Hu Su, Junran Peng, Zhipeng Wang, Bin He

机构 * D-Robotics(D机器人) National Key Laboratory of Autonomous Intelligent Unmanned Systems(国家级自主智能无人机系统实验室) University of Science and Technology Beijing(北京科技大学) State Key Laboratory of Multimodal Artificial Intelligence System (MAIS) Institute of Automation of Chinese Academy of Sciences(多模态人工智能系统(MAIS)实验室,中国科学院自动化研究所) Frontiers Science Center for Intelligent Autonomous Systems(智能自主系统前沿科学中心) Shanghai Institute of Intelligent Science and Technology, Tongji University(上海智能科学技术研究院,同济大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV、cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00060 2025-11-04 cs.CV cs.RO eess.IV 62%

Which LiDAR scanning pattern is better for roadside perception: Repetitive or Non-repetitive?

Zhiqi Qi, Runxin Zhao, Hanyang Zhuang, Chunxiang Wang, Ming Yang

机构 * School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(自动化与智能感知学院,上海交通大学) Global College, Shanghai Jiao Tong University(全球学院,上海交通大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV、cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01768 2025-11-04 cs.CV 57%

UniLION: Towards Unified Autonomous Driving Model with Linear Group RNNs

Zhe Liu, Jinghua Hou, Xiaoqing Ye, Jingdong Wang, Hengshuang Zhao, Xiang Bai

机构 * School of Electronic Information and Communications, Huazhong University of Science and Technology (HUST), Wuhan, China(华中科技大学电子信息与通信学院) School of Software Engineering, Huazhong University of Science and Technology (HUST), Wuhan, China(华中科技大学软件工程学院) Department of Computer Science, The University of Hong Kong, Hong Kong (HKU) SAR, China(香港大学计算机系) Baidu Inc., Beijing, China(百度公司)

专题命中 点云 :point cloud(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00940 2025-11-04 cs.RO cs.AI 57%

URDF-Anything: Constructing Articulated Objects with 3D Multimodal Language Model

Zhe Li, Xiang Bai, Jieyu Zhang, Zhuangzhe Wu, Che Xu, Ying Li, Chengkai Hou, Shanghang Zhang

机构 * State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(多媒体信息处理国家重点实验室,计算机学院,北京大学) University of Washington(华盛顿大学)

专题命中 点云 :point cloud(abstract);分类 cs.RO

Comments Accepted to the 39th Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00653 2025-11-04 cs.CV 57%

Benchmarking individual tree segmentation using multispectral airborne laser scanning data: the FGI-EMIT dataset

Lassi Ruoppa, Tarmo Hietala, Verneri Seppänen, Josef Taher, Teemu Hakala, Xiaowei Yu, Antero Kukko, Harri Kaartinen, Juha Hyyppä

机构 * Finnish Geospatial Research Institute FGI(芬兰地理空间研究 institute) The National Land Survey of Finland(芬兰国家土地调查局) Department of Remote Sensing and Photogrammetry(遥感与摄影测量系) Department of Built Environment, School of Engineering, Aalto University(环境学院,工程学院,阿alto大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

Comments 39 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00652 2025-11-04 eess.IV cs.CV 57%

Been There, Scanned That: Nostalgia-Driven LiDAR Compression for Self-Driving Cars

Ali Khalid, Jaiaid Mobin, Sumanth Rao Appala, Avinash Maurya, Stephany Berrio Perez, M. Mustafa Rafique, Fawad Ahmad

机构 * Rochester Institute of Technology(罗切斯特理工学院) Vellore Institute of Technology(维洛尔理工学院) The University of Sydney(悉尼大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00635 2025-11-04 cs.RO 57%

Multi-Mapcher: Loop Closure Detection-Free Heterogeneous LiDAR Multi-Session SLAM Leveraging Outlier-Robust Registration for Autonomous Vehicles

Hyungtae Lim, Daebeom Kim, Hyun Myung

机构 * Laboratory for Information & Decision Systems, Massachusetts Institute of Technology(信息与决策系统实验室,麻省理工学院) School of Electrical Engineering, KAIST(电气工程学院,韩国科学技术院)

专题命中 点云 :point cloud(abstract);分类 cs.RO

Comments 13 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12704 2025-11-04 cs.CV cs.MM 57%

SmartFreeEdit: Mask-Free Spatial-Aware Image Editing with Complex Instruction Understanding

Qianqian Sun, Jixiang Luo, Dell Zhang, Xuelong Li

机构 * Institute of Artificial Intelligence(TeleAI), China Telecom(人工智能研究院(TeleAI),中国电信) The University of Hongkong(香港大学)

专题命中 点云 :spatial understanding(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03707 2025-11-04 cs.LG astro-ph.CO astro-ph.IM 50%

CosmoBench: A Multiscale, Multiview, Multitask Cosmology Benchmark for Geometric Deep Learning

Ningyuan Huang, Richard Stiskalek, Jun-Young Lee, Adrian E. Bayer, Charles C. Margossian, Christian Kragh Jespersen, Lucia A. Perez, Lawrence K. Saul, Francisco Villaescusa-Navarro

机构 * Centers for Computational Mathematics(计算数学中心) Computational Astrophysics(计算天文学) University of Oxford(牛津大学) Seoul National University(首尔国立大学) Princeton University(普林斯顿大学)

专题命中 点云 :point cloud(abstract)

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 新视角合成 1 篇

2506.13030 2025-11-04 cs.CV 57%

WildCAT3D: Appearance-Aware Multi-View Diffusion in the Wild

Morris Alper, David Novotny, Filippos Kokkinos, Hadar Averbuch-Elor, Tom Monnier

机构 * Tel Aviv University(特拉维夫大学) Meta AI Cornell University(康奈尔大学)

专题命中 新视角合成 :novel view synthesis(abstract);分类 cs.CV

Comments Accepted to NeurIPS 2025. Project page: https://wildcat3d.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 3D生成 1 篇

2510.08271 2025-11-04 cs.GR cs.CV cs.LG 81%

SViM3D: Stable Video Material Diffusion for Single Image 3D Generation

Andreas Engelhardt, Mark Boss, Vikram Voleti, Chun-Han Yao, Hendrik P. A. Lensch, Varun Jampani

机构 * Stability AI University of Tübingen(图宾根大学)

专题命中 3D生成 :3D generation(title);novel view synthesis(abstract);分类 cs.CV、cs.GR

Comments Accepted by International Conference on Computer Vision (ICCV 2025). Project page: http://svim3d.aengelhardt.com

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 空间理解 1 篇

2411.10509 2025-11-04 cs.CV cs.LG 57%

TESGNN: Temporal Equivariant Scene Graph Neural Networks for Efficient and Robust Multi-View 3D Scene Understanding

Quang P. M. Pham, Khoi T. N. Nguyen, Lan C. Ngo, Truong Do, Dezhen Song, Truong-Son Hy

机构 * Department of Robotics(机器人学系) Mohamed bin Zayed University of Artificial Intelligence(莫扎德·本·扎伊德人工智能大学) College of Engineering and Computer Science(工程与计算机科学学院) VinUniversity(文大学) Department of Computer Science(计算机科学系) The University of Alabama at Birmingham(阿拉巴马大学伯明翰分校)

专题命中 空间理解 :point cloud(abstract);分类 cs.CV

Comments arXiv admin note: text overlap with arXiv:2407.00609

详情

展开后加载摘要…

URL PDF HTML 收藏

7. SLAM与定位 1 篇

2511.00120 2025-11-04 cs.CV cs.AI 57%

VLM6D: VLM based 6Dof Pose Estimation based on RGB-D Images

Md Selim Sarowar, Sungho Kim

专题命中 SLAM与定位 :point cloud(abstract);分类 cs.CV

Comments This paper has been accepted to IEIE( The Institute Of Electronics and Information Engineering, South Korea) Fall,2025 Conference

详情

展开后加载摘要…

URL PDF HTML 收藏