arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2025-12-01 至 2025-12-01 共收录 29 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 7 篇

2511.23052 2025-12-01 cs.CV 88%

Image Valuation in NeRF-based 3D reconstruction

基于NeRF的3D重建中的图像估值

Grigorios Aris Cheimariotis, Antonis Karakottas, Vangelis Chatzis, Angelos Kanlis, Dimitrios Zarpalas

机构 * Information Technologies Institute (ITI),Centre for Research and Technology Hellas (CERTH)(信息科技研究所(ITI)、希腊研究中心与技术(CERTH))

专题命中 三维重建 :NeRF(title,abstract);3D reconstruction(title,abstract);分类 cs.CV

AI总结 本文提出了一种基于NeRF的3D重建图像贡献量化方法,通过PSNR和MSE指标评估图像对重建质量的影响。

Comments Published In International Conference on Computer Analysis of Images and Patterns (pp. 375-385). Cham: Springer Nature Switzerland

Journal ref Proc. CAIP 2025, Part I, pp. 375-385

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21688 2025-12-01 cs.CV cs.AI cs.CL 85%

G$^2$VLM: Geometry Grounded Vision Language Model with Unified 3D Reconstruction and Spatial Reasoning

G$^2$VLM:基于几何的视觉语言模型,实现统一的3D重建与空间推理

Wenbo Hu, Jingli Lin, Yilin Long, Yunlong Ran, Lihan Jiang, Yifan Wang, Chenming Zhu, Runsen Xu, Tai Wang, Jiangmiao Pang

机构 * Shanghai AI Lab(上海人工智能实验室) UCLA(加州大学洛杉矶分校) SJTU(上海交通大学) FDU(福建师范大学) ZJU(浙江大学) USTC(中国科学技术大学) HKU(香港大学) CUHK(香港中文大学)

专题命中 三维重建 :3D reconstruction(title,abstract);3D vision(abstract);spatial understanding(abstract);分类 cs.CV

AI总结 G$^2$VLM通过统一3D重建与空间推理,提升视觉语言模型在空间智能任务中的性能。

Comments code are released at https://github.com/InternRobotics/G2VLM

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02863 2025-12-01 cs.CV cs.AI cs.LG 79%

Point3R: Streaming 3D Reconstruction with Explicit Spatial Pointer Memory

Point3R: 基于显式空间指针记忆的流式3D重建

Yuqi Wu, Wenzhao Zheng, Jie Zhou, Jiwen Lu

机构 * Department of Automation, Tsinghua University(自动化系,清华大学)

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.CV

AI总结 Point3R通过显式空间指针记忆实现高效的流式3D重建,提升密集重建的精度与效率。

Comments Code is available at: https://github.com/YkiWu/Point3R

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22429 2025-12-01 cs.CV 79%

Fin3R: Fine-tuning Feed-forward 3D Reconstruction Models via Monocular Knowledge Distillation

Fin3R:通过单目知识蒸馏细调馈送式3D重建模型

Weining Ren, Hongjun Wang, Xiao Tan, Kai Han

机构 * Visual AI Lab, The University of Hong Kong(香港大学视觉人工智能实验室) Department of Computer Vision Technology (VIS), Baidu Inc.(百度公司计算机视觉技术部)

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.CV

AI总结 Fin3R通过单目知识蒸馏细调馈送式3D重建模型,提升几何精度和鲁棒性,仅增加微小权重。

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07119 2025-12-01 cs.CV 77%

MoRe: Monocular Geometry Refinement via Graph Optimization for Cross-View Consistency

MoRe: 通过图优化改进单目几何以实现跨视角一致性

Dongki Jung, Jaehoon Choi, Yonghan Lee, Sungmin Eum, Heesung Kwon, Dinesh Manocha

机构 * University of Maryland, College Park(马里兰大学学院公园分校) DEVCOM Army Research Laboratory(陆军研究实验室)

专题命中 三维重建 :3D vision(abstract);3D reconstruction(abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 MoRe通过图优化改进单目几何以提升跨视角一致性与尺度对齐,增强3D重建与新视角合成性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.00303 2025-12-01 cs.CV cs.GR 62%

Neural Octahedral Field: Octahedral prior for simultaneous smoothing and sharp edge regularization

神经八面体场:用于同时平滑和锐边正则化的八面体先验

Ruichen Zheng, Tao Yu, Ruizhen Hu

机构 * Tsinghua University(清华大学) Shenzhen University(深圳大学)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV、cs.GR

AI总结 本文提出神经八面体场,通过八面体空间的平滑性实现同时平滑和锐边正则化,提升点云表面重建效果。

Comments project page: https://github.com/Ankbzpx/frame-field

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.00741 2025-12-01 cs.CV cs.AI 57%

Towards End-to-End Neuromorphic Event-based 3D Object Reconstruction Without Physical Priors

迈向无物理先验的端到端神经形态事件基3D物体重建

Chuanzhi Xu, Langyi Chen, Haodong Chen, Vera Chung, Qiang Qu

机构 * School of Computer Science The University of Sydney(计算机学院悉尼大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出了一种无需物理先验的端到端神经形态事件基3D重建方法,通过改进的事件表示和二值化阈值选择提升重建精度达54.6%。

Comments 6 pages, 3 figures, 5 tables, accepted by IEEE International Conference on Multimedia & Expo (ICME) 2025

Journal ref IEEE International Conference on Multimedia and Expo (ICME), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

2. Gaussian Splatting 11 篇

2511.22997 2025-12-01 cs.CV cs.RO 88%

MrGS: Multi-modal Radiance Fields with 3D Gaussian Splatting for RGB-Thermal Novel View Synthesis

MrGS: 多模态辐射场与3D高斯点云融合用于RGB-热成像新视角合成

Minseong Kweon, Janghyun Kim, Ukcheol Shin, Jinsun Park

机构 * Minnesota Robotics Institute (MnRI), University of Minnesota, Twin Cities(明尼苏达大学罗学院(MnRI)、明尼苏达大学双城分校) Department of Information Convergence Engineering (Artificial Intelligence Major), Pusan National University(信息融合工程系(人工智能专业),釜山国立大学) Department of Energy Engineering, Korea Institute of Energy Technology (KENTECH)(能源工程系,韩国能源技术研究所(KENTECH)) School of Computer Science and Engineering, Pusan National University(计算机科学与工程学院,釜山国立大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);novel view synthesis(title);3DGS(abstract);分类 cs.CV、cs.RO

AI总结 MrGS通过多模态辐射场与3D高斯点云融合,实现RGB和热成像新视角合成,利用物理原理建模热传导和辐射现象,提升重建精度与效率。

Comments Accepted at Thermal Infrared in Robotics (TIRO) Workshop, ICRA 2025 (Best Poster Award)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22147 2025-12-01 cs.CV cs.AI cs.CR 85%

RemedyGS: Defend 3D Gaussian Splatting against Computation Cost Attacks

RemedyGS: 保护3D高斯散射免受计算成本攻击

Yanping Li, Zhening Liu, Zijian Li, Zehong Lin, Jun Zhang

机构 * Hong Kong University of Science and Technology(香港科技大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 RemedyGS通过检测和净化被污染的图像,有效防御3DGS中的计算成本攻击,提升系统安全性和实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04844 2025-12-01 cs.RO cs.CV 84%

Embracing Dynamics: Dynamics-aware 4D Gaussian Splatting SLAM

拥抱动态:面向动态环境的4D高斯点划SLAM

Zhicong Sun, Jacqueline Lo, Jinxing Hu

机构 * Hong Kong Polytechnic University(香港理工大学) Shenzhen Institutes of Advanced Technology(深圳先进技术研究院) Chinese Academy of Sciences(中国科学院)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract);分类 cs.CV、cs.RO

AI总结 D4DGS-SLAM通过引入4DGS地图表示,解决动态环境中SLAM的定位与地图重建问题,采用动态感知模块和不同正则化项提升动态场景重建质量。

Comments This paper has been accepted by IROS 2025

Journal ref 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22233 2025-12-01 cs.CV 83%

IE-SRGS: An Internal-External Knowledge Fusion Framework for High-Fidelity 3D Gaussian Splatting Super-Resolution

IE-SRGS: 一种内部-外部知识融合框架用于高保真3D高斯溅射超分辨率

Xiang Feng, Tieshi Zhong, Shuo Chang, Weiliu Wang, Chengkai Wang, Yifei Chen, Yuhe Wang, Zhenzhong Kuang, Xuefei Yin, Yanming Zhu

机构 * Xiang Feng 1,2(XX大学) Tieshi Zhong 1(XX大学) Shuo Chang 1(XX大学) Weiliu Wang 1(XX大学) Chengkai Wang 1(XX大学) Yifei Chen 3(XX大学) Yuhe Wang 1(XX大学) Zhenzhong Kuang 1(XX大学) Xuefei Yin 4(XX大学) Yanming Zhu 4(XX大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract);分类 cs.CV

AI总结 IE-SRGS通过融合外部2DSR先验和内部3DGS特征,提升3D高斯溅射超分辨率的高保真重建性能。

Comments AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18755 2025-12-01 cs.AR 82%

Splatonic: Architecture Support for 3D Gaussian Splatting SLAM via Sparse Processing

Splatonic:通过稀疏处理支持3D高斯散射SLAM的架构

Xiaotong Huang, He Zhu, Tianrui Ma, Yuxiang Xiong, Fangxin Liu, Zhezhi He, Yiming Gan, Zihan Liu, Jingwen Leng, Yu Feng, Minyi Guo

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract)

AI总结 Splatonic通过稀疏处理和高效架构设计,实现了3DGS-SLAM在移动设备上的高速度和高能效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23044 2025-12-01 cs.CV 79%

Geometry-Consistent 4D Gaussian Splatting for Sparse-Input Dynamic View Synthesis

几何一致的4D高斯散射用于稀疏输入动态视角合成

Yiwei Li, Jiannong Cao, Penghui Ruan, Divya Saxena, Songye Zhu, Yinfeng Cao

机构 * The Hong Kong Polytechnic University, Hong Kong, China(香港理工大学) Southern University of Science and Technology, Shenzhen, China(南方科技大学) Indian Institute of Technology, Jodhpur, India(印度理工学院,朱道尔) Institute of Cyberspace Technology, HKCT Institute of Higher Education, Hong Kong, China(网络空间技术研究所,香港高等教育学院)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 GC-4DGS通过引入几何一致性提升稀疏输入动态视角合成的渲染质量与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22704 2025-12-01 cs.CV 79%

Splat-SAP: Feed-Forward Gaussian Splatting for Human-Centered Scene with Scale-Aware Point Map Reconstruction

Splat-SAP:基于双目相机的大稀疏场景的人为中心场景的前馈高斯点扩散

Boyao Zhou, Shunyuan Zheng, Zhanfeng Liao, Zihan Ma, Hanzhang Tu, Boning Liu, Yebin Liu

机构 * Tsinghua University(清华大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 Splat-SAP通过前馈高斯点扩散方法,利用像素级点图重建和两阶段学习策略,提升大稀疏场景的人为中心渲染稳定性与视觉质量。

Comments Accepted by AAAI 2026. Project page: https://yaourtb.github.io/Splat-SAP

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21697 2025-12-01 cs.GR 79%

Detail Enhanced Gaussian Splatting for Large-Scale Volumetric Capture

细节增强的高斯散射用于大规模体积捕获

Julien Philip, Li Ma, Pascal Clausen, Wenqi Xian, Ahmet Levent Taşel, Mingming He, Xueming Yu, David M. George, Ning Yu, Oliver Pilarski, Paul Debevec

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.GR

AI总结 本文提出了一种基于动态高斯散射和扩散增强的系统,用于高分辨率4D体积捕获,实现高质量自由视角视频和面部特写。

Comments 10 pages, Accepted as a Journal paper at Siggraph Asia 2025. Webpage: https://eyeline-labs.github.io/DEGS/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22968 2025-12-01 cs.CV 74%

Taming the Light: Illumination-Invariant Semantic 3DGS-SLAM

驯服光线:具有光照不变性的语义3DGS-SLAM

Shouhe Zhang, Dayong Ren, Sensen Song, Yurong Qian, Zhenhong Jia

机构 * School of Computer Science and Technology(计算机科学与技术学院) Joint International Research Laboratory of Silk Road Multilingual Cognitive Computing(丝绸之路多语种认知计算联合国际实验室) National Key Laboratory for Novel Software Technology(新型软件技术国家重点实验室) Key Laboratory of Signal Detection and Processing(信号检测与处理重点实验室)

专题命中 Gaussian Splatting :3DGS(title);分类 cs.CV

AI总结 本文提出一种具有光照不变性的语义3DGS-SLAM框架,通过固有外观标准化模块和动态辐射平衡损失实现鲁棒性,提升地图重建和语义分割的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.20789 2025-12-01 cs.GR 57%

LoDAvatar: Hierarchical Embedding and Selective Detail Enhancement for Adaptive Levels of Detail Gaussian Avatars

LoDAvatar:基于层次嵌入与选择性细节增强的自适应细节层次高斯头像

Xiaonuo Dongye, Hanzhi Guo, Le Luo, Haiyan Jiang, Yihua Bao, Jie Guo, Zeyu Tian, Dongdong Weng

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.GR

AI总结 LoDAvatar通过层次嵌入和选择性细节增强技术,在高斯头像中实现自适应细节层次,有效平衡视觉质量和计算成本。

Comments 21 pages, 7 figures, Published in Virtual Reality

Journal ref Virtual Reality 29, 178 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20270 2025-12-01 cs.CV 57%

ParticleGS: Learning Neural Gaussian Particle Dynamics from Videos for Prior-free Physical Motion Extrapolation

ParticleGS: 从视频中学习神经高斯粒子动力学以实现无先验的物理运动外推

Jinsheng Quan, Qiaowei Miao, Yichao Xu, Zizhuo Lin, Ying Li, Wei Yang, Zhihui Li, Yawei Luo

机构 * Zhejiang University(浙江大学) North China University of Technology(华北理工大学) University of Science and Technology of China(中国科学技术大学)

专题命中 Gaussian Splatting :3D reconstruction(abstract);分类 cs.CV

AI总结 ParticleGS通过学习神经高斯粒子动力学,实现无先验的物理运动外推,提升动态3D场景的预测准确性与一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 点云 6 篇

2511.22908 2025-12-01 cs.CV 83%

ViGG: Robust RGB-D Point Cloud Registration using Visual-Geometric Mutual Guidance

ViGG: 基于视觉-几何互指导的鲁棒RGB-D点云配准

Congjia Chen, Shen Yan, Yufu Qu

机构 * Beihang University(北航大学) China Agricultural University(中国农业大学)

专题命中 点云 :point cloud(title,abstract);3D vision(abstract);分类 cs.CV

AI总结 ViGG通过视觉-几何互指导策略提升RGB-D点云配准的鲁棒性,优于现有方法。

Comments Accepted by WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22238 2025-12-01 cs.RO 79%

MLATC: Fast Hierarchical Topological Mapping from 3D LiDAR Point Clouds Based on Adaptive Resonance Theory

MLATC: 基于自适应共振理论的快速分层拓扑映射:从3D激光雷达点云

Ryosuke Ofuchi, Yuichiro Toda, Naoki Masuyama, Takayuki Matsuno

机构 * IEEE

专题命中 点云 :point cloud(title,abstract);分类 cs.RO

AI总结 MLATC通过分层结构和自适应机制提升大规模动态环境中的拓扑图构建效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22171 2025-12-01 cs.CV cs.GR 62%

BrepGPT: Autoregressive B-rep Generation with Voronoi Half-Patch

BrepGPT: 基于Voronoi半块的自回归B-rep生成

Pu Li, Wenhao Zhang, Weize Quan, Biao Zhang, Peter Wonka, Dong-Ming Yan

机构 * MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所MAIS) University of Chinese Academy of Sciences(中国科学院大学) King Abdullah University of Science and Technology(国王 Abdullah 科学与技术大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV、cs.GR

AI总结 BrepGPT通过Voronoi半块表示实现单阶段自回归B-rep生成,提升生成效率与模型紧凑性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16098 2025-12-01 cs.CV 57%

SegDINO3D: 3D Instance Segmentation Empowered by Both Image-Level and Object-Level 2D Features

SegDINO3D: 由图像级和物体级2D特征共同赋能的3D实例分割

Jinyuan Qu, Hongyang Li, Xingyu Chen, Shilong Liu, Yukai Shi, Tianhe Ren, Ruitao Jing, Lei Zhang

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 SegDINO3D通过结合图像级和物体级2D特征,提升3D实例分割性能,在ScanNet200数据集上取得显著优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06597 2025-12-01 cs.RO 57%

LiHRA: A LiDAR-Based HRI Dataset for Automated Risk Monitoring Methods

LiHRA:基于LiDAR的人机交互风险监测数据集

Frederik Plahl, Georgios Katranis, Ilshat Mamaev, Andrey Morozov

机构 * Proximity Robotics & Automation GmbH(近距机器人与自动化有限公司) Institute of Industrial Automation and Software Engineering, University of Stuttgart(工业自动化与软件工程学院,斯图加特大学)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 LiHRA数据集通过多模态数据支持人机交互风险监测方法的开发,提供高分辨率LiDAR数据和真实碰撞事件,用于训练和评估RM算法。

Comments Preprint of final paper that will appear in the Proceedings of the IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.00359 2025-12-01 cs.LG eess.IV 50%

Linearly Constrained Diffusion Implicit Models

线性约束扩散隐式模型

Vivek Jayaram, Ira Kemelmacher-Shlizerman, Steven M. Seitz, John Thickstun

机构 * University of Washington(华盛顿大学) Cornell University(康奈尔大学)

专题命中 点云 :point cloud(abstract)

AI总结 CDIM通过动态调整投影步骤减少数量,实现快速准确解决噪声线性逆问题,适用于多种图像处理任务。

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 新视角合成 1 篇

2503.09464 2025-12-01 cs.GR cs.CV 85%

Hybrid Rendering for Multimodal Autonomous Driving: Merging Neural and Physics-Based Simulation

多模态自动驾驶的混合渲染:融合神经网络与基于物理的模拟

Máté Tóth, Péter Kovács, Réka Bencses, Zoltán Bendefy, Zoltán Hortsin, Balázs Teréki, Tamás Matuszka

机构 * aiMotive

专题命中 新视角合成 :NeRF(abstract);Gaussian Splatting(abstract);3DGS(abstract);point cloud(abstract)

AI总结 本文提出混合渲染方法,结合神经网络与基于物理的模拟,提升自动驾驶模拟中新颖视角合成质量及实时渲染效率。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 3D生成 3 篇

2511.22121 2025-12-01 cs.CV 79%

Cue3D: Quantifying the Role of Image Cues in Single-Image 3D Generation

Cue3D: 量化图像提示在单图像3D生成中的作用

Xiang Li, Zirui Wang, Zixuan Huang, James M. Rehg

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 3D生成 :3D generation(title,abstract);分类 cs.CV

AI总结 Cue3D通过量化图像提示在单图像3D生成中的作用,揭示了形状意义和几何提示的重要性,为开发更稳健的3D生成模型提供指导。

Comments NeurIPS 2025 Highlight; Project page:https://ryanxli.github.io/cue3d/index.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.12465 2025-12-01 cs.CV 57%

PhysX-3D: Physical-Grounded 3D Asset Generation

PhysX-3D:基于物理的3D资产生成

Ziang Cao, Zhaoxi Chen, Liang Pan, Ziwei Liu

机构 * Nanyang Technological University(南洋理工大学) Shanghai AI Lab(上海人工智能实验室)

专题命中 3D生成 :3D generation(abstract);分类 cs.CV

AI总结 PhysX-3D提出一种基于物理的3D资产生成方法,通过构建物理标注数据集和双分支框架,提升生成资产的物理合理性和几何质量。

Comments Accepted by NeurIPS 2025, Spotlight Project page: https://physx-3d.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22456 2025-12-01 cs.CV 57%

ITS3D: Inference-Time Scaling for Text-Guided 3D Diffusion Models

ITS3D: 推理时缩放用于文本引导的3D扩散模型

Zhenglin Zhou, Fan Ma, Xiaobo Xia, Hehe Fan, Yi Yang, Tat-Seng Chua

机构 * ReLER, Zhejiang University(浙江大学ReLER实验室) National University of Singapore(新加坡国立大学)

专题命中 3D生成 :3D generation(abstract);分类 cs.CV

AI总结 ITS3D通过优化问题和验证器引导搜索算法,提升文本引导的3D扩散模型生成质量。

Comments 25 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 空间理解 1 篇

2511.23186 2025-12-01 cs.RO cs.AI cs.CV 62%

Obstruction reasoning for robotic grasping

机器人抓取中的障碍物推理

Runyu Jiao, Matteo Bortolon, Francesco Giuliari, Alice Fasoli, Sergio Povoli, Guofeng Mei, Yiming Wang, Fabio Poiesi

机构 * Fondazione Bruno Kessler(布鲁诺·科塞勒基金会) University of Trento(特伦托大学)

专题命中 空间理解 :spatial understanding(abstract);分类 cs.CV、cs.RO

AI总结 UNOGrasp通过视觉-语言模型提升机器人抓取中障碍物推理能力,结合监督与强化学习微调,实现更高效的路径规划和抓取性能。

详情

展开后加载摘要…

URL PDF HTML 收藏