arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2025-11-25 至 2025-11-25 共收录 14 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 14 篇

2511.17824 2025-11-25 cs.CV cs.RO 81%

QAL: A Loss for Recall Precision Balance in 3D Reconstruction

QAL:用于3D重建中召回精度平衡的损失

Pranay Meshram, Yash Turkar, Kartikeya Singh, Praveen Raj Masilamani, Charuvahan Adhivarahan, Karthik Dantu

机构 * University at Buffalo, The State University of New York(布法罗大学)

专题命中 三维重建 :3D reconstruction(title);3D vision(abstract);分类 cs.CV、cs.RO

AI总结 QAL是一种用于3D重建中平衡召回和精度的损失函数,通过结合覆盖加权最近邻项和未覆盖真实地面吸引项,提升了补全效果和机器人操作的可靠性。

Comments Accepted to WACV 2026. Camera-ready version to appear

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19426 2025-11-25 cs.CV 79%

Ref-SAM3D: Bridging SAM3D with Text for Reference 3D Reconstruction

Ref-SAM3D: 通过文本连接SAM3D与参考3D重建

Yun Zhou, Yaoting Wang, Guangquan Jie, Jinyu Liu, Henghui Ding

机构 * Institute of Big Data, College of Computer Science and Artificial Intelligence, Fudan University(大数据研究院,计算机科学与人工智能学院,复旦大学)

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.CV

AI总结 Ref-SAM3D通过引入文本描述作为先验,实现基于单张图像的文本引导3D重建,提升零样本重建性能。

Comments Code: https://github.com/FudanCVL/Ref-SAM3D

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20776 2025-11-25 cs.CV 79%

CUPID: Generative 3D Reconstruction via Joint Object and Pose Modeling

CUPID:通过联合物体和姿态建模实现生成式3D重建

Binbin Huang, Haobin Duan, Yiqun Zhao, Zibo Zhao, Yi Ma, Shenghua Gao

机构 * The University of Hong Kong(香港大学) Transcengram Tencent(腾讯)

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.CV

AI总结 CUPID通过联合建模物体和姿态,实现高保真3D重建,优于现有方法,在PSNR和Chamfer距离上分别提升3 dB和10%。

Comments project page at https://cupid3d.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18115 2025-11-25 cs.CV 79%

Muskie: Multi-view Masked Image Modeling for 3D Vision Pre-training

Muskie:多视图遮蔽图像建模用于3D视觉预训练

Wenyu Li, Sidun Liu, Peng Qiao, Yong Dou, Tongrui Hu

机构 * National University of Defense Technology(国防科技大学)

专题命中 三维重建 :3D vision(title,abstract);分类 cs.CV

AI总结 Muskie通过多视图遮蔽图像建模方法,无需3D监督即可学习视图不变特征和几何理解,提升3D视觉任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01399 2025-11-25 cs.CV 74%

Semantic BIM enrichment for firefighting assets: Fire-ART dataset and panoramic image-based 3D reconstruction

语义BIM增强用于消防资产:Fire-ART数据集和全景图像基于的3D重建

Ya Wen, Yutong Qiao, Chi Chiu Lam, Ioannis Brilakis, Sanghoon Lee, Mun On Wong

专题命中 三维重建 :3D reconstruction(title);分类 cs.CV

AI总结 本研究提出Fire-ART数据集和基于全景图像的3D重建方法,用于提升消防资产在BIM中的语义化管理与数字化水平。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18680 2025-11-25 cs.GR cs.CV 62%

Inverse Rendering for High-Genus Surface Meshes from Multi-View Images

从多视角图像逆向渲染高亏格表面网格

Xiang Gao, Xinmu Wang, Xiaolong Wu, Jiazhi Li, Jingyu Shi, Yu Guo, Yuanpeng Liu, Xiyun Song, Heather Yu, Zongfang Lin, Xianfeng David Gu

机构 * Futurewei Technologies(未来科技公司) Stony Brook University(石溪大学) Purdue University(普渡大学) University of Southern California(南加州大学) George Mason University(乔治·马歇尔大学)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV、cs.GR

AI总结 本文提出了一种结合自适应V-循环重新网格化和重新参数化Adam优化器的方法,用于从多视角图像中逆向渲染高亏格表面网格,提升了拓扑和几何意识,有效改善了高亏格和低亏格表面的重建效果。

Comments 3DV2026 Accepted (Poster)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17883 2025-11-25 cs.CV cs.RO 62%

ArticFlow: Generative Simulation of Articulated Mechanisms

ArticFlow: 关节机构生成性模拟

Jiong Lin, Jinchen Ruan, Hod Lipson

机构 * Creative Machines Lab, Columbia University(创意机器实验室,哥伦比亚大学)

专题命中 三维重建 :3D generation(abstract);分类 cs.CV、cs.RO

AI总结 ArticFlow通过两阶段流匹配框架实现关节机构的生成与模拟,以高精度运动学和形状质量生成多样化关节结构。

Comments 8 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.05265 2025-11-25 cs.RO cs.CV cs.LG 62%

Advancing Autonomous Driving: DepthSense with Radar and Spatial Attention

推进自动驾驶:DepthSense与雷达与空间注意力

Muhamamd Ishfaq Hussain, Zubia Naz, Muhammad Aasim Rafique, Moongu Jeon

机构 * School of Electrical Engineering and Computer Science, Gwangju Institute of Science and Technology(全州科学技术院电气工程与计算机科学学院) Division of National Science and Technology Data (Large Scale AI Research Group), Korea Institute of Science and Technology Information (KISTI)(国家科学技术数据 division(大规模人工智能研究组),韩国科学技术信息研究院) Department of Information Systems, College of Computer Sciences and Information Technology, King Faisal University(国王法尔萨大学信息系统系,计算机科学与信息科技学院)

专题命中 三维重建 :spatial understanding(abstract);分类 cs.CV、cs.RO

AI总结 DepthSense通过结合雷达与单目相机数据,提升自动驾驶中的深度估计精度,采用编码器-解码器架构和空间注意力机制,实现高效且准确的深度感知。

Journal ref IEEE Sensors Journal 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19189 2025-11-25 cs.GR 57%

AvatarBrush: Monocular Reconstruction of Gaussian Avatars with Intuitive Local Editing

AvatarBrush: 基于单目视频的高斯姿态重建与直观局部编辑

Mengtian Li, Shengxiang Yao, Yichen Pan, Haiyao Xiao, Zhongmei Li, Zhifeng Xie, Keyu Chen

专题命中 三维重建 :3DGS(abstract);分类 cs.GR

AI总结 AvatarBrush通过单目视频输入实现高斯姿态的高效重建与直观局部编辑,提升编辑灵活性和用户体验。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18563 2025-11-25 cs.RO 57%

Object-centric Task Representation and Transfer using Diffused Orientation Fields

基于扩散方向场的对象中心任务表示与迁移

Cem Bilaloglu, Tobias Löw, Sylvain Calinon

机构 * Idiap Research Institute(Idiap研究机构) EPFL(瑞士联邦理工学院)

专题命中 三维重建 :point cloud(abstract);分类 cs.RO

AI总结 本文提出利用扩散方向场实现跨弯曲物体的任务迁移,通过平滑局部参考系建立稀疏关键点对应关系,成功迁移连续物理交互任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18290 2025-11-25 cs.CV cs.AI 57%

SwiftVGGT: A Scalable Visual Geometry Grounded Transformer for Large-Scale Scenes

SwiftVGGT: 一种可扩展的视觉几何基础Transformer用于大规模场景

Jungho Lee, Minhyeok Lee, Sunghun Yang, Minseok Kang, Sangyoun Lee

机构 * School of Electrical and Electronic Engineering, Yonsei University(电气电子工程学院,延世大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 SwiftVGGT是一种无需训练的高效Transformer,通过简化计算流程实现大规模场景中高质量3D重建。

Comments Project Page: https://Jho-Yonsei.github.io/SwiftVGGT/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18215 2025-11-25 cs.RO 57%

AFT: Appearance-Based Feature Tracking for Markerless and Training-Free Shape Reconstruction of Soft Robots

AFT:基于外观的特征追踪用于无标记和无训练的软机器人形状重建

Shangyuan Yuan, Preston Fairchild, Yu Mei, Xinyu Zhou, Xiaobo Tan

机构 * Department of Electrical and Computer Engineering, Michigan State University(电气与计算机工程系,密歇根州立大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.RO

AI总结 本文提出了一种基于外观的无标记、无训练软机器人形状重建方法,通过隐式视觉标记实现实时追踪,具有高鲁棒性和低成本优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04258 2025-11-25 cs.CV 57%

MoReMouse: Monocular Reconstruction of Laboratory Mouse

MoReMouse: 单目重建实验室小鼠

Yuan Zhong, Jingxiang Sun, Zhongbin Zhang, Liang An, Yebin Liu

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 MoReMouse通过创新的合成数据集、变换器架构与三平面表示,实现了高保真小鼠3D重建,提升重建精度与稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02387 2025-11-25 cs.RO cs.SY eess.SY 57%

RGBSQGrasp: Inferring Local Superquadric Primitives from Single RGB Image for Graspability-Aware Bin Picking

RGBSQGrasp: 从单张RGB图像推断局部超二次曲面原语以实现抓取感知的托盘拾取

Yifeng Xu, Fan Zhu, Ye Li, Sebastian Ren, Xiaonan Huang, Yuhao Chen

机构 * University of Michigan(密歇根大学) University of Waterloo(滑铁卢大学) Xi’an Jiaotong-Liverpool University(西安交通大学利物浦大学) University College London(伦敦大学学院)

专题命中 三维重建 :point cloud(abstract);分类 cs.RO

AI总结 RGBSQGrasp通过单目RGB图像推断抓取姿态,利用超二次曲面原语提升托盘拾取任务的抓取稳定性和适应性。

Comments 8 pages, 6 figures, IROS2025 RGMCW Best Workshop Paper

详情

展开后加载摘要…

URL PDF HTML 收藏