arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

共收录 158 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 158 篇

2606.18250 2026-06-17 cs.CV 新提交 79%

Future Dynamic 3D Reconstruction: A 3D World Model with Disentangled Ego-Motion

未来动态3D重建:一种具有解耦自运动的3D世界模型

Nils Morbitzer, Jonathan Evers, Artem Savkin, Thomas Stauner, Nassir Navab, Federico Tombari, Stefano Gasperini

机构 * Technical University of Munich (TUM)(慕尼黑技术大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心)

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.CV

AI总结 提出FR3D世界模型,通过解耦场景3D演化与智能体轨迹,利用教师-学生蒸馏策略实现从单目观测到未来动态3D重建的几何一致性和零样本泛化。

Comments ICML 2026. Project page: https://fr3d-wm.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16926 2026-07-21 cs.CV 新提交 77%

Splat-based 3D Scene Reconstruction with Extreme Motion-blur

基于体素的极端运动模糊3D场景重建

Hyeonjoong Jang, Dongyoung Choi, Donggun Kim, Woohyun Kang, Min H. Kim

机构 * KAIST(韩国科学技术院) HYPERGRAM(超图)

专题命中 三维重建 :Gaussian Splatting(abstract);3D reconstruction(abstract);point cloud(abstract);分类 cs.CV

AI总结 研究针对低光照下RGB-D输入的极端运动模糊问题,提出结合高斯体素框架的相机姿态估计与图像去模糊方法,通过对齐帧、调整高斯位置等步骤,提升3D重建质量,优于现有方法,有广泛应用意义。

Journal ref Proceedings of IEEE/CVF International Conference on Computer Vision (ICCV) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03771 2026-07-07 cs.CV 新提交 77%

City-Level 3D Surface Reconstruction with Viewpoint Orientation Partitioning and Scene Completion

基于视点方向划分和场景补全的城市级三维表面重建

Liang Han, Wenyuan Zhang, Junsheng Zhou, Yu-Shen Liu, Zhizhong Han

机构 * School of Software, Tsinghua University(清华大学软件学院) Department of Computer Science, Wayne State University(韦恩州立大学计算机科学系)

专题命中 三维重建 :Gaussian Splatting(abstract);3DGS(abstract);point cloud(abstract);分类 cs.CV

AI总结 针对多视图三维表面重建难题,提出基于视点方向的场景划分方法,确保相似方向视图共同参与以精确估计深度,并行计算更均衡,还提出检测修复点云缺失区域策略,提升大规模场景重建质量。

Comments Accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28132 2026-07-31 cs.CV 新提交 74%

Convolutional Neural Shading for High-Quality 3D Reconstruction from Multi-View Images

用于从多视图图像高质量三维重建的卷积神经着色

Juheon Hwang, Taewan Kim, Heeseok Oh, Jiwoo Kang

专题命中 三维重建 :3D reconstruction(title);分类 cs.CV

AI总结 该研究提出卷积神经着色(CNS)方法,通过卷积神经着色器和细节位移网络解决现有三维重建方法的单点信息局限,提升了多视图图像三维重建的质量。

Journal ref Multimedia Systems, vol. 31, no. 4, pp. 296, July 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24436 2026-07-28 cs.CV 新提交 74%

MSVS-VAE: Multi-Scale Anchored VecSet for High-Fidelity 3D Reconstruction

MSVS-VAE:用于高保真3D重建的多尺度锚定向量集

Dehao Hao, Kaiyi Zhang, Tanghui Jia, Xiangjun Gao, Dongyu Yan, Weikai Chen, Zeyu Hu, Lingting Zhu, Yingda Yin, Runze Zhang, Li Yuan, Xin Wang, Long Quan

机构 * The Hong Kong University of Science and Technology(香港科技大学) Peking University(北京大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Lightspeed Studios(光速工作室)

专题命中 三维重建 :3D reconstruction(title);分类 cs.CV

AI总结 研究针对高保真3D重建中VAE的瓶颈问题,提出MSVS-VAE。通过分层点洗牌上采样 densify 锚定向量集潜在特征,用AVS-Conv取代全局交叉注意力,引入多尺度查询解码融合特征,实验表明其性能优于现有方法,解码速度和紧凑性有显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04661 2026-07-07 cs.CV cs.AI 新提交 74%

Targeted Structure Completion for Sparse-View 3D Reconstruction in Autonomous Driving

自动驾驶中稀疏视图3D重建的目标结构完成

Guoqing Wang, Pin Tang, Xiangxuan Ren, Liping Hou, Chao Ma

机构 * MoE Key Lab of Artificial Intelligence, Institute of AI, Shanghai Jiao Tong University(教育部人工智能重点实验室,上海交通大学人工智能研究院) Central Research Institute, Huawei(华为中央研究院)

专题命中 三维重建 :3D reconstruction(title);分类 cs.CV

AI总结 针对自动驾驶稀疏视图3D重建难题,提出FocusGS框架,通过解耦结构完成与确定性区域,集中计算于几何模糊区域,设计模块优化高斯查询,提升效率质量平衡。

Comments Accepted by ECCV2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25430 2026-06-25 cs.CV 新提交 74%

PRISM: Feed-Forward Single-Image 3D Reconstruction via Geometric Warp-Residual Modeling

PRISM: 基于几何扭曲残差建模的前馈式单图像三维重建

Zhijie Zheng, Xinhao Xiang, Jiawei Zhang

机构 * University of California, Davis(加州大学戴维斯分校)

专题命中 三维重建 :3D reconstruction(title);分类 cs.CV

AI总结 提出PRISM前馈框架,将多视角潜在预测分解为无参数几何先验和可学习残差校正,无需扩散采样,推理时间仅36秒/场景,重建质量与扩散方法相当。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15828 2026-07-20 cs.RO cs.CV 新提交 73%

Beyond Frontiers: Scene-Anomaly Guided Autonomous Exploration

超越边界:场景异常引导的自主探索

Akash Kumbar, Abhinav Raundhal, Madhava Krishna

机构 * Robotics Research Center, IIIT-Hyderabad(机器人研究中心,印度国际信息技术学院海得拉巴分校)

专题命中 三维重建 :3D reconstruction(abstract);point cloud(abstract);分类 cs.CV、cs.RO

AI总结 研究针对传统3D环境自主探索方法忽视结构背景致轨迹低效及重建质量差的问题,提出SCAGE框架,将探索视为几何异常最小化问题,依据对室内建筑的理解标记异常引导机器人,实现空间发现与高保真映射结合,提升了覆盖率和重建质量。

Comments Accepted in IEEE/RSJ IROS 2026. Project page: https://beyondfrontiers.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08440 2026-06-09 cs.RO cs.CV 新提交 73%

GraspFoM: Towards Reconstruction-Driven Robotic Grasping with 3D Foundation Priors

GraspFoM:基于3D基础先验的重建驱动机器人抓取

Dongli Wu, Xiaobao Wei, Hao Wang, Qiaochu Dong, Ying Li, Qingpo Wuwu, Ming Lu, Wufan Zhao

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Peking University(北京大学) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 三维重建 :3DGS(abstract,abstract_cn);分类 cs.CV、cs.RO

AI总结 提出GraspFoM框架,利用3D基础先验(SAM3D)构建共享3D物体潜变量,联合优化重建与抓取姿态预测,通过锚点初始化的截断姿态推理扩散器生成连续多模态抓取,实现高保真重建与最优抓取。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21471 2026-07-24 cs.CV 新提交 70%

Future Rendering $\neq$ Future Surface: A Benchmark and Dataset for Dynamic Surface Reconstruction Beyond the Observed Window

未来渲染≠未来表面:超越观察窗口的动态表面重建基准和数据集

Yukun Shi, Minglun Gong

机构 * University of Guelph(圭尔夫大学)

专题命中 三维重建 :3DGS(abstract,abstract_cn);分类 cs.CV

AI总结 研究针对动态场景重建中未来表面重建缺乏标准基准的问题,引入FutureSurf基准和数据集,通过特定训练与评分方式评估方法,发现现有主干在受控运动及多个场景中有差距,且未来渲染质量与表面精度解耦。

Comments See https://github.com/Ricky-S/futuresurf

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20660 2026-07-24 cs.CV 新提交 70%

Axolotl3D: a Unified Framework for Faithful 3D Shape Completion

Axolotl3D:用于精确3D形状完成的统一框架

Anita Hu, Maria Shugrina

机构 * NVIDIA(英伟达)

专题命中 三维重建 :point cloud(abstract);3D generation(abstract);分类 cs.CV

AI总结 针对3D生成模型在多场景适用性有限及缺乏统一框架的问题,提出Axolotl3D模型,它基于多种模态条件设定,利用点云和相机参数,通过统一训练策略实现精确3D形状完成,实验验证其在多方面性能出色。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03789 2026-07-07 cs.CV 新提交 70%

G$^2$TAM: Geometry Grounded Track Anything Model

G$^2$TAM:几何基础的轨迹任意模型

Chenming Zhu, Peizhou Cao, Jingli Lin, Wenbo Hu, Yunlong Ran, Jiangmiao Pang, Tai Wang, Xihui Liu

机构 * HKU(香港大学) Shanghai AI Lab(上海人工智能实验室) BUAA(北京航空航天大学) SJTU(上海交通大学) UCLA(加州大学洛杉矶分校) ZJU(浙江大学)

专题命中 三维重建 :3D reconstruction(abstract);spatial understanding(abstract);分类 cs.CV

AI总结 研究利用现代前馈3D重建模型的空间一致性,提出G$^2$TAM框架,用无序RGB图像或视频进行3D实例跟踪。核心是跨模态空间编码器,还构建数据集,实验表明该模型有多种优势,为交互式空间推理奠定基础。

Comments Accepted by ICML 2026. Project Page:https://zcmax.github.io/projects/G2TAM/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01753 2026-07-03 cs.CV q-bio.QM 新提交 70%

The Turning Point of 3D Plant Phenotyping: 3D Foundation Models Enable Minute-to-Second Cross-Crop Reconstruction and Beyond

3D植物表型分析的转折点:3D基础模型实现分钟到秒级的跨作物重建及更多

Hanyue Jia, Wei Zhou, Wenbo Zhou, Yanan Li, Hao Lu, Tingting Wu

机构 * Northwest A&F University(西北农林科技大学) Huazhong University of Science and Technology(华中科技大学) Wuhan Institute of Technology(武汉工程大学)

专题命中 三维重建 :Gaussian Splatting(abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 提出基于3D基础模型的跨作物表型分析框架,用前馈几何恢复替代COLMAP,结合3D高斯泼溅实现少视图重建,将重建时间从6.52分钟降至1.58秒,保持高质量与高精度。

Comments 39 pages, 6 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24799 2026-06-24 cs.CV cs.AI 新提交 70%

OrbitForge: Text-to-3D Scene Generation via Reconstruction-Anchored Video Synthesis

OrbitForge: 通过重建锚定的视频合成实现文本到3D场景生成

Chenrui Fan, Paolo Favaro

机构 * Computer Vision Group, Institute of Computer Science University of Bern(计算机视觉组,计算机科学研究所,伯恩大学)

专题命中 三维重建 :Gaussian Splatting(abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 提出OrbitForge,利用冻结的视频先验和每提示高斯泼溅重建优化,将单个文本生成视频转换为规范闭轨3D场景,无需任务特定微调或分数蒸馏。

Comments 40 pages, 33 figures, 19 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23688 2026-06-23 cs.CV 新提交 70%

Lift4D: Harmonizing Single-View 3D Estimation for 4D Reconstruction In-the-Wild

Lift4D: 协调单视图3D估计以实现野外4D重建

Yehonathan Litman, Xiaoxuan Ma, Manan Shah, Nicolas Ugrinovic, Kris Kitani, Fernando De la Torre, Shubham Tulsiani

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 三维重建 :Gaussian Splatting(abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 提出Lift4D框架,通过因果潜在条件化单视图3D模型获得时域一致的初始化,再结合遮挡感知优化和扩散先验,实现从单目视频重建动态非刚体4D场景,显著优于现有方法。

Comments Webpage, Demos: https://lift4d.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14783 2026-08-18 cs.CV cs.GR 新提交 62%

MegaParts: Scaling Part-Aware 3D Object Generation to 300 Parts via Token-Efficient Autoregressive Modeling

MegaParts:通过令牌高效自回归建模将部件感知三维物体生成扩展至300个部件

Manwen Liao, Xinyu Lian, Jian Mao, Kaixu Chen, Li Luo, Jinghao Yan, Wanshui Gan, Qiao Yu, Weitian Zhang, Chunhua Shen, Guang Chen, Bo Dai, Xudong Xu, Zhaoyang Lyu

机构 * The University of Hong Kong(香港大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Fudan University(复旦大学) Tongji University(同济大学) University of Science and Technology of China(中国科学技术大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 三维重建 :3D generation(abstract);分类 cs.CV、cs.GR

AI总结 MegaParts提出结合结构化序列建模与令牌高效矢量量化形状令牌化器的自回归框架,将部件感知3D生成扩展至300个部件,性能优于基线模型,为大规模部件感知3D生成提供新方案。

Comments 12 pages, 6 pages appendix, 13 figures, technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13541 2026-08-14 cs.CV cs.GR 新提交 62%

SCULPT: Subtractive Composition for 3D Part Generation

SCULPT:用于3D部件生成的减法组合方法

Sikuang Li, Chen Yang, Jiemin Fang, Jiazhong Cen, Yuhe Wei, Jichen Pang, Wei Shen, Qi Tian

机构 * Shanghai Jiao Tong University(上海交通大学) Huawei(华为)

专题命中 三维重建 :3D generation(abstract);分类 cs.CV、cs.GR

AI总结 SCULPT是一种3D部件生成框架,通过减法组合方式生成部件,解决了现有方法的边界问题,在PartObjaverse上实现了最优几何性能,还能完成细粒度纹理部件分解。

Comments Project page: https://sculpt-part.github.io/ Code: https://github.com/sculpt-part/SCULPT

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22534 2026-07-27 cs.CV cs.AI cs.RO 新提交 62%

SM4RT: Learning Structured Motion Geometry for 4D Reconstruction

SM4RT:学习用于4D重建的结构化运动几何

Shing Ho J. Lin, Wenzhao Zheng, Dong Zhuo, Yuqi Wu, Jie Zhou, Jiwen Lu

机构 * Intelligent Vision Group, Tsinghua University(清华大学智能视觉组)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.RO

AI总结 针对将单目3D重建能力扩展到4D动态理解的挑战,提出SM4RT,通过引入运动结构表示场景动态,利用并行运动几何编码器和解码器,从单目RGB视频中联合推断相关信息,实现强大运动重建性能并保留场景运动几何结构。

Comments Code is available at: https://github.com/wzzheng/SM4RT

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13492 2026-07-16 cs.CV cs.GR 新提交 62%

CASA-SDF: Curriculum-Aware Spatial Adaptation with Curvature-Guided Density for Neural Implicit Surface Reconstruction

CASA-SDF:用于神经隐式曲面重建的基于曲率引导密度的课程感知空间自适应

Lei Yang, Weiqing Li, Zhiyong Su, Liang Xiao

机构 * School of Computer Science and Engineering, Nanjing University of Science and Technology(南京理工大学计算机科学与工程学院) School of Automation, Nanjing University of Science and Technology(南京理工大学自动化学院)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.GR

AI总结 针对室内场景几何异质性带来的高保真曲面重建挑战,提出CASA-SDF框架。通过混合空间自适应不确定性退火构建课程进行先验监督,利用曲率感知局部自适应密度转换增强薄结构表示,实验证明该方法提升了高频结构曲面完整性和细节恢复,且不影响平面稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11627 2026-07-14 cs.GR cs.RO 新提交 62%

IBPA: Real-time Free-form Manifold Mesh Reconstruction via Incremental Ball Pivoting with Integrated Hole Detection

IBPA:通过集成孔检测的增量球旋转实现实时自由形式流形网格重建

Mauhing Yip, Mohit Singh, Kostas Alexis, Christian Schellewald, Annette Stahl

机构 * Department of Engineering Cybernetics, NTNU(工程 cybernetics 系,NTNU)

专题命中 三维重建 :point cloud(abstract);分类 cs.GR、cs.RO

AI总结 针对水下航行器获取数据覆盖不完整及传统方法表达能力有限问题,提出IBPA方法,通过改进球旋转算法,从流点云数据增量构建可定向流形网格,引入孔检测机制,支持复杂表面拓扑且无需先验假设。

Comments The source code will be made public after the pre-print paper is available online

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09455 2026-07-13 cs.CV cs.RO 新提交 62%

Hydra++: Real-Time Hierarchical 3D Scene Graph Construction With Object-Level Shape Estimation

Hydra++:通过对象级形状估计进行实时分层3D场景图构建

Hyungtae Lim, Nathan Hughes, Xihang Yu, Ruihan Xu, Yun Chang, Jingnan Shi, Rajat Talak, Luca Carlone

机构 * Laboratory for Information & Decision Systems, Massachusetts Institute of Technology(信息与决策系统实验室,麻省理工学院)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV、cs.RO

AI总结 研究如何将基于学习的对象形状估计器集成到分层3D场景图管道中,提出Hydra++系统。它结合形状估计和一致性检查,默认配置可在线构建场景图,支持混合配置应对室外挑战,实验证明其提高了对象和场景级重建质量。

Comments 8 pages, 12 figures, accepted in Proc. IEEE/RSJ IROS

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08398 2026-07-10 cs.GR cs.CV 新提交 62%

HoloTetSphere: Unified TetSphere Mesh Reconstruction for Physical Simulations

HoloTetSphere:用于物理模拟的统一四面体网格重建

YaQiao Dai, Renjiao Yi, Zhirui Gao, Wei Chen, Kai Xu, Chenyang Zhu

机构 * National University of Defense Technology, Changsha, China(国防科技大学,中国长沙) Institute of AI for Industries, Chinese Academy of Sciences, Nanjing, China(产业人工智能研究所,中国科学院,中国南京)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.GR

AI总结 研究针对物理模拟的3D重建问题,提出通过耦合高斯球与四面体元素、联合最小化网格平滑能量和多视图高斯渲染误差等方法,构建统一且拓扑连贯的四面体网格,优于现有技术,简化物理模拟。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06600 2026-07-09 cs.CV cs.AI cs.RO 新提交 62%

MiLSD: A Micro Line-Segment Detector for Resource-Constrained Devices

MiLSD:一种用于资源受限设备的微线段检测器

Parsa Hassani Shariat Panahi, Amir Hossein Jalilvand, M. Hassan Najafi

机构 * School of Computer Engineering, Iran University of Science and Technology(伊朗科技大学计算机工程学院) Case Western Reserve University(凯斯西储大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.RO

AI总结 研究在资源受限设备上线段检测精度与内存的权衡,提出MiLSD检测器,通过比较三种输出表示,发现F-Clip公式在小模型下学习有效,8位量化可保性能,4位量化有损失,经推理增强,MiLSD在1MB内提升了上海科技线框数据集sAP10指标。

Comments 10 pages, 12 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05376 2026-07-07 cs.CV cs.GR 新提交 62%

MV-Forcing: Long Multi-View Video Generation via 4D-Grounded Spatio-Temporal Self-Forcing

MV-Forcing:基于4D锚定时空自强制的长时长多视角视频生成

Gal Fiebelman, Hadar Averbuch-Elor, Sagie Benaim

机构 * The Hebrew University of Jerusalem(耶路撒冷希伯来大学) Cornell University(康奈尔大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.GR

AI总结 针对动态场景长时多视角一致视频生成难题,提出MV-Forcing框架,融合时序与视角自回归,实现任意时长视角数的高一致性多视角视频生成。

Comments Accepted to ECCV 2026. Project webpage: https://galfiebelman.github.io/mv-forcing/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02554 2026-07-07 cs.CV cs.GR 新提交 62%

Reliability-Aware Monocular Depth Supervision for Sparse-View Neural Reconstruction

用于稀疏视图神经重建的可靠性感知单目深度监督

Wei-Teng Chu, Yashasvini Gopalan, Changju Yuan

机构 * Stanford University(斯坦福大学)

专题命中 三维重建 :NeRF(abstract);分类 cs.CV、cs.GR

AI总结 研究稀疏视图神经重建的单目深度监督,用Depth Anything V2作密集单目深度先验,经尺度变换拟合对齐预测,通过仅RGB基线模型生成的光度掩码选择性应用深度监督,在不同场景评估,结果表明应选择性适度加权应用。

Comments 10 pages, 6 figures. All authors contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30677 2026-07-01 cs.GR cs.CV 新提交 62%

DANTE-W: Diffuse Albedo Neural Texturing in the Wild

DANTE-W:野外场景的漫反射反照率神经纹理化

Guangyu Wang, Tianheng Lu, Ruqi Huang, Lu Fang

机构 * Tsinghua University(清华大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.GR

AI总结 提出DANTE-W神经纹理框架,利用神经表示融合生成式先验,通过物理神经渲染恢复高保真漫反射反照率纹理,提升重光照保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17836 2026-06-17 cs.CV cs.AI cs.CG cs.GR 新提交 62%

High-Fidelity 3D Geometric Reconstruction of Pelvic Organs from MRI: A Hybrid Deep Learning and Iterative Optimization Approach

高保真盆腔器官MRI三维几何重建:一种混合深度学习与迭代优化方法

Hui Wang, Xiaowei Li, Chenxin Zhang, Yifan Feng, Jianwei Zuo, Yumeng Tang, Xiuli Sun, Jianliu Wang, Bing Xie, Jiajia Luo

机构 * Institute of Medical Technology, Peking University Health Science Center, Peking University(北京大学医学部医学技术研究院,北京大学) Biomedical Engineering Department, Institute of Advanced Clinical Medicine, Peking University(北京大学先进临床医学研究院生物医学工程系) Department of Obstetrics and Gynecology, Peking University People’s Hospital(北京大学人民医院妇产科部)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.GR

AI总结 提出混合可变形形状建模框架,结合深度学习预测与迭代优化,实现膀胱、子宫和直肠的高保真三维几何重建,在几何保真度和网格质量上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17480 2026-06-17 cs.CV cs.RO 新提交 62%

GeneralVLA-2: Geometry-Aware Reconstruction and Governed Memory for Robot Planning

GeneralVLA-2: 几何感知重建与受控记忆用于机器人规划

Haoyu Wang, Guoqing Ma, Zeyu Zhang, Yandong Guo, Boxin Shi, Hao Tang

机构 * School of Computer Science, Peking University(北京大学计算机科学学院) CASIA(中国科学院自动化研究所) AI 2 Robotics

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.RO

AI总结 针对机器人规划中3D物体重建幻觉和记忆质量不可控的问题,提出GeoFuse-MV3D几何先验引导重建分支和受控长期记忆系统,在GSO-30和Terminal-Bench等基准上显著提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13655 2026-06-16 cs.CV cs.GR 新提交 62%

Flex4DHuman: Flexible Multi-view Video Diffusion for 4D Human Reconstruction

Flex4DHuman:面向4D人体重建的灵活多视角视频扩散模型

Jen-Hao Cheng, Yipeng Wang, Hao Zhang, Gengshan Yang, Jenq-Neng Hwang

机构 * University of Washington(华盛顿大学) World Labs

专题命中 三维重建 :Gaussian Splatting(abstract);分类 cs.CV、cs.GR

AI总结 提出Flex4DHuman,一种基于相对相机位姿条件化的多视角视频扩散模型,无需显式几何先验即可将单目或稀疏多视角视频转换为密集多视角视频,并用于4D高斯溅射重建。

Comments Project Page: https://andy-cheng.github.io/Flex4DHuman/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07115 2026-06-08 cs.CV cs.GR 新提交 62%

3DMorph: Single-Image-Guided Local 3D Shape Editing and Morphing

3DMorph: 单图引导的局部3D形状编辑与变形

Tobias Preintner, Yunfei Deng, Phillip Müller, Sebastian Illing, Adrian König, Thomas Bäck, Elena Raponi, Niki van Stein

机构 * ETH Zürich(苏黎世联邦理工学院)

专题命中 三维重建 :3D generation(abstract);分类 cs.CV、cs.GR

AI总结 提出无训练框架3DMorph,通过单张编辑图像自动定位并转移2D修改到3D局部区域,同时支持中间形状生成,在Delta3D基准上优于现有方法。

Comments Accepted to IJCNN 2026

详情

展开后加载摘要…

URL PDF HTML 收藏