arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

共收录 4400 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 4400 篇

2606.27862 2026-06-29 cs.CV 新提交 57%

ScaLe-INR: Scale and Learn Implicit Neural Representations

ScaLe-INR:尺度化与学习隐式神经表示

Buwaneka Epakanda, Athulya Ratnayake, Pandula Thennakoon, Mario De Silva, Avishka Ranasinghe, Roshan Godaliyadda, Parakrama Ekanayake

机构 * eng.pdn.ac.lk(彭达大学) ee.pdn.ac.lk(电子工程学院)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出多分支架构ScaLe-INR,通过方向坐标缩放匹配频谱与网络最优工作区域,并设计方向边缘引导损失消除频谱串扰,在图像、音频和3D重建任务上超越现有方法。

Comments Submitted as a conference paper to NeurIPS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27659 2026-06-29 cs.CV 新提交 57%

GeoFace: Consistent Multi-View Face Generation with Geometry-Constrained Diffusion

GeoFace: 基于几何约束的一致多视角人脸生成扩散模型

Yeji Choi, Jinhyeok Choi, Jaewon Min, Minkyung Kwon, Jin Hyeon Kim, Seungryong Kim

机构 * KAIST AI(韩国科学技术院人工智能研究所)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出GeoFace,一种几何约束的多视角扩散框架,通过外观与几何流的共享注意力层和几何引导注意力对齐损失,实现从单张输入生成一致的多视角人脸图像和3D几何,显著提升跨视角几何一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04349 2026-06-26 cs.CV cs.AI 版本更新 57%

VecSet-Edit: Unleashing Pre-trained LRM for Mesh Editing from Single Image

VecSet-Edit:利用预训练的LRM进行单图像网格编辑

Teng-Fang Hsiao, Bo-Kai Ruan, Yu-Lun Liu, Hong-Han Shuai

机构 * National Yang Ming Chiao Tung University(国立阳明交通大学)

专题命中 三维重建 :Gaussian Splatting(abstract);分类 cs.CV

AI总结 本文提出VecSet-Edit,利用VecSet LRM进行单图像网格编辑,通过Mask引导的token播种和注意力对齐的token门控策略,结合漂移感知的token修剪和细节保留的纹理烘焙模块,实现高精度网格编辑。

Comments Accepted by SIGGRAPH 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17916 2026-06-26 cs.CV 版本更新 57%

EndoUFM: Utilizing Foundation Models for Monocular depth estimation of endoscopic images

EndoUFM:利用基础模型进行内窥镜图像的单目深度估计

Xinning Yao, Bo Liu, Bojian Li, Jingjing Wang, Jinghua Yue, Fugen Zhou

机构 * Image Processing Center, Beihang University(北京航空航天大学图像处理中心) State Key Laboratory of High-Efficiency Reusable Aerospace Transportation Technology(高效可重复航天运输技术国家重点实验室)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出EndoUFM框架,通过双基础模型和自适应微调策略(RVLoRA和Res-DSC)提升内窥镜图像单目深度估计性能,在多个数据集上达到最优。

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25284 2026-06-25 cs.CV 新提交 57%

Evaluation Protocols and Validation for Cameras in Indoor Healthcare Monitoring

室内医疗监测中摄像头的评估协议与验证

Amirhossein Dadashzadeh, Jingjing Liu, Qianhui Men, Qiushuo Cheng, Kirsty Scott, Lisa Alcock, Ian Craddock, Majid Mirmehdi

机构 * 1 School of Engineering Mathematics Technology, University of Bristol, UK 2 School of Computer Science, University of Bristol, UK 3 Translational Clinical Research Institute, Faculty of Medical Sciences, Newcastle University, UK 4 NIHR Newcastle Biomedical Research Centre, Newcastle University The Newcastle upon Tyne Hospitals NHS Foundation Trust, UK

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出两种技术验证协议,系统评估五款摄像头在可控室内条件下的计量性能和人体姿态估计支持能力,为医疗监测中的摄像头选型提供依据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14915 2026-06-25 cs.CV 版本更新 57%

ILV: Iterative Latent Volumes for Fast and Accurate Sparse-View CT Reconstruction

ILV: 用于快速准确稀疏视角CT重建的迭代潜在体

Seungryong Lee, Woojeong Baek, Joosang Lee, Eunbyung Park

机构 * Sungkyunkwan University(成均馆大学) Yonsei University(延世大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出迭代潜在体(ILV)框架,结合数据驱动先验与经典迭代重建原理,通过构建并迭代更新显式3D潜在体,实现稀疏视角CBCT的快速高精度重建,在约14,000个CT体积的大规模数据集上显著优于现有方法。

Comments Project page: https://sngryonglee.github.io/ILV/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24282 2026-06-24 cs.CV 新提交 57%

UniRED: Unified RGB-D Video Frame Interpolation with Event Guidance

UniRED: 基于事件引导的统一RGB-D视频帧插值

Yinuo Zhang, Guangshun Wei, Yuanfeng Zhou, Yiran Shen

机构 * School of Software, Shandong University(山东大学软件学院)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出统一多模态框架UniRED,融合RGB外观、深度几何和事件时间线索,通过双向流估计与运动基细化实现高质量RGB-D视频帧插值,并构建RGB-D-Event数据集缓解数据稀缺。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23653 2026-06-23 cs.CV 新提交 57%

Lightweight Neural Framework for Robust 3D Volume and Surface Estimation from Multi-View Images

轻量级神经框架:从多视图图像稳健估计3D体积和表面积

Diego E. Farchione, Ramzi Idoughi, Peter Wonka

机构 * King Abdullah University of Science and Technology (KAUST)(阿卜杜拉国王科技大学)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 提出一种全前馈框架,通过图解码器融合3D点云与2D特征,直接从多视图图像回归尺度归一化的体积、表面积及其不确定性,在稀疏视图下优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22856 2026-06-23 cs.CV 新提交 57%

G-MASt3R-SfM: Graph-based View Pruning and Multi-stage Optimization for Robust SfM

G-MASt3R-SfM:基于图的视图剪枝与多阶段优化实现鲁棒SfM

Toshiki Watanabe, Shintaro Ito, Natsuki Takama, Koichi Ito, Takafumi Aoki

机构 * Graduate School of Information Sciences, Tohoku University, Japan(东北大学信息科学研究生院)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出G-MASt3R-SfM管道,通过基于图的视图剪枝(GVP)和多阶段优化(MSO)模块,抑制非重叠图像对导致的错误匹配,在ETH3D数据集上实现相机位姿和三维重建的最先进精度。

Comments accepted to ICIP2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22182 2026-06-23 cs.CV cs.AI 新提交 57%

Dual-Stream EEG Decoding for 3D Visual Perception

用于3D视觉感知的双流脑电解码

Ninon Lizé Masclef, Taisija Demcenko, Antonella Catanzaro, Nataliya Kosmyna

机构 * Massachusetts Institute of Technology(麻省理工学院)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出一种模仿生物视觉腹侧和背侧通路的双流脑电解码模型,通过圆形回归预测角度和EEG条件多视图扩散实现3D重建,揭示了时间动态的通道参与模式。

Comments 17 pages, 4 figures. Accepted at the Symmetry and Geometry in Neural Representations Workshop (NeurReps), NeurIPS 2025. To appear in Proceedings of Machine Learning Research (PMLR)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21501 2026-06-23 cs.RO 新提交 57%

UniviewVLA: A Unified Multiview Vision-Language-Action Model with World Modeling

UniviewVLA:统一的多视图视觉-语言-动作模型与世界建模

Tao Xu, Runhao Zhang, Zhijian Huang, Jiayi Guan, Jiaxin Wang, Yifan Ding, Yong-Lu Li, Long Chen, Guang Chen, Jinghui Lu

机构 * Tongji University(同济大学) Shanghai Innovation Institute(上海创新研究院) Shanghai Jiao Tong University(上海交通大学) Xiaomi EV(小米汽车)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.RO

AI总结 提出UniviewVLA,利用世界模型生成多视图未来帧,从标准双摄像头观测中预测动作,解决遮挡问题,无需额外硬件或显式重建,并通过运动信息令牌压缩和动作熵视图选择提升效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21027 2026-06-23 cs.CV 新提交 57%

Self-Supervised Dual-Frequency Phase Decomposition for Single-Shot Composite Fringe Projection Profilometry

自监督双频相位分解用于单帧复合条纹投影轮廓术

Jin-Hyuk Seok, Yatong An, Jae-Sang Hyun

机构 * Department of Mechanical Engineering, Yonsei University(延世大学机械工程系) Yonsei Institute for Embodied Intelligence, Yonsei University(延世大学具身智能研究所) Meta Reality Labs

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出自监督双频相位细化框架,利用低高频相位梯度关系及软边缘一致性损失,实现无标签的单帧复合条纹3D重建,精度优于变换方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07690 2026-06-23 cs.CV 版本更新 57%

FrameVGGT: Coherence-Preserving Memory for Bounded Streaming Geometry

FrameVGGT:几何对齐的帧级内存用于有界流式VGGT

Zhisong Xu, Takeshi Oishi

机构 * Institute of Industrial Science(工业科学研究所) The University of Tokyo(东京大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 FrameVGGT从几何支持角度重新审视有界内存流式处理,通过组织帧级增量KV贡献为连贯段,实现稳定几何支持与内存平衡。

Comments 23pages including appendix checklist

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03962 2026-06-23 cs.CV 版本更新 57%

A Linear Fractional Transformation Model and Calibration Method for Light Field Camera

光场相机的线性分式变换模型与标定方法

Zhong Chen, Changfeng Chen

机构 * School of Mechanical and Automotive Engineering, South China University of Technology(机械与自动化工程学院,华南理工大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出一种线性分式变换模型,通过单一参数解耦主透镜与微透镜阵列成像,实现独立标定,在物理与模拟数据集上达到2.1%的平均平移误差,优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18276 2026-06-23 cs.RO cs.AI 版本更新 57%

GAPartManip: A Large-scale Part-centric Dataset for Material-Agnostic Articulated Object Manipulation

GAPartManip:面向材料无关铰接物体操作的大规模部件中心数据集

Wenbo Cui, Chengyang Zhao, Songlin Wei, Jiazhao Zhang, Haoran Geng, Yaran Chen, Haoran Li, He Wang

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) CFCS, School of Computer Science, Peking University(北京大学计算机科学系) Carnegie Mellon University(卡内基梅隆大学) University of California, Berkeley(加州大学伯克利分校) Xi’an Jiaotong-Liverpool University(西安交通大学利物浦大学) Galbot

专题命中 三维重建 :3D vision(abstract);分类 cs.RO

AI总结 提出大规模部件中心数据集GAPartManip,结合照片级材质随机化和部件级交互姿态标注,通过模块化框架提升深度估计与交互姿态预测,在仿真和真实场景中实现鲁棒的铰接物体操作。

Comments Accepted by ICRA 2025. Project page: https://pku-epic.github.io/GAPartManip/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20322 2026-06-19 cs.RO 新提交 57%

Towards 3D karst underwater scene reconstruction from rotating sonar data

基于旋转声纳数据的3D喀斯特水下场景重建

Georgios Evangelos Margaritis, Lionel Lapierre, Simon Rohou, Zhi Yan, Andreas Nüchter, François Goulette

机构 * U2IS, ENSTA, Institut Polytechnique de Paris(巴黎综合理工学院ENSTA学院U2IS实验室) Lab-STICC, ENSTA, Institut Polytechnique de Paris(巴黎综合理工学院ENSTA学院Lab-STICC实验室) Informatics XVII – Robotics, Julius-Maximilians-Universität Würzburg(尤利乌斯-马克西米利安-维尔茨堡大学信息学XVII – 机器人学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.RO

AI总结 针对声纳数据稀疏噪声大、导航漂移导致3D重建困难的问题,提出结合连续时间SLAM校正轨迹与两阶段深度学习表面重建的流水线,生成可沉浸导航的3D网格。

Comments 1st Workshop on Long-term Deployments in the Wild (LoWi)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03199 2026-06-19 cs.CV 版本更新 57%

Does Head Pose Correction Improve Biometric Facial Recognition?

姿态校正是否能提升生物特征面部识别?

Justin Norman, Hany Farid

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 研究探讨了AI驱动的头部姿态校正与图像修复对面部识别准确率的影响,发现选择性应用CFR-GAN与CodeFormer可提升识别性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10873 2026-06-19 cs.CV cs.AI 版本更新 57%

CADBench: A Multimodal Benchmark for AI-Assisted CAD Program Generation

CADBench:一个用于AI辅助CAD程序生成的多模态基准

Anna C. Doris, Jacob Thomas Sony, Ghadi Nehme, Era Syla, Amin Heyrani Nobari, Faez Ahmed

机构 * Massachusetts Institute of Technology(麻省理工学院)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出CADBench,一个统一的多模态CAD程序生成基准,包含18000个样本和六类基准,评估11种视觉语言模型,揭示了CAD程序生成中的三种常见失败模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19316 2026-06-18 cs.CV 新提交 57%

NeuMesh++: Towards Versatile and Efficient Volumetric Editing with Disentangled Neural Mesh-based Implicit Field

NeuMesh++:基于解耦神经网格隐式场的多功能高效体积编辑

Chong Bao, Yuan Li, Bangbang Yang, Yujun Shen, Hujun Bao, Zhaopeng Cui, Yinda Zhang, Guofeng Zhang

机构 * State Key Lab of CAD&CG, College of Computer Science, Zhejiang University(浙江大学计算机科学学院CAD&CG国家重点实验室) Ant Research(蚂蚁研究院) Google(谷歌) ByteDance(字节跳动)

专题命中 三维重建 :novel view synthesis(abstract);分类 cs.CV

AI总结 提出一种基于网格顶点的解耦神经辐射场表示,实现几何、纹理和语义引导的高效体积编辑,包括网格引导几何编辑、纹理交换填充绘制及语义编辑。

Comments TPAMI 2025; Project Page: https://zju3dv.github.io/neumeshplusplus/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09439 2026-06-18 cs.CV 版本更新 57%

SuperCarver: Texture-Consistent 3D Geometry Super-Resolution for High-Fidelity Surface Detail Generation

SuperCarver: 纹理一致的3D几何超分辨率用于高保真表面细节生成

Qijian Zhang, Xiaozheng Jian, Xuan Zhang, Wenping Wang, Junhui Hou

机构 * Tencent Games, China(腾讯游戏,中国) Department of Computer Science & Engineering, Texas A & M University(电子与计算机工程系,德克萨斯A&M大学) Department of Computer Science, City University of Hong Kong(计算机科学系,香港城市大学)

专题命中 三维重建 :3D generation(abstract);分类 cs.CV

AI总结 提出SuperCarver,一种3D几何超分辨率管线,通过先验引导的法线扩散模型和噪声鲁棒的逆渲染,为粗糙网格补充纹理一致的表面细节,实现高保真细节生成。

Comments Accepted in IEEE TVCG

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17696 2026-06-17 cs.AI cs.GR 新提交 57%

FllumaOne: A Code-Native Multimodal CAD Dataset with Executable Programs and Kernel-Validated Feature Histories

FllumaOne:一个代码原生多模态CAD数据集,包含可执行程序与内核验证的特征历史

Jizong Zhan

机构 * Qt/C++ OpenCASCADE-based CAD system(基于Qt/C++ OpenCASCADE的CAD系统)

专题命中 三维重建 :point cloud(abstract);分类 cs.GR

AI总结 提出FllumaOne数据集,通过可执行Python程序生成CAD模型,对齐程序、特征树、几何等模态,支持可编辑逆向工程等任务。

Comments 24 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17384 2026-06-17 cs.CV 新提交 57%

Improving and Evaluating Hand-Object Interaction Detection

改进和评估手-物体交互检测

Ahmad Darkhalil, Dima Damen, David Fouhey

机构 * School of Computer Science, University of Bristol, Bristol, UK(布里斯托大学计算机科学学院) Computer Science and Electrical and Computer Engineering, New York University, NY, US(纽约大学计算机科学与电气与计算机工程系)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出HOI-DETR框架,将手-物体和物体-物体交互引入Co-DETR架构,在四个数据集上显著提升检测性能,mAP提升超过20个百分点。

Comments Project page: https://ahmaddarkhalil.github.io/HOI-DETR/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16479 2026-06-16 cs.CV cs.AI 新提交 57%

Uncertainty Quality of VGGT: An Analysis on the DTU Benchmark Dataset

VGGT的不确定性质量:基于DTU基准数据集的分析

Markus Hillemann, Robert Langendörfer, Steven Landgraf, Markus Ulrich

机构 * Institute of Photogrammetry and Remote Sensing, Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院摄影测量与遥感研究所)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文分析VGGT模型在DTU数据集上的不确定性预测质量,确定有效置信度阈值,并证明提升不确定性质量可显著改善3D重建精度。

Comments Accepted for publication in the ISPRS Annals of the Photogrammetry, Remote Sensing and Spatial Information Sciences

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15681 2026-06-16 cs.CV 新提交 57%

3D Consistency Optimization for Self-Supervised Monocular Video Depth Estimation

自监督单目视频深度估计的3D一致性优化

Yuanye Liu, Ke Zhang, Junzhe Jiang, Li Zhang, Vishal Patel, Xiahai Zhuang

机构 * Fudan University(复旦大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出一种将视频深度估计转化为多视图3D重建的框架,通过光度渲染、世界坐标对齐和多尺度时间梯度一致性约束,实现全局3D结构一致性,在自监督和零样本临床场景中达到最先进的空间精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14162 2026-06-15 cs.CV 新提交 57%

VideoWeave: Unlocking Geometric Consistency in Video Generation via Joint Geometry-Video Modeling

VideoWeave: 通过联合几何-视频建模解锁视频生成中的几何一致性

Xunzhi Xiang, Zixuan Duan, Yabo Chen, Zhengxuan Wei, Guiyu Zhang, Zixiao Gu, Zhe Gao, Haibin Huang, Chi Zhang, Qi Fan, Xuelong Li

机构 * Nanjing University(南京大学) Institute of Artificial Intelligence, China Telecom (TeleAI)(中国电信人工智能研究院(TeleAI)) Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 提出VideoWeave,一种在潜在空间后训练框架,利用隐式几何模型特征约束生成分布,缓解几何重建误差,提升视频几何一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12340 2026-06-11 cs.CV 新提交 57%

Echoes of the Prior: A Computational Phenomenology of Forgetting

先验的回响:遗忘的计算现象学

Gege Gao, Bernhard Schölkopf, Andreas Geiger

机构 * Eberhard Karl University of Tübingen(蒂宾根大学) Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所) Tübingen AI Center(蒂宾根人工智能中心)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 通过在前馈3D重建模型中诱导突触衰减,可视化遗忘的主观现象学,将神经网络作为认知代理探索神经形态美学。

Journal ref Proc. ACM Comput. Graph. Interact. Tech, ACM SIGGRAPH, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11805 2026-06-11 cs.CV cs.AI 新提交 57%

TextHOI-3D: Text-to-3D Hand-Object Interaction via Discrete Multi-View Generation and Joint Mesh Optimization

TextHOI-3D: 基于离散多视图生成与联合网格优化的文本到三维手物交互

Zixiong Hao, Zhencun Jiang

机构 * Technical University of Munich(慕尼黑工业大学) Tongji University(同济大学) Shanghai Research Institute for Intelligent Autonomous Systems(上海自主智能无人系统科学中心)

专题命中 三维重建 :3D generation(abstract);分类 cs.CV

AI总结 提出TextHOI-3D框架,通过多视图离散表示连接文本生成与几何恢复,实现文本驱动的三维手物网格生成,显著降低物体倒角距离和穿透体积。

Comments 11 pages, 8 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10142 2026-06-10 cs.CV 新提交 57%

DB-3DME: From Dataset to Benchmark for Human-aligned Automatic 3D Mesh Evaluation

DB-3DME:从数据集到基准测试,实现与人类对齐的自动3D网格评估

Nanshan Jia, Zhenyu Zhao, Sui Huang, Jingshen Wang, Zeyu Zheng

机构 * University of California, Berkeley(加州大学伯克利分校) Roblox Corporation(Roblox公司)

专题命中 三维重建 :3D generation(abstract);分类 cs.CV

AI总结 提出DB-3DME数据集与基准,包含2619个合成3D网格及其人类评分,通过微调视觉编码器优化VLM评估性能,显著超越现有模型。

Comments CVPR 2026 workshop paper. 10 pages, 3 figures, 6 tables. Dataset available at GitHub and Hugging Face

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08957 2026-06-09 cs.CV 新提交 57%

Rethinking 3D Shape Generation: Diffusion over Superquadrics

重新思考3D形状生成:超二次曲面上的扩散

Zhiyang Liu, Wanze Li, Yuwei Wu, Chengran Yuan, Jiawei Sun, Rui Zheng, Marcelo H Ang

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 提出将扩散模型从高基数几何表示转移到紧凑的超二次曲面参数上,以降低计算和内存成本,并支持无分辨率点云解码、部件级编辑和约束设计,实现高效生成。

Comments Accepted to ICML2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08205 2026-06-09 cs.CV 新提交 57%

Empowering Feed-Forward Reconstruction Models with Metric Scale via Satellite Images

利用卫星图像赋予前馈重建模型度量尺度

Xianghui Ze, Yongjian Luo, Mengjun Chao, Zhenbo Song, Jianfeng Lu, Yujiao Shi

机构 * Nanjing University of Science and Technology(南京理工大学) ShanghaiTech University(上海科技大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出卫星引导框架,通过双向交叉视图交互利用卫星图像作为全局度量参考,解决前馈3D重建中的尺度模糊问题,实现度量深度估计、点云重建和相机定位。

详情

展开后加载摘要…

URL PDF HTML 收藏