arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2025-12-04 至 2025-12-04 共收录 5 信号源:cs.CV, cs.GR, cs.RO

1. 点云 5 篇

2501.07076 2025-12-04 cs.CV cs.AI 83%

Representation Learning of Point Cloud Upsampling in Global and Local Inputs

全局和局部输入下的点云上采样表示学习

Tongxu Zhang, Bei Wang

机构 * East China University of Science and Technology(东华大学) The Hong Kong Polytechnic University(香港理工大学)

专题命中 点云 :point cloud(title,abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 本研究提出ReLPU框架,通过结合全局和局部特征学习提升点云上采样的性能和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.04476 2025-12-04 cs.CV cs.LG 83%

Rethinking Data Input for Point Cloud Upsampling

重新思考点云上采样中的数据输入

Tongxu Zhang

机构 * The Hong Kong Polytechnic University(香港理工大学)

专题命中 点云 :point cloud(title,abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出使用整体模型输入进行点云上采样,通过实验发现基于补丁的输入性能更优,并分析了影响上采样结果的关键因素。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03237 2025-12-04 cs.CV cs.GR 81%

LLM-Guided Material Inference for 3D Point Clouds

基于大语言模型的3D点云材料推断

Nafiseh Izadyar, Teseo Schneider

机构 * University of Victoria(维多利亚大学)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV、cs.GR

AI总结 本文提出基于大语言模型的3D点云材料推断方法,通过两阶段推理实现材料属性推断,验证了语言模型在连接几何推理与材料理解中的作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.04005 2025-12-04 cs.CV cs.LG cs.RO 62%

LargeAD: Large-Scale Cross-Sensor Data Pretraining for Autonomous Driving

LargeAD: 大规模跨传感器数据预训练用于自动驾驶

Lingdong Kong, Xiang Xu, Youquan Liu, Jun Cen, Runnan Chen, Wenwei Zhang, Liang Pan, Kai Chen, Ziwei Liu

机构 * WorldBench Team(WorldBench团队)

专题命中 点云 :point cloud(abstract);分类 cs.CV、cs.RO

AI总结 LargeAD通过跨传感器数据预训练提升自动驾驶中的三维场景理解,结合多模态对比学习和时间一致性,实现更鲁棒的感知性能。

Comments IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03566 2025-12-04 cs.CV cs.MM 57%

GAOT: Generating Articulated Objects Through Text-Guided Diffusion Models

通过文本引导的扩散模型生成拟人化物体:GAOT

Hao Sun, Lei Fan, Donglin Di, Shaohui Liu

机构 * Harbin Institute of Technology(哈尔滨工业大学) University of New South Wales(新南威尔士大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 GAOT通过文本引导的扩散模型和超图学习,实现从文本提示到拟人化物体的生成,取得优于现有方法的性能。

Comments Accepted by ACM MM Asia2026

详情

展开后加载摘要…

URL PDF HTML 收藏