arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-09-01 至 2026-09-01 共收录 41 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 9 篇

2608.28718 2026-09-01 cs.RO cs.AI cs.CV cs.ET cs.SY eess.SY 新提交 81%

RoboPhys-3D: A Comprehensive Embodied World Model Evaluation via 3D Reconstruction

RoboPhys-3D:通过三维重建进行全面的具身世界模型评估

Tianyi Wang, Jiazhou Chen, Yiming Xu, Xiangyu Li, Tianyi Zeng, Chih-Hsien Chou, Ning Lu, Liang Peng, Junfeng Jiao, Christian Claudel

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校) Purdue University(普渡大学) Futurewei Technologies, Inc(星纪时代科技公司)

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.CV、cs.RO

AI总结 本研究推出基于RoboTwin 2.0的三维具身世界模型基准RoboPhys-3D,含50个操作任务等数据,提出两个评估分数,发现Cosmos 3的RoboPhyscore最高,该分数与人类评估一致性强。

Comments 66 pages, 12 figures, 55 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29705 2026-09-01 cs.CV cs.AI 新提交 79%

A Calibration Audit of Confidence in Feed-Forward 3D Reconstruction

前馈三维重建的置信度校准审计

Nanxing Nick Deng, Qing Cheng, Niclas Zeller, Daniel Cremers

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.CV

AI总结 本研究审计7种前馈三维重建骨干网络在13个数据集上的置信度,发现其在非训练条件下不确定性预测偏低,采用幂律修正后偏差可降至1.12倍,并发布审计相关资源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29680 2026-09-01 cs.CV 新提交 74%

GeoRay: Gauge-Aware Feed-Forward Satellite 3D Reconstruction in the Geodetic Frame

GeoRay:大地坐标系下量规感知的前馈卫星三维重建

Zhe Dong, Wanqing Wu, Yuzhe Sun, Haochen Jiang, Yuchen Ma, Lecheng Ren, Tianzhu Liu, Yanfeng Gu

机构 * School of Electronics and Information Engineering, Harbin Institute of Technology(哈尔滨工业大学电子与信息工程学院) th Research Institute, China Electronics Technology Group Corporation(中国电子科技集团公司第五十四研究所) State Key Laboratory of Comprehensive PNT Network and Equipment Technology(综合PNT网络与装备技术国家重点实验室) School of Electrical and Electronic Engineering, University of Manchester(曼彻斯特大学电气与电子工程学院)

专题命中 三维重建 :3D reconstruction(title);分类 cs.CV

AI总结 GeoRay针对卫星三维重建问题,通过射线一致适配器、显式基准机制和逆方差融合技术,在绝对大地坐标系下实现了高精度、高覆盖率的前馈卫星三维重建,性能优于现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.31002 2026-09-01 cs.RO cs.CV 新提交 62%

DARP: A Calibrated Dual-Arm RGB-D-IR Dataset for Multi-View Robotic Perception

DARP:用于多视角机器人感知的校准双臂RGB-D-IR数据集

Manish Kansana, Mohammed Yusuf Mujawar, Sudip Mittal, Shahram Rahimi, Noorbakhsh Amiri Golilarz

机构 * The University of Alabama(阿拉巴马大学)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV、cs.RO

AI总结 本文提出DARP双臂机器人感知数据集,含10种桌面物体,经评估几何一致性良好,可用于多视角重建等多类机器人感知相关研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28838 2026-09-01 q-bio.BM cs.CV 新提交 57%

Reconstruction-Aware Cryo-EM Particle Picking

感知重构的冷冻电镜颗粒挑选

Riku Itsuji, Yuanhao Wang, Xingjian Li, Seonghui Min, Hideo Saito, Min Xu

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 该研究将冷冻电镜颗粒挑选、污染去除、二维分类选择整合为感知重构的单一流程,采用CryoTransformer等组件,实现更优三维分辨率,指出颗粒选择应基于重构效果判断。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29177 2026-09-01 cs.CV 新提交 57%

Dynamic-Robust Photometric-Semantic Reconstruction for Open-Vocabulary 3D Scene Understanding

面向开放词汇三维场景理解的动态鲁棒光度-语义重建

Boyu Cai, Li Yang, Yan Xu, Wei Liu, Nian Liu, Sikui Zhang, Yan Wang, Chunfeng Yuan, Weiming Hu

机构 * State Key Laboratory of Multimodal Artificial Intelligence Systems (MAIS)(多模态人工智能系统国家重点实验室) Institute of Automation, Chinese Academy of Sciences (CASIA)(中国科学院自动化研究所) School of Information Science and Technology, ShanghaiTech University(上海科技大学信息科学与技术学院) The Chinese University of Hong Kong(香港中文大学) Deepeleph Intelligent Technology(深智科技)

专题命中 三维重建 :novel view synthesis(abstract);分类 cs.CV

AI总结 提出SPAR架构与动态区域感知训练范式,解决NVS与OVS模型在动态场景的特征错位问题,在D-RE10K基准上实现SOTA性能,3/4视图下PSNR达22.15/23.33 dB,运动掩码预测mIoU达88.5%。

Comments Accepted to the European Conference on Computer Vision (ECCV) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29137 2026-09-01 cs.CV 新提交 57%

Chat-Edit-3D++: Interactive 3D and 4D Scene Editing via Large Language Models

Chat-Edit-3D++:基于大语言模型的交互式3D与4D场景编辑

Shuangkang Fang, Yufeng Wang, Yi-Hsuan Tsai, Wenrui Ding, Yi Yang, Shuchang Zhou, Ming-Hsuan Yang

机构 * School of Electrical and Information Engineering, Beihang University(北京航空航天大学电子信息工程学院) Institute of Unmanned System, Beihang University(北京航空航天大学无人系统研究院) Atmanity Inc.(Atmanity公司) Megvii Research(旷视研究院) University of California at Merced(加州大学默塞德分校)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 该研究针对现有3D场景编辑方案的缺陷,提出Hash-Atlas网络及基于LLM的CE3D++方法,实现2D编辑与3D重建解耦,可调度30种视觉工具,支持3D/4D场景交互式文本驱动编辑。

Comments Project Website: https://sk-fun.fun/CE3D

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28933 2026-09-01 cs.CV 新提交 57%

NBS: No Bias Stereo

NBS:无偏立体匹配

Vage Taamazyan, Zhuowen Shen, Stefan Hinterstoisser, Alberto Dall'Olio, Agastya Kalra, Aarrushi Shandilya, Xin Li, Wenping Wang, Kartik Venkataraman

机构 * Intrinsic (Google)(Intrinsic(谷歌)) Texas A&M University(德克萨斯农工大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 该研究提出无架构归纳偏置的NBS模型,采用端到端Vision Transformer,经大规模合成数据集训练,在立体匹配上达到最先进准确率与更优效率,证明显式归纳偏置非必要,解锁3D重建缩放定律。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28817 2026-09-01 q-bio.QM 新提交 50%

CryoAnomaly: Few-Shot Cryo-EM Particle Picking via Anomaly-Guided Hard Negative Suppression

CryoAnomaly:基于异常引导难负样本抑制的小样本冷冻电镜粒子挑选方法

Riku Itsuji, Rintaro Otsubo, Ryo Fujii, Xingjian Li, Xiaolong Wu, Hideo Saito, Min Xu

专题命中 三维重建 :3D reconstruction(abstract)

AI总结 本研究提出CryoAnomaly框架,利用合成数据解决小样本冷冻电镜粒子挑选中真实显微图像污染导致的误报问题,在CryoPPP基准小样本设置下实现最优挑选准确率与重建分辨率。

Comments 16 pages, 9 figures, 13 tables, Accepted for publication in IEEE Access

详情

展开后加载摘要…

URL PDF HTML 收藏

2. NeRF 1 篇

2608.30161 2026-09-01 cs.CV 新提交 81%

AI-enabled Low-Cost 3D Maize Ear Morphometry Platform at Breeding Scale

AI赋能的育种级低成本玉米果穗3D形态测量平台

Therin Young, Elijah Rodriguez, Lisa Coffey, Talukder Zaki Jubery, Adarsh Krishnamurthy, Patrick Schnable, Baskar Ganapathysubramanian

机构 * Iowa State University(爱荷华州立大学) Translational AI Research and Education Center(转化式AI研究与教育中心)

专题命中 NeRF :NeRF(summary_cn,abstract);分类 cs.CV

AI总结 本研究开发了一种低成本的玉米果穗3D形态测量平台,利用消费级设备和NeRF技术实现高效测量,经测试其精度符合要求,可用于育种级高通量表型分析。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. Gaussian Splatting 14 篇

2608.30870 2026-09-01 cs.CV 新提交 91%

VCAR: Training-Free 3DGS Segmentation via View Completeness and Axis-Aware Boundary Refinement

VCAR:基于视图完整性和轴感知边界优化的无需训练的3D高斯溅射(3DGS)分割方法

Kun Cao, Di Wang, Haibin Zhu, Haozhi Huang, Xu Wang, Zheng Shi, Guanghua Yang

机构 * Jinan University(暨南大学)

专题命中 Gaussian Splatting :3DGS(title,title_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 VCAR是一种无需训练的3DGS分割策略,通过粗阶段的可见性加权多视图投票、细阶段的球形螺旋采样补充视角及轴感知边界优化,在NVOS和LERF数据集上实现了最优的分割精度与效率。

Comments Accepted to the 34th ACM International Conference on Multimedia (MM '26). 16 pages, 11 figures, including supplementary material

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30054 2026-09-01 cs.LG cs.CV 新提交 91%

When 3D Gaussian Splatting Recovers Real Surfaces

当3D高斯溅射(3DGS)恢复真实表面时

Songhe Wang, David Johnathan Miller

机构 * School of EECS, Penn State(宾夕法尼亚州立大学电子工程与计算机科学学院)

专题命中 Gaussian Splatting :3DGS(title_cn,summary_cn);Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 该研究构建基于首击渲染抽象的数学框架,明确3D高斯溅射(3DGS)的可识别性窗口,经合成与真实数据集实验验证,揭示角容量对3DGS恢复真实表面的关键影响。

Comments Accepted at ECCV 2026. 30 pages, 3 figures, 1 table; includes supplementary material

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.31159 2026-09-01 cs.CV 新提交 90%

BRF-GS: Hyperspectral Bidirectional Reflectance Factor Modeling and Image Generation Based on 3D Gaussian Splatting

BRF-GS:基于3D高斯溅射(3DGS)的高光谱双向反射因子建模与图像生成

Yiling Yao, Wenjuan Zhang, Bowen Wang, Bocheng Li, Wentao Song, Bing Zhang

专题命中 Gaussian Splatting :3DGS(title_cn,abstract);Gaussian Splatting(title,abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 本文提出基于3D高斯溅射的BRF-GS框架,通过混合BRDF驱动核、两阶段训练策略等,结合AIR-BRF数据集,实现高保真的BRF建模与多角度高光谱反射率图像生成。

Comments 58 pages, 10 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29346 2026-09-01 cs.CV 新提交 89%

GSPotential: Camera Potential Field for Sparse-View 3D Gaussian Splatting

GSPotential:面向稀疏视图三维高斯溅射的相机势场

Zeyuan An, Yanghang Xiao, Zhiying Leng, Yijun Feng, Xiaohui Liang

机构 * State Key Laboratory of Virtual Reality Technology and Systems, Beihang University(北京航空航天大学虚拟现实技术与系统国家重点实验室) School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院) Zhongguancun Laboratory(中关村实验室)

专题命中 Gaussian Splatting :Gaussian Splatting(title,summary_cn);point cloud(abstract);分类 cs.CV

AI总结 GSPotential是面向稀疏视图3D Gaussian Splatting的框架,通过相机势场解决稀疏视图下的过拟合与几何伪影,采用虚拟相机采样与高斯更新策略提升重建保真度且训练效率具竞争力。

Comments 10 pages, 8 figures, 5 tables. Accepted to Pacific Graphics 2026 Conference Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28702 2026-09-01 cs.CV 新提交 89%

Stochastic Liquid Deformation Fields: An SDE Generalisation of Closed-Form Continuous-Time Cells for Dynamic 3D Gaussian Splatting

随机液体变形场:动态三维高斯溅射的闭式连续时间单元的SDE泛化

Mingzhao Li, Arghya Pal

机构 * School of Information Technology, Monash University(莫纳什大学信息技术学院)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);NeRF(abstract,abstract_cn);3DGS(abstract,abstract_cn);分类 cs.CV

AI总结 本研究将动态3D高斯溅射的变形场替换为带高斯扰动的CfC单元,提出随机液体变形场,在合成场景上性能优于MLP基线,明确了噪声项的适用场景。

Comments APSIPA ASC 2026 accepted paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29538 2026-09-01 cs.GR 新提交 86%

As-Rigid-As-Possible Deformation of Gaussian Radiance Fields

高斯辐射场的尽可能刚性变形

Xinhao Tong, Tianjia Shao, Yanlin Weng, Yin Yang, Kun Zhou

专题命中 Gaussian Splatting :3DGS(summary_cn,abstract);Gaussian Splatting(abstract);novel view synthesis(abstract);分类 cs.GR

AI总结 本文针对现有3D高斯溅射(3DGS)变形方法易产生伪影的问题,提出一种交互式尽可能刚性(ARAP)变形方法,通过优化高斯及设计径向特征、自适应各向异性空间低通滤波器,实现无伪影且保持高质量高效率的高斯辐射场变形。

Journal ref IEEE Transactions on Visualization and Computer Graphics, vol. 31, no. 10, pp. 7727-7739, Oct. 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29048 2026-09-01 cs.CV cs.GR 新提交 86%

DReSG: Diffusion Residuals for Stylized Gaussian Splatting

DReSG:用于风格化高斯溅射的扩散残差

Zhongliang Liu, Wenjie Liu, Yang Li

机构 * School of Software Engineering, East China Normal University(华东师范大学软件工程学院) School of Computer Science and Technology, East China Normal University(华东师范大学计算机科学与技术学院)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract,abstract_cn);分类 cs.CV、cs.GR

AI总结 针对现有3D风格化方法的缺陷,提出DReSG框架,将扩散提议作为残差目标并通过多视图高斯反馈优化,实现稳定可控的参考引导风格化,更好保留场景结构与跨视图稳定性。

Comments Accepted to Pacific Graphics 2026 (Conference Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29184 2026-09-01 cs.CR 新提交 85%

GhostSplat: Input-Triggered Backdoors for Multi-View-Consistent 3D Content Manipulation in Feed-Forward Gaussian Splatting

GhostSplat:前馈高斯溅射中用于多视图一致3D内容操纵的输入触发后门

Yudong Gao, Zongjian Ding, Linghan Chen, Yajing Chen, Yu Xinglin, Jiale Liu, Shan Huang, Mingjun Cheng

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract,abstract_cn)

AI总结 GhostSplat是针对前馈3D高斯溅射的输入触发后门,可植入共享生成器权重实现多视图一致的3D内容操纵,在多架构数据集上攻击成功率高且抗常见图像变换,现有防御措施无法有效应对。

Comments 10 pages, 6 figures, 6 tables; includes technical appendix and ancillary reproduction code

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28895 2026-09-01 cs.CV 新提交 84%

ReconSplat: Generalizable 3D Scene Reconstruction Beyond Observed Views

ReconSplat:超越观测视图的通用3D场景重建

Giuseppe Stracquadanio, Kevin Raj, Julia Grabinski, Stefan Roth

机构 * TU Darmstadt(达姆施塔特工业大学) Zuse School ELIZA(楚斯学校ELIZA)

专题命中 Gaussian Splatting :3DGS(summary_cn,abstract);Gaussian Splatting(abstract);分类 cs.CV

AI总结 ReconSplat是基于3DGS与MV-LDM的前馈3D场景重建模型,解决未观测区域视图生成与几何一致性的权衡问题,在RealEstate10K、DL3DV-10K基准上优于现有方法,可外推未观测视点并保持精确几何。

Comments ECCV 2026. Code and additional visual results are available on our project page: https://visinf.github.io/reconsplat

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30342 2026-09-01 cs.CV 新提交 81%

CapFrame: Text-Instructed Viewpoint Grounding in 3D Gaussian Scenes via Geometric Pseudo Labels

CapFrame:基于几何伪标签的3D高斯场景中文本引导视角定位

Jirong Li, Satoshi Ikehata, Shuhei Kurita, Ikuro Sato

机构 * Institute of Science Tokyo(东京科学大学) Denso IT Laboratory, Inc.(电装IT实验室) National Institute of Informatics(信息学研究所)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 本文针对3D高斯场景中虚拟相机位姿需人工设置的问题,提出CapFrame框架,通过检索-转换-优化流程实现文本引导的视角定位,实验表明其对齐度优于基线方法。

Comments Accepted at ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.31023 2026-09-01 cs.CV 新提交 79%

SMG: Semantic Motion Graph for Monocular Dynamic Gaussian Splatting

SMG:用于单目动态高斯溅射的语义运动图

Haozheng Yu, Xinyu Yang, Rundong Luo, Jennifer J. Sun, Bharath Hariharan

机构 * Cornell University(康奈尔大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 该研究针对单目动态高斯溅射过拟合、复杂场景下表现差的问题,提出SMG模型,引入新数据集,实现了该任务的最优性能。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30184 2026-09-01 cs.CV 新提交 79%

ATGS: Anchored Temporal Gaussian Splatting for Long Volumetric Video Representation

ATGS:用于长体积视频表示的锚定时间高斯溅射

Jiahao Wu, Jie Liang, Die Hu, Jiayu Yang, Kaiqiang Xiong, Xiang Li, Xiaoyun Zheng, Chao Wang, Ronggang Wang

机构 * Shenzhen Graduate School, Peking University(北京大学深圳研究生院) Pengcheng Laboratory(鹏城实验室)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 针对长序列体积视频的时间不稳定问题,提出基于高斯溅射的ATGS框架,通过时间条件锚点组织高斯、时间窗口策略及多级锚点特征约束,实现更优的长序列体积视频重建性能。

Comments ACM ToG(SIGGRAPH'2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29003 2026-09-01 cs.CV cs.AI 新提交 79%

RoSe-SLAM: Robust Semantic-Aware Gaussian Splatting SLAM from Dynamic Monocular Videos

RoSe-SLAM:面向动态单目视频的鲁棒语义感知高斯溅射SLAM

Wenting Wang, Jiaxin Guo, Wenzhen Dong, Yun-Hui Liu, Charlie C. L. Wang, Yeung Yam

机构 * The Chinese University of Hong Kong(香港中文大学) The University of Manchester(曼彻斯特大学) Centre for Perceptual and Interactive Intelligence (CPII) Limited(感知与互动智能中心有限公司)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 本研究提出RoSe-SLAM,利用2D基础模型语义特征与时空运动掩码等模块,结合几何与语义线索,在动态单目视频中实现更优的SLAM性能,优于现有动态RGB SLAM基线。

Comments Accepted by IEEE/RSJ INTERNATIONAL CONFERENCE ON INTELLIGENT ROBOTS & SYSTEMS (IROS), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29106 2026-09-01 cs.CV cs.CG 新提交 57%

Elastic Triangle Splatting

弹性三角形splatting

Tian Shi, Shenhan Qian, Daniel Cremers

机构 * Technical University of Munich(慕尼黑工业大学) MCML(慕尼黑计算与机器学习实验室)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 本研究针对三角形splatting的核函数选择问题,提出弹性核函数,经实验验证其在形状重建和多数新视图合成基准中优于现有核,凸显核设计的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 点云 16 篇

2608.30279 2026-09-01 cs.CV 新提交 79%

Motion-Saliency Complementary Masked Modeling for Point Cloud Video Understanding

面向点云视频理解的运动显著性互补掩码建模

Wei Wang, Yiding Sun, Yuyan Wang, Zhuoyue Zhang, Zhengqiao Li, Dongfu Yin, Chen Li

机构 * School of Computer Science and Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院) State Key Laboratory of Intelligent Geotechnics and Tunnelling (FSDI)(智能岩土与隧道工程国家重点实验室) School of Software Engineering, Xi’an Jiaotong University(西安交通大学软件学院) Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东省人工智能与数字经济实验室(深圳)) School of Information and Communication Engineering, Xi’an Jiaotong University(西安交通大学信息与通信工程学院)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 该研究提出MoSaiC框架,结合CMSM、NFM、CTCP组件实现自监督点云视频表示学习,在多个下游任务上验证了方法的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29793 2026-09-01 cs.CV 新提交 79%

GridFlow: Structured Latent Flow for Seamless City-Scale 3D Point Cloud Generation

GridFlow:用于无缝城市级三维点云生成的结构化潜在流

Xinyu Wang, Muhammad Ibrahim, Atif Mansoor, Ajmal Mian

机构 * The University of Western Australia(西澳大学)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 该研究提出GridFlow框架,结合多模态条件生成城市级无缝三维点云,并构建City3D-MultiGen基准,实验显示其性能优于现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29434 2026-09-01 cs.LG cs.AI cs.CV 新提交 79%

Does Latent Planning Survive Point Clouds? Action-Conditioned JEPA World Models for Geometric Observations

潜在规划在点云场景中是否可行?面向几何观测的动作条件JEPA世界模型

Fabio F. Oberweger, Michael Schwingshackl

机构 * AIT Austrian Institute of Technology(奥地利技术研究所) Assistive & Autonomous Systems(辅助与自主系统)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 该研究将JEPA模型扩展至点云场景,验证了三种JEPA设计可在点云规划中有效工作,其中动作敏感型模型表现最优,还实现了无需目标观测的3D目标接口构建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29433 2026-09-01 cs.CV cs.RO 新提交 62%

Calibration and Comparative Analysis of Forward-Looking Sonar and 3D Sonar for Enhanced Underwater Object Recognition

用于增强水下目标识别的前视声呐与三维声呐的校准及对比分析

Aditya Penumarti, Khanh Dong, Zi-Hao Zhang, Yongkyoon Park, Zhenqi Wu, Trung Dong, Shahriar Negahdaripour, Xiaomin Lin, Jane Shin

机构 * College of Engineering at the University of Florida(佛罗里达大学工程学院) Seoul National University(首尔大学) University of South Florida(南佛罗里达大学) University of Miami(迈阿密大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV、cs.RO

AI总结 该研究针对声呐噪声导致水下目标识别困难的问题,采用前视声呐与三维声呐两种模态,通过自动校准过滤噪声特征,提升了特征提取性能,为水下目标识别提供了有效方案。

Comments 6 pages, Accepted to IEEE OCEANS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28913 2026-09-01 cs.CV cs.GR cs.LG eess.SP 新提交 62%

mmIR: Frequency-Space Inverse Rendering for 3D Millimeter-Wave Radar ADC Synthesis

mmIR:用于3D毫米波雷达ADC合成的频率空间逆渲染方法

Adnan Armouti, Yixuan Gao, Rajalakshmi Nandakumar

机构 * Cornell Tech(康奈尔科技学院)

专题命中 点云 :point cloud(abstract);分类 cs.CV、cs.GR

AI总结 提出开源可微分的FMCW雷达逆渲染器mmIR,采用LiDAR辅助逆渲染,在ColoRadar数据集上实现高分辨率3D雷达数据合成,相关性能优于Sionna-RT且可跨雷达硬件迁移。

Comments Accepted to the European Conference on Computer Vision (ECCV) 2026. Project page: https://mmwave-inverse-rendering.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30451 2026-09-01 cs.CV 新提交 57%

SeqAlign3DVG: A Sequence-Aligned Benchmark and Voxel Reasoning Framework for 3D Visual Grounding

SeqAlign3DVG:用于3D视觉定位的序列对齐基准与体素推理框架

Yi Zhang, Yi Wang, Yueting Wu, Kaiyue Yang, Yuejiao Su, Lap-Pui Chau

机构 * The Hong Kong Polytechnic University(香港理工大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 针对现有3D视觉定位基准的文本-观测对齐松散、忽略时间顺序的问题,提出SeqAlign3DVG基准及含ROVM、PLVF的体素推理框架,在无深度协议下实现最优性能,提升复杂关系目标定位效果。

Comments Accepted by ACM Multimedia 2026 (MM '26)

详情

展开后加载摘要…

URL PDF HTML 收藏