arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

多模态信息融合

面向图像、视频、多传感器和跨模态感知的信息融合,包括 Image Fusion、红外可见光、遥感、医学影像、LiDAR/雷达/相机和音视频融合。

2026-02-06 至 2026-02-06 共收录 2 信号源:cs.CV, eess.IV, eess.SP, cs.RO, cs.MM

1. 机器人多传感器融合 2 篇

2602.04904 2026-02-06 cs.LG cs.AI cs.MM eess.IV 62%

DCER: Dual-Stage Compression and Energy-Based Reconstruction

DCER:双阶段压缩与基于能量的重建

Yiwen Wang, Jiahao Qin

机构 * Yiwen Wang(无) Jiahao Qin(无)

专题命中 机器人多传感器融合 :multimodal fusion(abstract);分类 eess.IV、cs.MM

AI总结 DCER通过双阶段压缩和基于能量的重建解决多模态融合中的噪声和缺失模态问题,实现鲁棒性提升。

Comments 13 pages, 2 figures, 8 tables. Submitted to ICML 2026. Code will be available on GitHub

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05855 2026-02-06 cs.RO cs.LG 57%

A Hybrid Autoencoder for Robust Heightmap Generation from Fused Lidar and Depth Data for Humanoid Robot Locomotion

一种用于人形机器人运动的融合激光雷达和深度数据的鲁棒高度图生成的混合自编码器

Dennis Bank, Joost Cordes, Thomas Seel, Simon F. G. Ehlers

机构 * Institute of Mechatronic Systems, Leibniz University Hannover(机械系统研究所,莱比锡洪堡大学)

专题命中 机器人多传感器融合 :multimodal fusion(abstract);分类 cs.RO

AI总结 本文提出了一种混合自编码器,通过融合激光雷达和深度数据生成鲁棒的高度图,以提升人形机器人在非结构化环境中的运动性能。

详情

展开后加载摘要…

URL PDF HTML 收藏