arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

多模态信息融合

面向图像、视频、多传感器和跨模态感知的信息融合,包括 Image Fusion、红外可见光、遥感、医学影像、LiDAR/雷达/相机和音视频融合。

2026-03-04 至 2026-03-04 共收录 6 信号源:cs.CV, eess.IV, eess.SP, cs.RO, cs.MM

1. 红外-可见光融合 2 篇

2603.02560 2026-03-04 cs.CV 83%

CAWM-Mamba: A unified model for infrared-visible image fusion and compound adverse weather restoration

CAWM-Mamba:一种用于红外可见图像融合和复合恶劣天气恢复的统一模型

Huichun Liu, Xiaosong Li, Zhuangfan Huang, Tao Ye, Yang Liu, Haishu Tan

机构 * School of Physics(物理学院) Optoelectronic Engineering, Foshan University, Foshan 528225, China(光学电子工程学院,佛山大学,佛山528225,中国) Guangdong-HongKong-Macao Joint Laboratory for Intelligent Micro-Nano Optoelectronic Technology, Foshan 528225, China(粤港澳联合智能微纳光电子技术实验室,佛山528225,中国) School of Mechanical Electronic(机械电子学院) Information Engineering, China University of Mining and Technology, Beijing 100083, China(信息工程学院,中国矿业大学,北京100083,中国)

专题命中 红外-可见光融合 :image fusion(title,abstract);multimodal image fusion(abstract);分类 cs.CV

AI总结 CAWM-Mamba提出了一种统一模型,用于红外可见图像融合和复合恶劣天气恢复,通过三个关键模块提升多退化场景下的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00931 2026-03-04 cs.CV 74%

Learning to Weigh Waste: A Physics-Informed Multimodal Fusion Framework and Large-Scale Dataset for Commercial and Industrial Applications

学习称重垃圾:一种融合多模态的物理引导框架和大规模数据集用于商业和工业应用

Md. Adnanul Islam, Wasimul Karim, Md Mahbub Alam, Subhey Sadi Rahman, Md. Abdur Rahman, Arefin Ittesafun Abian, Mohaimenul Azam Khan Raiaan, Kheng Cher Yeo, Deepika Mathur, Sami Azam

机构 * Department of Computer Science and Engineering, United International University(计算机科学与工程系,国际大学) Applied Artificial Intelligence and Intelligent Systems (AAIINS) Laboratory(应用人工智能与智能系统实验室) Department of Data Science and Artificial Intelligence, Monash University(数据科学与人工智能系,墨尔本大学) Faculty of Science and Technology, Charles Darwin University(科学与技术学院,查尔斯达尔文大学) Faculty of Arts and Society, Charles Darwin University(艺术与社会学院,查尔斯达尔文大学)

专题命中 红外-可见光融合 :multimodal fusion(title);分类 cs.CV

AI总结 本文提出了一种融合多模态的物理引导框架和大规模数据集,用于准确估计商业和工业垃圾的重量,通过结合视觉和物理信息提升预测精度。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 医学影像融合 1 篇

2601.14337 2026-03-04 eess.IV cs.CV 62%

Unsupervised Deformable Image Registration with Local-Global Attention and Image Decomposition

无监督可变形图像配准与局部-全局注意力及图像分解

Zhengyong Huang, Xingwen Sun, Xuting Chang, Ning Jiang, Yao Wang, Jianfei Sun, Hongbin Han, Yao Sui

机构 * Institute of Medical Technology, Peking University Health Science Center(北京大学医学部医学技术研究所) National Institute of Health Data Science, Peking University(北京大学国家健康数据科学研究院) Department of Radiology, Peking University Third Hospital(北京大学第三医院放射科) Department of Pediatrics, Peking University First Hospital(北京大学第一医院儿科) Pediatric Epilepsy Center, Peking University First Hospital(北京大学第一医院儿童癫痫中心) School of Biological Science and Medical Engineering, Southeast University(东南大学生物科学与医学工程学院) Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院)

专题命中 医学影像融合 :multi-modal fusion(abstract);分类 cs.CV、eess.IV

AI总结 本文提出LGANet++,通过局部-全局注意力机制和图像分解技术,实现更准确、鲁棒的无监督可变形图像配准。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 机器人多传感器融合 1 篇

2603.02878 2026-03-04 cs.RO astro-ph.EP 57%

Emerging trends in Cislunar Space for Lunar Science Exploration and Space Robotics aiding Human Spaceflight Safety

月球科学探索与空间机器人助力人类航天安全的新兴趋势

Arsalan Muhammad, Yue Wang, Hai Huang, Hao Wang

专题命中 机器人多传感器融合 :sensor fusion(abstract);分类 cs.RO

AI总结 本文探讨了人工智能与空间机器人在月球科学探索及载人航天安全中的应用,旨在推动可持续月球探索和未来火星任务的发展。

Comments Conference Proceedings of 2nd IAA Conference on AI in and for Space (2nd IAA SPAICE), Suzhou, China, 1-3 November, 2025

Journal ref Conference Proceedings of 2nd IAA Conference on AI in and for Space (2nd IAA SPAICE), Suzhou, China, 1-3 November, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 融合架构与评测 2 篇

2506.17623 2026-03-04 cs.MM cs.CV 62%

Synthetic Perception: Can Generated Images Unlock Latent Visual Prior for Text-Centric Reasoning?

合成感知:生成图像能否解锁潜在的视觉先验以用于以文本为中心的推理?

Yuesheng Huang, Peng Zhang, Xiaoxin Wu, Riliang Liu, Jiaqi Liang

专题命中 融合架构与评测 :multimodal fusion(abstract);分类 cs.CV、cs.MM

AI总结 本文探讨生成图像能否解锁潜在视觉先验以提升文本中心推理,通过多模态融合架构和提示工程策略实现性能提升。

Comments Accepted as a poster at the International Conference on Machine Learning (ICML 2025) NewInML Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01404 2026-03-04 cs.RO 57%

D-GVIO: A Buffer-Driven and Efficient Decentralized GNSS-Visual-Inertial State Estimator for Multi-Agent Systems

D-GVIO: 一种基于缓冲的高效分布式GNSS-视觉-惯性状态估计器用于多智能体系统

Yarong Luo, Wentao Lu, Chi Guo, Ming Li

机构 * School of Robotics, Wuhan University(机器人学院,武汉大学) School of Electronic Information of Wuhan University, Hubei Luojia Laboratory(武汉大学电子信息学院,湖北珞珈实验室)

专题命中 融合架构与评测 :information fusion(abstract);分类 cs.RO

AI总结 D-GVIO通过基于缓冲的分布式框架和L-IEKF实现高效鲁棒的GNSS-视觉-惯性状态估计,适用于多智能体系统的协同定位任务。

Comments Accepted by ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏