arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

多模态信息融合

面向图像、视频、多传感器和跨模态感知的信息融合,包括 Image Fusion、红外可见光、遥感、医学影像、LiDAR/雷达/相机和音视频融合。

2025-12-11 至 2025-12-11 共收录 3 信号源:cs.CV, eess.IV, eess.SP, cs.RO, cs.MM

1. 医学影像融合 1 篇

2512.09801 2025-12-11 cs.CV 57%

Modality-Specific Enhancement and Complementary Fusion for Semi-Supervised Multi-Modal Brain Tumor Segmentation

模态特异性增强与互补融合用于半监督多模态脑肿瘤分割

Tien-Dat Chung, Ba-Thinh Lam, Thanh-Huy Nguyen, Thien Nguyen, Nguyen Lan Vi Vu, Hoang-Loc Cao, Phat Kim Huynh, Min Xu

专题命中 医学影像融合 :information fusion(abstract);分类 cs.CV

AI总结 本文提出了一种半监督多模态脑肿瘤分割框架,通过模态特异性增强模块和互补信息融合模块提升分割性能。

Comments 9 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 融合架构与评测 2 篇

2512.09311 2025-12-11 cs.CV cs.CR 74%

Transformer-Driven Multimodal Fusion for Explainable Suspiciousness Estimation in Visual Surveillance

基于Transformer的多模态融合用于视觉监控中的可解释性可疑性估计

Kuldeep Singh Yadav, Lalan Kumar

机构 * Big Data Research and Supercomputing Division, CSIR Fourth Paradigm Institute(CSIR第四范式研究所大数据研究与超级计算部门) Department of Electrical Engineering, Bharti School of Telecommunication, Yardi School of Artificial Intelligence, IIT Delhi(电信学院电子工程系、Yardi人工智能学院、德里理工学院)

专题命中 融合架构与评测 :multimodal fusion(title);分类 cs.CV

AI总结 本文提出基于Transformer的多模态融合框架DeepUSEvision,结合YOLOv12、双深度卷积网络和Transformer判别器,实现高准确率和可解释性的可疑性估计。

Comments 12 pages, 10 figures, IEEE Transaction on Image Processing

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.19804 2025-12-11 cs.CV cs.AI 57%

LENVIZ: A High-Resolution Low-Exposure Night Vision Benchmark Dataset

LENVIZ:一个高分辨率低曝光夜视基准数据集

Manjushree Aithal, Rosaura G. VidalMata, Manikandtan Kartha, Gong Chen, Eashan Adhikarla, Lucas N. Kirsten, Zhicheng Fu, Nikhil A. Madhusudhana, Joe Nasti

机构 * Lenovo Research(联想研究) Lehigh University(莱文斯顿大学) Motorola Mobility(摩托罗拉移动)

专题命中 融合架构与评测 :multi-exposure(abstract);分类 cs.CV

AI总结 LENVIZ数据集为低光照图像增强提供高分辨率、多曝光的基准,包含24,000个真实场景,由专家摄影师精心制作,用于评估和改进相关技术。

详情

展开后加载摘要…

URL PDF HTML 收藏