arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

多模态信息融合

面向图像、视频、多传感器和跨模态感知的信息融合,包括 Image Fusion、红外可见光、遥感、医学影像、LiDAR/雷达/相机和音视频融合。

2026-01-21 至 2026-01-21 共收录 7 信号源:cs.CV, eess.IV, eess.SP, cs.RO, cs.MM

1. 通用Image Fusion 2 篇

2601.13052 2026-01-21 cs.CV 79%

GridNet-HD: A High-Resolution Multi-Modal Dataset for LiDAR-Image Fusion on Power Line Infrastructure

GridNet-HD: 一种高分辨率多模态数据集,用于电力线路基础设施的LiDAR-图像融合

Antoine Carreaud, Shanci Li, Malo De Lacour, Digre Frinde, Jan Skaloud, Adrien Gressin

专题命中 通用Image Fusion :image fusion(title);multi-modal fusion(abstract);分类 cs.CV

AI总结 GridNet-HD是一个高分辨率多模态数据集,用于电力线路基础设施的LiDAR-图像融合,通过融合高密度LiDAR和高分辨率影像提升3D语义分割性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12682 2026-01-21 cs.CV 70%

Fusion-Restoration Image Processing Algorithm to Improve the High-Temperature Deformation Measurement

融合-修复图像处理算法以提高高温变形测量

Banglei Guan, Dongcai Tan, Jing Tao, Ang Su, Yang Shang, Qifeng Yu

机构 * College of Aerospace Science and Engineering(航空航天科学与工程学院) National University of Defense Technology(国防科技大学) Hunan Provincial Key Laboratory of Image Measurement and Vision Navigation(湖南省图像测量与视觉导航重点实验室)

专题命中 通用Image Fusion :image fusion(abstract);multi-exposure(abstract);分类 cs.CV

AI总结 本文提出融合-修复图像处理算法,用于抑制高温变形测量中的热辐射和热晕干扰,提升DIC测量精度和图像质量。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 红外-可见光融合 2 篇

2509.12710 2026-01-21 cs.CV 88%

RIS-FUSION: Rethinking Text-Driven Infrared and Visible Image Fusion from the Perspective of Referring Image Segmentation

RIS-FUSION: 重新思考基于文本的红外和可见图像融合:从指代图像分割的角度

Siju Ma, Changsiyu Gong, Xiaofeng Fan, Yong Ma, Chengjie Jiang

机构 * Central University of Finance and Economics(中央财经大学) Tsinghua University(清华大学)

专题命中 红外-可见光融合 :image fusion(title,abstract);infrared and visible(title,abstract);分类 cs.CV

AI总结 RIS-FUSION通过联合优化融合与指代图像分割,提升基于文本的红外和可见图像融合性能,实现mIoU指标的显著提升。

Comments ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12697 2026-01-21 cs.CV cs.CG 70%

Fusing in 3D: Free-Viewpoint Fusion Rendering with a 3D Infrared-Visible Scene Representation

在三维中融合:基于三维红外-可见场景表示的自由视角融合渲染

Chao Yang, Deshui Miao, Chao Tian, Guoqing Zhu, Yameng Gu, Zhenyu He

机构 * School of Computer Science(计算机科学学院) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学深圳研究院)

专题命中 红外-可见光融合 :image fusion(abstract);infrared and visible(abstract);分类 cs.CV

AI总结 本文提出一种基于三维红外-可见场景表示的融合框架,通过跨模态调整模块和融合损失确保融合图像保留关键特征,有效解决传统方法在复杂场景下的信息丢失问题。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 遥感融合与全色锐化 1 篇

2601.13502 2026-01-21 cs.CV 57%

DIS2: Disentanglement Meets Distillation with Classwise Attention for Robust Remote Sensing Segmentation under Missing Modalities

DIS2: 通过类级注意机制实现解耦与蒸馏以在缺失模态下实现鲁棒的遥感分割

Nhi Kieu, Kien Nguyen, Arnold Wiliem, Clinton Fookes, Sridha Sridharan

机构 * Queensland University of Technology(昆士兰理工大学) Shield AI

专题命中 遥感融合与全色锐化 :hybrid fusion(abstract);分类 cs.CV

AI总结 DIS2通过类级注意机制实现解耦与蒸馏,以在缺失模态下实现鲁棒的遥感分割。

Comments Accepted to WACV 2026 - Computer Vision for Earth Observation Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 音视频/视觉语言融合 1 篇

2601.02438 2026-01-21 cs.SE cs.AI cs.CR 71%

Focus on What Matters: Fisher-Guided Adaptive Multimodal Fusion for Vulnerability Detection

聚焦关键要素:基于Fisher信息的自适应多模态融合用于漏洞检测

Yun Bian, Yi Chen, HaiQuan Wang, ShiHao Li, Zhe Cui

机构 * University of Chinese Academy of Sciences(中国科学院大学)

专题命中 音视频/视觉语言融合 :multimodal fusion(title)

AI总结 本文提出TaCCS-DFA框架,通过Fisher信息引导的自适应多模态融合,提升漏洞检测的F1分数,同时降低推理延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 融合架构与评测 1 篇

2601.11885 2026-01-21 cs.AI 50%

MyGram: Modality-aware Graph Transformer with Global Distribution for Multi-modal Entity Alignment

MyGram: 多模态实体对齐的模态感知图变换器与全局分布

Zhifei Li, Ziyue Qin, Xiangyu Luo, Xiaoju Hou, Yue Zhao, Miao Zhang, Zhifang Huang, Kui Xiao, Bing Yang

专题命中 融合架构与评测 :multi-modal fusion(abstract)

AI总结 MyGram通过模态感知图变换器与全局分布机制,提升多模态实体对齐的性能。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏