arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

多模态信息融合

面向图像、视频、多传感器和跨模态感知的信息融合,包括 Image Fusion、红外可见光、遥感、医学影像、LiDAR/雷达/相机和音视频融合。

2025-11-26 至 2025-11-26 共收录 9 信号源:cs.CV, eess.IV, eess.SP, cs.RO, cs.MM

1. 通用Image Fusion 2 篇

2503.10109 2025-11-26 cs.CV 83%

Dream-IF: Dynamic Relative EnhAnceMent for Image Fusion

Dream-IF: 动态相对增强用于图像融合

Xingxin Xu, Bing Cao, Dongdong Li, Qinghua Hu, Pengfei Zhu

专题命中 通用Image Fusion :image fusion(title,abstract);multi-modal image fusion(abstract);分类 cs.CV

AI总结 Dream-IF通过动态相对增强框架提升图像融合质量,结合主导区域信息实现多模态图像的协同增强。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19865 2025-11-26 cs.AI 50%

Agentic AI-Empowered Conversational Embodied Intelligence Networks in 6G

基于代理AI的6G时代对话具身智能网络

Mingkai Chen, Zijie Feng, Lei Wang, Yaser Khamayseh

机构 * Key Laboratory of Broadband Wireless Communication and Sensor Network Technology(宽带无线通信与传感网络技术重点实验室) Nanjing University of Posts and Telecommunications(南京邮电大学) College of Technological Innovation(技术创新学院)

专题命中 通用Image Fusion :information fusion(abstract)

AI总结 本文提出一种基于代理AI的6G时代对话具身智能网络,通过多模态融合、自适应通信和可解释性模块,提升复杂任务执行效率与语义一致性。

Comments 7 pages, 8 figures. Preprint submitted to IEEE Vehicle Technology Magazine

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 红外-可见光融合 1 篇

2511.17964 2025-11-26 cs.CV 83%

X-ReID: Multi-granularity Information Interaction for Video-Based Visible-Infrared Person Re-Identification

X-ReID:基于视频的可见-红外人重识别中的多粒度信息交互

Chenyang Yu, Xuehu Liu, Pingping Zhang, Huchuan Lu

专题命中 红外-可见光融合 :visible-infrared(title,abstract);information fusion(abstract);分类 cs.CV

AI总结 X-ReID通过多粒度信息交互和跨模态特征学习,提升视频中可见-红外人重识别的性能。

Comments Accepted by AAAI2026. More modifications may be performed

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 多聚焦/多曝光融合 1 篇

2511.20412 2025-11-26 stat.ME 78%

A novel multi-exposure-to-multi-mediator mediation model for imaging genetic study of brain disorders

一种用于脑部疾病影像遗传研究的新型多暴露-多中介中介模型

Neng Wang, Eric V. Slud, Tianzhou Ma

专题命中 多聚焦/多曝光融合 :multi-exposure(title,abstract)

AI总结 本文提出了一种新型多暴露-多中介中介模型,用于研究基因-神经影像-脑部疾病之间的中介路径,通过整合遗传、神经影像和表型数据,提高中介效应的解释性与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 音视频/视觉语言融合 4 篇

2511.20167 2025-11-26 cs.MM 57%

FINE: Factorized multimodal sentiment analysis via mutual INformation Estimation

FINE: 通过互信息估计进行因子化多模态情感分析

Yadong Liu, Shangfei Wang

专题命中 音视频/视觉语言融合 :multimodal fusion(abstract);分类 cs.MM

AI总结 本文提出了一种基于互信息估计的因子化多模态情感分析框架,通过分解模态为共享和独特表示,抑制噪声并提升情感表示质量,从而在多个数据集上优于现有方法。

Comments 15 pages, 9 figures, conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20000 2025-11-26 eess.SP 57%

Cross-Modal Semantic Communication for Heterogeneous Collaborative Perception

跨模态语义通信用于异构协同感知

Mingyi Lu, Guowei Liu, Le Liang, Chongtao Guo, Hao Ye, Shi Jin

专题命中 音视频/视觉语言融合 :information fusion(abstract);分类 eess.SP

AI总结 本文提出跨模态语义通信框架,通过统一语义空间实现异构传感器车辆间的高效协同感知,提升低信噪比环境下的感知性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17585 2025-11-26 cs.LG cs.AI cs.CV 57%

PaSE: Prototype-aligned Calibration and Shapley-based Equilibrium for Multimodal Sentiment Analysis

PaSE:原型对齐校准与基于Shapley的均衡用于多模态情感分析

Kang He, Boyu Chen, Yuzhe Ding, Fei Li, Chong Teng, Donghong Ji

专题命中 音视频/视觉语言融合 :multimodal fusion(abstract);分类 cs.CV

AI总结 PaSE通过原型对齐校准和基于Shapley的均衡框架,有效缓解多模态情感分析中的模态竞争问题,提升模型性能。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19509 2025-11-26 cs.LG 50%

TouchFormer: A Robust Transformer-based Framework for Multimodal Material Perception

TouchFormer: 一种基于变换器的鲁棒多模态材料感知框架

Kailin Lyu, Long Xiao, Jianing Zeng, Junhao Dong, Xuexin Liu, Zhuojun Zou, Haoyue Yang, Lin Shu, Jie Hao

专题命中 音视频/视觉语言融合 :multimodal fusion(abstract)

AI总结 TouchFormer通过模态自适应门控和注意力机制提升多模态材料感知的鲁棒性,并在细粒度分类任务中实现性能提升。

Comments 9 pages, 7 figures, Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 融合架构与评测 1 篇

2504.14209 2025-11-26 cs.AI 50%

Energy-Aware Pattern Disentanglement: A Generalizable Pattern Assisted Architecture for Multi-task Time Series Analysis

节能模式解耦:一种通用的模式辅助架构用于多任务时间序列分析

Xiangkai Ma, Xiaobin Hong, Wenzhong Li, Sanglu Lu

机构 * State Key Laboratory for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学)

专题命中 融合架构与评测 :information fusion(abstract)

AI总结 Pets提出了一种通用的模式辅助架构,通过局部能量分析和波动模式融合,提升多任务时间序列分析的泛化能力和性能。

Comments We have updated the abstract, citations and related work. At the same time, we have also updated the latest baseline model

详情

展开后加载摘要…

URL PDF HTML 收藏