arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

多模态信息融合

面向图像、视频、多传感器和跨模态感知的信息融合,包括 Image Fusion、红外可见光、遥感、医学影像、LiDAR/雷达/相机和音视频融合。

2026-02-03 至 2026-02-03 共收录 7 信号源:cs.CV, eess.IV, eess.SP, cs.RO, cs.MM

1. 融合架构与评测 7 篇

2602.01060 2026-02-03 cs.SD cs.AI eess.AS 71%

TLDiffGAN: A Latent Diffusion-GAN Framework with Temporal Information Fusion for Anomalous Sound Detection

TLDiffGAN:一种结合时间信息融合的扩散-生成对抗网络框架用于异常声音检测

Chengyuan Ma, Peng Jia, Hongyue Guo, Wenming Yang

机构 * Shenzhen International Graduate School, Tsinghua University, China(清华大学深圳国际研究生院) Collaborative Innovation Center for Transport Studies, Dalian Maritime University, China(大连海事大学交通运输协同创新中心)

专题命中 融合架构与评测 :information fusion(title)

AI总结 TLDiffGAN通过结合潜在扩散模型与预训练音频编码器,提升异常声音检测的准确性和时间频率定位能力。

Comments Accepted by ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01974 2026-02-03 eess.SP 70%

Obstacle Detection at Level Crossings under Adverse Weather Conditions -- A Survey

恶劣天气条件下铁路道口障碍物检测——综述

Chenyang Yan, Mats Bengtsson

专题命中 融合架构与评测 :sensor fusion(abstract);multi-sensor fusion(abstract);分类 eess.SP

AI总结 本文综述了恶劣天气下铁路道口障碍物检测的传感器技术和融合策略,分析了各传感器的优缺点及应对措施,提出未来研究方向以提升检测系统的可靠性和适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01447 2026-02-03 cs.CL cs.AI 67%

SentiFuse: Deep Multi-model Fusion Framework for Robust Sentiment Extraction

SentiFuse:一种用于鲁棒情感提取的深度多模型融合框架

Hieu Minh Duong, Rupa Ghosh, Cong Hoan Nguyen, Eugene Levin, Todd Gary, Long Nguyen

机构 * University of Louisville(路易斯维尔大学) Meharry Medical College(梅哈里医学院)

专题命中 融合架构与评测 :feature-level fusion(abstract);decision-level fusion(abstract)

AI总结 SentiFuse通过多模型融合框架提升情感提取的鲁棒性和准确性,特征级融合在F1分数上取得显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00107 2026-02-03 cs.CV cs.RO eess.IV 67%

Efficient UAV trajectory prediction: A multi-modal deep diffusion framework

高效无人机轨迹预测:一种多模态深度扩散框架

Yuan Gao, Xinyu Guo, Wenjing Xie, Zifan Wang, Hongwen Yu, Gongyang Li, Shugong Xu

专题命中 融合架构与评测 :multi-modal fusion(abstract);分类 cs.CV、eess.IV、cs.RO

AI总结 本文提出一种多模态深度融合框架,通过融合激光雷达和毫米波雷达数据提升无人机轨迹预测精度,实验显示其比基线模型提升40%。

Comments in Chinese language

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00696 2026-02-03 eess.SP 57%

CMANet: Channel-Masked Attention Network for Cooperative Multi-Base-Station 3D Positioning

CMANet:基于合作多基站3D定位的通道掩码注意力网络

Tong An, Huan Lu, Jiayang Shi, Kai Yu, Rongrong Zhu, Bin Zheng, Jiwei Zhao, Haibo Zhou

专题命中 融合架构与评测 :feature-level fusion(abstract);分类 eess.SP

AI总结 CMANet通过通道掩码注意力机制和轻量级LSTM解码器实现多基站协作的高精度3D定位,实验显示其在城市环境中具有优于现有方法的定位精度。

Comments 6pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00102 2026-02-03 eess.IV cs.AI cs.LG 57%

Radiomics in Medical Imaging: Methods, Applications, and Challenges

医学影像中的放射组学:方法、应用与挑战

Fnu Neha, Deepak kumar Shukla

专题命中 融合架构与评测 :multimodal fusion(abstract);分类 eess.IV

AI总结 本文系统分析了放射组学的全流程,探讨了特征稳定性、模型可靠性及临床转化有效性,并提出了标准化、领域转移和临床部署等未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00561 2026-02-03 cs.AI 50%

Uncovering Latent Communication Patterns in Brain Networks via Adaptive Flow Routing

通过自适应流路由揭示脑网络中的潜在通信模式

Tianhao Huang, Guanghui Min, Zhenyu Lei, Aiying Zhang, Chen Chen

机构 * University of Virginia(弗吉尼亚大学)

专题命中 融合架构与评测 :multi-modal fusion(abstract)

AI总结 本文提出AFR-Net,通过神经通信动态视角融合SC和FC,揭示潜在神经通路,优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏