arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

多模态信息融合

面向图像、视频、多传感器和跨模态感知的信息融合,包括 Image Fusion、红外可见光、遥感、医学影像、LiDAR/雷达/相机和音视频融合。

2025-12-05 至 2025-12-05 共收录 3 信号源:cs.CV, eess.IV, eess.SP, cs.RO, cs.MM

1. 红外-可见光融合 1 篇

2512.04522 2025-12-05 cs.CV 79%

Identity Clue Refinement and Enhancement for Visible-Infrared Person Re-Identification

身份线索细化与增强用于可见-红外人再识别

Guoqing Zhang, Zhun Wang, Hairui Wang, Zhonglin Ye, Yuhui Zheng

机构 * School of Computer Science, Nanjing University of Information Science and Technology(南京信息工程大学计算机学院) Key Laboratory of Social Computing and Cognitive Intelligence (Dalian University of Technology), Ministry of Education(社会计算与认知智能重点实验室(大连理工大学)) State Key Laboratory of Tibetan Intelligent Information Processing and Application, Qinghai Normal University(藏语智能信息处理与应用国家重点实验室(青海师范大学))

专题命中 红外-可见光融合 :visible-infrared(title,abstract);分类 cs.CV

AI总结 本文提出ICRE网络,通过细化和增强身份线索来提升可见-红外人再识别的性能。

Comments 14 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 多聚焦/多曝光融合 1 篇

2507.07381 2025-12-05 cs.CV 79%

Multi-Focus Temporal Shifting for Precise Event Spotting in Sports Videos

多焦点时间位移用于体育视频中精确事件定位

Hao Xu, Xinyu Wei, Sam Wells, Sunil Aryal

机构 * Deakin University(德金大学)

专题命中 多聚焦/多曝光融合 :multi-focus(title,abstract);分类 cs.CV

AI总结 本文提出多焦点时间位移模块,用于提升体育视频中精确事件定位的性能,通过多尺度时间位移和组聚焦模块实现高效建模,同时引入首个乒乓球PES基准测试集。

Comments 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 融合架构与评测 1 篇

2512.04943 2025-12-05 cs.CV 57%

Towards Adaptive Fusion of Multimodal Deep Networks for Human Action Recognition

面向人类动作识别的多模态深度网络自适应融合

Novanto Yudistira

机构 * Departemen Teknik Informatika, Fakultas Ilmu Komputer, Universitas Brawijaya(计算机科学系,信息学院,布拉格亚大学)

专题命中 融合架构与评测 :multimodal fusion(abstract);分类 cs.CV

AI总结 本文提出了一种基于多模态深度网络的自适应融合方法,通过门控机制提升人类动作识别的准确性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏