arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

多模态信息融合

面向图像、视频、多传感器和跨模态感知的信息融合,包括 Image Fusion、红外可见光、遥感、医学影像、LiDAR/雷达/相机和音视频融合。

2025-08-29 至 2025-08-29 共收录 4 信号源:cs.CV, eess.IV, eess.SP, cs.RO, cs.MM

1. 红外-可见光融合 1 篇

2503.12232 2025-08-29 cs.CV 79%

L2RW+: A Comprehensive Benchmark Towards Privacy-Preserved Visible-Infrared Person Re-Identification

Yan Jiang, Hao Yu, Mengting Wei, Zhaodong Sun, Haoyu Chen, Xu Cheng, Guoying Zhao

机构 * Center for Machine Vision and Signal Analysis, University of Oulu(机器视觉与信号分析中心,奥卢大学) University of Oulu(奥卢大学) School of Computer Science, Nanjing University of Information Science and Technology(信息科学技术大学计算机学院) Nanjing University of Information Science and Technology(信息科学技术大学)

专题命中 红外-可见光融合 :visible-infrared(title,abstract);分类 cs.CV

Comments Extended Version of L2RW. We extend it from image to video data

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 多聚焦/多曝光融合 1 篇

2508.20381 2025-08-29 cs.CV 57%

More Reliable Pseudo-labels, Better Performance: A Generalized Approach to Single Positive Multi-label Learning

Luong Tran, Thieu Vo, Anh Nguyen, Sang Dinh, Van Nguyen

机构 * FPT Software AI Center(FPT软件人工智能中心) National University of Singapore(新加坡国立大学) University of Liverpool(利物浦大学) Hanoi University of Science and Technology(河内科学技术大学)

专题命中 多聚焦/多曝光融合 :multi-focus(abstract);分类 cs.CV

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 音视频/视觉语言融合 1 篇

2508.16188 2025-08-29 cs.CL cs.CV cs.MM cs.SD eess.AS 62%

Seeing is Believing: Emotion-Aware Audio-Visual Language Modeling for Expressive Speech Generation

Weiting Tan, Jiachen Lian, Hirofumi Inaguma, Paden Tomasello, Philipp Koehn, Xutai Ma

机构 * Johns Hopkins University(约翰霍普金斯大学) Meta AI Research(Meta AI 研究)

专题命中 音视频/视觉语言融合 :multimodal fusion(abstract);分类 cs.CV、cs.MM

Comments EMNLP 2025 (Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 融合架构与评测 1 篇

2508.20415 2025-08-29 cs.CV 74%

Graph-Based Uncertainty Modeling and Multimodal Fusion for Salient Object Detection

Yuqi Xiong, Wuzhen Shi, Yang Wen, Ruhan Liu

机构 * Guangdong Key Laboratory of Intelligent Information Processing(广东智能信息处理重点实验室) College of Electronics and Information Engineering(电子信息工程学院) Shenzhen University(深圳大学) Furong Laboratory(芙蓉实验室) Central South University(中南大学)

专题命中 融合架构与评测 :multimodal fusion(title);分类 cs.CV

Comments ICONIP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏