arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

多模态信息融合

面向图像、视频、多传感器和跨模态感知的信息融合,包括 Image Fusion、红外可见光、遥感、医学影像、LiDAR/雷达/相机和音视频融合。

2025-10-13 至 2025-10-13 共收录 3 信号源:cs.CV, eess.IV, eess.SP, cs.RO, cs.MM

1. 多聚焦/多曝光融合 1 篇

2510.08279 2025-10-13 cs.CV cs.AI 57%

Learning Neural Exposure Fields for View Synthesis

Michael Niemeyer, Fabian Manhardt, Marie-Julie Rakotosaona, Michael Oechsle, Christina Tsalicoglou, Keisuke Tateno, Jonathan T. Barron, Federico Tombari

机构 * Google(谷歌)

专题命中 多聚焦/多曝光融合 :multi-exposure(abstract);分类 cs.CV

Comments Accepted to NeurIPS 2025. Project page available at https://m-niemeyer.github.io/nexf/index.html

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 音视频/视觉语言融合 1 篇

2510.08802 2025-10-13 cs.LG 50%

Edu-EmotionNet: Cross-Modality Attention Alignment with Temporal Feedback Loops

S M Rafiuddin

机构 * Department of Computer Science Oklahoma State University Stillwater, Oklahoma, USA(计算机科学系 奥克拉荷马州立大学 斯蒂尔沃特 奥克拉荷马州 美国)

专题命中 音视频/视觉语言融合 :multimodal fusion(abstract)

Comments 6 Pages, 6 Figures, 3 Tables, Accepted as a Regular Research paper at ICMLA 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 融合架构与评测 1 篇

2507.01428 2025-10-13 cs.CV eess.IV 62%

DiffMark: Diffusion-based Robust Watermark Against Deepfakes

Chen Sun, Haiyang Sun, Zhiqing Guo, Yunfeng Diao, Liejun Wang, Dan Ma, Gaobo Yang, Keqin Li

机构 * College of Computer Science and Technology, Xinjiang University(新疆大学计算机科学与技术学院) Silk Road Multilingual Cognitive Computing International Cooperation Joint Laboratory(丝绸之路多语种认知计算国际合作联合实验室) School of Computer Science and Information Engineering, Hefei University of Technology(合肥工业大学计算机科学与信息工程学院) College of Computer Science and Electronic Engineering, Hunan University(湖南大学计算机科学与电子工程学院) Department of Computer Science, State University of New York(纽约州立大学计算机科学系)

专题命中 融合架构与评测 :information fusion(abstract);分类 cs.CV、eess.IV

详情

展开后加载摘要…

URL PDF HTML 收藏