arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

多模态信息融合

面向图像、视频、多传感器和跨模态感知的信息融合,包括 Image Fusion、红外可见光、遥感、医学影像、LiDAR/雷达/相机和音视频融合。

2026-02-12 至 2026-02-12 共收录 6 信号源:cs.CV, eess.IV, eess.SP, cs.RO, cs.MM

1. 遥感融合与全色锐化 1 篇

2602.10547 2026-02-12 cs.RO 70%

ReSPEC: A Framework for Online Multispectral Sensor Reconfiguration in Dynamic Environments

ReSPEC:动态环境中在线多光谱传感器重新配置框架

Yanchen Liu, Yuang Fan, Minghui Zhao, Xiaofan Jiang

机构 * Department of Electrical Engineering, Columbia University(电气工程系,哥伦比亚大学)

专题命中 遥感融合与全色锐化 :sensor fusion(abstract);multi-sensor fusion(abstract);分类 cs.RO

AI总结 ReSPEC框架通过强化学习实现动态多光谱传感器重新配置,提升机器人在复杂环境下的感知效率与资源利用率。

Comments 8 pages, 4 figures. This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人多传感器融合 2 篇

2602.10610 2026-02-12 cs.RO 57%

Pitch Angle Control of a Magnetically Actuated Capsule Robot with Nonlinear FEA-based MPC and EKF Multisensory Fusion

磁性驱动胶囊机器人pitch角控制的非线性FEA基MPC与EKF多感官融合

Chongxun Wang, Zikang Shen, Apoorav Rathore, Akanimoh Udombeh, Harrison Teng, Fangzhou Xia

专题命中 机器人多传感器融合 :sensor fusion(abstract);分类 cs.RO

AI总结 本文提出基于有限元分析的非线性MPC与EKF多感官融合方法,实现磁性驱动胶囊机器人pitch角的高效控制与稳定闭环调节。

Comments This version is submitted for review at IEEE/ASME Transactions on Mechatronics

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10530 2026-02-12 stat.ML cs.LG math.ST stat.TH 50%

Generalized Robust Adaptive-Bandwidth Multi-View Manifold Learning in High Dimensions with Noise

高维噪声下的通用稳健自适应带宽多视图流形学习

Xiucai Ding, Chao Shen, Hau-Tieng Wu

机构 * Department of Statistics, University of California, Davis(加州大学戴维斯分校统计系) Amazon(亚马逊) Courant Institute of Mathematical Sciences, New York University, New York, 10012, NY, USA(纽约大学Courant数学科学研究所)

专题命中 机器人多传感器融合 :sensor fusion(abstract)

AI总结 本文提出GRAB-MDM框架,通过视图依赖的自适应带宽策略,在高维噪声环境下实现稳健的多视图流形学习。

Comments 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 融合架构与评测 3 篇

2602.10138 2026-02-12 cs.CV cs.AI cs.CL cs.LG 79%

Multimodal Information Fusion for Chart Understanding: A Survey of MLLMs -- Evolution, Limitations, and Cognitive Enhancement

多模态信息融合用于图表理解:MLLMs的综述——演变、局限与认知增强

Zhihang Yi, Jian Zhao, Jiancheng Lv, Tao Wang

机构 * College of Computer Science, Sichuan University(四川大学计算机科学学院) Engineering Research Center of Machine Learning(机器学习工程研究中心) China Telecom Institute of AI(中国电信人工智能研究院)

专题命中 融合架构与评测 :information fusion(title,abstract);分类 cs.CV

AI总结 本文综述了多模态大语言模型在图表理解中的应用,分析了其演变、局限及未来发展方向,旨在推动更稳健的系统发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10549 2026-02-12 cs.CV cs.AI 57%

Enhancing Weakly Supervised Multimodal Video Anomaly Detection through Text Guidance

通过文本引导增强弱监督多模态视频异常检测

Shengyang Sun, Jiashen Hua, Junyi Feng, Xiaojin Gong

机构 * School of Computer Science and Technology, Hangzhou Dianzi University(杭州电子科技大学计算机科学与技术学院) Alibaba Cloud(阿里云) College of Information Science and Electronic Engineering, Zhejiang University(浙江大学信息科学与电子工程学院)

专题命中 融合架构与评测 :multimodal fusion(abstract);分类 cs.CV

AI总结 本文提出文本引导框架,通过多阶段文本增强和多尺度瓶颈Transformer融合模块,提升弱监督多模态视频异常检测的性能。

Comments Accepted by IEEE Transactions on Multimedia

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13180 2026-02-12 cs.LG cs.AI cs.DC 50%

GC-Fed: Gradient Centralized Federated Learning with Partial Client Participation

GC-Fed: 带部分客户端参与的梯度集中联邦学习

Jungwon Seo, Ferhat Ozgur Catak, Chunming Rong, Kibeom Hong, Minhoe Kim

机构 * Department of Electrical Engineering and Computer Science, University of Stavanger(电子工程与计算机科学系,斯瓦尔内尔大学) Department of Software, Sookmyung Women's University(软件系,淑明女子大学) Department of Electrical and Information Engineering, Seoul National University of Science and Technology(电子与信息工程系,首尔科学技术大学)

专题命中 融合架构与评测 :information fusion(abstract)

AI总结 GC-Fed通过梯度集中技术缓解联邦学习中的客户端漂移问题,提升异构数据下的模型准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏