A2DINOv3: Rethinking Multi-Modal Object Detection via Socialized Collaboration
A2DINOv3:通过社会化协作重新思考多模态目标检测
专题命中 红外-可见光融合 :multi-modal fusion(abstract);分类 cs.CV
AI总结 本文提出A2DINOv3框架,通过社会化协作协议让RGB与红外分支以异构专家模式选择性交互,结合零初始化策略,在四个多模态基准上实现了多模态目标检测的SOTA性能。
视觉与机器人
面向图像、视频、多传感器和跨模态感知的信息融合,包括 Image Fusion、红外可见光、遥感、医学影像、LiDAR/雷达/相机和音视频融合。
A2DINOv3:通过社会化协作重新思考多模态目标检测
专题命中 红外-可见光融合 :multi-modal fusion(abstract);分类 cs.CV
AI总结 本文提出A2DINOv3框架,通过社会化协作协议让RGB与红外分支以异构专家模式选择性交互,结合零初始化策略,在四个多模态基准上实现了多模态目标检测的SOTA性能。
机械滥用下锂离子电池热失控的红外热点引导预警
专题命中 红外-可见光融合 :multimodal fusion(abstract)
AI总结 针对机械滥用下锂离子电池热失控预警问题,提出两阶段融合红外热点动态与多模态特征的方法,经实验验证可实现更早的预警与更高的ROC-AUC。