IV-tuning: Parameter-Efficient Transfer Learning for Infrared-Visible Tasks
IV-tuning: 用于红外-可见任务的参数高效迁移学习
专题命中 红外-可见光融合 :infrared and visible(abstract);分类 cs.CV
AI总结 IV-tuning通过冻结参数和高效微调,提升红外-可见任务的泛化能力和计算效率。
视觉与机器人
面向图像、视频、多传感器和跨模态感知的信息融合,包括 Image Fusion、红外可见光、遥感、医学影像、LiDAR/雷达/相机和音视频融合。
IV-tuning: 用于红外-可见任务的参数高效迁移学习
专题命中 红外-可见光融合 :infrared and visible(abstract);分类 cs.CV
AI总结 IV-tuning通过冻结参数和高效微调,提升红外-可见任务的泛化能力和计算效率。
一种用于对话中多模态情绪识别的专家混合模型
机构 * LEAP Lab, Department of Electrical Engineering(LEAP实验室,电气工程系) ; Microsoft(微软)
专题命中 音视频/视觉语言融合 :information fusion(abstract)
AI总结 MiSTER-E通过专家混合框架提升对话中多模态情绪识别的准确率,实现跨模态一致性与融合。
Comments Accepted to Elsevier Computer Speech and Language. 30 pages, 9 figures, 5 tables
从无偏到特定:基于潜在偏好的多行为序列推荐扩散模型
机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) ; School of Cyber Security, UCAS(UCAS网络安全学院)
专题命中 融合架构与评测 :information fusion(abstract)
AI总结 FatsMB通过潜在空间中的偏好生成,实现从无偏到特定的多行为序列推荐,提升推荐的多样性和准确性。
将机器学习集成与大型语言模型结合用于心脏病预测的投票融合
专题命中 融合架构与评测 :hybrid fusion(abstract)
AI总结 本研究通过结合机器学习集成与大型语言模型的投票融合方法,提高了心脏病预测的准确性与可靠性。
Comments 7 pages, 8 figures, (Accepted at a peer-reviewed conference)
模态引导的图专家混合网络与熵触发路由用于多模态推荐
机构 * Beijing University of Posts and Telecommunications(北京邮电大学) ; Tianjin University of Technology(天津理工大学)
专题命中 融合架构与评测 :multimodal fusion(abstract)
AI总结 MAGNET通过模态引导的图专家混合网络与熵触发路由,提升多模态推荐中融合的可控性、稳定性和可解释性。