Uni-Hema: Unified Model for Digital Hematopathology
机构 * Information Technology University of Punjab(旁遮普信息科技大学) ; Chughtai Lab(楚格塔实验室)
专题命中 图文多模态 :multimodal(abstract);multi-modal(abstract);分类 cs.CV
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
机构 * Information Technology University of Punjab(旁遮普信息科技大学) ; Chughtai Lab(楚格塔实验室)
专题命中 图文多模态 :multimodal(abstract);multi-modal(abstract);分类 cs.CV
机构 * Huazhong University of Science and Technology(华中科技大学) ; Zhongguancun Academy(中关村学院) ; East China Normal University(华东师范大学) ; Zhengzhou University(郑州大学) ; Zhongguancun Institute of Artificial Intelligence(中关村人工智能研究院)
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV、cs.CL、cs.AI
基于CLIP的层次语义树锚定的类增量学习
机构 * School of Artificial Intelligence, Nanjing University(人工智能学院,南京大学) ; State Key Laboratory for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学)
专题命中 图文多模态 :multi-modal(abstract);分类 cs.CV
AI总结 HASTEN通过层次语义树锚定方法,有效解决CLIP类增量学习中的灾难性遗忘问题,提升模型对层次化类别结构的保持能力。
多文本引导的少样本语义分割
机构 * State Key Laboratory of Electromechanical Integrated Manufacturing of High-Performance Electronic Equipments(高性能电子设备机电一体化制造国家重点实验室) ; Center for Complex Systems(复杂系统中心) ; School of Mechano-Electronic Engineering(机械电子工程学院) ; Xidian University(西安电子科技大学)
专题命中 图文多模态 :cross-modal(abstract);分类 cs.CV
AI总结 MTGNet通过融合多文本提示提升少样本语义分割性能,采用多文本先验细化、文本锚点特征融合和前景置信度加权注意力模块,有效增强分割鲁棒性与语义一致性。
机构 * Nanjing University(南京大学) ; Technical University of Munich(慕尼黑技术大学) ; Helmholtz-Zentrum Dresden-Rossendorf(德累斯顿-罗斯托克亥姆霍兹中心)
专题命中 图文多模态 :image-text(abstract);分类 cs.CV