Enhancing Multimodal In-Context Learning for Image Classification through Coreset Optimization
机构 * Southeast University(东南大学) ; Huawei Singapore Research Center(华为新加坡研究中心)
专题命中 图文多模态 :multimodal(title);分类 cs.CV、cs.AI
Comments 11 pages, 5 figures
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
机构 * Southeast University(东南大学) ; Huawei Singapore Research Center(华为新加坡研究中心)
专题命中 图文多模态 :multimodal(title);分类 cs.CV、cs.AI
Comments 11 pages, 5 figures
专题命中 图文多模态 :multimodal(title);分类 cs.CV、cs.AI
机构 * Tsinghua University(清华大学) ; Zhipu AI(智谱AI) ; Peking University(北京大学)
专题命中 图文多模态 :multimodal(title);分类 cs.CV、cs.CL
机构 * Nanyang Technological University, Singapore(新加坡南洋理工大学) ; National Institute of Education (NIE), Singapore(新加坡国家教育研究所) ; Institute for Infocomm Research (I 2 R), A*STAR, Singapore(新加坡资讯与通信研究院(I2R))
专题命中 图文多模态 :multimodal(title);分类 cs.CL、cs.AI
Comments ACL 2025 Industry Track
机构 * NAMAA ; KAND CA Corp. ; Prince Sultan University
专题命中 图文多模态 :multimodal(title);分类 cs.CV、cs.AI
机构 * Seoul National University(首尔国立大学) ; Kim & Chang AI&IT System Center(金·昌AI&IT系统中心) ; Waddle Corporation(Waddle公司)
专题命中 图文多模态 :multimodal(title);分类 cs.CV、cs.AI
机构 * Institute for Transfusion Medicine, University Hospital Essen, Hufelandstraße 55, Essen, Germany(1 输血医学研究所,埃森大学医院,Hufelandstraße 55,德国) ; Department of Computer Science, University of Applied Sciences and Arts Dortmund (FHDO), Emil-Figge Str. 42, Dortmund, Germany(2 计算机科学系,多特蒙德应用科学大学(FHDO),Emil-Figge Str. 42,德国) ; Institute for Medical Informatics, Biometry and Epidemiology (IMIBE), University Hospital Essen, Hufelandstraße 55, Essen, Germany(3 医学信息学、生物统计学和流行病学研究所(IMIBE),埃森大学医院,Hufelandstraße 55,德国) ; Institute for AI in Medicine (IKIM), University Hospital Essen, Girardetstraße 2, Essen, Germany(4 医学人工智能研究所(IKIM),埃森大学医院,Girardetstraße 2,德国) ; Institute of Interventional and Diagnostic Radiology and Neuroradiology, University Hospital Essen, Hufelandstraße 55, Essen, Germany(5 干预性和诊断放射学及神经放射学研究所,埃森大学医院,Hufelandstraße 55,德国) ; Department of Dermatology, University Hospital Essen, Hufelandstraße 55, Essen, Germany(6 皮肤科系,埃森大学医院,Hufelandstraße 55,德国)
专题命中 图文多模态 :multimodal(title);分类 cs.CV、cs.CL
专题命中 图文多模态 :multimodal(title);分类 cs.CV、cs.AI
专题命中 图文多模态 :multimodal(title);分类 cs.CL、cs.AI
Comments NAACL 2025 Main
专题命中 图文多模态 :multi-modal(title);分类 cs.CL、cs.AI
Comments 32pp (+6pp sup.mat.) Accepted in Computer Vision and Image Understanding Journal on January 23, 2025. This research received funding Horizon-Europe TERAIS project (G.A. 101079338) and Slovak Research and Development Agency, project no. APVV-21-0105
专题命中 图文多模态 :multimodal(title);分类 cs.CV、cs.CL
专题命中 图文多模态 :image-text(title);分类 cs.CV、cs.AI
专题命中 图文多模态 :image-text(title);分类 cs.CV、cs.AI
Comments Accepted to ECCV Synthetic Data for Computer Vision Workshop (Oral)
专题命中 图文多模态 :multimodal(title);分类 cs.CV、cs.AI
Comments Code is available at https://github.com/cnzzx/VSA
专题命中 图文多模态 :multi-modal(title);分类 cs.CV、cs.MM
专题命中 图文多模态 :multimodal(title);分类 cs.CV、cs.AI
Comments 14 pages, 10 figures. Accepted to 35th British Machine Vision Conference (BMVC 2024), Workshop on Privacy, Fairness, Accountability and Transparency in Computer Vision
专题命中 图文多模态 :multimodal(title);分类 cs.CV、cs.CL
Comments 12 pages, 5 tables, 2 figures, Proceedings of the 18th International Workshop on Semantic Evaluation (SemEval-2024) @ NAACL 2024
专题命中 图文多模态 :multi-modal(title);分类 cs.CV、cs.AI
专题命中 图文多模态 :image-text(title);分类 cs.CV、cs.AI
专题命中 图文多模态 :multimodal(title);分类 cs.CL、cs.AI
Comments 18 pages, 9 figures, 12 tables
专题命中 图文多模态 :multimodal(title);分类 cs.CV、cs.AI
专题命中 图文多模态 :cross-modal(title);分类 cs.CV、cs.CL
专题命中 图文多模态 :multi-modal(title);分类 cs.CV、cs.CL
专题命中 图文多模态 :multi-modal(title);分类 cs.CV、cs.CL
专题命中 图文多模态 :cross-modal(title);分类 cs.CV、cs.CL
专题命中 图文多模态 :image-text(title);分类 cs.CV、cs.CL
Comments 9 pages, 2 figures, 6 tables, 1 algorithm
专题命中 图文多模态 :image-text(title);分类 cs.CV、cs.MM
Comments 15pages, 15 figures, 8 tables
专题命中 图文多模态 :multi-modal(title);分类 cs.CV、cs.CL
Comments Source code available at: https://github.com/subho406/OmniNet
专题命中 图文多模态 :multi-modal(title);分类 cs.CV、cs.CL
Comments To be presented at ICML 2018; 10 pages 5 figures
专题命中 图文多模态 :multi-modal(title);分类 cs.CV、cs.AI
Comments 23 pages; CVPR 2017 submission; see https://guesswhat.ai