Preserving Clusters in Prompt Learning for Unsupervised Domain Adaptation
机构 * Monash University(墨尔本大学) ; New York University(纽约大学)
专题命中 图文多模态 :multi-modal(abstract);image-text(abstract);分类 cs.CV
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
机构 * Monash University(墨尔本大学) ; New York University(纽约大学)
专题命中 图文多模态 :multi-modal(abstract);image-text(abstract);分类 cs.CV
机构 * Liverpool John Moores University(利物浦约翰·穆里斯大学) ; Birla Institute of Technology(比拉理工学院) ; Christ University(基督大学) ; Columbia University(哥伦比亚大学) ; New York University(纽约大学) ; University of Washington(华盛顿大学) ; Hanyang University(翰阳大学)
专题命中 图文多模态 :multimodal(abstract);MLLM(abstract);分类 cs.CV
机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) ; ByteDance Seed(字节跳动种子) ; The Chinese University of Hong Kong(香港中文大学) ; City University of Hong Kong(香港城市大学) ; BIAI-ZJUT ; Zhejiang University of Technology(浙江工业大学)
专题命中 图文多模态 :multimodal(abstract);image-text(abstract);分类 cs.CV
机构 * School of Computer Science, Wuhan University(武汉大学计算机学院) ; School of Artificial Intelligence, Wuhan University(武汉大学人工智能学院)
专题命中 图文多模态 :cross-modal(abstract);image-text(abstract);分类 cs.CV
Comments Accepted by IEEE Geoscience and Remote Sensing Magazine
Journal ref IEEE Geoscience and Remote Sensing Magazine, Early Access, 2025
专题命中 图文多模态 :multimodal(abstract);MLLM(abstract);分类 cs.CV
机构 * University of Maryland, College Park(马里兰大学学院公园分校)
专题命中 图文多模态 :multimodal(abstract);cross-modal(abstract);分类 cs.CV
机构 * Zhejiang University(浙江大学) ; Byte Dance(字节跳动) ; National University of Singapore(新加坡国立大学) ; Zhejiang Key Laboratory of Medical Imaging Artificial Intelligence(浙江省医学影像人工智能重点实验室)
专题命中 图文多模态 :multimodal(abstract);MLLM(abstract);分类 cs.CL
机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) ; Meta AI
专题命中 图文多模态 :multi-modal(abstract);image-text(abstract);分类 cs.AI
Comments ACL 2025 Main Conference, 27 pages
专题命中 图文多模态 :cross-modal(abstract);image-text(abstract);分类 cs.CV
Comments accepted to ICML 2025
机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) ; University of Chinese Academy of Sciences(中国科学院大学)
专题命中 图文多模态 :multimodal(abstract);image-text(abstract);分类 cs.CV
机构 * School of Informatics, The University of Edinburgh(信息学院,爱丁堡大学) ; HiTZ Center - Ixa, University of the Basque Country UPV/EHU(巴斯克国家大学HiTZ中心)
专题命中 图文多模态 :multimodal(abstract);cross-modal(abstract);分类 cs.CL
Comments Accepted Findings ACL 2025
专题命中 图文多模态 :multimodal(abstract);cross-modal(abstract);分类 cs.AI
Comments ICML 2025 Main Proceedings
机构 * The Chinese University of Hong Kong(香港中文大学) ; Tencent Hunyuan Research(腾讯文言研究院)
专题命中 图文多模态 :multimodal(abstract);cross-modal(abstract);分类 cs.AI
机构 * De Artificial Intelligence Lab(人工智能实验室)
专题命中 图文多模态 :multimodal(abstract);cross-modal(abstract);分类 cs.CV
机构 * Purdue University(普渡大学) ; University at Albany, State University of New York(纽约州立大学阿尔巴尼分校)
专题命中 图文多模态 :multimodal(abstract);image-text(abstract);分类 cs.CV
机构 * Center for Research in Computer Vision, University of Central Florida(计算机视觉研究中心,佛罗里达大学)
专题命中 图文多模态 :multi-modal(abstract);cross-modal(abstract);分类 cs.CV
Comments Accepted at ICLR 2025. Main paper + supplementary material
机构 * Faculty of Computer Science and Information Technology, Universiti Malaya(马来亚大学计算机科学与信息学院) ; School of Computing and Information Systems, The University of Melbourne(墨尔本大学计算机与信息学院)
专题命中 图文多模态 :multimodal(abstract);cross-modal(abstract);分类 cs.CV
Comments Accepted by IJCNN 2025, 8 pages, 8 figures, 3 tables
机构 * School of Computer Science and Engineering, The University of New South Wales(计算机科学与工程学院,新南威尔士大学) ; Adobe Research(Adobe研究) ; School of Computer Science, Georgia Institute of Technology(计算机科学学院,佐治亚理工学院) ; University of California, San Diego(加州大学圣地亚哥分校) ; ETH Zurich(苏黎世联邦理工学院) ; University of Klagenfurt(克雷格弗特大学) ; The University of New South Wales and CSIRO’s Data61(新南威尔士大学和CSIRO的数据61)
专题命中 图文多模态 :multimodal(abstract);multi-modal(abstract);分类 cs.AI
专题命中 图文多模态 :multimodal(abstract);MLLM(abstract);分类 cs.CV
Comments 26 pages, CVPR MORSE Workshop 2025
专题命中 图文多模态 :multimodal(abstract);MLLM(abstract);分类 cs.CV
专题命中 图文多模态 :cross-modal(abstract);image-text(abstract);分类 cs.CV
Comments Our dataset and code will be publicly available at https://github.com/SiyuanYan1/Derm1M
专题命中 图文多模态 :multimodal(abstract);MLLM(abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(abstract);image-text(abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(abstract);multi-modal(abstract);分类 cs.CV
Comments Accepted at CVPR 2025
专题命中 图文多模态 :multi-modal(abstract);cross-modal(abstract);分类 cs.CV
专题命中 图文多模态 :cross-modal(abstract);image-text(abstract);分类 cs.CV
Comments Project page available at https://github.com/zhaozh10/Awesome-CLIP-in-Medical-Imaging
专题命中 图文多模态 :multimodal(abstract);image-text(abstract);分类 cs.CV
专题命中 图文多模态 :multi-modal(abstract);omni-modal(abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(abstract);image-text(abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(abstract);multimodal foundation model(abstract);分类 cs.CV
Comments Accepted at WACV 2025 (Oral)