Backdoor Cleaning without External Guidance in MLLM Fine-tuning
专题命中 VLM训练与架构 :MLLM(title);multimodal large language model(abstract);分类 cs.CV
AI 大模型
视觉语言模型、视觉推理、视觉问答、图文理解和视觉 grounding。
专题命中 VLM训练与架构 :MLLM(title);multimodal large language model(abstract);分类 cs.CV
机构 * Stanford University(斯坦福大学) ; Together AI ; University of California, Berkeley(加州大学伯克利分校) ; Cedars-Sinai Medical Center(西德斯-西奈医学中心) ; University of California, San Francisco(加州大学旧金山分校)
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.CV
机构 * School of Computer Science, Peking University(北京大学计算机科学学院) ; Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) ; Beijing Academy of Artificial Intelligence(北京人工智能研究院)
专题命中 VLM训练与架构 :MLLM(title,abstract);分类 cs.LG
Comments ICLR 2025
机构 * School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) ; State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.CV
机构 * Muroran Institute of Technology(茂兰技术学院)
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.CV
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.CV
机构 * NTT, Inc.(NTT公司) ; Kyoto University(京都大学) ; Yokohama National University(横滨国立大学)
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.CV
Comments Code is available at https://github.com/kzkadc/uninfo
机构 * National University of Singapore(新加坡国立大学) ; Nanyang Technological University(南洋理工大学)
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.CV
Comments In Progress
机构 * School of Computing, National University of Singapore(计算学院,新加坡国立大学)
专题命中 VLM训练与架构 :LLaVA(title,abstract);分类 cs.CV
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.CV
Comments 16 pages
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.CV
机构 * Cohere for AI Community(Cohere for AI社区) ; Cisco Meraki ; Indiana University Bloomington(印第安纳大学布卢明顿分校) ; Bangladesh University of Engineering and Technology(孟加拉工程与技术大学)
专题命中 VLM训练与架构 :LLaVA(title,abstract);分类 cs.CV
Comments Accepted at ReGenAI CVPR2025 Workshop as Oral
机构 * Mohamed bin Zayed University of AI(穆罕默德·本·扎耶德人工智能大学) ; Aalto University(艾尔沃斯大学)
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.CV
Comments Accepted at ACL 2024-BIONLP Workshop. Code: https://github.com/mbzuai-oryx/XrayGPT
机构 * TIB – Leibniz Information Centre for Science and Technology(蒂宾根-莱比锡信息科学与技术研究中心) ; Hochschule Hannover – Data(汉诺威高等学院-数据) ; H Institute for Applied Data Science(汉诺威应用数据科学研究所) ; L3S Research Center – Leibniz University Hannover(L3S研究中心-汉诺威莱比锡大学)
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.CV
Comments 12 pages (excluding references), 8 tables, 1 equation
机构 * Australian Institute for Machine Learning, The University of Adelaide(澳大利亚机器学习研究所,阿德莱德大学) ; Microsoft Research(微软研究院) ; The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) ; Mohamed bin Zayed University of AI(穆罕默德·本·扎耶德人工智能大学)
专题命中 VLM训练与架构 :LLaVA(title,abstract);分类 cs.CV
Comments Accepted by CVPR 2025
机构 * Centre for Innovation & Precision Eye Health(创新与精准眼科健康中心) ; Yong Loo Lin School of Medicine(尤洛林医学院) ; National University of Singapore(新加坡国立大学) ; Department of Ophthalmology(眼科部门) ; Joint Shantou International Eye Center(汕尾国际眼科中心) ; Shantou University(汕尾大学) ; Chinese University of Hong Kong(香港中文大学) ; Department of Radiology(放射科部门) ; University of Pennsylvania(宾夕法尼亚大学) ; School of Biomedical Engineering(生物医学工程学院) ; College of Computer Science and Technology(计算机科学与技术学院) ; Center of Advanced Medical Computing and Analysis(先进医学计算与分析中心) ; National Key Laboratory of Fundamental Science on Synthetic Vision and the College of Computer Science(合成视觉基础科学国家实验室和计算机科学学院) ; Big Vision Medical Technology Ltd.(大视觉医疗科技有限公司) ; Singapore Eye Research Institute(新加坡眼科研究院) ; Singapore National Eye Centre(新加坡国家眼科中心) ; Ophthalmology & Visual Sciences Academic Clinical Program (EYE ACP)(眼科与视觉科学学术临床计划) ; The Chinese University of Hong Kong(香港中文大学) ; Shenzhen Longgang E.N.T Hospital(深圳龙岗耳鼻喉医院) ; Dongguan Songshan Lake Central Hospital(东莞松山湖中心医院) ; Department of Computer Science(计算机科学部门) ; University of Exeter(埃克塞特大学)
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.CV
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.CV
专题命中 VLM训练与架构 :visual language model(title,abstract);分类 cs.CV
Comments Accepted to CVPR 2025
专题命中 VLM训练与架构 :VLM(title);vision-language model(abstract);分类 cs.CV
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.CV
专题命中 VLM训练与架构 :LLaVA(title,abstract);分类 cs.CV
Comments Technical report
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.CV
Comments Accepted by IJCV
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.CV
Comments Accepted by the IEEE International Conference on Multimedia & Expo 2025 (ICME 2025); 12 pages, 6 figures, 8 tables
专题命中 VLM训练与架构 :vision language model(title);vision-language model(abstract);分类 cs.CV
专题命中 VLM训练与架构 :multimodal large language model(title,abstract);分类 cs.CV
Comments Accepted by CVPR 2025
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.CV
专题命中 VLM训练与架构 :LLaVA(title,abstract);分类 cs.CV
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.CV
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.CV
Comments Accepted to CVPR 2025
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.CV