LFTR: Learning-Free Token Reduction for Multimodal Large Language Models
专题命中 VLM训练与架构 :multimodal large language model(title,abstract);LLaVA(abstract);MLLM(abstract);分类 cs.CV、cs.AI
AI 大模型
视觉语言模型、视觉推理、视觉问答、图文理解和视觉 grounding。
专题命中 VLM训练与架构 :multimodal large language model(title,abstract);LLaVA(abstract);MLLM(abstract);分类 cs.CV、cs.AI
机构 * VUNO Inc.(VUNO公司) ; KAIST(韩国科学技术院)
专题命中 VLM训练与架构 :vision-language model(title,abstract);VLM(abstract);分类 cs.CV、cs.AI、cs.LG
Comments 38 pages, 17 figures, preprint
机构 * Imperial College London(伦敦帝国学院) ; Apta AI
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.AI
Comments 5 pages, 1 figure, 3 tables
机构 * Baidu VIS(百度视觉) ; National University of Singapore(新加坡国立大学)
专题命中 VLM训练与架构 :vision-language model(abstract);VLM(abstract);grounding(abstract);分类 cs.CV
Comments 23 pages, 10 figures
机构 * Zhejiang University(浙江大学) ; Huawei Noah’s Ark Lab(华为诺亚实验室)
专题命中 VLM训练与架构 :InternVL(abstract);multimodal large language model(abstract);MLLM(abstract);分类 cs.LG
机构 * Meta Superintelligence Labs(Meta 超智能实验室) ; University of Oxford(牛津大学)
专题命中 VLM训练与架构 :visual reasoning(abstract);MLLM(abstract);分类 cs.CV、cs.AI、cs.LG
Comments Project page: https://junlinhan.github.io/projects/lsbs/
机构 * AIDAS Laboratory(AIDAS实验室) ; IPAI ; ECE(电子工程系) ; Seoul National University(首尔国立大学)
专题命中 VLM训练与架构 :vision-language model(abstract);VLM(abstract);分类 cs.CV、cs.AI
Comments Accepted in NeurIPS 2025
机构 * Tsinghua University(清华大学)
专题命中 VLM训练与架构 :multimodal large language model(abstract);MLLM(abstract);分类 cs.CV
Comments ICCV 2025
机构 * University of Catania(卡塔尼亚大学) ; PeRCeiVe Lab, University of Catania(PeRCeiVe实验室,卡塔尼亚大学)
专题命中 VLM训练与架构 :vision-language model(abstract);分类 cs.CV、cs.AI、cs.LG
Comments Accepted at International Joint Conference on Neural Networks (IJCNN) 2025. Code available at https://github.com/perceivelab/ZeroDFL
机构 * IEEE CBMI 2025
专题命中 VLM训练与架构 :LLaVA(abstract);分类 cs.CV、cs.AI
Comments IEEE CBMI 2025. This is the authors' accepted version. The final publication is available at https://ieeexplore.ieee.org/
机构 * University of California, San Diego(加州大学圣迭戈分校) ; Adobe Research(Adobe研究)
专题命中 VLM训练与架构 :vision-language model(abstract);分类 cs.CV、cs.LG
Comments Preprint
机构 * Peking University(北京大学) ; AI Geeks ; Australian Artificial Intelligence Institute(澳大利亚人工智能研究所)
专题命中 VLM训练与架构 :MLLM(abstract);分类 cs.CV
专题命中 VLM训练与架构 :grounding(abstract)