LFTR: Learning-Free Token Reduction for Multimodal Large Language Models
专题命中 多模态训练与对齐 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV、cs.CL、cs.AI
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 多模态训练与对齐 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV、cs.CL、cs.AI
机构 * State Key Laboratory of Brain Cognition and Brain-inspired Intelligence Technology, Institute of Automation, Chinese Academy of Sciences(脑认知与脑启发智能技术重点实验室,自动化研究所,中国科学院) ; School of Artificial Intelligence, University of Chinese Academy of Sciences(人工智能学院,中国科学院大学) ; School of Future Technology, University of Chinese Academy of Sciences(未来技术学院,中国科学院大学) ; State Key Laboratory of Cognitive Neuroscience and Learning, Beijing Normal University(认知神经科学与学习国家重点实验室,北京师范大学)
专题命中 多模态训练与对齐 :multimodal(title,abstract);MLLM(abstract);分类 cs.CL、cs.AI、cs.MM
机构 * University of Illinois Chicago(伊利诺伊大学香槟分校) ; Sony AI(索尼人工智能)
专题命中 多模态训练与对齐 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV、cs.CL、cs.AI
Comments 8 pages for the main paper
机构 * Graduate School(研究生院) ; Faculty of Information Science(信息科学系) ; Electrical Engineering(电气工程) ; Kyushu University(九州大学) ; JAPAN(日本)
专题命中 多模态训练与对齐 :MLLM(title,abstract);multimodal(abstract);multi-modal(abstract)
机构 * ISIR, Sorbonne Université(ISIR,索邦大学)
专题命中 多模态训练与对齐 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV、cs.CL、cs.AI
Comments ICCV 2025. The first three authors contributed equally. Project page and code: https://pegah- kh.github.io/projects/lmm-finetuning-analysis-and-steering/
专题命中 多模态训练与对齐 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV、cs.CL、cs.AI
Comments NeurIPS 2024 Workshop on Adaptive Foundation Models
专题命中 多模态训练与对齐 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV、cs.CL、cs.AI
Comments Accepted by ACL 2025 Main
机构 * Eindhoven University of Technology(埃因霍温理工大学)
专题命中 多模态训练与对齐 :multimodal(title,abstract);image-text(abstract);audio-visual(abstract)
Comments 10 pages, 5 figures, accepted to FedGenAI-IJCAI 2025
专题命中 多模态训练与对齐 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CV、cs.CL、cs.AI
Comments 13 pages, 2 figures
机构 * College of Systems Engineering, National University of Defense Technology(系统工程学院,国防科技大学) ; Tsinghua University(清华大学) ; Hefei University of Technology(合肥工业大学) ; iFLYTEK Research(iFLYTEK研究院)
专题命中 多模态训练与对齐 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CV、cs.CL、cs.AI
Comments EMNLP 2024 main
机构 * NJU(南京大学) ; Tencent Youtu Lab(腾讯计算机系统有限公司视觉实验室) ; XMU(厦门大学) ; CASIA(中国科学院自动化研究所)
专题命中 多模态训练与对齐 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV、cs.CL、cs.AI
Comments Project Page: https://vita-home.github.io
机构 * Department of Computer Science and Engineering, The Ohio State University(计算机科学与工程系,俄亥俄州立大学) ; Translational Data Analytics Institute, The Ohio State University(转化数据分析研究所,俄亥俄州立大学) ; Department of Biomedical Informatics, The Ohio State University(生物医学信息学系,俄亥俄州立大学)
专题命中 多模态训练与对齐 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV、cs.CL、cs.AI
机构 * Georgia State University(佐治亚州立大学) ; Adobe MDSR ; Wright State University(怀特州立大学) ; California Polytechnic State University(加州州立大学帕克校区)
专题命中 多模态训练与对齐 :cross-modal(title);multimodal(abstract);multi-modal(abstract);分类 cs.CV、cs.CL、cs.AI
Comments Accepted at IEEE International Conference on Big Data 2024 (IEEE BigData 2024)
Journal ref IEEE International Conference on Big Data 2024 (IEEE BigData 2024)
机构 * Multimedia Laboratory (MMLab)(多媒体实验室) ; The Chinese University of Hong Kong(香港中文大学) ; CPII under InnoHK(创新香港科技署CPII)
专题命中 多模态训练与对齐 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CV、cs.CL、cs.AI
Comments Accepted to ACL 2025 Findings
专题命中 多模态训练与对齐 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CV、cs.CL、cs.AI
专题命中 多模态训练与对齐 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV、cs.CL、cs.AI
Comments Kun Jiang, Mengmeng Yang and Diange Yang are Corresponding Author. The main paper and supplementary material are both included here, total 23 pages (main paper is 10 pages and supplementary material is 13 pages), total 17 figures (6 figures in main paper and 11 figures in supplementary material), this paper is Accepted to CVPR WDFM-AD Workshop 2025, The code will be available at https://Ankit-Zefan.github.io/CleanMap/
专题命中 多模态训练与对齐 :multi-modal(title,abstract);MLLM(abstract);分类 cs.CV、cs.CL、cs.AI
Comments Accepted to CVPR 2025, codes in process
专题命中 多模态训练与对齐 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV、cs.CL、cs.AI
Comments published at COLM-2024
专题命中 多模态训练与对齐 :multi-modal(title);multimodal(abstract);MLLM(abstract);分类 cs.CV、cs.CL、cs.MM
专题命中 多模态训练与对齐 :multimodal(title,abstract);multi-modal(abstract);分类 cs.CV、cs.CL、cs.AI
Comments NeurIPS 2024
专题命中 多模态训练与对齐 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CV、cs.AI、cs.MM
Comments The paper has been accepted by INTERSPEECH 2024
专题命中 多模态训练与对齐 :cross-modal(title,abstract);multimodal(abstract);分类 cs.CV、cs.MM、eess.AS
专题命中 多模态训练与对齐 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV、cs.CL、cs.AI
专题命中 多模态训练与对齐 :omni-modal(title,abstract);multimodal(abstract);分类 cs.CV、cs.AI、cs.MM
Comments Project Website: https://invictus717.github.io/MiCo/
专题命中 多模态训练与对齐 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV、cs.CL、cs.AI
Comments Github: https://github.com/VIM-Bench/VIM_TOOL, Model and Data: https://huggingface.co/VIM-Bench
专题命中 多模态训练与对齐 :multimodal(title,abstract);multi-modal(abstract);分类 cs.CV、cs.CL、cs.AI
专题命中 多模态训练与对齐 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV、cs.CL、cs.AI
Comments CVPR 2024 camera-ready
专题命中 多模态训练与对齐 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV、cs.CL、cs.AI
Comments 14 pages, 2 figures, 11 tables
专题命中 多模态训练与对齐 :multimodal(title,abstract);audio-visual(abstract);分类 cs.AI、cs.MM、eess.AS
专题命中 多模态训练与对齐 :multimodal(title,abstract);multi-modal(abstract);分类 cs.CV、cs.CL、cs.AI
Comments A Preprint