VaccineRAG: Boosting Multimodal Large Language Models' Immunity to Harmful RAG Samples
专题命中 视觉问答 :multimodal large language model(title);visual question answering(abstract);分类 cs.AI
AI 大模型
视觉语言模型、视觉推理、视觉问答、图文理解和视觉 grounding。
专题命中 视觉问答 :multimodal large language model(title);visual question answering(abstract);分类 cs.AI
机构 * University of California, Merced(加州大学梅尔德分校) ; The University of Queensland(昆士兰大学) ; vivo Mobile Communication Co., Ltd(vivo移动通信有限公司)
专题命中 视觉推理 :grounding(title,abstract);visual reasoning(title);vision-language model(abstract);分类 cs.CV、cs.AI
Comments EMNLP 2025 Main Conference
专题命中 视觉推理 :vision-language model(title,abstract);分类 cs.CV、cs.AI
机构 * University of Amsterdam(阿姆斯特丹大学) ; College of Business(商学院) ; Economics, University of Johannesburg(经济系,约翰内斯堡大学)
专题命中 视觉推理 :multimodal large language model(abstract);分类 cs.CV、cs.AI
专题命中 视觉推理 :vision-language model(abstract);分类 cs.CV
专题命中 视觉定位与Grounding :grounding(title,abstract);multimodal large language model(abstract);MLLM(abstract);分类 cs.CV、cs.AI
机构 * Toyota Technological Institute(丰田技术研究所)
专题命中 视觉定位与Grounding :VLM(title,abstract);vision-language model(abstract);分类 cs.CV
Comments 10 pages, Accepted to ICCV2025
机构 * Southeast University(东南大学) ; Zhejiang University(浙江大学) ; Baidu VIS(百度视觉) ; Jiangnan University(江南大学)
专题命中 视觉定位与Grounding :grounding(title,abstract);分类 cs.CV、cs.AI
Comments ICCV2025
机构 * KAIST AI(韩国科学技术院人工智能研究所) ; AITRICS(人工智能与机器人技术研究所在线)
专题命中 视觉定位与Grounding :vision-language model(title,abstract);分类 cs.CV、cs.AI
Comments accepted to EMNLP 2025
机构 * Insight Research Ireland Centre for Data Analytics, DCU, Dublin, Ireland(爱尔兰洞察研究爱尔兰数据分析中心,都柏林大学,都柏林) ; Research Ireland Centre for Research Training in Machine Learning, DCU, Dublin, Ireland(爱尔兰研究爱尔兰机器学习研究培训中心,都柏林大学,都柏林) ; School of Computing, Dublin City University, Dublin, Ireland(计算学院,都柏林城市大学,都柏林)
专题命中 视觉定位与Grounding :vision-language model(title,abstract);分类 cs.CV
Comments Medical Imaging with Deep Learning (MIDL 2025) short paper
专题命中 视觉定位与Grounding :grounding(title,abstract);分类 cs.AI
Comments 4 figures, 6 pages, presented at CHI 2025 Workshop on Human-AI Interaction for Augmented Reasoning
专题命中 视觉定位与Grounding :grounding(title)
Comments Chapter draft for the Blackwell Companion to the Philosophy and the Multiverse
机构 * Accenture Labs(埃森哲实验室)
专题命中 视觉定位与Grounding :vision language model(abstract);分类 cs.CV、cs.LG
机构 * Mercedes-Benz AG, Germany(梅赛德斯-奔驰集团,德国) ; Technical University of Munich, Germany(慕尼黑技术大学,德国) ; Ferdinand-Steinbeis-Institut der Steinbeis-Stiftung, Germany(施坦贝格基金会费尔迪南-斯坦贝格研究所,德国)
专题命中 视觉定位与Grounding :vision-language model(abstract);分类 cs.AI
机构 * University of Pennsylvania(宾夕法尼亚大学) ; Archimedes, Athena RC(阿基米德、阿提卡RC)
专题命中 视觉定位与Grounding :multimodal large language model(abstract);分类 cs.CV
Comments ICCV 2025
专题命中 GUI与屏幕智能体 :VLM(title,abstract);vision-language model(abstract);分类 cs.AI
Comments 10 pages
专题命中 GUI与屏幕智能体 :vision language model(title,abstract)
Comments 8 pages, 5 figures
机构 * School of Computer Science(计算机学院) ; Key Laboratory of Shanghai Education Commission for Intelligent Interaction and Cognitive Engineering(智能交互与认知工程重点实验室) ; Shanghai Jiao Tong University(上海交通大学) ; Shanghai Key Laboratory of Trusted Data Circulation and Governance in Web3(Web3可信数据流通与治理上海市重点实验室) ; GenAI, Meta(Meta GenAI)
专题命中 GUI与屏幕智能体 :multimodal large language model(abstract);MLLM(abstract)
Comments ACL 2025
专题命中 VLM训练与架构 :VLM(title);vision-language model(abstract);分类 cs.CV
机构 * Beihang University(北航大学) ; National University of Singapore(国立新加坡大学) ; King Abdullah University of Science and Technology(国王 Abdullah 科学与技术大学)
专题命中 VLM训练与架构 :visual question answering(abstract);multimodal large language model(abstract);分类 cs.CV
Comments Accepted by ICCV 2025
机构 * University of Science and Technology of China(中国科学技术大学) ; Peking University(北京大学) ; Kuaishou Technology(快手科技)
专题命中 VLM训练与架构 :multimodal large language model(abstract);分类 cs.CV
机构 * Graduate School of Information Science(信息科学研究生学校) ; Technology, Hokkaido University, Sapporo 060-0814, Japan(技术,北海道大学,札幌060-0814,日本) ; Office of Institutional Research, Hokkaido University, Sapporo 060-0808, Japan(机构研究办公室,北海道大学,札幌060-0808,日本) ; Faculty of Information Science(信息科学学院)
专题命中 其他VLM :multimodal large language model(title,abstract);分类 cs.LG
Comments 11 pages, 4 figures
专题命中 其他VLM :multimodal large language model(abstract);分类 cs.CV、cs.AI
Comments 34 pages, 7 figures