Vision-Language Introspection: Mitigating Overconfident Hallucinations in MLLMs via Interpretable Bi-Causal Steering
视觉-语言反思:通过可解释的双因果引导减轻大语言模型中的过度自信幻觉
Shuliang Liu, Songbo Yang, Dong Fang, Sihang Jia, Yuqi Tang, Lingfeng Su, Ruoshui Peng, Yibo Yan, Xin Zou, Xuming Hu
机构
*
The Hong Kong University of Science and Technology (Guangzhou)(香港理工大学(广州))
;
The Hong Kong University of Science and Technology(香港理工大学)
;
LIGHTSPEED
专题命中
幻觉与鲁棒性
:multimodal large language model(abstract);分类 cs.CV、cs.AI
The Forgotten Shield: Safety Grafting in Parameter-Space for Medical MLLMs
被遗忘的盾牌:参数空间中的医疗大语言模型安全性移植
Jiale Zhao, Xing Mou, Jinlin Wu, Hongyuan Yu, Mingrui Sun, Yang Shi, Xuanwu Yin, Zhen Chen, Zhen Lei, Yaohua Wang
机构
*
National University of Defense Technology(国防科技大学)
;
Multimodal Artificial Intelligence Systems (MAIS), Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所多模态人工智能系统(MAIS))
;
Multimedia Department, Xiaomi Inc(小米公司多媒体部门)
;
Centre for Artificial Intelligence and Robotics, Hong Kong Institute of Science and Innovation, Chinese Academy of Sciences, Hong Kong(香港科学院人工智能与机器人中心)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences, UCAS(中国科学院大学人工智能学院)
专题命中
幻觉与鲁棒性
:multimodal large language model(abstract);分类 cs.AI、cs.LG