Vision-Language Introspection: Mitigating Overconfident Hallucinations in MLLMs via Interpretable Bi-Causal Steering
视觉-语言反思:通过可解释的双因果引导减轻大语言模型中的过度自信幻觉
Shuliang Liu, Songbo Yang, Dong Fang, Sihang Jia, Yuqi Tang, Lingfeng Su, Ruoshui Peng, Yibo Yan, Xin Zou, Xuming Hu
机构
*
The Hong Kong University of Science and Technology (Guangzhou)(香港理工大学(广州))
;
The Hong Kong University of Science and Technology(香港理工大学)
;
LIGHTSPEED
专题命中
幻觉与鲁棒性
:multimodal large language model(abstract);分类 cs.CV、cs.AI
The Forgotten Shield: Safety Grafting in Parameter-Space for Medical MLLMs
被遗忘的盾牌:参数空间中的医疗大语言模型安全性移植
Jiale Zhao, Xing Mou, Jinlin Wu, Hongyuan Yu, Mingrui Sun, Yang Shi, Xuanwu Yin, Zhen Chen, Zhen Lei, Yaohua Wang
机构
*
National University of Defense Technology(国防科技大学)
;
Multimodal Artificial Intelligence Systems (MAIS), Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所多模态人工智能系统(MAIS))
;
Multimedia Department, Xiaomi Inc(小米公司多媒体部门)
;
Centre for Artificial Intelligence and Robotics, Hong Kong Institute of Science and Innovation, Chinese Academy of Sciences, Hong Kong(香港科学院人工智能与机器人中心)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences, UCAS(中国科学院大学人工智能学院)
专题命中
幻觉与鲁棒性
:multimodal large language model(abstract);分类 cs.AI、cs.LG
Scanner-Induced Domain Shifts Undermine the Robustness of Pathology Foundation Models
扫描诱导的域偏移损害病理基础模型的鲁棒性
Erik Thiringer, Fredrik K. Gustafsson, Kajsa Ledesma Eriksson, Mattias Rantalainen
机构
*
Department of Medical Epidemiology and Biostatistics, Karolinska Institutet(卡罗林斯卡研究所医学流行病学与生物统计学系)
;
Department of Engineering Science, University of Oxford(牛津大学工程科学系)
Benchmark Success, Clinical Failure: When Reinforcement Learning Optimizes for Benchmarks, Not Patients
基准成功,临床失败:当强化学习优化于基准,而非患者
Armin Berger, Manuela Bergau, Helen Schneider, Saad Ahmad, Tom Anglim Lagones, Gianluca Brugnara, Martha Foltyn-Dumitru, Kai Schlamp, Philipp Vollmuth, Rafet Sifa
机构
*
Fraunhofer IAIS(弗劳恩霍夫人工智能研究所)
;
University of Bonn(波恩大学)
;
Lamarr Institute(拉马尔研究所)
;
Department of Health Queensland(昆士兰健康部)
;
Griffith University(格里菲斯大学)
;
University Hospital Bonn(波恩大学医院)
MM-SpuBench: Towards Better Understanding of Spurious Biases in Multimodal LLMs
MM-SpuBench:迈向更好地理解多模态大语言模型中伪偏差的深入研究
Wenqian Ye, Bohan Liu, Guangtao Zheng, Di Wang, Yunsheng Ma, Xu Cao, Bolin Lai, James M. Rehg, Aidong Zhang
机构
*
University of Virginia(弗吉尼亚大学)
;
Purdue University(普渡大学)
;
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
Georgia Institute of Technology(佐治亚理工学院)
专题命中
幻觉与鲁棒性
:multimodal large language model(abstract);分类 cs.CV、cs.LG
RoboSafe: Safeguarding Embodied Agents via Executable Safety Logic
RoboSafe: 通过可执行的安全逻辑保障具身智能体
Le Wang, Zonghao Ying, Xiao Yang, Quanchen Zou, Zhenfei Yin, Tianlin Li, Jian Yang, Yaodong Yang, Aishan Liu, Xianglong Liu
机构
*
Beihang University(北航大学)
;
AI Security Lab(360AI安全实验室)
;
The University of Sydney(悉尼大学)
;
Nanyang Technological University(南洋理工大学)
;
Peking University(北京大学)
;
Beijing Academy of Artificial Intelligence(北京人工智能研究院)
MIMIR: Masked Image Modeling for Mutual Information-based Adversarial Robustness
MIMIR:基于互信息的对抗鲁棒性图像建模
Xiaoyun Xu, Shujian Yu, Zhuoran Liu, Stjepan Picek
机构
*
Radboud University Nijmegen(拉德博德大学尼姆维根分校)
;
Vrije Universiteit Amsterdam(自由大学阿姆斯特丹)
;
University of Zagreb Faculty of Electrical Engineering and Computing(Zagreb大学电子工程与计算学院)
SAVE: Sparse Autoencoder-Driven Visual Information Enhancement for Mitigating Object Hallucination
SAVE:基于稀疏自编码器的视觉信息增强用于缓解物体幻觉
Sangha Park, Seungryong Yoo, Jisoo Mok, Sungroh Yoon
机构
*
Department of Electrical and Computer Engineering, Seoul National University(电子与计算机工程系,首尔国立大学)
;
Daegu Gyeongbuk Institute of Science and Technology(大邱庆州科学技术院)
;
IPAI, AIIS, ASRI, INMC, and ISRC, Seoul National University(IPAI、AIIS、ASRI、INMC 和 ISRC,首尔国立大学)
专题命中
幻觉与鲁棒性
:multimodal large language model(abstract);分类 cs.CV、cs.AI
Reading Smiles: Proxy Bias in Foundation Models for Facial Emotion Recognition
读微笑:面部情绪识别基础模型中的代理偏差
Iosif Tsangko, Andreas Triantafyllopoulos, Adem Abdelmoula, Adria Mallol-Ragolta, Bjoern W. Schuller
机构
*
CHI – Chair of Health Informatics, MRI, Technical University of Munich(慕尼黑技术大学健康信息学系)
;
MCML – Munich Center for Machine Learning(慕尼黑机器学习中心)
;
GLAM – Group on Language, Audio, & Music(语言、音频与音乐小组)
;
MDSI – Munich Data Science Institute(慕尼黑数据科学研究所)
专题命中
幻觉与鲁棒性
:vision language model(abstract);分类 cs.CV、cs.AI
GUARD: Role-playing to Generate Natural-language Jailbreakings to Test Guideline Adherence of Large Language Models
Haibo Jin, Ruoxi Chen, Peiyan Zhang, Andy Zhou, Haohan Wang
机构
*
School of Information Sciences University of Illinois at Urbana-Champaign(信息科学学院伊利诺伊大学厄巴纳-香槟分校)
;
Independent Researcher, Starc Institute(Starc研究所独立研究者)
;
Computer Science and Engineering HKUST(HKUST计算机科学与工程学院)
;
Computer Science Lapis Labs University of Illinois Urbana-Champaign(计算机科学Lapis Labs伊利诺伊大学厄巴纳-香槟分校)
;
School of Information Sciences University of Illinois Urbana-Champaign(信息科学学院伊利诺伊大学厄巴纳-香槟分校)
专题命中
幻觉与鲁棒性
:vision language model(abstract);分类 cs.CV、cs.LG