Guardrail-Agnostic Societal Bias Evaluation in Large Vision-Language Models
强安全护栏下大型视觉语言模型的护栏无关社会偏见评估
机构 * NVIDIA(英伟达)
AI总结 本研究针对强护栏LVLMs的偏见评估难题,提出解耦人物属性推断的评估方法,发现20款LVLMs均存在不当使用用户人口统计信息的偏见,且专有模型偏见低于开源模型。
Comments Accepted at ECCV 2026
大厂专区
强安全护栏下大型视觉语言模型的护栏无关社会偏见评估
机构 * NVIDIA(英伟达)
AI总结 本研究针对强护栏LVLMs的偏见评估难题,提出解耦人物属性推断的评估方法,发现20款LVLMs均存在不当使用用户人口统计信息的偏见,且专有模型偏见低于开源模型。
Comments Accepted at ECCV 2026
思考、观察与修正:多模态大语言模型中基于不一致感知的视觉自我修正
机构 * University of Edinburgh(爱丁堡大学) ; NVIDIA Research(英伟达研究院)
AI总结 本研究针对工具增强型多模态推理中工具输出缺乏验证的问题,提出ReVISE框架,通过带监督反思的训练数据集与强化学习目标奖励,实现错误检测与修正,在多个基准上取得性能提升。
Comments accepted by EMNLP2026
稀疏Koopman自编码器识别多盆系统中的局部动力学 regime
机构 * Chandar Research Lab(钱达尔研究实验室) ; Mila – Quebec AI Institute(米拉-魁北克人工智能研究所) ; Université de Montréal(蒙特利尔大学) ; University of Pennsylvania(宾夕法尼亚大学) ; NVIDIA(英伟达) ; Polytechnique Montréal(蒙特利尔理工学院)
AI总结 该研究提出稀疏Koopman自编码器(SKAEs),无需标签即可识别多盆系统的局部动力学 regime,其预测性能优于密隐KAEs,且隐支撑可有效识别吸引盆。