arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

2026-04-13 至 2026-04-13 共收录 2
2604.09425 2026-04-13 cs.CV

Do Vision Language Models Need to Process Image Tokens?

视觉语言模型是否需要处理图像标记?

Sambit Ghosh, R. Venkatesh Babu, Chirag Agarwal

机构 * IBM Indian Institute of Science(印度科学研究所) University of Virginia(弗吉尼亚大学)

AI总结 本文研究了视觉语言模型中图像标记的功能,发现视觉表示快速收敛至有限复杂度,而文本表示持续重构。视觉表示在不同层间可互换,任务依赖性影响视觉处理的必要性。

Comments Accepted (Oral) at TRUE-V Workshop CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08561 2026-04-13 cs.CL cs.LG

A Representation-Level Assessment of Bias Mitigation in Foundation Models

基础模型中偏见缓解的表示层面评估

Svetoslav Nizhnichenkov, Rahul Nair, Elizabeth Daly, Brian Mac Namee

机构 * IBM Research(IBM研究院) School of Computer Science, University College Dublin(都柏林大学计算机科学学院)

AI总结 本文通过对比基线与偏见缓解模型,分析了性别与职业术语在嵌入空间中的变化,发现偏见缓解减少了性别-职业差异,提出了WinoDec数据集用于评估解码器模型。

Comments Accepted at ECML-PKDD 2025 (5th Workshop on Bias and Fairness in AI)

详情

展开后加载摘要…

URL PDF HTML 收藏