arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

IEEE TPAMI

IEEE Transactions on Pattern Analysis and Machine Intelligence · 期刊 · Computer Vision

2026-04-07 至 2026-04-07 共收录 3
2406.14194 2026-04-07 cs.CV cs.AI

VLBiasBench: A Comprehensive Benchmark for Evaluating Bias in Large Vision-Language Model

VLBiasBench: 一个用于评估大视觉-语言模型偏见的综合性基准

Sibo Wang, Xiangkui Cao, Jie Zhang, Zheng Yuan, Shiguang Shan, Xilin Chen, Wen Gao

机构 * Key Laboratory of AI Safety of CAS, Institute of Computing Technology (ICT)(中国科学院人工智能安全重点实验室,计算技术研究所) University of Chinese Academy of Sciences (UCAS)(中国科学院大学) Peking University(北京大学)

AI总结 本文提出VLBiasBench,通过覆盖九种社会偏见类别和两个交叉偏见类别的大规模数据集,评估大视觉-语言模型的偏见问题,基于15种开源和两种闭源模型进行广泛评估,揭示模型中的偏见特征。

Comments Accepted By TPAMI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.05773 2026-04-07 cs.CV

Scalable and Generalizable Correspondence Pruning via Geometry-Consistent Pre-training

基于几何一致预训练的可扩展且可泛化的对应关系修剪

Tangfei Liao, Xiaoqin Zhang, Tao Wang, Hao Ye, Min Li, Guobao Xiao, Mang Ye

机构 * Wuhan University(武汉大学) Wenzhou University(温州大学) Nanjing University(南京大学) Xiaomi Corporation, Xiaomi Automobile Co., Ltd.(小米集团,小米汽车有限公司) Tongji University(同济大学)

AI总结 本文提出几何一致预训练方法,通过掩码内点重建任务和双流编码器提升对应关系的鲁棒性和泛化能力,在相机姿态估计、视觉定位和3D配准任务中取得显著性能提升。

Comments Accepted by TPAMI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.17491 2026-04-07 cs.CV cs.LG

Robust Adaptation of Foundation Models with Black-Box Visual Prompting

基于黑盒视觉提示的模型鲁棒适应

Changdae Oh, Gyeongdeok Seo, Geunyoung Jung, Zhi-Qi Cheng, Hosik Choi, Jiyoung Jung, Kyungwoo Song

机构 * University of Wisconsin-Madison(威斯康星大学麦迪逊分校) University of Seoul(首尔市立大学) Yonsei University(延世大学) University of Washington(华盛顿大学)

AI总结 本文提出BlackVIP方法,通过协调器和SPSA-GC组件实现无需模型参数的PTM适应,通过实验展示其在不同领域和任务中的鲁棒性,同时提供理论分析支持视觉提示方法的鲁棒性。

Comments Accepted to IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏