arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视觉大模型 / VLM

视觉语言模型、视觉推理、视觉问答、图文理解和视觉 grounding。

2026-01-28 至 2026-01-28 共收录 3 信号源:cs.CV, cs.AI, cs.LG

1. 幻觉与鲁棒性 3 篇

2601.19798 2026-01-28 cs.CV 70%

Youtu-VL: Unleashing Visual Potential via Unified Vision-Language Supervision

Youtu-VL: 通过统一的视觉-语言监督释放视觉潜力

Zhixiang Wei, Yi Li, Zhehan Kan, Xinghua Jiang, Zuwei Long, Shifeng Liu, Hongze Shen, Wei Liu, Xiaoyu Tan, Haojia Lin, Yubo Zhu, Qianyu Li, Di Yin, Haoyu Cao, Weibo Gu, Xin Li, Yinsong Liu, Deqiang Jiang, Xing Sun, Yunsheng Wu, Mingkong Tang, Shuangyin Liu, Lexiang Tang, Haodong Lin, Junru Lu, Jiarui Qin, Lingfeng Qiao, Ruizhi Qiao, Bo Ke, Jianfeng He, Ke Li, Yangning Li, Yunhang Shen, Mengdan Zhang, Peixian Chen, Kun Yin, Bing Liu, Yunfei Wu, Huang Chen, Zhongpeng Cai, Xiaotian Li

机构 * Youtu-VL Team(Youtu-VL 团队)

专题命中 幻觉与鲁棒性 :vision-language model(abstract);VLM(abstract);分类 cs.CV

AI总结 Youtu-VL通过统一视觉-语言自回归监督范式,提升多模态理解能力,实现视觉与语言的协同优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19507 2026-01-28 cs.CL 50%

Automated Safety Benchmarking: A Multi-agent Pipeline for LVLMs

自动化安全基准测试:一种用于大型视觉语言模型的多代理流程

Xiangyang Zhu, Yuan Tian, Zicheng Zhang, Qi Jia, Chunyi Li, Renrui Zhang, Heng Li, Zongrui Wang, Wei Sun

机构 * Shanghai AI Lab(上海人工智能实验室) PolyU HK(PolyU香港分校) East China Normal University(东华大学)

专题命中 幻觉与鲁棒性 :vision-language model(abstract)

AI总结 VLSafetyBencher通过多代理流程自动化构建高质量安全基准,有效区分不同模型的安全性,提升LVLMs的安全评估效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18901 2026-01-28 cs.CL 50%

Self-Aware Knowledge Probing: Evaluating Language Models' Relational Knowledge through Confidence Calibration

具有自意识的知识探测:通过置信度校准评估语言模型的关系知识

Christopher Kissling, Elena Merdjanovska, Alan Akbik

机构 * Humboldt-Universität zu Berlin(柏林洪堡大学)

专题命中 幻觉与鲁棒性 :grounding(abstract)

AI总结 本文提出了一种新的校准探测框架,用于评估语言模型在关系知识上的置信度,揭示了大多数模型在置信度校准上的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏