2601.19798
2026-01-28
cs.CV
70%
Youtu-VL: Unleashing Visual Potential via Unified Vision-Language Supervision
Youtu-VL: 通过统一的视觉-语言监督释放视觉潜力
Zhixiang Wei, Yi Li, Zhehan Kan, Xinghua Jiang, Zuwei Long, Shifeng Liu, Hongze Shen, Wei Liu, Xiaoyu Tan, Haojia Lin, Yubo Zhu, Qianyu Li, Di Yin, Haoyu Cao, Weibo Gu, Xin Li, Yinsong Liu, Deqiang Jiang, Xing Sun, Yunsheng Wu, Mingkong Tang, Shuangyin Liu, Lexiang Tang, Haodong Lin, Junru Lu, Jiarui Qin, Lingfeng Qiao, Ruizhi Qiao, Bo Ke, Jianfeng He, Ke Li, Yangning Li, Yunhang Shen, Mengdan Zhang, Peixian Chen, Kun Yin, Bing Liu, Yunfei Wu, Huang Chen, Zhongpeng Cai, Xiaotian Li
机构
*
Youtu-VL Team(Youtu-VL 团队)
专题命中
幻觉与鲁棒性
:vision-language model(abstract);VLM(abstract);分类 cs.CV
AI总结
Youtu-VL通过统一视觉-语言自回归监督范式,提升多模态理解能力,实现视觉与语言的协同优化。