CapRL: Stimulating Dense Image Caption Capabilities via Reinforcement Learning
机构 * University of Science and Technology of China(中国科学技术大学) ; Shanghai AI Laboratory(上海人工智能实验室) ; The Chinese University of Hong Kong(香港中文大学) ; Shanghai Innovation Institute(上海创新研究院) ; Alibaba Cloud(阿里巴巴云)
专题命中 VLM训练与架构 :vision-language model(abstract);visual language model(abstract);分类 cs.CV、cs.AI
Comments Code is available at https://github.com/InternLM/CapRL