机构
*
NLPR & MAIS, Institute of Automation, Chinese Academy of Sciences(人工智能研究院 & 模式识别与人工智能研究所,中国科学院自动化研究所)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(人工智能学院,中国科学院大学)
;
Meituan(美团)
LLaVA-UHD v3: Progressive Visual Compression for Efficient Native-Resolution Encoding in MLLMs
LLaVA-UHD v3:渐进式视觉压缩用于多模态大语言模型中的高效原分辨率编码
Shichu Sun, Yichen Zhang, Haolin Song, Zonghao Guo, Chi Chen, Yidan Zhang, Yuan Yao, Zhiyuan Liu, Maosong Sun
机构
*
Tsinghua University(清华大学)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院航天信息研究所)
;
School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences(中国科学院大学先进交叉学科学院)
机构
*
School of Computer Science and Technology, Huazhong University of Science and Technology(华中科技大学计算机科学与技术学院)
;
Xiaohongshu Inc.(小红书公司)
;
Shanghai Jiao Tong University(上海交通大学)
Zooming into Comics: Region-Aware RL Improves Fine-Grained Comic Understanding in Vision-Language Models
Yule Chen, Yufan Ren, Sabine Süsstrunk
机构
*
School of Computer and Communication Sciences, EPFL(瑞士联邦理工学院计算机与通信科学学院)
;
Department of Computer Science and Engineering, Chalmers University of Technology(楚科奇技术大学计算机科学与工程系)
;
IVRL, EPFL(EPFL智能机器人实验室)
Comments39th Conference on Neural Information Processing Systems (NeurIPS 2025) Workshop: The First Workshop on Generative and Protective AI for Content Creation
Approximate Domain Unlearning for Vision-Language Models
Kodai Kawamura, Yuta Goto, Rintaro Yanagi, Hirokatsu Kataoka, Go Irie
机构
*
Tokyo University of Science(东京科学大学)
;
National University of Singapore(新加坡国立大学)
;
National Institute of Advanced Industrial Science and Technology (AIST)(国家先进工业科学与技术研究院)
;
University of Oxford(牛津大学)
机构
*
Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
Nanjing University of Aeronautics and Astronautics(南京航空航天大学)
;
Northwest A&F University(西北农林科技大学)
;
Nanyang Technological University(南洋理工大学)
;
Jinan University(济南大学)
专题命中
VLM训练与架构
:VLM(title,abstract);visual language model(abstract);分类 cs.CV、cs.AI
机构
*
Harvard University(哈佛大学)
;
City University of Hong Kong(香港城市大学)
;
Amazon(亚马逊)
;
Fudan University(复旦大学)
;
MoE Key Lab of Artificial Intelligence, AI Institute, Shanghai Jiao Tong University(人工智能关键实验室,上海交通大学)