Model Specific Task Similarity for Vision Language Model Selection via Layer Conductance
为视觉语言模型选择而基于模型特定任务相似性的层导电性
Wei Yang, Hong Xie, Tao Tan, Xin Li, Defu Lian, Enhong Chen
机构
*
School of Computer Science and Technology, University of Science and Technology of China(计算机科学与技术学院,科学技术大学)
;
School of AI and Data Science, University of Science and Technology of China(人工智能与数据科学学院,科学技术大学)
专题命中
VLM训练与架构
:vision language model(title);vision-language model(abstract);分类 cs.AI
Visual Affect Analysis: Predicting Emotions of Image Viewers with Vision-Language Models
视觉情感分析:利用视觉-语言模型预测图像观看者的感受
Filip Nowicki, Hubert Marciniak, Jakub Łączkowski, Krzysztof Jassem, Tomasz Górecki, Vimala Balakrishnan, Desmond C. Ong, Maciej Behnke
机构
*
Faculty of Mathematics and Computer Science, Adam Mickiewicz University(数学与计算机科学学院,亚当·密茨凯维奇大学)
;
Faculty of Computer Science and Information Technology, Universiti Malaya(计算机科学与信息技术学院,马来亚大学)
;
Department of Computer Science and Engineering, Korea University(计算机科学与工程系,韩国大学)
;
Department of Psychology, University of Texas at Austin(心理学系,德克萨斯大学奥斯汀分校)
;
Cognitive Neuroscience Center, Adam Mickiewicz University(认知神经科学中心,亚当·密茨凯维奇大学)
Measuring and Aligning Abstraction in Vision-Language Models with Medical Taxonomies
利用医学分类法测量和对齐视觉-语言模型中的抽象能力
Ben Schaper, Maxime Di Folco, Bernhard Kainz, Julia A. Schnabel, Cosmin I. Bercea
机构
*
1 School of Computation, Information
;
Technology, Technical University of Munich, Germany 2 Institute of Machine Learning in Biomedical Imaging, Helmholtz Munich, Germany 3 LTCI, Télécom Paris, Institut Polytechnique de Paris, France 4 Munich Center for Machine Learning (MCML) 5 School of Biomedical Engineering
;
Imaging Sciences, King's College London, UK 6 Department of Artificial Intelligence in Biomedical Imaging, FAU Erlangen-Nuremberg, Germany 7 Department of Computing, Imperial College London, UK
机构
*
Fudan University(复旦大学)
;
Shanghai Innovation Institut(上海创新研究院)
;
University of Southern California(南加州大学)
;
Huawei Technologies Co., Ltd(华为技术有限公司)
;
Ningbo Key Laboratory of Spatial Intelligence and Digital Derivative, Institute of Digital Twin, EIT(宁波空间智能与数字衍生关键实验室,数字孪生研究院,EIT)
专题命中
VLM训练与架构
:vision language model(title);vision-language model(abstract);分类 cs.CV
Venus: An Efficient Edge Memory-and-Retrieval System for VLM-based Online Video Understanding
Venus: 一种高效的边缘内存与检索系统用于基于VLM的在线视频理解
Shengyuan Ye, Bei Ouyang, Tianyi Qian, Liekang Zeng, Mu Yuan, Xiaowen Chu, Weijie Hong, Xu Chen
机构
*
School of Computer Science and Engineering, Sun Yat-sen University, Guangzhou, China(计算机科学与工程学院,中山大学,广州,中国)
;
Department of Information Engineering, The Chinese University of Hong Kong, Hong Kong SAR, China(信息工程系,香港中文大学,香港特别行政区,中国)
;
Shenzhen Smart City Communications Co., Ltd., China(深圳智慧城市通信有限公司,中国)
Towards Comprehensive Interactive Change Understanding in Remote Sensing: A Large-scale Dataset and Dual-granularity Enhanced VLM
迈向遥感中全面交互变化理解:一个大规模数据集和双粒度增强VLM
Junxiao Xue, Quan Deng, Xuecheng Wu, Kelu Yao, Xinyi Yin, Fei Yu, Wei Zhou, Yanfei Zhong, Yang Liu, Dingkang Yang
机构
*
Research Center for Space Computing System, Zhejiang Lab(浙江省实验室空间计算系统研究中心)
;
Hangzhou Institute for Advanced Study, University of Chinese Academy of Sciences(中国科学院大学杭州高等研究院)
;
School of Computer Science and Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院)
;
School of Cyber Science and Engineering, Zhengzhou University(郑州大学网络科学与工程学院)
;
Liaoning University of Technology(辽宁科技学院)
;
School of Computer Science and Informatics, Cardiff University(卡迪夫大学计算机科学与信息学院)
;
State Key Laboratory of Information Engineering in Surveying, Mapping and Remote Sensing (LIESMARS), Wuhan University(武汉测绘遥感与信息工程国家重点实验室(LIESMARS))
;
College of Electronic and Information Engineering, Tongji University(同济大学电子与信息工程学院)
;
College of Intelligent Robotics and Advanced Manufacturing, Fudan University(复旦大学智能机器人与先进制造学院)