机构
*
Zachry Department of Civil
;
Environmental Engineering, Texas A\&M University
;
Department of Computer Science
;
Engineering, Texas A\&M University
GIFT: Global Irreplaceability Frame Targeting for Efficient Video Understanding
GIFT:全局不可替代性帧目标用于高效视频理解
Junpeng Ma, Sashuai Zhou, Guanghao Li, Xin Gao, Yue Cao, Hengyu Zeng, Yuxiang Yan, Zhibin Wang, Jun Song, Bo Zheng, Shanghang Zhang, Jian Pu
机构
*
Institute of Science and Technology for Brain-inspired Intelligence, Fudan University(复旦大学类脑智能科学与技术研究院)
;
State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(北京大学计算机学院多媒体信息处理国家重点实验室)
;
Zhejiang University(浙江大学)
;
Alibaba Group Holding Limited(阿里巴巴集团控股有限公司)
;
Future Living Lab of Alibaba(阿里巴巴未来生活实验室)
Cross-Modal Prototype Alignment and Mixing for Training-Free Few-Shot Classification
跨模态原型对齐与混合用于无训练少样本分类
Dipam Goswami, Simone Magistri, Gido M. van de Ven, Bartłomiej Twardowski, Andrew D. Bagdanov, Tinne Tuytelaars, Joost van de Weijer
机构
*
Department of Computer Science, Universitat Autònoma de Barcelona, Spain(巴塞罗那自治大学计算机科学系)
;
Computer Vision Center, Barcelona, Spain(巴塞罗那计算机视觉中心)
;
Media Integration and Communication Center, University of Florence, Italy(佛罗伦萨大学媒体整合与传播中心)
;
Bernoulli Institute, University of Groningen, the Netherlands(格罗宁根大学伯努利学院)
;
IDEAS Research Institute, Poland(波兰IDEAS研究所)
;
ESAT-PSI, KU Leuven, Belgium(比利时KU莱顿大学ESAT-PSI)
Parameter-efficient Prompt Tuning and Hierarchical Textual Guidance for Few-shot Whole Slide Image Classification
高效参数提示调优与层次文本引导在少样本整张滑片图像分类中的应用
Jayanie Bogahawatte, Sachith Seneviratne, Saman Halgamuge
机构
*
AI, Optimization and Pattern Recognition Research Group(人工智能、优化与模式识别研究组)
;
Dept. of Mechanical Eng., University of Melbourne, Australia(墨尔本大学机械工程系,澳大利亚)
Multimodal Continual Instruction Tuning with Dynamic Gradient Guidance
多模态持续指令微调与动态梯度指导
Songze Li, Mingyu Gao, Tonghua Su, Xu-Yao Zhang, Zhongjie Wang
机构
*
Harbin Institute of Technology(哈尔滨工业大学)
;
Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东人工智能与数字经济发展实验室)
;
Chongqing Research Institute of HIT(重庆哈工大研究院)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
专题命中
VLM训练与架构
:multimodal large language model(abstract);分类 cs.CV
机构
*
Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Department of Computer Science, Hong Kong Baptist University(香港 Baptist 大学计算机科学系)
;
College of Computing and Data Science, NTU(NTU 计算与数据科学学院)
;
Huawei(华为)
;
School of Flexible Electronics, SYSU(SYSU 灵活电子学院)
;
School of Cyber Science and Technology, Shenzhen Campus of Sun Yat-sen University(Sun Yat-sen 大学深圳校区计算机科学与技术学院)
专题命中
VLM训练与架构
:multimodal large language model(abstract);分类 cs.CV