机构
*
Research Center for Space Computing System, Zhejiang Lab, Hangzhou(杭州浙大实验室空间计算系统研究中心)
;
Hangzhou Institute for Advanced Study, University of Chinese Academy of Sciences, Hangzhou(中国科学院大学杭州高等研究院)
;
School of Cyber Science and Engineering, Zhengzhou University(郑州大学计算机科学与工程学院)
;
School of Computer Science and Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院)
CogniVerse: Revolutionizing Multi-Modal Retrieval-Augmented Generation with Cognitive Reflection and Geometric Reasoning
CogniVerse: 用认知反思与几何推理革新多模态检索增强生成
Xiang Fang, Wanlong Fang, Changshuo Wang
机构
*
School of Software Engineering, Huazhong University of Science and Technology(华中科技大学软件学院)
;
Nanyang Technological University, Singapore(新加坡南洋理工大学)
;
University College London(伦敦大学学院)
Training-Free Multimodal Large Language Model Orchestration
免训练的多模态大语言模型编排
Tianyu Xie, Yuexiao Ma, Yuhang Wu, Wang Chen, Jiayi Ji, Tat-Seng Chua, Xiawu Zheng, Rongrong Ji
机构
*
Media Analytics and Computing Lab, Xiamen University, Xiamen, China(厦门大学媒体分析与计算实验室)
;
Institute of Artificial Intelligence, Xiamen University, Xiamen, China(厦门大学人工智能研究院)
;
School of Informatics, Xiamen University, Xiamen, China(厦门大学信息学院)
;
Peng Cheng Laboratory, Shenzhen, China(鹏城实验室)
;
Department of Computer Science, National University of Singapore, Singapore(新加坡国立大学计算机科学系)
机构
*
University of Amsterdam(阿姆斯特丹大学)
;
University of Bristol(布里斯托大学)
;
Amazon AGI(亚马逊人工智慧)
;
College of Business and Economics(商学院和经济学学院)
;
University of Johannesburg(约翰内斯堡大学)
Compressing then Matching: An Efficient Pre-training Paradigm for Multimodal Embedding
压缩后再匹配:一种高效的多模态嵌入预训练范式
Da Li, Yuxiao Luo, Keping Bi, Jiafeng Guo, Wei Yuan, Biao Yang, Yan Wang, Fan Yang, Tingting Gao, Guorui Zhou
机构
*
State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(人工智能安全国家重点实验室,计算技术研究所,中国科学院)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Kuaishou Technology(快手科技)
Joona Kareinen, Veikka Immonen, Tuomas Eerola, Lumi Haraguchi, Lasse Lensu, Kaisa Kraft, Sanna Suikkanen, Heikki Kälviäinen
机构
*
Lappeenranta-Lahti University of Technology LUT(拉佩宁拉-拉赫蒂技术大学)
;
Finnish Environment Institute(芬兰环境研究所)
;
Faculty of Information Technology(信息科技学院)
;
Brno University of Technology(布拉格技术大学)
机构
*
Shanghai Jiao Tong University(上海交通大学)
;
Institute of Digital Twin, Eastern Institute of Technology(数字孪生研究院,东部技术研究所)
;
Ningbo Key Laboratory of Spatial Intelligence and Digital Derivative(宁波空间智能与数字衍生关键实验室)
Unleashing MLLMs on the Edge: A Unified Framework for Cross-Modal ReID via Adaptive SVD Distillation
在边缘侧释放MLLMs:通过自适应SVD蒸馏实现跨模态重识别的统一框架
Hongbo Jiang, Jie Li, Xinqi Cai, Tianyu Xie, Yunhang Shen, Pingyang Dai, Liujuan Cao
机构
*
Tencent Youtu Lab, Shanghai, China(腾讯优图实验室,上海,中国)
;
Xiamen University, Media Analytics(厦门大学,媒体分析)
;
Computing Lab, Department of Artificial Intelligence, School of Informatics, Xiamen, China(计算实验室,人工智能系,信息学院,厦门,中国)
机构
*
Nanyang Technological University(南洋理工大学)
;
Yale University(耶鲁大学)
;
NYU Shanghai(纽约大学上海分校)
;
Alibaba-NTU Singapore Joint Research Institute(阿里-国立新加坡大学联合研究机构)
;
University of the Chinese Academy of Sciences(中国科学院大学)
;
Center for Data Science(数据科学中心)
;
New York University(纽约大学)