Scale, Don't Fine-tune: Guiding Multimodal LLMs for Efficient Visual Place Recognition at Test-Time
Jintao Cheng, Weibin Li, Jiehao Luo, Xiaoyu Tang, Zhijian He, Jin Wu, Yao Zou, Wei Zhang
机构
*
Hong Kong University of Science(香港科学与技术大学)
;
South China Normal University, Shanwei, Guangdong, China(华南师范大学,汕尾,广东,中国)
;
Shenzhen Technology University, Shenzhen, Guangdong, China(深圳科技大学,深圳,广东,中国)
;
University of Science(科学大学)
专题命中
效率与部署
:large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.LG
KG-RAG: Enhancing GUI Agent Decision-Making via Knowledge Graph-Driven Retrieval-Augmented Generation
Ziyi Guan, Jason Chun Lok Li, Zhijian Hou, Pingping Zhang, Donglai Xu, Yuzhi Zhao, Mengyang Wu, Jinpeng Chen, Thanh-Toan Nguyen, Pengfei Xian, Wenao Ma, Shengchao Qin, Graziano Chesi, Ngai Wong
机构
*
Huawei Hong Kong Research Center(华为香港研究部)
;
The University of Hong Kong(香港大学)
;
City University of Hong Kong(城市大学)
;
Guangzhou Institute of Technology, Xidian University(广州技术学院,西安电子科技大学)
;
ICTT and ISN Laboratory, Xidian University(ICTT和ISN实验室,西安电子科技大学)
专题命中
效率与部署
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL
机构
*
University of Toronto(多伦多大学)
;
University of Waterloo(滑铁卢大学)
;
Amazon Web Services(亚马逊网络服务)
;
Carnegie Mellon University(卡内基梅隆大学)
;
Independent Researcher(独立研究者)
;
Vector Institute(向量研究所)
;
NVIDIA(英伟达)
专题命中
效率与部署
:large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
UniBERT: Adversarial Training for Language-Universal Representations
Andrei-Marius Avram, Marian Lupaşcu, Dumitru-Clementin Cercel, Ionuţ Mironică, Ştefan Trăuşan-Matu
机构
*
National University of Science and Technology POLITEHNICA Bucharest(波兰技术大学科学与技术国立大学)
;
University of Bucharest(布加勒斯特大学)
;
Adobe Research(Adobe研究)
;
Academy of Romanian Scientists (AOSR)(罗马尼亚科学院)
From TLinFormer to TConstFormer: The Leap to Constant-Time Transformer Attention: Achieving O(1) Computation and O(1) KV Cache during Autoregressive Inference
OpenGuide: Assistive Object Retrieval in Indoor Spaces for Individuals with Visual Impairments
Yifan Xu, Qianwei Wang, Vineet Kamat, Carol Menassa
机构
*
Department of Civil and Environmental Engineering, University of Michigan(密歇根大学土木与环境工程系)
;
College of Literature, Science, and the Arts, University of Michigan(密歇根大学文学、科学与艺术学院)