Fighting Fire with Fire (F3): A Training-free and Efficient Visual Adversarial Example Purification Method in LVLMs
Yudong Zhang, Ruobing Xie, Yiqing Huang, Jiansheng Chen, Xingwu Sun, Zhanhui Kang, Di Wang, Yu Wang
机构
*
Tsinghua University, Tencent(清华大学,腾讯)
;
Tencent(腾讯)
;
University of Science and Technology Beijing(北京科技大学)
;
Tencent, University of Macau(腾讯,澳门大学)
;
Tsinghua University(清华大学)
SynthVLM: Towards High-Quality and Efficient Synthesis of Image-Caption Datasets for Vision-Language Models
Zheng Liu, Hao Liang, Bozhou Li, Wentao Xiong, Chong Chen, Conghui He, Wentao Zhang, Bin Cui
机构
*
Peking University Beijing China
;
Huawei Technologies Ltd. Beijing China
;
Shanghai AI Laboratory Shanghai China
;
Peking University Center for Machine Learning Research Beijing China
;
Peking University School of Computer Science \& Key Lab of High Confidence Software Technologies (MOE) Beijing China
;
Peking University
;
Huawei Technologies Ltd.
;
Shanghai AI Laboratory
MR-CLIP: Efficient Metadata-Guided Learning of MRI Contrast Representations
Mehmet Yigit Avci, Pedro Borges, Paul Wright, Mehmet Yigitsoy, Sebastien Ourselin, Jorge Cardoso
机构
*
School of Biomedical Engineering and Imaging Sciences, King’s College London, London, UK(生物医学工程与成像科学学院,伦敦国王学院,伦敦,英国)
;
deepc GMBH, Munich, Germany(deepc 德国慕尼黑分公司)
A Survey on Vision-Language-Action Models for Autonomous Driving
Sicong Jiang, Zilin Huang, Kangan Qian, Ziang Luo, Tianze Zhu, Yang Zhong, Yihong Tang, Menglin Kong, Yunlong Wang, Siwen Jiao, Hao Ye, Zihao Sheng, Xin Zhao, Tuopu Wen, Zheng Fu, Sikai Chen, Kun Jiang, Diange Yang, Seongjin Choi, Lijun Sun
机构
*
McGill University(麦吉尔大学)
;
Tsinghua University(清华大学)
;
Xiaomi Corporation(小米公司)
;
University of Wisconsin–Madison(威斯康星大学麦迪逊分校)
;
University of Minnesota–Twin Cities(明尼苏达大学双城分校)
;
State Key Laboratory of Intelligent Green Vehicle and Mobility, Tsinghua University(智能绿色车辆与移动国家重点实验室,清华大学)
Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation
Shansong Wang, Zhecheng Jin, Mingzhe Hu, Mojtaba Safari, Feng Zhao, Chih-Wei Chang, Richard LJ Qiu, Justin Roper, David S. Yu, Xiaofeng Yang
机构
*
Department of Radiation Oncology, Winship Cancer Institute, Emory University School of Medicine(放射肿瘤科,Winship癌症研究所,埃默里大学医学院)
;
Department of Biomedical Engineering, College of Engineering, Georgia Institute of Technology(生物医学工程系,工程学院,佐治亚理工学院)
;
Department of Computer Science and Mathematics, Laney Graduate School, Emory University(计算机科学与数学系,兰尼研究生院,埃默里大学)
;
School of Electrical and Computer Engineering, College of Engineering, Georgia Institute of Technology(电气与计算机工程系,工程学院,佐治亚理工学院)
SensorLM: Learning the Language of Wearable Sensors
Yuwei Zhang, Kumar Ayush, Siyuan Qiao, A. Ali Heydari, Girish Narayanswamy, Maxwell A. Xu, Ahmed A. Metwally, Shawn Xu, Jake Garrison, Xuhai Xu, Tim Althoff, Yun Liu, Pushmeet Kohli, Jiening Zhan, Mark Malhotra, Shwetak Patel, Cecilia Mascolo, Xin Liu, Daniel McDuff, Yuzhe Yang
机构
*
Google DeepMind(谷歌DeepMind)
;
Google Research(谷歌研究)
;
University of Cambridge(剑桥大学)