A Sensor Agnostic Domain Generalization Framework for Leveraging Geospatial Foundation Models: Enhancing Semantic Segmentation viaSynergistic Pseudo-Labeling and Generative Learning
Anan Yaghmour, Melba M. Crawford, Saurabh Prasad
机构
*
University of Houston(休斯敦大学)
;
Purdue University(普渡大学)
专题命中
领域大模型
:foundation model(title,abstract)
CommentsAccepted in the 2025 CVPR Workshop on Foundation and Large Vision Models in Remote Sensing, to appear in CVPR 2025 Workshop Proceedings
SilVar-Med: A Speech-Driven Visual Language Model for Explainable Abnormality Detection in Medical Imaging
Tan-Hanh Pham, Chris Ngo, Trong-Duong Bui, Minh Luu Quang, Tan-Huong Pham, Truong-Son Hy
机构
*
Florida Institute of Technology(佛罗里达理工学院)
;
Knovel Engineering Lab(诺维尔工程实验室)
;
Vietnam Military Medical University(越南军事医科大学)
;
Military Central Hospital(108陆军中央医院)
;
Can Tho University of Medicine and Pharmacy(芹苴医药大学)
;
University of Alabama at Birmingham(阿拉巴马大学伯明翰分校)
机构
*
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
Fourth Military Medical University(第四军医大学)
;
Tsinghua University(清华大学)
;
University of Science and Technology of China(中国科学技术大学)
;
SenseTime Research(商汤科技研究院)
;
Hong Kong University of Science and Technology(香港科技大学)
;
Peking University(北京大学)
;
Shengqiang Technology Co. Ltd.(胜强科技有限公司)
;
Institute of Materials Research, Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院材料研究院)
GMAI-VL & GMAI-VL-5.5M: A Large Vision-Language Model and A Comprehensive Multimodal Dataset Towards General Medical AI
Tianbin Li, Yanzhou Su, Wei Li, Bin Fu, Zhe Chen, Ziyan Huang, Guoan Wang, Chenglong Ma, Ying Chen, Ming Hu, Yanjun Li, Pengcheng Chen, Xiaowei Hu, Zhongying Deng, Yuanfeng Ji, Jin Ye, Yu Qiao, Junjun He
机构
*
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
Shanghai Jiao Tong University(上海交通大学)
;
Shenzhen Institute of Advanced Technology (SIAT), Chinese Academy of Sciences(中国科学院深圳先进技术研究院)
;
Nanjing University(南京大学)
;
East China Normal University(华东师范大学)
;
Fudan University(复旦大学)
;
Xiamen University(厦门大学)
;
Monash University(莫纳什大学)
;
University of Washington(华盛顿大学)
;
University of Cambridge(剑桥大学)
;
Stanford University(斯坦福大学)
Towards Training-free Anomaly Detection with Vision and Language Foundation Models
Jinjin Zhang, Guodong Wang, Yizhou Jin, Di Huang
机构
*
Beihang University(北京航空航天大学)
;
State Key Laboratory of Complex and Critical Software Environment, Beihang University(北京航空航天大学复杂与关键软件环境国家重点实验室)
;
School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院)
SmolDocling: An ultra-compact vision-language model for end-to-end multi-modal document conversion
Ahmed Nassar, Andres Marafioti, Matteo Omenetti, Maksym Lysak, Nikolaos Livathinos, Christoph Auer, Lucas Morin, Rafael Teixeira de Lima, Yusik Kim, A. Said Gurbuz, Michele Dolfi, Miquel Farré, Peter W. J. Staar
Integrating Frequency-Domain Representations with Low-Rank Adaptation in Vision-Language Models
Md Azim Khan, Aryya Gangopadhyay, Jianwu Wang, Robert F. Erbacher
机构
*
University of Maryland Baltimore County (UMBC)(马里兰大学巴尔的摩县分校)
;
Center for Real-time Distributed Sensing and Autonomy (CARDS)(实时分布式感知与自主中心)
;
DEVCOM Army Research Laboratory(DEVCOM陆军研究实验室)
机构
*
Lanzhou University(兰州大学)
;
Shanghai Jiaotong University(上海交通大学)
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院)
;
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
机构
*
Artificial Intelligence Innovation and Incubation Institute, Fudan University(复旦大学人工智能创新与孵化研究院)
;
Shanghai Academy of Artificial Intelligence for Science(上海人工智能科学研究院)
;
Huashan Hospital, Fudan University(复旦大学附属华山医院)
;
Human Phenome Institute, Fudan University(复旦大学人类表型组研究院)
;
School of Information Science and Engineering, Lanzhou University(兰州大学信息科学与工程学院)
机构
*
School of Electronic Information Engineering, Beihang University(北京航空航天大学电子信息工程学院)
;
AI Research, Qihoo 360(奇虎360公司360人工智能研究院)
;
School of Artificial Intelligence, Beihang University(北京航空航天大学人工智能学院)
;
State Key Laboratory of Media Convergence and Communication, Communication University of China(中国传媒大学媒体融合与传播国家重点实验室)
;
National Superior College for Engineers, Beihang University(北京航空航天大学国家优秀工程师学院)
;
Artificial Intelligence Research Center, Lobachevsky State University(罗巴切夫斯基国立大学人工智能研究中心)
机构
*
Shanghai University(上海大学)
;
The Hong Kong University of Science and Technology(香港科技大学)
;
Sun Yat-sen University(中山大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
East China Normal University(华东师范大学)
;
Shanghai Jiao Tong University School of Medicine(上海交通大学医学院)