Few-Shot Image Quality Assessment via Adaptation of Vision-Language Models
Xudong Li, Zihao Huang, Yan Zhang, Yunhang Shen, Ke Li, Xiawu Zheng, Liujuan Cao, Rongrong Ji
机构
*
Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University(中国教育部多媒体可信感知与高效计算重点实验室,厦门大学)
;
Beijing Institute of Technology(北京理工大学)
;
Tencent Youtu Lab, Shanghai, China(腾讯优图实验室,中国)
机构
*
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Westlake University(西湖大学)
;
Zhejiang University(浙江大学)
;
OpenHelix Team(OpenHelix团队)
;
State Key Laboratory of Networking and Switching Technology(网络与交换技术国家重点实验室)
;
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
When Color-Space Decoupling Meets Diffusion for Adverse-Weather Image Restoration
Wenxuan Fang, Jili Fan, Chao Wang, Xiantao Hu, Jiangwei Weng, Ying Tai, Jian Yang, Jun Li
机构
*
School of Computer Science and Engineering, Nanjing University of Science and Technology(计算机科学与工程学院,南京理工大学)
;
School of Electrical Engineering, Southeast University(电气工程学院,东南大学)
;
School of Intelligence Science and Technology, Nanjing University(智能科学与技术学院,南京大学)
MOMENTS: A Comprehensive Multimodal Benchmark for Theory of Mind
Emilio Villa-Cueva, S M Masrur Ahmed, Rendi Chevi, Jan Christian Blaise Cruz, Kareem Elzeky, Fermin Cristobal, Alham Fikri Aji, Skyler Wang, Rada Mihalcea, Thamar Solorio
机构
*
MBZUAI
;
University of Houston(德克萨斯大学休斯顿分校)
;
McGill University(麦吉尔大学)
;
University of Michigan(密歇根大学)
专题命中
其他VLM
:multimodal large language model(abstract)