Memory-Supported Synergistic Adaptation for Training-Free Test-Time Medical Image Segmentation
用于无训练测试时医学图像分割的内存支持协同适应
Lingrui Li, Nan Pu, Dong Zhao, Wenjing Li, Andrew P French, Zhun Zhong, Xin Chen
机构
*
School of Computer Science, University of Nottingham(诺丁汉大学计算机科学学院)
;
School of Computer Science and Information Engineering, Hefei University of Technology(合肥工业大学计算机科学与信息工程学院)
;
Information Systems Technology and Design Pillar, Singapore University of Technology and Design(新加坡科技设计大学信息系统技术与设计支柱)
Platonic Representations for Poverty Mapping: Unified Vision-Language Codes or Agent-Induced Novelty?
贫困地图绘制的柏拉图式表示:统一的视觉语言代码还是智能体诱导的新颖性?
Satiyabooshan Murugaboopathy, Connor T. Jerzak, Adel Daoud
机构
*
AI and Global Development Lab(人工智能与全球发展实验室)
;
Institute for Analytical Sociology(分析社会学研究所)
;
Institute of Computer Science(计算机科学研究所)
;
Department of Government(政府系)
ESC: Emotional Self-Correction for Reliable Vision-Language Models
ESC:面向可靠视觉语言模型的情感自我纠正
Tien-Huy Nguyen, Minh-Nhat Nguyen, Nguyen Nhat Huy, Hung Viet Nguyen, Huy Nguyen Minh Nhat, Thanh-Huy Nguyen, Cuong Tuan Nguyen, Hoang M. Le, Dat Nguyen, Phat Kim Huynh, Min Xu, Ulas Bagci
机构
*
1 GenAI4E Lab 2 University of Information Technology, Ho Chi Minh City, Vietnam 3 Universit\"at Trier, Germany 4 Ho Chi Minh University of Technology, Ho Chi Minh City, Vietnam 5 PAMI Lab, Vietnamese German University, Vietnam 6 Vietnam National University, Ho Chi Minh City, Vietnam 7 Carnegie Mellon University, USA 8 Omoshiroi AI, USA 9 Harvard University, USA 10 Basis Research Institute 11 PASSIO Laboratory, North Carolina A\&T State University, USA 12 Mohamed bin Zayed University of Artificial Intelligence, UAE 13 Northwestern University, USA [4pt] Equal contribution. Corresponding author
机构
*
School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences (UCAS)(中国科学院大学先进交叉学科学院)
;
School of Electronic, Electrical and Communication Engineering, UCAS(中国科学院大学电子、电气与通信工程学院)
;
School of Computer Science and Technology, UCAS(中国科学院大学计算机科学与技术学院)
ComMem: Complementary Memory Systems for Test-Time Adaptation of Vision-Language Models
ComMem:视觉语言模型测试时自适应的互补记忆系统
Guanglong Sun, Shuang Cui, Bo Lei, Liyuan Wang, Zihan Zhai, Hongwei Yan, Hang Su, Jun Zhu, Yi Zhong
机构
*
School of Life Sciences, IDG/McGovern Institute for Brain Research, Tsinghua University, Beijing, China(生命科学学院,IDG/麦克戈文脑科学研究院,清华大学,北京,中国)
;
Institute of Software Chinese Academy of Sciences, Beijing, China(中国科学院软件研究所,北京,中国)
;
Beijing Academy of Artificial Intelligence, Beijing, China(北京人工智能研究院,北京,中国)
;
Department of Psychological and Cognitive Sciences, Tsinghua University, Beijing, China(心理学与认知科学系,清华大学,北京,中国)
;
Dept. of Comp. Sci. and Tech., Institute for AI, Tsinghua-Bosch Joint ML Center, THBI Lab, BNRist Center, Tsinghua University, Beijing, China(计算机科学与技术系,人工智能研究院,清华大学-博世联合机器学习中心,THBI实验室,BNRist中心,清华大学,北京,中国)
Revealing Training Data Exposure in Vision Language Large Models via Parameter Gradients
揭示视觉语言大模型中的训练数据暴露:基于参数梯度的方法
Zhihao Zhu, Hongyi Tang, Yi Yang, Ahmed Abbasi
机构
*
Department of Information Systems, Business Statistics and Operations Management (ISOM), Hong Kong University of Science and Technology, Hong Kong, China(信息系统、商业统计与运营管理系(ISOM),香港科技大学,香港,中国)
;
Department of IT, Analytics, and Operations, University of Notre Dame, Notre Dame, Indiana, USA(信息技术、分析与运营系,诺丁汉大学,诺丁汉,印第安纳州,美国)
机构
*
University of Virginia(弗吉尼亚大学)
;
J. Crayton Pruitt Family Department of Biomedical Engineering, Herbert Wertheim College of Engineering, University of Florida(佛罗里达大学赫伯特·韦特海姆工程学院J. Crayton Pruitt家庭生物医学工程系)
Reasoning in Computer Vision: Taxonomy, Models, Tasks, and Methodologies
计算机视觉中的推理:分类、模型、任务与方法论
Ayushman Sarkar, Zhenyu Yu, Mohd Yamani Idna Idris
机构
*
Department of Computer Science and Engineering, Birbhum Institute of Engineering and Technology(计算机科学与工程系,比罗尔理工学院)
;
College of Computer Science and Artificial Intelligence, Fudan University(计算机科学与人工智能学院,复旦大学)
;
Faculty of Computer Science and Information Technology, Universiti Malaya(计算机科学与信息技术学院,马来亚大学)
Does the Question Really Matter? Training-Free Data Selection for Vision-Language SFT
问题真的重要吗?视觉-语言SFT的无训练数据选择
Peng Sun, Yi Yang, Huawen Shen, Yi Ban, Tianfan Fu, Yanbo Wang, Yuqiang Li
机构
*
Nanjing University(南京大学)
;
Institute of Information Engineering(信息工程研究所)
;
North University of China(中国北方大学)
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
机构
*
School of Computer Science and Engineering, Nanjing University of Science and Technology(南京理工大学计算机科学与工程学院)
;
School of Information Engineering, Huzhou Normal University(湖州师范学院信息工程学院)
;
School of Artificial Intelligence, Nanjing University of Posts and Telecommunications(南京邮电大学人工智能学院)
;
National Key Laboratory of Tibetan Language Intelligence(藏语智能国家重点实验室)
;
Zhejiang University(浙江大学)
;
Beijing Normal University(北京师范大学)
VCap: Hypergeometric Rewards for Weak-to-Strong Visual Captioning
VCap: 用于弱到强视觉字幕的超几何奖励
Xingyu Lu, Jinpeng Wang, Yi-Fan Zhang, Yankai Yang, Yancheng Long, Yiyang Fan, Xuanyu Zheng, Haonan Fan, Kaiyu Jiang, Tianke Zhang, Changyi Liu, Bin Wen, Fan Yang, Tingting Gao, Han Li, Chun Yuan
机构
*
Tsinghua Shenzhen International Graduate School(清华大学深圳国际研究生院)
;
Harbin Institute of Technology, Shenzhen(哈尔滨工业大学深圳分校)
;
Chinese Academy of Sciences(中国科学院)
;
Kuaishou Technology(快手科技)
FTibSuite: A Comprehensive Resource Suite for Tibetan Vision-Language Modeling
FTibSuite:面向藏语视觉语言建模的综合资源套件
Guixian Xu, Yide Liang, Zeli Su, Xuexian Song, Ziyin Zhang, Yushuang Dong, Ting Zhang, Xu Han
机构
*
Hainan International College, Minzu University of China(民族大学海南国际学院)
;
School of Information Engineering, Minzu University of China(民族大学信息工程学院)
;
Shanghai Jiao Tong University(上海交通大学)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
机构
*
Zhejiang Key Laboratory of Space Information Sensing and Transmission(浙江空间信息感知与传输重点实验室)
;
Hangzhou Dianzi University(杭州电子科技大学)
;
Zhejiang University(浙江大学)
;
Tsinghua University(清华大学)
;
Children's Hospital, Zhejiang University School of Medicine(浙江大学医学院附属儿童医院)
专题命中
图文多模态
:multimodal(abstract);multimodal foundation model(abstract);分类 cs.CV