Confidence Calibration for Multimodal LLMs: An Empirical Study through Medical VQA
多模态大语言模型的置信度校准:基于医学视觉问答的实证研究
Yuetian Du, Yucheng Wang, Ming Kong, Tian Liang, Qiang Long, Bingdi Chen, Qiang Zhu
机构
*
College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)
;
School of Computer Science and Technology, Xidian University(西安电子科技大学计算机科学与技术学院)
;
Zhihui Medical Technology (Shanghai) Co., Ltd.(智汇医疗科技(上海)有限公司)
专题命中
领域大模型
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI
SAERec: Constructing Fine-grained Interpretable Intents Priors via Sparse Autoencoders for Recommendation
SAERec:通过稀疏自编码器为推荐构建细粒度可解释意图先验
Jiangnan Xia, Xuansheng Wu, Yu Yang, Xin Wang, Ninghao Liu
机构
*
University of Georgia(佐治亚大学)
;
Shanghai AI Laboratory(上海人工智能实验室)
;
The Education University of Hong Kong(香港教育大学)
;
Jilin University(吉林大学)
;
The Hong Kong Polytechnic University(香港理工大学)
专题命中
领域大模型
:LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI
机构
*
Princeton University(普林斯顿大学)
;
Springer Heidelberg(斯普林格海德堡)
;
ABC Institute(ABC研究所)
;
Rupert-Karls-University Heidelberg(海德堡鲁珀特-卡尔大学)
;
Hangzhou Dianzi University(杭州电子科技大学)
;
Zhejiang University(浙江大学)
;
Children’s Hospital, Zhejiang University School of Medicine, National Clinical Research Center for Children and Adolescents’ Health and Diseases(浙江大学医学院儿童医院,国家儿童青少年健康与疾病临床研究中心)
专题命中
领域大模型
:LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI
ReclAIm: A Multi-Agent Framework for Monitoring and Correcting Performance Decline in Medical Imaging AI
ReclAIm:用于监测和纠正医学影像AI性能下降的多智能体框架
Eleftherios Tzanis, Michail E. Klontzas
机构
*
Artificial Intelligence and Translational Imaging (ATI) Lab, Department of Radiology, School of Medicine, University of Crete(人工智能与转化成像实验室,放射科,医学院,希腊克里特大学)
;
Computational Biomedicine Laboratory, Institute of Computer Science Foundation for Research and Technology Hellas (ICS - FORTH), Heraklion, Crete, Greece(计算生物医学实验室,希腊基础研究与技术院计算机科学研究所(ICS - FORTH),克里特,希腊)
;
Division of Radiology, Department of Clinical Science, Intervention and Technology (CLINTEC), Karolinska Institute, Huddinge, Sweden(放射科,临床科学、干预与技术部(CLINTEC),卡罗林斯卡研究所,瑞典Huddinge)
专题命中
领域大模型
:large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI
机构
*
Kalyani Government Engineering College(卡利尼政府工程学院)
;
IIIT Delhi(德里IIIT)
;
BITS Pilani Hyderabad Campus(比斯汉学院海得拉巴校区)
;
AI Institute, University of South Carolina(南卡罗来纳大学人工智能研究所)
;
IIIT Guwahati(古瓦哈提IIIT)
;
NIT Silchar(西里char理工学院)
;
San José State University(圣何塞州立大学)
;
UCLA(加州大学洛杉矶分校)
;
Washington State University(华盛顿州立大学)
;
Vishwakarma Institute of Information Technology(维斯瓦卡马信息科技学院)
;
Meta AI
;
Amazon AI(亚马逊人工智能)
;
BITS Pilani Goa(比斯汉学院果阿)
专题命中
领域大模型
:LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL
Domain-Adaptable Reinforcement Learning for Code Generation with Dense Rewards
用于密集奖励的领域可适应强化学习代码生成
Erfan Aghadavoodi Jolfaei, Daniel Maninger, Abhinav Anand, Mert Tiftikci, Mira Mezini
机构
*
Hessian Center for Artificial Intelligence (hessian.AI)(海斯曼人工智能中心)
;
National Research Center for Applied Cybersecurity ATHENE(应用网络安全国家研究中心ATHENE)
专题命中
领域大模型
:LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.LG
机构
*
The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
;
National University of Singapore(新加坡国立大学)
;
Nanyang Technological University(南洋理工大学)
;
Zhejiang University(浙江大学)
Stable diffusion models reveal a persisting human and AI gap in visual creativity
稳定扩散模型揭示了人类与AI在视觉创造力中的持续性差距
Silvia Rondini, Claudia Alvarez-Martin, Paula Angermair-Barkai, Olivier Penacchio, M. Paz, Matthew Pelowski, Dan Dediu, Antoni Rodriguez-Fornells, Xim Cerda-Company
机构
*
Cognition and Brain Plasticity Unit, Bellvitge Biomedical Research Institute(认知与脑可塑性单位,贝尔维希生物医学研究所)
;
Bridging AI and Neuroscience, Computer Vision Center(弥合人工智能与神经科学,计算机视觉中心)
;
Department of Cognition, Development and Educational Psychology, University of Barcelona(认知、发展与教育心理学系,巴塞罗那大学)
;
Vienna Cognitive Science Hub(维也纳认知科学中心)
;
Faculty of Psychology, University of Vienna(心理学系,维也纳大学)
;
Computer Science Department, Universitat Autonoma de Barcelona(计算机科学系,巴塞罗那自治大学)
;
University of Barcelona Institute for Complex Systems (UBICS)(巴塞罗那大学复杂系统研究所)
;
Department of Catalan Philology and General Linguistics, University of Barcelona(加泰罗尼亚语言学与一般语言学系,巴塞罗那大学)
;
Catalan Institution for Research and Advanced Studies (ICREA)(加泰罗尼亚研究与高级科学研究机构(ICREA))
;
Aix-Marseille University(艾克斯-马赛大学)
;
Institute of Neurosciences (UBNeuro), University of Barcelona(神经科学研究所(UBNeuro),巴塞罗那大学)
专题命中
领域大模型
:large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI
Agentic AI Scientists Are Not Built For Autonomous Scientific Discovery
代理式AI科学家并非为自主科学发现而建
Harshit Bisht, Vinay Kumar, Kevin Maik Jablonka, Mausam, N. M. Anoop Krishnan
机构
*
Yardi School of Artificial Intelligence, Indian Institute of Technology Delhi(印度理工学院德里人工智能学院)
;
Department of Computer Science and Engineering, Indian Institute of Technology Delhi(印度理工学院德里计算机科学与工程系)
;
Department of Civil and Environmental Engineering, Indian Institute of Technology Delhi(印度理工学院德里土木与环境工程系)
;
Laboratory of Organic and Macromolecular Chemistry (IOMC), Friedrich Schiller University Jena(耶拿弗里德里希·席勒大学有机与大分子化学实验室)
;
Center for Energy and Environmental Chemistry Jena, Friedrich Schiller University Jena(耶拿弗里德里希·席勒大学能源与环境化学中心)
;
Helmholtz Institute for Polymers in Energy Applications Jena (HIPOLE Jena)(耶拿海德堡聚合物能源应用研究所(HIPOLE耶拿))
专题命中
领域大模型
:large language model(abstract);language model(abstract);post-training(abstract);分类 cs.AI
CommentsThe authors have identified an issue in the evaluation protocol in Section 5.1.3. Feature extraction and semantic matching used to compute P-EHR require correction and re-validation, as they may not have been applied consistently across all generated explanations and baselines. This may affect part of the reported quantitative results and analysis, so the authors withdraw this version
Purely Agent-Driven Black-Box Optimization for Biological Design
纯粹的基于代理的黑盒优化用于生物设计
Natalie Maus, Yimeng Zeng, Haydn Thomas Jones, Yining Huang, Gaurav Ng Goel, Alden Rose, Kyurae Kim, Hyun-Su Lee, Marcelo Der Torossian Torres, Fangping Wan, Cesar de la Fuente-Nunez, Mark Yatskar, Osbert Bastani, Jacob R. Gardner
机构
*
University of Pennsylvania(宾夕法尼亚大学)
专题命中
领域大模型
:LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.LG
Iterative Multimodal Retrieval-Augmented Generation for Medical Question Answering
迭代多模态检索增强生成用于医疗问答
Xupeng Chen, Binbin Shi, Chenqian Le, Jiaqi Zhang, Kewen Wang, Ran Gong, Jinhan Zhang, Chihang Wang
机构
*
New York University, New York, USA(纽约大学)
;
Tsinghua University, Beijing, China(清华大学)
;
Independent Researcher(独立研究者)
;
Chinese Academy of Sciences, Beijing, China(中国科学院)