Benchmark Success, Clinical Failure: When Reinforcement Learning Optimizes for Benchmarks, Not Patients
基准成功,临床失败:当强化学习优化于基准,而非患者
Armin Berger, Manuela Bergau, Helen Schneider, Saad Ahmad, Tom Anglim Lagones, Gianluca Brugnara, Martha Foltyn-Dumitru, Kai Schlamp, Philipp Vollmuth, Rafet Sifa
机构
*
Fraunhofer IAIS(弗劳恩霍夫人工智能研究所)
;
University of Bonn(波恩大学)
;
Lamarr Institute(拉马尔研究所)
;
Department of Health Queensland(昆士兰健康部)
;
Griffith University(格里菲斯大学)
;
University Hospital Bonn(波恩大学医院)
专题命中
领域大模型
:large language model(abstract);language model(abstract);SFT(abstract);分类 cs.AI、cs.LG
Modeling the One-to-Many Property in Open-Domain Dialogue with LLMs
在开放式对话中利用大语言模型建模一对一多属性
Jing Yang Lee, Kong-Aik Lee, Woon-Seng Gan
机构
*
School of Electrical and Electronic Engineering, Nanyang Technological University(南洋理工大学电子与电气工程学院)
;
Department of Electrical and Electronic Engineering, The Hong Kong Polytechnic University(香港理工大学电子与电气工程系)
机构
*
School of Cyberspace, Hangzhou Dianzi University(电子科技大学信息学院)
;
Innovation Center for Electronic Design Automation Technology, Hangzhou Dianzi University(电子科技大学电子设计自动化创新中心)
;
Hangzhou Geriatric Stomatology Hospital, Hangzhou Dental Hospital Group(杭州老年口腔医院,杭州口腔医院集团)
;
School of Computing and Mathematical Sciences, University of Leicester(莱斯特大学计算与数学科学学院)