Aishik Mandal, Hiba Arnaout, Clarissa W. Ong, Juliet Bockhorst, Kate Sheehan, Rachael Moldow, Tanmoy Chakraborty, Iryna Gurevych
机构
*
UKP Lab, Department of Computer Science and Hessian Center for AI (hessian.AI), Technische Universität Darmstadt(德国达姆施塔特技术大学UKP实验室、计算机科学系和海森人工智能中心(hessian.AI))
;
Zuse School ELIZA(Zuse学院ELIZA)
;
National Research Center for Applied Cybersecurity ATHENE(应用网络安全国家研究中心ATHENE)
;
Indian Institute of Technology Delhi(印度德里理工学院)
;
Yardi School of Artificial Intelligence(Yardi人工智能学院)
;
University of Louisville(路易斯维尔大学)
;
University of Toledo(托莱多大学)
An evidence-guided reinforcement learning method to improve psychiatric reasoning in small language models
评估一种证据引导的强化学习框架在对齐光参数大语言模型与精神科临床推理决策认知中的作用
Xinxin Lin, Guangxin Dai, Yi Zhong, Xiang Li, Xue Xiao, Jian Liu, Yixin Zhang, Lingming Hu, Zhengdong Wu, Yongbo Zheng, Runchuan Zhu, Ming Zhao, Huizi Yu, Yi Zhang, Fangting Lu, Shuo Wu, Jun Zhao, Ping Yin, Joey W. Y. Chan, Ngan Yin Chan, Yumei Wang, Lejin Yang, Yanqiu Xing, Sijing Chen, Yun Kwok Wing, Lin Lu, Xin Ma, Lizhou Fan
机构
*
The Chinese University of Hong Kong, Shatin, N.T., Hong Kong SAR, China(香港中文大学)
;
Shandong University, Jinan, China(山东大学)
;
Peking University Sixth Hospital, Beijing, China(北京大学第六医院)
;
Inspur Cloud Information Technology Co., Ltd., Jinan, China(Inspur 云技术有限公司)
;
Fudan University, Shanghai, China(复旦大学)
;
Shandong Provincial Hospital Affiliated to Shandong First Medical University, Jinan, China(山东第一医科大学附属山东省人民医院)
;
Jilin University, Changchun, China(吉林大学)
;
Hong Kong ICI Cloud Service Limited, Hong Kong SAR, China(香港ICI云服务有限公司)
;
Shandong First Medical University, Jinan, China(山东第一医科大学)