Displacement-Resistant Extensions of DPO with Nonconvex $f$-Divergences
对抗位移的DPO扩展:非凸f-散度
Idan Pipano, Shoham Sabach, Kavosh Asadi, Mohammad Ghavamzadeh
机构
*
Faculty of Data and Decision Sciences(数据与决策科学学院)
;
Technion - Israel Institute of Technology(技术ion-以色列理工学院)
;
Meta
;
Qualcomm AI Research(高通人工智能研究)
Do Prompts Guarantee Safety? Mitigating Toxicity from LLM Generations through Subspace Intervention
提示是否保证安全?通过子空间干预减轻大语言模型生成中的毒性
Himanshu Singh, Ziwei Xu, A. V. Subramanyam, Mohan Kankanhalli
机构
*
Department of Computer Science(计算机科学系)
;
School of Computing, National University of Singapore(新加坡国立大学计算机学院)
;
Department of Electronics and Communications Engineering(电子与通信工程系)
HyPlan: Hybrid Learning-Assisted Planning Under Uncertainty for Safe Autonomous Driving
HyPlan:在不确定环境下通过混合学习辅助规划实现安全自动驾驶
Donald Pfaffmann, Matthias Klusch, Marcel Steinmetz
机构
*
Saarland University, Computer Science Dept.(萨尔兰大学计算机科学系)
;
German Research Center for Artificial Intelligence (DFKI)(德国人工智能研究中心)
;
French National Centre for Scientific Research (CNRS)(法国国家科学研究中心)
机构
*
Institute of Software Chinese Academy of Sciences, Beijing, China(中国科学院软件研究所)
;
University of Chinese Academy of Sciences, Beijing, China(中国科学院大学)
;
Institute of Information Engineering Chinese Academy of Sciences, Beijing, China(中国科学院信息工程研究所)
;
Hong Kong University of Science and Technology, China, Hong Kong, China(香港科学与技术大学)
机构
*
School of Computer and Electronic Information, Nanjing Normal University(计算机与电子信息学院,南京师范大学)
;
School of Artificial Intelligence and Information Technology, Nanjing University of Chinese Medicine(人工智能与信息科技学院,南京中医药大学)
Evaluating an evidence-guided reinforcement learning framework in aligning light-parameter large language models with decision-making cognition in psychiatric clinical reasoning
评估一种证据引导的强化学习框架在对齐光参数大语言模型与精神科临床推理决策认知中的作用
Xinxin Lin, Guangxin Dai, Yi Zhong, Xiang Li, Xue Xiao, Yixin Zhang, Zhengdong Wu, Yongbo Zheng, Runchuan Zhu, Ming Zhao, Huizi Yu, Shuo Wu, Jun Zhao, Lingming Hu, Yumei Wang, Ping Yin, Joey W. Y. Chan, Ngan Yin Chan, Sijing Chen, Yun Kwok Wing, Lin Lu, Xin Ma, Lizhou Fan
机构
*
The Chinese University of Hong Kong, Shatin, N.T., Hong Kong SAR, China(香港中文大学)
;
Shandong University, Jinan, China(山东大学)
;
Peking University Sixth Hospital, Beijing, China(北京大学第六医院)
;
Inspur Cloud Information Technology Co., Ltd., Jinan, China(Inspur 云技术有限公司)
;
Fudan University, Shanghai, China(复旦大学)
;
Shandong Provincial Hospital Affiliated to Shandong First Medical University, Jinan, China(山东第一医科大学附属山东省人民医院)
;
Jilin University, Changchun, China(吉林大学)
;
Hong Kong ICI Cloud Service Limited, Hong Kong SAR, China(香港ICI云服务有限公司)
;
Shandong First Medical University, Jinan, China(山东第一医科大学)
MPIB: A Benchmark for Medical Prompt Injection Attacks and Clinical Safety in LLMs
MPIB:用于医疗提示注入攻击和大语言模型临床安全性的基准
Junhyeok Lee, Han Jang, Kyu Sung Choi
机构
*
Seoul National University College of Medicine(首尔国立大学医学院)
;
Seoul National University(首尔国立大学)
;
Seoul National University College of Medicine, Seoul National University Hospital(首尔国立大学医学院、首尔国立大学医院)
机构
*
School of Software, Shandong University(山东大学软件学院)
;
Sonli Holding Group Co., Ltd.(山东利集团有限公司)
;
Shandong Huazhi Talent Technology Co., Ltd.(山东华智人才科技有限公司)
;
Information Technology Service Center of People’s Court(人民法院信息技术服务中心)
Are AI Capabilities Increasing Exponentially? A Competing Hypothesis
人工智能能力是否呈指数增长?一个竞争性假设
Haosen Ge, Hamsa Bastani, Osbert Bastani
机构
*
Wharton AI \& Analytics Initiative, The Wharton School, University of Pennsylvania, USA
;
Department of Operations, Information
;
Decisions, The Wharton School, University of Pennsylvania, USA
;
Department of Computer
;
Information Science, University of Pennsylvania, USA