ReasAlign: Reasoning Enhanced Safety Alignment against Prompt Injection Attack
ReasAlign: 基于推理增强的安全对齐以抵御提示注入攻击
Hao Li, Yankai Yang, G. Edward Suh, Ning Zhang, Chaowei Xiao
机构
*
Washington University in St. Louis(华盛顿大学圣路易斯分校)
;
University of Wisconsin–Madison(威斯康星大学麦迪逊分校)
;
NVIDIA(NVIDIA公司)
;
Johns Hopkins University(约翰霍普金斯大学)
专题命中
推理与问题求解
:large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
Social Determinants of Health Prediction for ICD-9 Code with Reasoning Models
基于推理模型的ICD-9代码社会决定因素预测
Sharim Khan, Paul Landes, Adam Cross, Jimeng Sun
机构
*
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
University of Illinois Chicago(伊利诺伊大学芝加哥分校)
;
University of Illinois Chicago Peoria(伊利诺伊大学芝加哥分校皮奥里亚分校)
专题命中
推理与问题求解
:large language model(abstract);language model(abstract);分类 cs.CL、cs.LG
Long-Chain Reasoning Distillation via Adaptive Prefix Alignment
通过自适应前缀对齐实现长链推理蒸馏
Zhenghao Liu, Zhuoyang Wu, Xinze Li, Yukun Yan, Shuo Wang, Zulong Chen, Yu Gu, Ge Yu, Maosong Sun
机构
*
School of Computer Science and Engineering, Northeastern University, China(东北大学计算机科学与工程学院)
;
Department of Computer Science and Technology, Institute for AI, Tsinghua University, China(清华大学计算机科学与技术系)
;
Alibaba Group, China(阿里巴巴集团)
专题命中
推理与问题求解
:large language model(abstract);language model(abstract);分类 cs.CL
机构
*
Department of Mechatronics and Robotics, Xi’an Jiaotong–Liverpool University(机械与机器人系,西安交通大学利物浦大学)
;
Department of Applied Mathematics, Xi’an Jiaotong–Liverpool University(应用数学系,西安交通大学利物浦大学)
;
Hansheng Lawyers Building(翰盛律师事务所)
;
Suzhou Gewu Digital Technology Co., Ltd.(苏州葛武数字技术有限公司)
;
Kenneth Wang School of Law, Soochow University(肯尼斯·王法学院,苏州大学)
;
College of Computer Science and Artificial Intelligence, Fudan University(计算机科学与人工智能学院,复旦大学)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);分类 cs.AI
Contextual StereoSet: Stress-Testing Bias Alignment Robustness in Large Language Models
上下文立体集:在大型语言模型中压力测试偏见对齐的鲁棒性
Abhinaba Basu, Pavan Chakraborty
机构
*
Indian Institute of Information Technology, Allahabad (IIITA)(印度信息与技术研究所(Allahabad))
;
National Institute of Electronics and Information Technology (NIELIT)(国家电子与信息技术研究所)
专题命中
评测与基准
:large language model(title);language model(title);prompting(abstract);分类 cs.CL、cs.AI、cs.LG
机构
*
DataArc Tech Ltd.(DataArc科技有限公司)
;
IDEA Research, International Digital Economy Academy(国际数字经济学院IDEA研究所)
;
School of Advanced Interdisciplinary Sciences, UCAS(北京大学交叉学科学院)
;
State Key Lab of AI Safety, Institute of Computing Technology, CAS(中国科学院计算技术研究所人工智能安全国家重点实验室)
专题命中
评测与基准
:LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
SALP-CG: Standard-Aligned LLM Pipeline for Classifying and Grading Large Volumes of Online Conversational Health Data
SALP-CG:面向在线医疗对话数据分类与分级的标准对齐大语言模型流水线
Yiwei Yan, Hao Li, Hua He, Gong Kai, Zhengyi Yang, Guanfeng Liu
机构
*
School of Computing, Macquarie University, Australia(麦考瑞大学计算机学院)
;
Department of Biomedical Engineering, National University of Singapore(新加坡国立大学生物医学工程系)
;
School of Mathematics and Statistics, Shandong University of Technology, China(山东理工大学数学与统计学院)
;
Digital Intelligence Center, Fuzhou University Affiliated Provincial Hospital, China(福州市附属省医院数字智能中心)
;
School of Computer Science and Engineering, UNSW, Australia(新南威尔士大学计算机科学与工程学院)
专题命中
评测与基准
:LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI