Can Small-Scale Data Poisoning Exacerbate Dialect-Linked Biases in Large Language Models?
Chaymaa Abbas, Mariette Awad, Razane Tajeddine
机构
*
Department of Electrical and Computer Engineering, Maroun Semaan Faculty of Engineering and Architecture(电气与计算机工程系,马鲁恩·塞马安工程与建筑学院)
;
American University of Beirut(贝鲁特美国大学)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);LLM(abstract);instruction tuning(abstract)
Reducing Large Language Model Safety Risks in Women's Health using Semantic Entropy
Jahan C. Penny-Dimri, Magdalena Bachmann, William R. Cooke, Sam Mathewlynn, Samuel Dockree, John Tolladay, Jannik Kossen, Lin Li, Yarin Gal, Gabriel Davis Jones
机构
*
Oxford Digital Health Labs, Nuffield Department of Women’s and Reproductive Health(牛津数字健康实验室,女性与生殖健康系)
;
University of Oxford(牛津大学)
;
Oxford University Hospitals NHS Foundation Trust(牛津大学医院 NHS 基础信托)
;
OATML, Department of Computer Science(OATML,计算机科学系)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG
Krinos Li, Xianglu Xiao, Shenglong Deng, Lucas He, Zijun Zhong, Yuanjie Zou, Zhonghao Zhan, Zheng Hui, Weiye Bao, Guang Yang
机构
*
Imperial College London(伦敦帝国理工学院)
;
University College London(伦敦大学学院)
;
New Jersey Institute of Technology(新泽西理工学院)
;
University of Cambridge(剑桥大学)
;
King’s College London(伦敦国王学院)
;
Royal Brompton Hospital(皇家布隆特医院)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG
PiCo: Jailbreaking Multimodal Large Language Models via Pictorial Code Contextualization
Aofan Liu, Lulu Tang, Ting Pan, Yuguo Yin, Bin Wang, Ao Yang
机构
*
School of Artificial Intelligence, Wuhan University(武汉大学人工智能学院)
;
School of Electronic and Computer Engineering, Peking University(北京大学电子与计算机工程学院)
;
Beijing Academy of Artificial Intelligence(北京人工智能研究院)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);分类 cs.AI
CommentsAccepted to IEEE International Conference on Multimedia and Expo (ICME) 2025
Evaluating LLM-Generated Versus Human-Authored Responses in Role-Play Dialogues
Dongxu Lu, Johan Jeuring, Albert Gatt
机构
*
Utrecht University(乌得勒支大学)
专题命中
评测与基准
:LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
CommentsAccepted for publication at the 18th International Natural Language Generation Conference (INLG 2025). Revised version: improved image quality and minor corrections. No change to conclusions
机构
*
State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(中国科学院人工智能安全国家重点实验室,计算技术研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Baidu Inc.(百度公司)
专题命中
评测与基准
:LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
BixBench: a Comprehensive Benchmark for LLM-based Agents in Computational Biology
Ludovico Mitchener, Jon M Laurent, Alex Andonian, Benjamin Tenmann, Siddharth Narayanan, Geemi P Wellawatte, Andrew White, Lorenzo Sani, Samuel G Rodriques
专题命中
评测与基准
:LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI
机构
*
DAUIN, Politecnico di Torino(达乌因,托斯卡纳理工学院)
;
DEI, University of Bologna(电子工程学院,博洛尼亚大学)
;
DIST, Politecnico di Torino(信息与通信技术学院,托斯卡纳理工学院)
;
D-ITET, ETH Zurich(信息与通信技术系,苏黎世联邦理工学院)