XL-SafetyBench: A Country-Grounded Cross-Cultural Benchmark for LLM Safety and Cultural Sensitivity
XL-SafetyBench: 一个基于国家的跨文化安全基准,用于LLM安全性和文化敏感性
Dasol Choi, Eugenia Kim, Jaewon Noh, Sang Seo, Eunmi Kim, Myunggyo Oh, Yunjin Park, Brigitta Jesica Kartono, Josef Pichlmeier, Helena Berndt, Sai Krishna Mendu, Glenn Johannes Tungka, Özlem Gökçe, Suresh Gehlot, Katherine Pratt, Amanda Minnich, Haon Park
机构
*
AIM Intelligence(AIM智能研究院)
;
Microsoft(微软公司)
;
Korea AISI(韩国人工智能研究所)
;
KT Corporation(KT公司)
;
BMW Group(宝马集团)
;
Coinbase(Coinbase公司)
;
Technical University of Munich(慕尼黑技术大学)
;
Ankara University(安卡拉大学)
;
Cyril Amarchand Mangaldas(Cyril Amarchand Mangaldas法律事务所)
;
Seoul National University(首尔国立大学)
Cutscene Agent: An LLM Agent Framework for Automated 3D Cutscene Generation
Cutscene Agent:一种用于自动化3D场景生成的LLM代理框架
Lanshan He, Haozhou Pang, Qi Gan, Xin Shen, Ziwei Zhang, Yibo Liu, Gang Fang, Bo Liu, Kai Sheng, Shengfeng Zeng, Chaofan Li, Zhen Hui, Keer Zhou, Lan Zhou, Shujun Dai
Case-Specific Rubrics for Clinical AI Evaluation: Methodology, Validation, and LLM-Clinician Agreement Across 823 Encounters
针对具体病例的评估量表:方法、验证及LLM与医生一致性的823次病例研究
Aaryan Shah, Andrew Hines, Alexia Downs, Denis Bajet, Paulius Mui, Fabiano Araujo, Laura Offutt, Aida Rutledge, Elizabeth Jimenez
机构
*
Canvas Medical
;
Department of Biomedical Data Science, Stanford University(斯坦福大学生物医学数据科学系)
;
XPC (X Primary Care)(XPC(X初级保健))
;
FCA Consulting(FCA咨询)
;
Department of Pediatrics, University of Nevada, Reno, NV, USA(内华达大学拉斯维加斯分校儿科系)
机构
*
School of Computer Science and Engineering, Vellore Institute of Technology, India(印度维杰雷理工学院计算机科学与工程学院)
;
Indian Institute of Science, Bangalore, India(印度班加罗尔印度科学学院)
专题命中
评测与基准
:LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG
CommentsAccepted at the 21st International Conference on Artificial Intelligence and Law (ICAIL 2026), Singapore, June 8-12, 2026. 10 pages, 14 figures, 2 tables
Beyond Reproduction: A Paired-Task Framework for Assessing LLM Comprehension and Creativity in Literary Translation
超越复制:一种配对任务框架用于评估LLM在文学翻译中的理解与创造力
Ran Zhang, Steffen Eger, Arda Tezcan, Wei Zhao, Simone Paolo Ponzetto, Lieve Macken
机构
*
Natural Language Learning Group (NLLG) School of Business Informatics and Mathematics University of Mannheim(曼海姆大学自然语言学习组(NLLG)商学院信息与数学学院)
;
University of Technology Nuremberg (UTN), Department Engineering(纽伦堡技术大学(UTN)工程系)
;
University of Gent, Department of Translation, Interpreting and Communication(根特大学翻译、口译与传播系)
;
University of Aberdeen, Department of Computing Science(阿伯丁大学计算科学系)
;
Natural Language Learning and Generation (NLLG) Lab(自然语言学习与生成(NLLG)实验室)
专题命中
评测与基准
:LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
机构
*
National Engineering Research Center of Educational Big Data, Faculty of Artificial Intelligence in Education, Central China Normal University(国家教育大数据工程研究中心,教育人工智能学院,中央财经大学)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI
Journal refLiu, S., Liu, S., Sha, L., Zeng, Z., Gasevic, D., & Liu, Z. (2025). Annotation Guideline-Based Knowledge Augmentation: Towards Enhancing Large Language Models for Educational Text Classification. IEEE Transactions on Learning Technologies
机构
*
CFCS, School of Computer Science, Peking University(计算机科学系,北京大学)
;
School of Business, Jiangnan University(商学院,江南大学)
;
Microsoft Research Asia(微软亚洲研究院)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG
CommentsA shorter conference version is published in IJCAI 2025, titled 'Game Theory Meets Large Language Models: A Systematic Survey'