How Human-Like Are Large Language Models? A Register-Aware Linguistic Evaluation Framework
大型语言模型有多像人类?一个语域感知的语言评估框架
Björn Nieth, Marianna Gracheva, Michaela Mahlberg, Bjoern Eskofier, Emmanuelle Salin
机构
*
Department Artificial Intelligence in Biomedical Engineering (AIBE)(人工智能生物医学工程系)
;
Department of Digital Humanities and Social Studies (DHSS)(数字人文与社会科学系)
;
University of Birmingham(伯明翰大学)
;
Chair of AI-supported Therapy Decisions(人工智能支持治疗决策教授职位)
;
Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心)
;
Institute of AI for Health, Helmholtz Zentrum München(健康人工智能研究所,海德堡中心慕尼黑)
专题命中
评测与基准
:LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.CL
Comments16 pages, 20 references. v2: Added brief discussion situating "honest signals" terminology in evolutionary biology (Sec. 3), with two added citations (Zahavi 1975; Maynard Smith & Harper 2003). No changes to argument or conclusions
On the Hidden Costs of Counterfactual Knowledge Training in LLM Unlearning
反事实知识训练在LLM遗忘中的隐藏代价
Xiaotian Ye, Xiaohan Wang, Mengqi Zhang, Shu Wu
机构
*
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Huazhong University of Science and Technology(华中科技大学)
;
Shandong University(山东大学)
;
NLPR, MAIS, Institute of Automation, Chinese Academy of Sciences(神经网络计划、人工智能研究所、中国科学院自动化研究所)
专题命中
评测与基准
:LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL
机构
*
Electrical Engineering, University of Notre Dame(诺丁汉大学电气工程系)
;
Computer Science and Engineering, University of Notre Dame(诺丁汉大学计算机科学与工程系)
;
School of Medicine, Indiana University(印第安纳大学医学院)
专题命中
评测与基准
:LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL
机构
*
School of Cyber Science and Technology, Beihang University, Beijing 100191, China(信息科学与技术学院,北京航空航天大学,北京100191,中国)
;
The College of Cyber Security/College of Information Science and Technology, Jinan University, Guangzhou, China(网络安全学院/信息科学与技术学院,暨南大学,广州,中国)
;
School of Computer Science and Engineering, Beihang University, Beijing 100083, China(计算机科学与工程学院,北京航空航天大学,北京100083,中国)
;
School of Cyber Science and Technology, Beijing University of Posts and Telecommunications, Beijing 100876, China(信息科学与技术学院,北京邮电大学,北京100876,中国)
专题命中
评测与基准
:LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL
EconCausal: A Context-Aware Economic Reasoning Benchmark for Large Language Models
EconCausal: 面向大语言模型的上下文感知经济推理基准
Donggyu Lee, Hyeok Yun, Meeyoung Cha, Sungwon Park, Sangyoon Park, Jihee Kim
机构
*
Graduate School of Data Science, KAIST(韩国科学技术院数据科学研究生院)
;
College of Business, KAIST(韩国科学技术院商学院)
;
Data Science for Humanity Group, MPI-SP(马克斯·普朗克所际数据科学为人类集团)
;
School of Computing, KAIST(韩国科学技术院计算学院)
;
Division of Social Science, HKUST(香港科技大学社会科学系)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);LLM(abstract_cn);分类 cs.CL、cs.AI
CommentsACM SIGKDD Exploration. 12 pages. Additional resources, including a regularly updated list of related papers, and LLM-generated text detectors, are available at https://llm-authorship.github.io
机构
*
Division of Applied Oral Sciences and Community Dental Care, Faculty of Dentistry, The University of Hong Kong(香港大学牙科学院应用口腔科学与社区牙科护理系)
;
School of Data Science, The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)数据科学学院)
;
School of Artificial Intelligence, The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)人工智能学院)
;
Department of Periodontology, Shenzhen Stomatology Hospital (Pingshan) of Southern Medical University, Shenzhen, China(南方医科大学深圳口腔医院(平山)牙周科)
;
Beijing Institute of Collaborative Innovation(北京协同创新研究院)
;
Department of Orthodontics, Shenzhen Stomatology Hospital (Pingshan) of Southern Medical University, Shenzhen, China(南方医科大学深圳口腔医院(平山)正畸科)
;
Shenzhen Stomatology Hospital (Pingshan) of Southern Medical University, Shenzhen, China(南方医科大学深圳口腔医院(平山))
;
College of Future Technology, Peking University(北京大学未来技术学院)
;
Freedom AI
;
New Cornerstone Science Laboratory, National Biomedical Imaging Center, State Key Laboratory of Membrane Biology, Institute of Molecular Medicine, Peking-Tsinghua Center for Life Sciences, College of Future Technology, Peking University, Beijing 100871, China(新基石科学实验室、国家生物医学成像中心、膜生物学国家重点实验室、分子医学研究院、北京大学未来技术学院、生命科学中心,北京大学,北京100871,中国)
;
IDG/McGovern Institute for Brain Research, Peking University, Beijing 100871, China(IDG/ McGovern脑科学研究院,北京大学,北京100871,中国)
;
Division of Oral and Maxillofacial Surgery, Faculty of Dentistry, The University of Hong Kong(香港大学牙科学院口腔颌面外科系)
;
Shenzhen Loop Area Institute(深圳河套学院)
;
Department of Cancer Biology, Mayo Clinic Arizona, 5777 E. Mayo Blvd., IERB-3-504A, Phoenix, Arizona, 85054, USA(梅奥诊所亚利桑那分部癌症生物学部门,5777 E. Mayo Blvd., IERB-3-504A, Phoenix, Arizona, 85054, USA)
;
Department of Conservative Dentistry, Periodontology and Digital Dentistry, LMU University Hospital, LMU Munich, Munich, Germany(慕尼黑大学医院保守牙科、牙周病学和数字牙科部门,慕尼黑,德国,慕尼黑大学)
;
Division of Periodontology & Implant Dentistry, Faculty of Dentistry, The University of Hong Kong, Hong Kong, SAR, China(香港大学牙科学院牙周病学与种植牙科系,香港,中国)
专题命中
评测与基准
:LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
Conv-to-Bench: Evaluating Language Models Via User-Assistant Dialogues In Code Tasks
Conv-to-Bench: 通过代码任务中的用户-助手对话评估语言模型
Victor M. dos Santos, Andre C. Castro, Samuel L. de S. Toledo, Bruno M. L. Calura, Lisandra C. de M. Menezes, Raul C. R. Mata, Telma W. de L. Soares, Bryan L. M. de Oliveira
机构
*
Institute of Mathematics and Computer Science, University of São Paulo(圣保罗大学数学与计算机科学学院)
;
Institute of Informatics, Federal University of Goiás(戈亚斯联邦大学信息学院)
;
HUG Labs(HUG实验室)
;
Advanced Knowledge Center for Immersive Technologies (AKCIT)(沉浸式技术高级知识中心)
专题命中
评测与基准
:language model(title,abstract);LLM(abstract,abstract_cn);large language model(abstract);分类 cs.CL