arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 32208 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 32208 篇

2410.11540 2025-03-03 cs.LG 90%

Data Quality Control in Federated Instruction-tuning of Large Language Models

Yaxin Du, Rui Ye, Fengting Yuchi, Wanru Zhao, Jingjing Qu, Yanfeng Wang, Siheng Chen

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.04059 2025-02-25 cs.CL 90%

Comparing Large Language Model AI and Human-Generated Coaching Messages for Behavioral Weight Loss

Zhuoran Huang, Michael P. Berry, Christina Chwyl, Gary Hsieh, Jing Wei, Evan M. Forman

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments 12 pages, 5 figures

Journal ref Journal of Technology in Behavioral Science (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09993 2025-02-25 cs.CL 90%

Large Language Models for Persian $ \leftrightarrow $ English Idiom Translation

Sara Rezaeimanesh, Faezeh Hosseini, Yadollah Yaghoobzadeh

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.17132 2025-01-29 cs.SE cs.CL 90%

ASTRAL: Automated Safety Testing of Large Language Models

Miriam Ugarte, Pablo Valle, José Antonio Parejo, Sergio Segura, Aitor Arrieta

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Journal ref The 6th ACM/IEEE International Conference on Automation of Software Test (AST 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08246 2025-01-15 cs.LG 90%

Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints

Jonathan Nöther, Adish Singla, Goran Radanović

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments This is an extended version of a paper published at AAAI 25

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.03056 2025-01-13 q-bio.GN cs.AI 90%

LitSumm: Large language models for literature summarisation of non-coding RNAs

Andrew Green, Carlos Ribas, Nancy Ontiveros-Palacios, Sam Griffiths-Jones, Anton I. Petrov, Alex Bateman, Blake Sweeney

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.04425 2025-01-09 cs.CL 90%

End-to-End Bangla AI for Solving Math Olympiad Problem Benchmark: Leveraging Large Language Model Using Integrated Approach

H. M. Shadman Tabib, Jaber Ahmed Deedar

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Journal ref IJNLC,vol:13, Issue:5/6, page 49-59,2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01305 2025-01-03 cs.CL 90%

Large Language Models for Mental Health Diagnostic Assessments: Exploring The Potential of Large Language Models for Assisting with Mental Health Diagnostic Assessments -- The Depression and Anxiety Case

Kaushik Roy, Harshul Surana, Darssan Eswaramoorthi, Yuxin Zi, Vedant Palit, Ritvik Garimella, Amit Sheth

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.15329 2024-12-10 cs.CL 90%

DnA-Eval: Enhancing Large Language Model Evaluation through Decomposition and Aggregation

Minzhi Li, Zhengyuan Liu, Shumin Deng, Shafiq Joty, Nancy F. Chen, Min-Yen Kan

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments COLING2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03796 2024-12-06 cs.AI 90%

Automated Multi-Label Annotation for Mental Health Illnesses Using Large Language Models

Abdelrahaman A. Hassan, Radwa J. Hanafy, Mohammed E. Fouda

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07140 2024-11-14 cs.CL 90%

Chinese SimpleQA: A Chinese Factuality Evaluation for Large Language Models

Yancheng He, Shilong Li, Jiaheng Liu, Yingshui Tan, Weixun Wang, Hui Huang, Xingyuan Bu, Hangyu Guo, Chengwei Hu, Boren Zheng, Zhuoran Lin, Xuepeng Liu, Dekai Sun, Shirong Lin, Zhicheng Zheng, Xiaoyong Zhu, Wenbo Su, Bo Zheng

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12478 2024-10-21 cs.CL 90%

MlingConf: A Comprehensive Study of Multilingual Confidence Estimation on Large Language Models

Boyang Xue, Hongru Wang, Rui Wang, Sheng Wang, Zezhong Wang, Yiming Du, Bin Liang, Kam-Fai Wong

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments Comments: This work was intended as a replacement of arXiv:2402.13606 and any subsequent updates will appear there

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.06765 2024-10-21 cs.CL 90%

ConspEmoLLM: Conspiracy Theory Detection Using an Emotion-Based Large Language Model

Zhiwei Liu, Boyang Liu, Paul Thompson, Kailai Yang, Sophia Ananiadou

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);instruction tuning(abstract)

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12835 2024-10-18 cs.CE cs.CL 90%

A Dutch Financial Large Language Model

Sander Noels, Jorne De Blaere, Tijl De Bie

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);instruction tuning(abstract)

Comments 9 pages, 1 figure, accepted at ACM ICAIF'24

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03278 2024-10-10 cs.CL 90%

What do Large Language Models Need for Machine Translation Evaluation?

Shenbin Qian, Archchana Sindhujan, Minnie Kabra, Diptesh Kanojia, Constantin Orăsan, Tharindu Ranasinghe, Frédéric Blain

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments Accepted to EMNLP 2024 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03312 2024-10-07 cs.CL eess.AS 90%

Context and System Fusion in Post-ASR Emotion Recognition with Large Language Models

Pavel Stepachev, Pinzhen Chen, Barry Haddow

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.04941 2024-10-07 cs.CL 90%

Unleashing Large Language Models' Proficiency in Zero-shot Essay Scoring

Sanwoo Lee, Yida Cai, Desong Meng, Ziyang Wang, Yunfang Wu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.04222 2024-09-30 cs.CL 90%

Self-Evaluation of Large Language Model based on Glass-box Features

Hui Huang, Yingqi Qu, Jing Liu, Muyun Yang, Bing Xu, Tiejun Zhao, Wenpeng Lu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments accepted as Findings of EMNLP2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.13952 2024-09-24 cs.CL cs.HC 90%

Exploring Automated Keyword Mnemonics Generation with Large Language Models via Overgenerate-and-Rank

Jaewook Lee, Hunter McNichols, Andrew Lan

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments EMNLP 2024 findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08892 2024-09-23 cs.DB cs.AI 90%

Leveraging Large Language Models for Enhanced Process Model Comprehension

Humam Kourani, Alessandro Berti, Jasmin Hennrich, Wolfgang Kratsch, Robin Weidlich, Chiao-Yun Li, Ahmad Arslan, Daniel Schuster, Wil M. P. van der Aalst

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.10756 2024-09-18 cs.SE cs.AI 90%

VulnLLMEval: A Framework for Evaluating Large Language Models in Software Vulnerability Detection and Patching

Arastoo Zibaeirad, Marco Vieira

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.18276 2024-09-11 cs.AR cs.AI 90%

Rome was Not Built in a Single Step: Hierarchical Prompting for LLM-based Chip Design

Andre Nakkab, Sai Qian Zhang, Ramesh Karri, Siddharth Garg

专题命中 评测与基准 :LLM(title,abstract);prompting(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted at MLCAD '24. 10 pages, 7 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.12547 2024-09-06 cs.CL 90%

Towards Evaluating and Building Versatile Large Language Models for Medicine

Chaoyi Wu, Pengcheng Qiu, Jinxin Liu, Hongfei Gu, Na Li, Ya Zhang, Yanfeng Wang, Weidi Xie

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);instruction tuning(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.16276 2024-08-30 cs.CL 90%

Enhancing AI-Driven Psychological Consultation: Layered Prompts with Large Language Models

Rafael Souza, Jia-Hao Lim, Alexander Davis

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.15040 2024-08-29 cs.CL 90%

A Survey of Large Language Models for European Languages

Wazir Ali, Sampo Pyysalo

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.12194 2024-08-26 cs.CL 90%

Large Language Models as Foundations for Next-Gen Dense Retrieval: A Comprehensive Empirical Assessment

Kun Luo, Minghao Qin, Zheng Liu, Shitao Xiao, Jun Zhao, Kang Liu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

Comments Submitted to EMNLP24

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.06929 2024-08-14 cs.CL 90%

Evaluating Cultural Adaptability of a Large Language Model via Simulation of Synthetic Personas

Louis Kwok, Michal Bravansky, Lewis D. Griffin

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments 18 pages, 8 figures, Published as a conference paper at COLM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.11852 2024-07-17 cs.DB cs.AI 90%

Schema Matching with Large Language Models: an Experimental Study

Marcel Parciak, Brecht Vandevoort, Frank Neven, Liesbet M. Peeters, Stijn Vansummeren

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments Accepted at the 2nd International Workshop on Tabular Data Analysis (TaDA24), collocated with the 50th International Conference on Very Large Data Bases (VLDB 2024) Guangzhou, China - August 29, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.17447 2024-06-28 cs.CL 90%

A Large Language Model Approach to Educational Survey Feedback Analysis

Michael J. Parker, Caitlin Anderson, Claire Stone, YeaRim Oh

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Journal ref Int J Artif Intell Educ (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.07844 2024-06-12 cs.SE cs.CL 90%

Mercury: A Code Efficiency Benchmark for Code Large Language Models

Mingzhe Du, Anh Tuan Luu, Bin Ji, Qian Liu, See-Kiong Ng

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);SFT(abstract);preference optimization(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏