arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 32096 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 32096 篇

2405.13974 2024-05-24 cs.CL cs.AI 88%

CIVICS: Building a Dataset for Examining Culturally-Informed Values in Large Language Models

Giada Pistilli, Alina Leidinger, Yacine Jernite, Atoosa Kasirzadeh, Alexandra Sasha Luccioni, Margaret Mitchell

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.15335 2024-05-24 cs.CR cs.AI cs.CV cs.LG 88%

L-AutoDA: Leveraging Large Language Models for Automated Decision-based Adversarial Attacks

Ping Guo, Fei Liu, Xi Lin, Qingchuan Zhao, Qingfu Zhang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

Comments Camera ready version for GECCO'24 workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.10659 2024-05-21 cs.CL cs.AI 88%

Realistic Evaluation of Toxicity in Large Language Models

Tinh Son Luong, Thanh-Thien Le, Linh Ngo Van, Thien Huu Nguyen

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Findings of ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.10542 2024-05-20 cs.CL cs.AI 88%

Benchmarking Large Language Models on CFLUE -- A Chinese Financial Language Understanding Evaluation Dataset

Jie Zhu, Junhui Li, Yalong Wen, Lifan Guo

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted by ACL 2024

Journal ref The 62nd Annual Meeting of the Association for Computational Linguistics(ACL),2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.09300 2024-05-16 cs.CL cs.AI cs.HC 88%

Comparing the Efficacy of GPT-4 and Chat-GPT in Mental Health Care: A Blind Assessment of Large Language Models for Psychological Support

Birger Moell

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.06772 2024-05-14 cs.CR cs.AI cs.CL 88%

CANAL -- Cyber Activity News Alerting Language Model: Empirical Approach vs. Expensive LLM

Urjitkumar Patel, Fang-Chun Yeh, Chinmay Gondhalekar

专题命中 评测与基准 :LLM(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Published in 2024 IEEE 3rd International Conference on AI in Cybersecurity (ICAIC), Conference Date: 07-09 February 2024

Journal ref 2024 IEEE 3rd International Conference on AI in Cybersecurity (ICAIC), Houston, TX, USA, 2024, pp. 1-12

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.06719 2024-05-14 cs.CL cs.AI 88%

Enhancing Traffic Prediction with Textual Data Using Large Language Models

Xiannan Huang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.03153 2024-05-07 cs.CL cs.CY cs.LG 88%

Exploring the Potential of the Large Language Models (LLMs) in Identifying Misleading News Headlines

Md Main Uddin Rony, Md Mahfuzul Haque, Mohammad Ali, Ahmed Shatil Alam, Naeemul Hassan

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

Comments 5 pages, 2 tables, 1st HEAL Workshop at CHI Conference on Human Factors in Computing Systems, May 12, Honolulu, HI, USA 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.02738 2024-05-07 cs.CL cs.AI 88%

Relations Prediction for Knowledge Graph Completion using Large Language Models

Sakher Khalil Alqaaidi, Krzysztof Kochut

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.18359 2024-04-30 cs.CL cs.AI 88%

FoundaBench: Evaluating Chinese Fundamental Knowledge Capabilities of Large Language Models

Wei Li, Ren Ma, Jiang Wu, Chenya Gu, Jiahui Peng, Jinyang Len, Songyang Zhang, Hang Yan, Dahua Lin, Conghui He

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.18276 2024-04-30 cs.CL cs.AI 88%

Bias Neutralization Framework: Measuring Fairness in Large Language Models with Bias Intelligence Quotient (BiQ)

Malur Narayan, John Pasmore, Elton Sampaio, Vijay Raghavan, Gabriella Waters

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments 41 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.12399 2024-04-25 cs.LG cs.CL cs.SI 88%

A Survey of Graph Meets Large Language Model: Progress and Future Directions

Yuhan Li, Zhixun Li, Peisong Wang, Jia Li, Xiangguo Sun, Hong Cheng, Jeffrey Xu Yu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

Comments IJCAI 2024 Survey Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.14467 2024-04-24 cs.CL cs.AI 88%

Integrating Chemistry Knowledge in Large Language Models via Prompt Engineering

Hongxuan Liu, Haoyu Yin, Zhiyao Luo, Xiaonan Wang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments 43 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.14432 2024-04-24 cs.SI cs.AI cs.CL cs.IR 88%

Monitoring Critical Infrastructure Facilities During Disasters Using Large Language Models

Abdul Wahab Ziaullah, Ferda Ofli, Muhammad Imran

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted to appear at the 2024 ISCRAM conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.13099 2024-04-23 cs.CL cs.AI 88%

Mathify: Evaluating Large Language Models on Mathematical Problem Solving Tasks

Avinash Anand, Mohit Gupta, Kritarth Prasad, Navya Singla, Sanjana Sanjeev, Jatin Kumar, Adarsh Raj Shivam, Rajiv Ratn Shah

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments 10 pages, 3 figures, NeurIPS 2023 Workshop on Generative AI for Education (GAIED)

Journal ref NeurIPS 2023 Workshop on Generative AI for Education (GAIED)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.13074 2024-04-23 cs.CL cs.AI 88%

Towards Compositionally Generalizable Semantic Parsing in Large Language Models: A Survey

Amogh Mannekote

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.12291 2024-04-23 cs.CL cs.AI 88%

Augmenting emotion features in irony detection with Large language modeling

Yucheng Lin, Yuhan Xia, Yunfei Long

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments 11 pages, 3 tables, 2 figures. Accepted by the 25th Chinese Lexical Semantics Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.01102 2024-04-18 cs.NE cs.AI cs.CL 88%

LLMatic: Neural Architecture Search via Large Language Models and Quality Diversity Optimization

Muhammad U. Nasir, Sam Earle, Christopher Cleghorn, Steven James, Julian Togelius

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted to The Genetic and Evolutionary Computation Conference 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.10552 2024-04-17 cs.CL cs.AI 88%

Unveiling the Misuse Potential of Base Large Language Models via In-Context Learning

Xiao Wang, Tianze Chen, Xianjun Yang, Qi Zhang, Xun Zhao, Dahua Lin

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.06149 2024-04-17 cs.CL cs.AI 88%

Can Large Language Models Automatically Score Proficiency of Written Essays?

Watheq Mansour, Salam Albatarni, Sohaila Eltanbouly, Tamer Elsayed

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments V2 (published version of LREC-COLING 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09696 2024-04-16 cs.CL cs.AI cs.ET 88%

Are Large Language Models Reliable Argument Quality Annotators?

Nailia Mirzakhmedova, Marcel Gohsen, Chia Hao Chang, Benno Stein

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments 18 pages, 5 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.04917 2024-04-16 cs.CL cs.AI 88%

Adapting Fake News Detection to the Era of Large Language Models

Jinyan Su, Claire Cardie, Preslav Nakov

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accept to NAACL 2024 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.08018 2024-04-15 cs.SE cs.AI cs.CL 88%

Analyzing the Performance of Large Language Models on Code Summarization

Rajarshi Haldar, Julia Hockenmaier

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.07084 2024-04-11 cs.CL cs.AI 88%

Dynamic Generation of Personalities with Large Language Models

Jianzhi Liu, Hexiang Gu, Tianyu Zheng, Liuyu Xiang, Huijia Wu, Jie Fu, Zhaofeng He

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.14207 2024-04-09 cs.CL cs.AI 88%

Assisting in Writing Wikipedia-like Articles From Scratch with Large Language Models

Yijia Shao, Yucheng Jiang, Theodore A. Kanell, Peter Xu, Omar Khattab, Monica S. Lam

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments 27 pages, NAACL 2024 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.18105 2024-04-03 cs.CL cs.AI 88%

Large Language Models for Education: A Survey and Outlook

Shen Wang, Tianlong Xu, Hang Li, Chaoli Zhang, Joleen Liang, Jiliang Tang, Philip S. Yu, Qingsong Wen

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14938 2024-04-02 cs.CL cs.AI 88%

Do LLMs Understand Social Knowledge? Evaluating the Sociability of Large Language Models with SocKET Benchmark

Minje Choi, Jiaxin Pei, Sagar Kumar, Chang Shu, David Jurgens

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Camera-ready version for EMNLP'23. First two authors contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00188 2024-04-02 cs.CL cs.AI 88%

DataAgent: Evaluating Large Language Models' Ability to Answer Zero-Shot, Natural Language Queries

Manit Mishra, Abderrahman Braham, Charles Marsom, Bryan Chung, Gavin Griffin, Dakshesh Sidnerlikar, Chatanya Sarin, Arjun Rajaram

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments 5 pages, Submitted to International Conference on AI in Cybersecurity

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.11676 2024-04-01 cs.CL cs.AI 88%

A Multi-Aspect Framework for Counter Narrative Evaluation using Large Language Models

Jaylen Jones, Lingbo Mo, Eric Fosler-Lussier, Huan Sun

专题命中 评测与基准 :large language model(title);language model(title);LLM(abstract);prompting(abstract)

Comments 22 pages, camera-ready version; references added, typos corrected, methodology section expanded, additional table

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.10997 2024-03-28 cs.CL cs.AI 88%

Retrieval-Augmented Generation for Large Language Models: A Survey

Yunfan Gao, Yun Xiong, Xinyu Gao, Kangxiang Jia, Jinliu Pan, Yuxi Bi, Yi Dai, Jiawei Sun, Meng Wang, Haofen Wang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Ongoing Work

详情

展开后加载摘要…

URL PDF HTML 收藏