arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 32207 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 32207 篇

2409.15706 2024-09-25 cs.HC cs.AI 89%

Improving Emotional Support Delivery in Text-Based Community Safety Reporting Using Large Language Models

Yiren Liu, Yerong Li, Ryan Mayfield, Yun Huang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.15334 2024-09-25 cs.CL 89%

Evaluating Large Language Models with Tests of Spanish as a Foreign Language: Pass or Fail?

Marina Mayor-Rocher, Nina Melero, Elena Merino-Gómez, María Grandury, Javier Conde, Pedro Reviriego

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.01909 2024-09-25 cs.CL cs.SD eess.AS 89%

Pinyin Regularization in Error Correction for Chinese Speech Recognition with Large Language Models

Zhiyuan Tang, Dong Wang, Shen Huang, Shidong Shang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

Comments Interspeech 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.03882 2024-09-25 cs.CL cs.SD eess.AS 89%

Spontaneous Speech-Based Suicide Risk Detection Using Whisper and Large Language Models

Ziyun Cui, Chang Lei, Wen Wu, Yinan Duan, Diyang Qu, Ji Wu, Runsen Chen, Chao Zhang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments Accepted by Interspeech 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14997 2024-09-24 cs.CL 89%

Enhancing Aspect-based Sentiment Analysis in Tourism Using Large Language Models and Positional Information

Chun Xu, Mengmeng Wang, Yan Ren, Shaolin Zhu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments 19 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.06853 2024-09-24 cs.CL 89%

History, Development, and Principles of Large Language Models-An Introductory Survey

Zichong Wang, Zhibo Chu, Thang Viet Doan, Shiwen Ni, Min Yang, Wenbin Zhang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14473 2024-09-24 cs.CE cs.CL 89%

A Large Language Model and Denoising Diffusion Framework for Targeted Design of Microstructures with Commands in Natural Language

Nikita Kartashov, Nikolaos N. Vlassis

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments 29 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14371 2024-09-24 cs.CL 89%

The Ability of Large Language Models to Evaluate Constraint-satisfaction in Agent Responses to Open-ended Requests

Lior Madmoni, Amir Zait, Ilia Labzovsky, Danny Karmon

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.05216 2024-09-24 cs.CL 89%

Large Language Model as an Assignment Evaluator: Insights, Feedback, and Challenges in a 1000+ Student Course

Cheng-Han Chiang, Wei-Chih Chen, Chun-Yi Kuan, Chienchou Yang, Hung-yi Lee

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments EMNLP 2024 main conference paper. An empirical report of our course: Introduction to Generative AI 2024 Spring (https://speech.ee.ntu.edu.tw/~hylee/genai/2024-spring.php)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.07938 2024-09-24 cs.CL 89%

EconLogicQA: A Question-Answering Benchmark for Evaluating Large Language Models in Economic Sequential Reasoning

Yinzhu Quan, Zefang Liu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.01133 2024-09-24 cs.LG eess.SP 89%

Evaluating Large Language Models as Virtual Annotators for Time-series Physical Sensing Data

Aritra Hota, Soumyajit Chatterjee, Sandip Chakraborty

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

Journal ref ACM Transactions on Intelligent Systems and Technology 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.13940 2024-09-23 cs.CL 89%

A User-Centric Multi-Intent Benchmark for Evaluating Large Language Models

Jiayin Wang, Fengran Mo, Weizhi Ma, Peijie Sun, Min Zhang, Jian-Yun Nie

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.09054 2024-09-17 cs.SE cs.AI cs.PL 89%

Evaluating the Performance of Large Language Models in Competitive Programming: A Multi-Year, Multi-Grade Analysis

Adrian Marius Dumitran, Adrian Catalin Badea, Stefan-Gabriel Muscalu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments 7 pages, Inista 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.07556 2024-09-16 cs.CL 89%

Truth-Aware Context Selection: Mitigating Hallucinations of Large Language Models Being Misled by Untruthful Contexts

Tian Yu, Shaolei Zhang, Yang Feng

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments Accepted to ACL 2024 Findings. Code is available at: https://github.com/ictnlp/TACS

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.02219 2024-09-12 cs.IR cs.AI 89%

A Normative Framework for Benchmarking Consumer Fairness in Large Language Model Recommender System

Yashar Deldjoo, Fatemeh Nazary

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16528 2024-09-11 cs.CL 89%

Evaluating the Ability of Large Language Models to Reason about Cardinal Directions

Anthony G Cohn, Robert E Blackwell

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments 9 pages, 3 figures, 1 table. Short paper accepted by COSIT 24, The 16th Conference on Spatial Information Theory

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.15991 2024-09-06 cs.SE cs.LG cs.PL 89%

WhiteFox: White-Box Compiler Fuzzing Empowered by Large Language Models

Chenyuan Yang, Yinlin Deng, Runyu Lu, Jiayi Yao, Jiawei Liu, Reyhaneh Jabbarvand, Lingming Zhang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

Comments Published in OOPSLA 2024

Journal ref Proc. ACM Program. Lang., Vol. 8, No. OOPSLA2, Article 296. Publication date: October 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.00202 2024-09-04 cs.CL 89%

The creative psychometric item generator: a framework for item generation and validation using large language models

Antonio Laverghetta, Simone Luchini, Averie Linell, Roni Reiter-Palmon, Roger Beaty

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments CREAI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.00089 2024-09-04 cs.CR cs.AI 89%

Watermarking Techniques for Large Language Models: A Survey

Yuqing Liang, Jiancheng Xiao, Wensheng Gan, Philip S. Yu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments Preprint. 19 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.17431 2024-09-02 eess.AS cs.AI 89%

Advancing Multi-talker ASR Performance with Large Language Models

Mohan Shi, Zengrui Jin, Yaoxun Xu, Yong Xu, Shi-Xiong Zhang, Kun Wei, Yiwen Shao, Chunlei Zhang, Dong Yu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments 8 pages, accepted by IEEE SLT 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.16740 2024-08-30 cs.CL 89%

Theoretical and Methodological Framework for Studying Texts Produced by Large Language Models

Jiří Milička

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.05418 2024-08-30 cs.CL 89%

Mitigating Exaggerated Safety in Large Language Models

Ruchira Ray, Ruchi Bhalani

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

Comments 17 pages, 8 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.11911 2024-08-30 cs.CL 89%

InstructERC: Reforming Emotion Recognition in Conversation with Multi-task Retrieval-Augmented Large Language Models

Shanglin Lei, Guanting Dong, Xiaoping Wang, Keheng Wang, Runqi Qiao, Sirui Wang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.14834 2024-08-28 cs.SE cs.AI 89%

Strategic Optimization and Challenges of Large Language Models in Object-Oriented Programming

Zinan Wang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.05885 2024-08-28 cs.CL 89%

Are Large Language Models Actually Good at Text Style Transfer?

Sourabrata Mukherjee, Atul Kr. Ojha, Ondřej Dušek

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.07595 2024-08-22 cs.CR cs.AI cs.SE 89%

VulDetectBench: Evaluating the Deep Capability of Vulnerability Detection with Large Language Models

Yu Liu, Lang Gao, Mingxin Yang, Yu Xie, Ping Chen, Xiaojin Zhang, Wei Chen

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11043 2024-08-21 cs.CY cs.AI 89%

Reconciling Methodological Paradigms: Employing Large Language Models as Novice Qualitative Research Assistants in Talent Management Research

Sreyoshi Bhaduri, Satya Kapoor, Alex Gil, Anshul Mittal, Rutu Mulkar

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments Accepted to KDD '24 workshop on Talent Management and Computing (TMC 2024). 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.10357 2024-08-21 cs.CL cs.IR 89%

Beyond Relevant Documents: A Knowledge-Intensive Approach for Query-Focused Summarization using Large Language Models

Weijia Zhang, Jia-Hong Huang, Svitlana Vakulenko, Yumo Xu, Thilina Rajapakse, Evangelos Kanoulas

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments Accepted by the 27th International Conference on Pattern Recognition (ICPR 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.08068 2024-08-19 cs.CL 89%

Large Language Models Meet Text-Centric Multimodal Sentiment Analysis: A Survey

Hao Yang, Yanyan Zhao, Yang Wu, Shilong Wang, Tian Zheng, Hongbo Zhang, Zongyang Ma, Wanxiang Che, Bing Qin

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments arXiv admin note: text overlap with arXiv:2210.14556 by other authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.07884 2024-08-16 cs.CL 89%

Instruct Large Language Models to Generate Scientific Literature Survey Step by Step

Yuxuan Lai, Yupeng Wu, Yidan Wang, Wenpeng Hu, Chen Zheng

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments NLPCC 2024

详情

展开后加载摘要…

URL PDF HTML 收藏