arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 32096 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 32096 篇

2403.15482 2024-03-26 cs.CL cs.HC cs.LG 88%

Multi-Level Feedback Generation with Large Language Models for Empowering Novice Peer Counselors

Alicja Chaszczewicz, Raj Sanjay Shah, Ryan Louie, Bruce A Arnow, Robert Kraut, Diyi Yang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.07039 2024-03-22 cs.AR cs.AI cs.CL 88%

From English to ASIC: Hardware Implementation with Large Language Model

Emil Goh, Maoyang Xiang, I-Chyn Wey, T. Hui Teo

专题命中 评测与基准 :language model(title,abstract);large language model(title);LLM(abstract);分类 cs.CL、cs.AI

Comments 15 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.12368 2024-03-20 cs.CL cs.AI 88%

Characteristic AI Agents via Large Language Models

Xi Wang, Hongliang Dai, Shen Gao, Piji Li

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments COLING 2024,The benchmark is available at: https://github.com/nuaa-nlp/Character100

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.12171 2024-03-20 cs.CL cs.AI 88%

EasyJailbreak: A Unified Framework for Jailbreaking Large Language Models

Weikang Zhou, Xiao Wang, Limao Xiong, Han Xia, Yingshuang Gu, Mingxu Chai, Fukang Zhu, Caishuang Huang, Shihan Dou, Zhiheng Xi, Rui Zheng, Songyang Gao, Yicheng Zou, Hang Yan, Yifan Le, Ruohui Wang, Lijun Li, Jing Shao, Tao Gui, Qi Zhang, Xuanjing Huang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.13202 2024-03-19 cs.CL cs.AI 88%

Investigating Large Language Models and Control Mechanisms to Improve Text Readability of Biomedical Abstracts

Zihao Li, Samuel Belkadi, Nicolo Micheletti, Lifeng Han, Matthew Shardlow, Goran Nenadic

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted by IEEE-ICHI 2024 https://ieeeichi2024.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.09750 2024-03-18 cs.CL cs.AI 88%

Meta-Cognitive Analysis: Evaluating Declarative and Procedural Knowledge in Datasets and Large Language Models

Zhuoqun Li, Hongyu Lin, Yaojie Lu, Hao Xiang, Xianpei Han, Le Sun

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted by LREC-COLING 2024 as a short paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.03690 2024-03-07 cs.CL cs.AI 88%

Rapidly Developing High-quality Instruction Data and Evaluation Benchmark for Large Language Models with Minimal Human Effort: A Case Study on Japanese

Yikun Sun, Zhen Wan, Nobuhiro Ueda, Sakiko Yahata, Fei Cheng, Chenhui Chu, Sadao Kurohashi

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments COLING 2024. Our code are available here: \href{https://github.com/hitoshizuku7/awesome-Ja-self-instruct}{self-instruct data} and \href{https://github.com/ku-nlp/ja-vicuna-qa-benchmark}{evaluation benchmark}

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.05273 2024-02-27 cs.CL cs.AI 88%

INACIA: Integrating Large Language Models in Brazilian Audit Courts: Opportunities and Challenges

Jayr Pereira, Andre Assumpcao, Julio Trecenti, Luiz Airosa, Caio Lente, Jhonatan Cléto, Guilherme Dobins, Rodrigo Nogueira, Luis Mitchell, Roberto Lotufo

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.16389 2024-02-27 cs.CL cs.AI 88%

MoZIP: A Multilingual Benchmark to Evaluate Large Language Models in Intellectual Property

Shiwen Ni, Minghuan Tan, Yuelin Bai, Fuqiang Niu, Min Yang, Bowen Zhang, Ruifeng Xu, Xiaojun Chen, Chengming Li, Xiping Hu, Ye Li, Jianping Fan

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Journal ref LREC-COLING 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.12474 2024-02-27 cs.CL cs.AI 88%

Evaluating the Performance of Large Language Models on GAOKAO Benchmark

Xiaotian Zhang, Chunyang Li, Yi Zong, Zhengyu Ying, Liang He, Xipeng Qiu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.13714 2024-02-22 q-bio.QM cs.AI cs.LG 88%

An Evaluation of Large Language Models in Bioinformatics Research

Hengchuang Yin, Zhonghui Gu, Fanhao Wang, Yiparemu Abuduhaibaier, Yanqiao Zhu, Xinming Tu, Xian-Sheng Hua, Xiao Luo, Yizhou Sun

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.08107 2024-02-22 cs.LG cs.CL 88%

AutoML in the Age of Large Language Models: Current Challenges, Future Opportunities and Risks

Alexander Tornede, Difan Deng, Theresa Eimer, Joseph Giovanelli, Aditya Mohan, Tim Ruhkopf, Sarah Segel, Daphne Theodorakopoulos, Tanja Tornede, Henning Wachsmuth, Marius Lindauer

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

Comments Submitted and accepted at TMLR: https://openreview.net/forum?id=cAthubStyG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.12738 2024-02-21 cs.CL cs.AI cs.HC 88%

Can Large Language Models be Used to Provide Psychological Counselling? An Analysis of GPT-4-Generated Responses Using Role-play Dialogues

Michimasa Inaba, Mariko Ukiyo, Keiko Takamizo

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted as a conference paper at IWSDS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.11051 2024-02-20 cs.CL cs.AI 88%

Large Language Models Fall Short: Understanding Complex Relationships in Detective Narratives

Runcong Zhao, Qinglin Zhu, Hainiu Xu, Jiazheng Li, Yuxiang Zhou, Yulan He, Lin Gui

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.08341 2024-02-16 cs.CL cs.AI 88%

Eliciting Personality Traits in Large Language Models

Airlie Hilliard, Cristian Munoz, Zekun Wu, Adriano Soares Koshiyama

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Manuscript submitted to ACM Facct. Authors One and Two contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.07384 2024-02-13 cs.CV cs.AI cs.LG 88%

Exploring Perceptual Limitation of Multimodal Large Language Models

Jiarui Zhang, Jinyi Hu, Mahyar Khayatkhoei, Filip Ilievski, Maosong Sun

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

Comments 14 pages, 14 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.05939 2024-02-12 cs.SE cs.CL cs.LG 88%

Uncertainty Awareness of Large Language Models Under Code Distribution Shifts: A Benchmark Study

Yufei Li, Simin Chen, Yanghong Guo, Wei Yang, Yue Dong, Cong Liu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

Comments 16 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.14877 2024-02-09 cs.CL cs.AI 88%

Robust Knowledge Extraction from Large Language Models using Social Choice Theory

Nico Potyka, Yuqicheng Zhu, Yunjie He, Evgeny Kharlamov, Steffen Staab

专题命中 评测与基准 :language model(title,abstract);large language model(title);LLM(abstract);分类 cs.CL、cs.AI

Comments Accepted by AAMAS 2024 as a full paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.03597 2024-02-07 cs.CL cs.IR cs.LG 88%

Identifying Reasons for Contraceptive Switching from Real-World Data Using Large Language Models

Brenda Y. Miao, Christopher YK Williams, Ebenezer Chinedu-Eneh, Travis Zack, Emily Alsentzer, Atul J. Butte, Irene Y. Chen

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.01065 2024-02-05 cs.CL cs.AI 88%

Evaluation Methodology for Large Language Models for Multilingual Document Question and Answer

Adar Kahana, Jaya Susan Mathew, Said Bleik, Jeremy Reynolds, Oren Elisha

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.17589 2024-01-30 cs.CL cs.AI 88%

An Open Source Data Contamination Report for Large Language Models

Yucheng Li, Frank Guerin, Chenghua Lin

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.14317 2024-01-23 cs.AI cs.CL cs.SE 88%

ICE-Score: Instructing Large Language Models to Evaluate Code

Terry Yue Zhuo

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted to Findings of EACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.17484 2024-01-19 cs.CL cs.AI 88%

Truth Forest: Toward Multi-Scale Truthfulness in Large Language Models through Intervention without Tuning

Zhongzhi Chen, Xingwu Sun, Xianfeng Jiao, Fengzong Lian, Zhanhui Kang, Di Wang, Cheng-Zhong Xu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted as AAAI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.06805 2024-01-19 cs.CL cs.AI 88%

Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning

Yiqi Wang, Wentao Chen, Xiaotian Han, Xudong Lin, Haiteng Zhao, Yongfei Liu, Bohan Zhai, Jianbo Yuan, Quanzeng You, Hongxia Yang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.06437 2024-01-17 cs.GR cs.AI cs.CL 88%

3D-PreMise: Can Large Language Models Generate 3D Shapes with Sharp Features and Parametric Control?

Zeqing Yuan, Haoxuan Lan, Qiang Zou, Junbo Zhao

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments 10 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.06466 2024-01-15 cs.CL cs.AI 88%

PersianMind: A Cross-Lingual Persian-English Large Language Model

Pedram Rostami, Ali Salemi, Mohammad Javad Dousti

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.04515 2024-01-10 cs.CL cs.AI 88%

Exploring Prompt-Based Methods for Zero-Shot Hypernym Prediction with Large Language Models

Mikhail Tikhomirov, Natalia Loukachevitch

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.09150 2024-01-09 cs.CL cs.AI 88%

Can Large Language Models Understand Real-World Complex Instructions?

Qianyu He, Jie Zeng, Wenhao Huang, Lina Chen, Jin Xiao, Qianxi He, Xunzhe Zhou, Lida Chen, Xintao Wang, Yuncheng Huang, Haoning Ye, Zihan Li, Shisong Chen, Yikai Zhang, Zhouhong Gu, Jiaqing Liang, Yanghua Xiao

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.06281 2024-01-04 cs.CL cs.AI 88%

EQ-Bench: An Emotional Intelligence Benchmark for Large Language Models

Samuel J. Paech

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.01044 2024-01-03 cs.SD cs.AI cs.CL eess.AS 88%

Auffusion: Leveraging the Power of Diffusion and Large Language Models for Text-to-Audio Generation

Jinlong Xue, Yayue Deng, Yingming Gao, Ya Li

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Demo and implementation at https://auffusion.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏