arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 32208 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 32208 篇

2409.00369 2024-09-11 cs.CL 88%

An Empirical Study on Information Extraction using Large Language Models

Ridong Han, Chaohao Yang, Tao Peng, Prayag Tiwari, Xiang Wan, Lu Liu, Benyou Wang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments This submission was intended instead as the replacement of arXiv:2305.14450 , where it now appears as arXiv:2305.14450v2

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.02617 2024-09-05 cs.CL 88%

PUB: Plot Understanding Benchmark and Dataset for Evaluating Large Language Models on Synthetic Visual Data Interpretation

Aneta Pawelec, Victoria Sara Wesołowska, Zuzanna Bączek, Piotr Sankowski

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.14154 2024-09-04 cs.CL cs.CV cs.CY 88%

MM-Soc: Benchmarking Multimodal Large Language Models in Social Media Platforms

Yiqiao Jin, Minje Choi, Gaurav Verma, Jindong Wang, Srijan Kumar

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments In Proceedings of ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.03058 2024-09-04 cs.CL cs.SE 88%

Zero-shot Bilingual App Reviews Mining with Large Language Models

Jialiang Wei, Anne-Lise Courbis, Thomas Lambolais, Binbin Xu, Pierre Louis Bernard, Gérard Dray

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments Accepted for The 35th IEEE International Conference on Tools with Artificial Intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.14750 2024-08-28 cs.CL cs.DL 88%

LyCon: Lyrics Reconstruction from the Bag-of-Words Using Large Language Models

Haven Kim, Kahyun Choi

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments Dataset downlodable at https://github.com/havenpersona/lycon

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.08508 2024-08-27 cs.CL 88%

EmoLLMs: A Series of Emotional Large Language Models and Annotation Tools for Comprehensive Affective Analysis

Zhiwei Liu, Kailai Yang, Tianlin Zhang, Qianqian Xie, Sophia Ananiadou

专题命中 评测与基准 :large language model(title);language model(title);LLM(abstract);instruction tuning(abstract)

Comments Accepted by KDD 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.05126 2024-08-26 cs.HC cs.CL cs.SI 88%

Large Language Models and Thematic Analysis: Human-AI Synergy in Researching Hate Speech on Social Media

Petre Breazu, Miriam Schirmer, Songbo Hu, Napoleon Katsos

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.12599 2024-08-23 cs.CL 88%

Controllable Text Generation for Large Language Models: A Survey

Xun Liang, Hanyu Wang, Yezhaohui Wang, Shichao Song, Jiawei Yang, Simin Niu, Jie Hu, Dan Liu, Shunyu Yao, Feiyu Xiong, Zhiyu Li

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments 52 pages, 11 figures, 7 tables, 11 equations

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11981 2024-08-23 cs.CL 88%

Large Language Models for Page Stream Segmentation

Hunter Heidenreich, Ratish Dalvi, Rohith Mukku, Nikhil Verma, Neven Pičuljan

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11826 2024-08-23 cs.CY cs.AI 88%

Generative Organizational Behavior Simulation using Large Language Model based Autonomous Agents: A Holacracy Perspective

Chen Zhu, Yihang Cheng, Jingshuai Zhang, Yusheng Qiu, Sitao Xia, Hengshu Zhu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08848 2024-08-19 cs.CL 88%

PsychoLex: Unveiling the Psychological Mind of Large Language Models

Mohammad Amin Abbasi, Farnaz Sadat Mirnezami, Hassan Naderi

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08422 2024-08-19 cs.CE cs.AI 88%

Assessing and Enhancing Large Language Models in Rare Disease Question-answering

Guanchu Wang, Junhao Ran, Ruixiang Tang, Chia-Yuan Chang, Chia-Yuan Chang, Yu-Neng Chuang, Zirui Liu, Vladimir Braverman, Zhandong Liu, Xia Hu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.06249 2024-08-19 cs.CE cs.CL 88%

No Language is an Island: Unifying Chinese and English in Financial Large Language Models, Instruction Data, and Benchmarks

Gang Hu, Ke Qin, Chenhan Yuan, Min Peng, Alejandro Lopez-Lira, Benyou Wang, Sophia Ananiadou, Jimin Huang, Qianqian Xie

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments 19 pages, 3 figures, 12 tables, including Appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.05319 2024-08-19 cs.CR cs.LG cs.PL cs.SE 88%

Large Language Models for Code: Security Hardening and Adversarial Testing

Jingxuan He, Martin Vechev

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

Comments Accepted to ACM CCS 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.12261 2024-08-14 cs.CL 88%

NEO-BENCH: Evaluating Robustness of Large Language Models with Neologisms

Jonathan Zheng, Alan Ritter, Wei Xu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments accepted to ACL 2024 main conference, 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.06040 2024-08-13 cs.CV cs.CL 88%

ARPA: A Novel Hybrid Model for Advancing Visual Word Disambiguation Using Large Language Models and Transformers

Aristi Papastavrou, Maria Lymperaiou, Giorgos Stamou

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.00981 2024-08-08 cs.HC cs.CL 88%

VisEval: A Benchmark for Data Visualization in the Era of Large Language Models

Nan Chen, Yuge Zhang, Jiahang Xu, Kan Ren, Yuqing Yang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.02237 2024-08-06 cs.CL 88%

Do Large Language Models Speak All Languages Equally? A Comparative Study in Low-Resource Settings

Md. Arid Hasan, Prerona Tarannum, Krishno Dey, Imran Razzak, Usman Naseem

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.05695 2024-08-06 cs.CL 88%

Integrating Physician Diagnostic Logic into Large Language Models: Preference Learning from Process Feedback

Chengfeng Dou, Zhi Jin, Wenpin Jiao, Haiyan Zhao, Yongqiang Zhao, Zhenwei Tao

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments Accepted by ACL2024 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.15699 2024-08-05 cs.CL 88%

FEEL: A Framework for Evaluating Emotional Support Capability with Large Language Models

Huaiwen Zhang, Yu Chen, Ming Wang, Shi Feng

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments Accepted to ICIC 2024

Journal ref Advanced Intelligent Computing Technology and Applications. ICIC 2024. Lecture Notes in Computer Science

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.19528 2024-07-30 cs.CL 88%

Motamot: A Dataset for Revealing the Supremacy of Large Language Models over Transformer Models in Bengali Political Sentiment Analysis

Fatema Tuj Johora Faria, Mukaffi Bin Moin, Rabeya Islam Mumu, Md Mahabubul Alam Abir, Abrar Nawar Alfy, Mohammad Shafiul Alam

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments Accepted for publication in "The IEEE Region 10 Symposium (TENSYMP 2024)"

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.19280 2024-07-30 cs.AI cs.RO 88%

Large Language Models for Human-like Autonomous Driving: A Survey

Yun Li, Kai Katsumata, Ehsan Javanmardi, Manabu Tsukada

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments 8 pages, 2 figures, accepted at IEEE Intelligent Transportation Systems Conference (ITSC) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.16089 2024-07-30 cs.CL cs.IR 88%

Towards Completeness-Oriented Tool Retrieval for Large Language Models

Changle Qu, Sunhao Dai, Xiaochi Wei, Hengyi Cai, Shuaiqiang Wang, Dawei Yin, Jun Xu, Ji-Rong Wen

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments Accepted by CIKM 2024; GitHub: https://github.com/quchangle1/COLT

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.19240 2024-07-30 cs.CL 88%

M4LE: A Multi-Ability Multi-Range Multi-Task Multi-Domain Long-Context Evaluation Benchmark for Large Language Models

Wai-Chung Kwan, Xingshan Zeng, Yufei Wang, Yusen Sun, Liangyou Li, Lifeng Shang, Qun Liu, Kam-Fai Wong

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments Code and data are available at https://github.com/KwanWaiChung/M4LE

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.14656 2024-07-24 cs.CL 88%

Scientific Large Language Models: A Survey on Biological & Chemical Domains

Qiang Zhang, Keyang Ding, Tianwen Lyv, Xinda Wang, Qingyu Yin, Yiwen Zhang, Jing Yu, Yuhao Wang, Xiaotong Li, Zhuoyi Xiang, Kehua Feng, Xiang Zhuang, Zeyuan Wang, Ming Qin, Mengyao Zhang, Jinlu Zhang, Jiyu Cui, Tao Huang, Pengju Yan, Renjun Xu, Hongyang Chen, Xiaolin Li, Xiaohui Fan, Huabin Xing, Huajun Chen

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.13069 2024-07-19 cs.CL cs.IR 88%

Dynamic Sentiment Analysis with Local Large Language Models using Majority Voting: A Study on Factors Affecting Restaurant Evaluation

Junichiro Niimi

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments This manuscript is under peer review

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.09209 2024-07-19 cs.CL eess.AS 88%

Pronunciation Assessment with Multi-modal Large Language Models

Kaiqi Fu, Linkai Peng, Nan Yang, Shuran Zhou

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.09977 2024-07-16 physics.geo-ph cs.AI 88%

Mitigating Interpretation Bias in Rock Records with Large Language Models: Insights from Paleoenvironmental Analysis

Luoqi Wang, Haipeng Li, Linshu Hu, Jiarui Cai, Zhenhong Du

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.08922 2024-07-15 cs.LG 88%

Leveraging large language models for nano synthesis mechanism explanation: solid foundations or mere conjectures?

Yingming Pu, Liping Huang, Tao Lin, Hongyu Chen

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.05563 2024-07-09 cs.CL 88%

LLMBox: A Comprehensive Library for Large Language Models

Tianyi Tang, Yiwen Hu, Bingqian Li, Wenyang Luo, Zijing Qin, Haoxiang Sun, Jiapeng Wang, Shiyi Xu, Xiaoxue Cheng, Geyang Guo, Han Peng, Bowen Zheng, Yiru Tang, Yingqian Min, Yushuo Chen, Jie Chen, Yuanqian Zhao, Luran Ding, Yuhao Wang, Zican Dong, Chunxuan Xia, Junyi Li, Kun Zhou, Wayne Xin Zhao, Ji-Rong Wen

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments Accepted by ACL 2024 Demo

详情

展开后加载摘要…

URL PDF HTML 收藏