arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 32096 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 32096 篇

2502.14137 2025-02-21 cs.IR 89%

Collaborative Retrieval for Large Language Model-based Conversational Recommender Systems

Yaochen Zhu, Chao Wan, Harald Steck, Dawen Liang, Yesu Feng, Nathan Kallus, Jundong Li

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Accepted by WWW'2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13626 2025-02-20 cs.CE 89%

AI-Empowered Catalyst Discovery: A Survey from Classical Machine Learning Approaches to Large Language Models

Yuanyuan Xu, Hanchen Wang, Wenjie Zhang, Lexing Xie, Yin Chen, Flora Salim, Ying Zhang, Justin Gooding, Toby Walsh

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.16149 2025-02-18 cs.SE 89%

PATCH: Empowering Large Language Model with Programmer-Intent Guidance and Collaborative-Behavior Simulation for Automatic Bug Fixing

Yuwei Zhang, Zhi Jin, Ying Xing, Ge Li, Fang Liu, Jiaxin Zhu, Wensheng Dou, Jun Wei

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Preprint, to appear in the ACM Transactions on Software Engineering and Methodology (TOSEM)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10815 2025-02-18 cs.AR 89%

LintLLM: An Open-Source Verilog Linting Framework Based on Large Language Models

Zhigang Fang, Renzhi Chen, Zhijie Yang, Yang Guo, Huadong Dai, Lei Wang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15896 2025-02-14 cs.SI 89%

Evaluation of Reliability Criteria for News Publishers with Large Language Models

Manuel Pratelli, John Bianchi, Fabio Pinelli, Marinella Petrocchi

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.08073 2025-02-13 cs.CY 89%

Large language models perpetuate bias in palliative care: development and analysis of the Palliative Care Adversarial Dataset (PCAD)

Naomi Akhras, Fares Antaki, Fannie Mottet, Olivia Nguyen, Shyam Sawhney, Sabrina Bajwah, Joanna M Davies

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments The complete PCAD datasets are available on Figshare: dx.doi.org/10.6084/m9.figshare.28396016

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07474 2025-02-12 cs.IR 89%

ETimeline: An Extensive Timeline Generation Dataset based on Large Language Model

Xiaochen Liu, Yanan Zhang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.01582 2025-02-12 econ.GN q-fin.EC 89%

Donald Trumps in the Virtual Polls: Simulating and Predicting Public Opinions in Surveys Using Large Language Models

Shapeng Jiang, Lijia Wei, Chen Zhang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.05212 2025-02-11 cs.CR cs.AI cs.CL cs.LG 89%

Preserving Privacy in Large Language Models: A Survey on Current Threats and Solutions

Michele Miranda, Elena Sofia Ruzzetti, Andrea Santilli, Fabio Massimo Zanzotto, Sébastien Bratières, Emanuele Rodolà

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Published in Transactions on Machine Learning Research (TMLR) https://openreview.net/forum?id=Ss9MTTN7OL

Journal ref Transactions on Machine Learning Research, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04029 2025-02-07 cs.HC 89%

Echo-Teddy: Preliminary Design and Development of Large Language Model-based Social Robot for Autistic Students

Unggi Lee, Hansung Kim, Juhong Eom, Hyeonseo Jeong, Seungyeon Lee, Gyuri Byun, Yunseo Lee, Minji Kang, Gospel Kim, Jihoi Na, Jewoong Moon, Hyeoncheol Kim

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03425 2025-02-06 cs.SE 89%

Harnessing Large Language Models for Curated Code Reviews

Oussama Ben Sghaier, Martin Weyssow, Houari Sahraoui

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.16998 2025-01-29 cs.SE 89%

Large Language Models for Code Generation: The Practitioners Perspective

Zeeshan Rasheed, Muhammad Waseem, Kai Kristian Kemell, Aakash Ahmad, Malik Abdul Sami, Jussi Rasku, Kari Systä, Pekka Abrahamsson

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 20 pages, 4 figures, 2 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.07692 2025-01-28 cs.LG cs.AI cs.CL cs.GT 89%

On The Truthfulness of 'Surprisingly Likely' Responses of Large Language Models

Naman Goel

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.12988 2025-01-23 eess.SP 89%

Large Language Model-Based Semantic Communication System for Image Transmission

Soheyb Ribouh, Osama Saleem

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.18373 2025-01-23 cs.NI 89%

6G comprehensive intelligence: network operations and optimization based on Large Language Models

Sifan Long, Fengxiao Tang, Yangfan Li, Tiao Tan, Zhengjie Jin, Ming Zhao, Nei Kato

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments This paper has been published on the IEEE network, and the relevant information is as follows: 8 pages, 5 figures, 15 preferences,

Journal ref IEEE Network (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.12221 2025-01-22 cs.DL 89%

Leveraging Large Language Models for Realizing Truly Intelligent User Interfaces

Allard Oelen, Sören Auer

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.00676 2025-01-22 cs.SE 89%

Fixing Function-Level Code Generation Errors for Foundation Large Language Models

Hao Wen, Yueheng Zhu, Chao Liu, Xiaoxue Ren, Weiwei Du, Meng Yan

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16239 2025-01-20 cs.CR 89%

CS-Eval: A Comprehensive Large Language Model Benchmark for CyberSecurity

Zhengmin Yu, Jiutian Zeng, Siyi Chen, Wenhan Xu, Dandan Xu, Xiangyu Liu, Zonghao Ying, Nan Wang, Yuan Zhang, Min Yang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.02901 2025-01-07 cs.SE cs.PL 89%

DeCon: Detecting Incorrect Assertions via Postconditions Generated by a Large Language Model

Hao Yu, Tianyu Chen, Jiaming Huang, Zongyang Li, Dezhi Ran, Xinyu Wang, Ying Li, Assaf Marron, David Harel, Yuan Xie, Tao Xie

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.02408 2025-01-07 cs.IR 89%

GenTREC: The First Test Collection Generated by Large Language Models for Evaluating Information Retrieval Systems

Mehmet Deniz Türkmen, Mucahid Kutlu, Bahadir Altun, Gokalp Cosgun

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.20427 2024-12-31 cs.IR 89%

AmalREC: A Dataset for Relation Extraction and Classification Leveraging Amalgamation of Large Language Models

Mansi, Pranshu Pandya, Mahek Bhavesh Vora, Soumya Bharadwaj, Ashish Anand

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 18 pages, 5 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.16120 2024-12-20 cs.SE 89%

Fixing Large Language Models' Specification Misunderstanding for Better Code Generation

Zhao Tian, Junjie Chen, Xiangyu Zhang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(abstract)

Comments Accepted by ICSE 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.07499 2024-12-18 cs.IR 89%

Can Large Language Models Assess Serendipity in Recommender Systems?

Yu Tokutake, Kazushi Okamoto

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Journal ref Journal of Advanced Computational Intelligence and Intelligent Informatics, Fuji Technology Press, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10509 2024-12-17 cs.AI cs.CL cs.LG 89%

Do Large Language Models Show Biases in Causal Learning?

Maria Victoria Carro, Francisca Gauna Selasco, Denise Alejandra Mester, Margarita Gonzales, Mario A. Leiva, Maria Vanina Martinez, Gerardo I. Simari

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 15 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06693 2024-12-10 cs.CL cs.AI cs.CV cs.LG cs.MM 89%

OmniEvalKit: A Modular, Lightweight Toolbox for Evaluating Large Language Model and its Omni-Extensions

Yi-Kai Zhang, Xu-Xiang Zhong, Shiyin Lu, Qing-Guo Chen, De-Chuan Zhan, Han-Jia Ye

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05625 2024-12-10 cs.RO 89%

Can Large Language Models Help Developers with Robotic Finite State Machine Modification?

Xiangyu Robin Gan, Yuxin Ray Song, Nick Walker, Maya Cakmak

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05093 2024-12-09 cs.CY 89%

Sense and Sensitivity: Evaluating the simulation of social dynamics via Large Language Models

Da Ju, Adina Williams, Brian Karrer, Maximilian Nickel

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.07057 2024-12-09 cs.CL cs.AI cs.CV cs.LG 89%

MultiTrust: A Comprehensive Benchmark Towards Trustworthy Multimodal Large Language Models

Yichi Zhang, Yao Huang, Yitong Sun, Chang Liu, Zhe Zhao, Zhengwei Fang, Yifan Wang, Huanran Chen, Xiao Yang, Xingxing Wei, Hang Su, Yinpeng Dong, Jun Zhu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 100 pages, 84 figures, 33 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04056 2024-12-06 cs.MA cs.CY cs.HC 89%

Prompt Engineering Guidance for Conceptual Agent-based Model Extraction using Large Language Models

Siamak Khatami, Christopher Frantz

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.15017 2024-12-05 cs.CL cs.AI cs.CV cs.HC cs.LG 89%

Knowledge Mechanisms in Large Language Models: A Survey and Perspective

Mengru Wang, Yunzhi Yao, Ziwen Xu, Shuofei Qiao, Shumin Deng, Peng Wang, Xiang Chen, Jia-Chen Gu, Yong Jiang, Pengjun Xie, Fei Huang, Huajun Chen, Ningyu Zhang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments EMNLP 2024 Findings; 39 pages (v4)

详情

展开后加载摘要…

URL PDF HTML 收藏