arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 32208 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 32208 篇

2404.00699 2025-07-11 cs.CL 89%

A Comprehensive Survey of Contamination Detection Methods in Large Language Models

Mathieu Ravaut, Bosheng Ding, Fangkai Jiao, Hailin Chen, Xingxuan Li, Ruochen Zhao, Chengwei Qin, Caiming Xiong, Shafiq Joty

机构 * Nanyang Technological University(南洋理工大学) Institute of Infocomm Research (I2R), A*STAR(信息通信研究所(I2R),A*STAR) Salesforce Research(Salesforce研究)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments Accepted by TMLR in July 2025. 18 pages, 1 figure, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05565 2025-07-09 cs.SE cs.AI cs.NE 89%

Search-based Selection of Metamorphic Relations for Optimized Robustness Testing of Large Language Models

Sangwon Hyun, Shaukat Ali, M. Ali Babar

机构 * The University of Adelaide(阿德莱德大学) Simula Research Laboratory(Simula研究实验室)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04803 2025-07-08 cs.AI 89%

Application and Evaluation of Large Language Models for Forecasting the Impact of Traffic Incidents

George Jagadeesh, Srikrishna Iyer, Michal Polanowski, Kai Xin Thia

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments This paper has been accepted for publication at the 2025 IEEE 28th International Conference on Intelligent Transportation Systems (ITSC), Gold Coast, Australia, 2025. Copyright IEEE

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04697 2025-07-08 cs.LG cs.DC cs.MS 89%

Performance Evaluation of General Purpose Large Language Models for Basic Linear Algebra Subprograms Code Generation

Daichi Mukunoki, Shun-ichiro Hayashi, Tetsuya Hoshino, Takahiro Katagiri

机构 * Information Technology Center\ University Nagoya, Aichi 466-8601 Email Graduate School of Informatics\ University Nagoya, Aichi 466-8601 Email

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

Comments 8 pages, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.19265 2025-07-08 cs.CL 89%

PHEONA: An Evaluation Framework for Large Language Model-based Approaches to Computational Phenotyping

Sarah Pungitore, Shashank Yadav, Vignesh Subbian

机构 * Program in Applied Mathematics, The University of Arizona(应用数学项目,亚利桑那大学) College of Engineering, The University of Arizona(工程学院,亚利桑那大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments 2 figures, 5 tables, accepted at 2025 AMIA Annual Symposium

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02919 2025-07-08 cs.CL cs.CY cs.ET 89%

ChatGPT is not A Man but Das Man: Representativeness and Structural Consistency of Silicon Samples Generated by Large Language Models

Dai Li, Linzhuo Li, Huilian Sophie Qiu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23486 2025-07-04 cs.AI 89%

Autoformalization in the Era of Large Language Models: A Survey

Ke Weng, Lun Du, Sirui Li, Wangyue Lu, Haozhe Sun, Hengyu Liu, Tiancheng Zhang

机构 * Northeastern University(东北大学) Ant Research Institute, Ant Group(蚂蚁集团研究院) Department of Computer Science, Aalborg University(奥尔堡大学计算机科学系)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02241 2025-07-04 cs.LG 89%

VERBA: Verbalizing Model Differences Using Large Language Models

Shravan Doda, Shashidhar Reddy Javaji, Zining Zhu

机构 * Stevens Institute of Technology(史蒂文斯理工学院)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00693 2025-07-02 cs.SD cs.CL eess.AS 89%

Leveraging Large Language Models for Spontaneous Speech-Based Suicide Risk Detection

Yifan Gao, Jiao Fu, Long Guo, Hong Liu

机构 * College of Computer Science(计算机科学学院) National Key Laboratory of Fundamental Science on Synthetic Vision(合成视觉基础科学国家重点实验室)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments Accepted to Interspeech 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00088 2025-07-02 physics.soc-ph cs.AI cs.SI 89%

How large language models judge and influence human cooperation

Alexandre S. Pires, Laurens Samson, Sennay Ghebreab, Fernando P. Santos

机构 * Institute of Informatics(信息学院) University of Amsterdam(阿姆斯特丹大学) City of Amsterdam(阿姆斯特丹市)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23762 2025-07-01 cs.SE cs.AI 89%

Software Engineering for Large Language Models: Research Status, Challenges and the Road Ahead

Hongzhou Rao, Yanjie Zhao, Xinyi Hou, Shenao Wang, Haoyu Wang

机构 * Huazhong University of Science and Technology(华中科技大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23527 2025-07-01 cs.CL 89%

On Recipe Memorization and Creativity in Large Language Models: Is Your Model a Creative Cook, a Bad Cook, or Merely a Plagiator?

Jan Kvapil, Martin Fajcik

机构 * Brno University of Technology(布拉格技术大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11095 2025-06-30 cs.CL 89%

A Survey of Large Language Models in Psychotherapy: Current Landscape and Future Directions

Hongbin Na, Yining Hua, Zimu Wang, Tao Shen, Beibei Yu, Lilin Wang, Wei Wang, John Torous, Ling Chen

机构 * Australian Artificial Intelligence Institute(澳大利亚人工智能研究所) University of Technology Sydney(悉尼科技大学) Harvard University(哈佛大学) Xi’an Jiaotong-Liverpool University(西安交通大学利物浦大学) University of Pennsylvania(宾夕法尼亚大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments Accepted by ACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.21360 2025-06-27 cs.CL 89%

Structuralist Approach to AI Literary Criticism: Leveraging Greimas Semiotic Square for Large Language Models

Fangzhou Dong, Yifan Zeng, Yingpeng Sang, Hong Shen

机构 * School of Computer Science and Engineering, Sun Yat-sen University(中山大学计算机科学与工程学院) School of Engineering and Technology, Central Queensland University(中央昆士兰大学工程与技术学院)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments Accepted in CogSci 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20274 2025-06-26 cs.AI 89%

Enterprise Large Language Model Evaluation Benchmark

Liya Wang, David Yi, Damien Jose, John Passarelli, James Gao, Jordan Leventis, Kang Li

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments Submitted to MLNLP 2025 at https://csity2025.org/mlnlp/index

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.07919 2025-06-23 cs.AI 89%

Large Language Model Interface for Home Energy Management Systems

François Michelon, Yihong Zhou, Thomas Morstyn

机构 * University of Edinburgh(爱丁堡大学) Oxford University(牛津大学)

专题命中 评测与基准 :language model(title,abstract);large language model(title);LLM(abstract);prompting(abstract)

Comments 13 pages conference paper

Journal ref Proc. 16th ACM Int. Conf. on Future and Sustainable Energy Systems, e-Energy 2025, pages 590-602, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16064 2025-06-23 cs.CL 89%

Self-Critique-Guided Curiosity Refinement: Enhancing Honesty and Helpfulness in Large Language Models via In-Context Learning

Duc Hieu Ho, Chenglin Fan

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04804 2025-06-18 cs.CY cs.CL 89%

What do Large Language Models Say About Animals? Investigating Risks of Animal Harm in Generated Text

Arturs Kanepajs, Aditi Basu, Sankalpa Ghose, Constance Li, Akshat Mehta, Ronak Mehta, Samuel David Tucker-Davis, Eric Zhou, Bob Fischer, Jacy Reese Anthis

机构 * Alethic Research Texas State University(德克萨斯州立大学) Sentience Institute(意识研究所)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.07313 2025-06-18 cs.CL 89%

ETM: Modern Insights into Perspective on Text-to-SQL Evaluation in the Age of Large Language Models

Benjamin G. Ascoli, Yasoda Sai Ram Kandikonda, Jinho D. Choi

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.07637 2025-06-18 cs.AI cs.NI 89%

OpsEval: A Comprehensive IT Operations Benchmark Suite for Large Language Models

Yuhe Liu, Changhua Pei, Longlong Xu, Bohan Chen, Mingze Sun, Zhirui Zhang, Yongqian Sun, Shenglin Zhang, Kun Wang, Haiming Zhang, Jianhui Li, Gaogang Xie, Xidao Wen, Xiaohui Nie, Minghua Ma, Dan Pei

机构 * Tsinghua University \& BNRist Beijing China Beijing University of Posts Nankai University \& TKL-SEHCI Tianjin China Nankai University \& HL-IT Tianjin China Microsoft Redmond USA Tsinghua University \& BNRist Nankai University \& TKL-SEHCI Nankai University \& HL-IT Microsoft

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12338 2025-06-17 cs.CL 89%

Investigating the Effects of Cognitive Biases in Prompts on Large Language Model Outputs

Yan Sun, Stanley Kok

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.19824 2025-06-17 cs.AR cs.AI cs.SE 89%

AnalogXpert: Automating Analog Topology Synthesis by Incorporating Circuit Design Expertise into Large Language Models

Haoyi Zhang, Shizhao Sun, Yibo Lin, Runsheng Wang, Jiang Bian

机构 * School of Integrated Circuits, Peking University(集成电路学院,北京大学) Institute of EDA, Peking University(EDA研究院,北京大学) Beijing Advanced Innovation Center for Integrated Circuits(北京集成电路先进创新中心) Microsoft Research Asia(微软亚洲研究院)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.02050 2025-06-16 cs.CL 89%

JBBQ: Japanese Bias Benchmark for Analyzing Social Biases in Large Language Models

Hitomi Yanaka, Namgi Han, Ryoma Kumon, Jie Lu, Masashi Takeshita, Ryo Sekizawa, Taisei Kato, Hiromi Arai

机构 * The University of Tokyo(东京大学) Riken(理化学研究所) Hokkaido University(北海道大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

Comments Accepted to the 6th Workshop on Gender Bias in Natural Language Processing (GeBNLP2025) at ACL2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10282 2025-06-13 cs.LG 89%

Graph-MLLM: Harnessing Multimodal Large Language Models for Multimodal Graph Learning

Jiajin Liu, Dongzhe Fan, Jiacheng Shen, Chuanhao Ji, Daochen Zha, Qiaoyu Tan

机构 * New York University Shanghai(纽约大学上海校区) University of Chinese Academy of Sciences(中国科学院大学) Rice University(德克萨斯大学里德学院)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

Comments 16 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10264 2025-06-13 cs.AI 89%

WGSR-Bench: Wargame-based Game-theoretic Strategic Reasoning Benchmark for Large Language Models

Qiyue Yin, Pei Xu, Qiaozhe Li, Shengda Liu, Shengqi Shen, Tong Wang, Yihong Han, Xiaonan Zhao, Likun Yang, Shiyue Cao, Shiyu Qiu, Yuxuan Liu, Shizhao Yu, Lei Cui, Chengxin Yan, Jie Sun, Xiangquan Tang, Kaiqi Huang

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments 15 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08430 2025-06-13 cs.CL cs.MA 89%

CAF-I: A Collaborative Multi-Agent Framework for Enhanced Irony Detection with Large Language Models

Ziqi. Liu, Ziyang. Zhou, Mingxuan. Hu

机构 * Xi’an Jiaotong-Liverpool University(西安交通大学利物浦大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.19726 2025-06-13 cs.AI 89%

Position: Theory of Mind Benchmarks are Broken for Large Language Models

Matthew Riemer, Zahra Ashktorab, Djallel Bouneffouf, Payel Das, Miao Liu, Justin D. Weisz, Murray Campbell

机构 * IBM Research(IBM研究院)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09227 2025-06-12 cs.LG cs.CR 89%

SoK: Machine Unlearning for Large Language Models

Jie Ren, Yue Xing, Yingqian Cui, Charu C. Aggarwal, Hui Liu

机构 * Michigan State University(密歇根州立大学) IBM T. J. Watson Research Center(IBM 托马斯·J·沃森研究中心)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08907 2025-06-11 cs.CL 89%

Dialect Normalization using Large Language Models and Morphological Rules

Antonios Dimakis, John Pavlopoulos, Antonios Anastasopoulos

机构 * Archimedes, Athena Research Center, Greece(阿基米德,雅典娜研究中心,希腊) Department of Informatics and Telecommunications, NKUA(信息与电信系,NKUA) Department of Informatics, Athens University of Economics and Business, Greece(信息系,雅典经济与商业大学,希腊) Department of Computer Science, George Mason University(计算机科学系,乔治·梅森大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

Comments 19 pages, 18 figures, to be published in the Findings of the Association for Computational Linguistics 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08593 2025-06-11 cs.CL 89%

Hateful Person or Hateful Model? Investigating the Role of Personas in Hate Speech Detection by Large Language Models

Shuzhou Yuan, Ercong Nie, Mario Tawfelis, Helmut Schmid, Hinrich Schütze, Michael Färber

机构 * ScaDS.AI and TU Dresden(ScaDS.AI 和 梵高大学) LMU Munich(慕尼黑大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏