arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 32208 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 32208 篇

2506.14096 2025-09-09 cs.CV cs.AI 90%

Image Segmentation with Large Language Models: A Survey with Perspectives for Intelligent Transportation Systems

Sanjeda Akter, Ibne Farabi Shihab, Anuj Sharma

机构 * Department of Computer Science, Iowa State University, Ames, IA, USA(Iowa State University) Department of Civil, Construction and Environmental Engineering, Iowa State University, Ames, IA, USA(Iowa State University)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02855 2025-09-04 cs.CL cs.CY 90%

IDEAlign: Comparing Large Language Models to Human Experts in Open-ended Interpretive Annotations

Hyunji Nam, Lucia Langlois, James Malamut, Mei Tan, Dorottya Demszky

机构 * Stanford University(斯坦福大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments 10 pages, 9 pages for appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00963 2025-09-03 cs.CY cs.AI 90%

Who Gets Left Behind? Auditing Disability Inclusivity in Large Language Models

Deepika Dash, Yeshil Bangera, Mithil Bangera, Gouthami Vadithya, Srikant Panda

机构 * IBM India(IBM印度分公司) University of New Haven(新罕布什尔大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18638 2025-08-29 cs.HC cs.AI 90%

Prompt Engineering and the Effectiveness of Large Language Models in Enhancing Human Productivity

Rizal Khoirul Anam

机构 * Department of Computer Science(计算机科学系)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments 38 pages, 15 tables, 5 figures. Submitted as a research paper draft for arXiv. Based on survey data collected in 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.05123 2025-08-27 cs.CL 90%

A Survey on Data Selection for LLM Instruction Tuning

Bolin Zhang, Jiahao Wang, Qianlong Du, Jiajun Zhang, Zhiying Tu, Dianhui Chu

机构 * Harbin Institute of Technology(哈尔滨工业大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Harbin Institute of Technology (Weihai)(哈尔滨工业大学(威海))

专题命中 评测与基准 :LLM(title,abstract);instruction tuning(title,abstract);large language model(abstract);language model(abstract)

Comments Published in JAIR (Vol. 83, Article 32, 2025)

Journal ref Journal of Artificial Intelligence Research, 83:32, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.24102 2025-08-25 cs.CL 90%

Is Small Language Model the Silver Bullet to Low-Resource Languages Machine Translation?

Yewei Song, Lujun Li, Cedric Lothritz, Saad Ezzini, Lama Sleem, Niccolo Gentile, Radu State, Tegawendé F. Bissyandé, Jacques Klein

专题命中 评测与基准 :language model(title,abstract);small language model(title,abstract);LLM(abstract);large language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02312 2025-08-05 cs.CR cs.AI 90%

A Survey on Data Security in Large Language Models

Kang Chen, Xiuze Zhou, Yuanguo Lin, Jinhe Su, Yuanhui Yu, Li Shen, Fan Lin

机构 * School of Computer Engineering, Jimei University, Xiamen, 361021, China(厦门大学计算机工程学院) College of Science, Mathematics and Technology, Wenzhou-Kean University, Wenzhou, 325060, China(温州-凯恩大学科学、数学与技术学院) The Hong Kong University of Science and Technology (Guangzhou), Guangzhou, 511453, China(香港科学与技术大学(广州)) School of Professional Studies, New York University, New York, 10003, United States(纽约大学专业研究学院) School of Informatics, Xiamen University, Xiamen, 361102, China(厦门大学信息学院)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);RLHF(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01708 2025-08-05 cs.CL 90%

Am I Blue or Is My Hobby Counting Teardrops? Expression Leakage in Large Language Models as a Symptom of Irrelevancy Disruption

Berkay Köprü, Mehrzad Mashal, Yigit Gurses, Akos Kadar, Maximilian Schmitt, Ditty Mathew, Felix Burkhardt, Florian Eyben, Björn W. Schuller

机构 * audEERING GmbH(audEERING公司) Agile Robots SE(Agile Robots公司) Chair of Health Informatics, Technical University of Munich(技术大学慕尼黑健康信息学系) Group on Language, Audio & Music, Imperial College London(伦敦帝国学院语言、音频与音乐组)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03108 2025-07-23 cs.CR cs.AI 90%

OMNISEC: LLM-Driven Provenance-based Intrusion Detection via Retrieval-Augmented Behavior Prompting

Wenrui Cheng, Tiantian Zhu, Shunan Jing, Jian-Ping Mei, Mingjun Ma, Jiaobo Jin, Zhengqiu Weng

机构 * Zhejiang University of Technology(浙江工业大学) Wenzhou University of Technology(温州大学)

专题命中 评测与基准 :LLM(title,abstract);prompting(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16899 2025-07-15 cs.CR cs.AI 90%

Towards Effective Complementary Security Analysis using Large Language Models

Jonas Wagner, Simon Müller, Christian Näther, Jan-Philipp Steghöfer, Andreas Both

机构 * Data Science Group \ Web \& Software Engineering Research Group Paderborn University Leipzig University of Applied Sciences Paderborn, Germany \ Leipzig, Germany \ Web \& Software Engineering Research Group Leipzig University of Applied Sciences Leipzig, Germany

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07533 2025-07-15 cs.CL 90%

Large Language Models as Neurolinguistic Subjects: Discrepancy between Performance and Competence

Linyang He, Ercong Nie, Helmut Schmid, Hinrich Schütze, Nima Mesgarani, Jonathan Brennan

机构 * Columbia University(哥伦比亚大学) University of Michigan(密歇根大学) Munich Center for Machine Learning(慕尼黑机器学习中心) LMU Munich, Germany(慕尼黑大学, 德国)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21411 2025-06-24 cs.AI 90%

Exploring the Roles of Large Language Models in Reshaping Transportation Systems: A Survey, Framework, and Roadmap

Tong Nie, Jian Sun, Wei Ma

机构 * Department of Civil and Environmental Engineering, The Hong Kong Polytechnic University, Hong Kong SAR, China(香港理工大学土木与环境工程系) Department of Traffic Engineering, Tongji University, Shanghai, 201804, China(同济大学交通工程系)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

Comments Published at Artificial Intelligence for Transportation, Inaugural Issue

Journal ref Artificial Intelligence for Transportation, Volume 1, July 2025, 100003

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17335 2025-06-24 cs.SE cs.AI 90%

LMR-BENCH: Evaluating LLM Agent's Ability on Reproducing Language Modeling Research

Shuo Yan, Ruochen Li, Ziming Luo, Zimu Wang, Daoyang Li, Liqiang Jing, Kaiyu He, Peilin Wu, George Michalopoulos, Yue Zhang, Ziyang Zhang, Mian Zhang, Zhiyu Chen, Xinya Du

机构 * University of Texas at Dallas(德克萨斯大学达拉斯分校)

专题命中 评测与基准 :LLM(title,abstract);language model(title,abstract);large language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22251 2025-06-06 eess.AS cs.CL 90%

Evaluation of LLMs in Speech is Often Flawed: Test Set Contamination in Large Language Models for Speech Recognition

Yuan Tseng, Titouan Parcollet, Rogier van Dalen, Shucong Zhang, Sourav Bhattacharya

机构 * Samsung AI Center Cambridge(三星AI研究中心剑桥)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13031 2025-06-03 cs.CL 90%

HPSS: Heuristic Prompting Strategy Search for LLM Evaluators

Bosi Wen, Pei Ke, Yufei Sun, Cunxiang Wang, Xiaotao Gu, Jinfeng Zhou, Jie Tang, Hongning Wang, Minlie Huang

机构 * The Conversational Artificial Intelligence (CoAI) Group, Tsinghua University(清华大学对话人工智能(CoAI)小组) University of Electronic Science and Technology of China(电子科技大学) Zhipu AI(智谱AI) The Knowledge Engineering Group (KEG), Tsinghua University(清华大学知识工程小组(KEG))

专题命中 评测与基准 :LLM(title,abstract);prompting(title,abstract);large language model(abstract);language model(abstract)

Comments ACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.08559 2025-06-03 cs.LG 90%

Underestimated Privacy Risks for Minority Populations in Large Language Model Unlearning

Rongzhe Wei, Mufei Li, Mohsen Ghassemi, Eleonora Kreačić, Yifan Li, Xiang Yue, Bo Li, Vamsi K. Potluru, Pan Li, Eli Chien

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.00006 2025-05-30 cs.SE cs.AI 90%

Personality-Guided Code Generation Using Large Language Models

Yaoqi Guo, Zhenpeng Chen, Jie M. Zhang, Yang Liu, Yun Ma

机构 * Peking University(北京大学) Nanyang Technological University(南洋理工大学) King’s College London(伦敦大学国王学院)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments Accepted by the 63rd Annual Meeting of the Association for Computational Linguistics (ACL 2025) Main Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22645 2025-05-29 cs.CL cs.CY 90%

Characterizing Bias: Benchmarking Large Language Models in Simplified versus Traditional Chinese

Hanjia Lyu, Jiebo Luo, Jian Kang, Allison Koenecke

机构 * University of Rochester(罗切斯特大学) Cornell University(康奈尔大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments To appear in the 2025 ACM Conference on Fairness, Accountability, and Transparency (FAccT '25)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.13606 2025-05-27 cs.CL 90%

MlingConf: A Comprehensive Study of Multilingual Confidence Estimation on Large Language Models

Boyang Xue, Hongru Wang, Rui Wang, Sheng Wang, Zezhong Wang, Yiming Du, Bin Liang, Wenxuan Zhang, Kam-Fai Wong

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments Accepted in ACL2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17154 2025-05-26 q-bio.QM cs.AI 90%

Can Large Language Models Design Biological Weapons? Evaluating Moremi Bio

Gertrude Hattoh, Jeremiah Ayensu, Nyarko Prince Ofori, Solomon Eshun, Darlington Akogo

机构 * Gertrude Hattoh(第一作者) Jeremiah Ayensu(第一作者) Nyarko Prince Ofori(第一作者) Solomon Eshun(第一作者) Darlington Akogo(第一作者)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16452 2025-05-19 cs.CL 90%

FMDLlama: Financial Misinformation Detection based on Large Language Models

Zhiwei Liu, Xin Zhang, Kailai Yang, Qianqian Xie, Jimin Huang, Sophia Ananiadou

机构 * The University of Manchester(曼彻斯特大学) The Fin AI Singapore(Fin AI新加坡) Archimedes RC Athena(阿基米德RC雅典)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);instruction tuning(abstract)

Comments Accepted by The Web Conference (WWW) 2025 Short Paper Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12313 2025-04-18 cs.CL cs.HC 90%

Exploring the Impact of Personality Traits on Conversational Recommender Systems: A Simulation with Large Language Models

Xiaoyan Zhao, Yang Deng, Wenjie Wang, Hongzhan lin, Hong Cheng, Rui Zhang, See-Kiong Ng, Tat-Seng Chua

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07901 2025-04-11 cs.CL 90%

Redefining Machine Translation on Social Network Services with Large Language Models

Hongcheng Guo, Fei Zhao, Shaosheng Cao, Xinze Lyu, Ziyan Liu, Yue Wang, Boyang Wang, Zhoujun Li, Chonggang Lu, Zhe Xu, Yao Hu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);preference optimization(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.12146 2025-04-03 cs.AI cs.PF cs.SE 90%

Should AI Optimize Your Code? A Comparative Study of Classical Optimizing Compilers Versus Current Large Language Models

Miguel Romero Rosas, Miguel Torres Sanchez, Rudolf Eigenmann

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments 12 pages, 7 figures, Accepted at SupercomputingAsia 2025 (SCA'25), March 10 to 13, 2025, Singapore, Singapore

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16668 2025-03-24 cs.NE cs.AI 90%

Code Evolution Graphs: Understanding Large Language Model Driven Design of Algorithms

Niki van Stein, Anna V. Kononova, Lars Kotthoff, Thomas Bäck

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments Accepted at GECCO 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.01414 2025-03-21 cs.SE cs.AI 90%

A Deep Dive Into Large Language Model Code Generation Mistakes: What and Why?

QiHong Chen, Jiachen Yu, Jiawei Li, Jiecheng Deng, Justin Tian Jin Chen, Iftekhar Ahmed

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15248 2025-03-20 cs.SE cs.AI 90%

Automated Non-Functional Requirements Generation in Software Engineering with Large Language Models: A Comparative Study

Jomar Thomas Almonte, Santhosh Anitha Boominathan, Nathalia Nascimento

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05388 2025-03-10 cs.AI 90%

Ontology Generation using Large Language Models

Anna Sofia Lippolis, Mohammad Javad Saeedizade, Robin Keskisärkkä, Sara Zuppiroli, Miguel Ceriani, Aldo Gangemi, Eva Blomqvist, Andrea Giovanni Nuzzolese

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments 2 figures and 3 tables. 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02532 2025-03-05 cs.CY cs.CL 90%

Use Me Wisely: AI-Driven Assessment for LLM Prompting Skills Development

Dimitri Ognibene, Gregor Donabauer, Emily Theophilou, Cansu Koyuturk, Mona Yavari, Sathya Bursic, Alessia Telari, Alessia Testa, Raffaele Boiano, Davide Taibi, Davinia Hernandez-Leo, Udo Kruschwitz, Martin Ruskov

专题命中 评测与基准 :LLM(title,abstract);prompting(title,abstract);large language model(abstract);language model(abstract)

Comments Preprint accepted for Publication in Educational Technology & Society (ET&S)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.16792 2025-03-05 cs.LO cs.AI 90%

Laurel: Unblocking Automated Verification with Large Language Models

Eric Mugnier, Emmanuel Anaya Gonzalez, Ranjit Jhala, Nadia Polikarpova, Yuanyuan Zhou

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments 34 pages, accepted at OOPSLA 25

详情

展开后加载摘要…

URL PDF HTML 收藏