arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 32208 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 32208 篇

2508.07714 2025-08-12 cs.CV cs.AI cs.ET 89%

DoorDet: Semi-Automated Multi-Class Door Detection Dataset via Object Detection and Large Language Models

Licheng Zhang, Bach Le, Naveed Akhtar, Tuan Ngo

机构 * The University of Melbourne(墨尔本大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07283 2025-08-12 cs.HC cs.AI eess.SP q-bio.NC 89%

Fine-Tuning Large Language Models Using EEG Microstate Features for Mental Workload Assessment

Bujar Raufi

机构 * School of Computer Science, Technological University Dublin, Dublin, Ireland(计算机科学学院,都柏林技术大学,都柏林,爱尔兰) Artificial Intelligence and Cognitive Load Lab, Applied Intelligence Research Centre, School of Computer Science, Technological University Dublin, Dublin, Ireland(人工智能与认知负荷实验室,应用智能研究中心,计算机科学学院,都柏林技术大学,都柏林,爱尔兰)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments 17 Pages, 7 figures, 3 tables and one prompt template

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07196 2025-08-12 cs.DL cs.AI 89%

Can Smaller Large Language Models Evaluate Research Quality?

Mike Thelwall

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20910 2025-08-11 cs.CL 89%

Automated Privacy Information Annotation in Large Language Model Interactions

Hang Zeng, Xiangyu Liu, Yong Hu, Chaoyue Niu, Fan Wu, Shaojie Tang, Guihai Chen

机构 * Shanghai Jiao Tong University(上海交通大学) WeChat Tencent(微信腾讯) University at Buffalo(布法罗大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments 8 content pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12772 2025-08-07 cs.CV cs.AI cs.RO 89%

NuPlanQA: A Large-Scale Dataset and Benchmark for Multi-View Driving Scene Understanding in Multi-Modal Large Language Models

Sung-Yeon Park, Can Cui, Yunsheng Ma, Ahmadreza Moradipari, Rohit Gupta, Kyungtae Han, Ziran Wang

机构 * Purdue University(普渡大学) Toyota InfoTech Labs(丰田信息技术实验室)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03406 2025-08-06 cs.AI 89%

Multi-Objective Infeasibility Diagnosis for Routing Problems Using Large Language Models

Kai Li, Ruihao Zheng, Xinye Hao, Zhenkun Wang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.05286 2025-08-06 cs.PL cs.CL 89%

LLM4Decompile: Decompiling Binary Code with Large Language Models

Hanzhuo Tan, Qi Luo, Jing Li, Yuqun Zhang

机构 * Department of Computer Science and Engineering, Southern University of Science and Technology, Shenzhen, China(南方科技大学计算机科学与工程系) Department of Computing, The Hong Kong Polytechnic University, HKSAR, China(香港理工大学计算机系) Research Centre for Data Science & Artificial Intelligence(数据科学与人工智能研究中心)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Journal ref Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02430 2025-08-05 cs.CL 89%

AI-Based Measurement of Innovation: Mapping Expert Insight into Large Language Model Applications

Robin Nowak, Patrick Figge, Carolin Haeussler

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01514 2025-08-05 cs.IR cs.LG 89%

End-to-End Personalization: Unifying Recommender Systems with Large Language Models

Danial Ebrat, Tina Aminian, Sepideh Ahmadian, Luis Rueda

机构 * University of Windsor(温莎大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

Comments Second Workshop on Generative AI for Recommender Systems and Personalization at the ACM Conference on Knowledge Discovery and Data Mining (GenAIRecP@KDD 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22952 2025-08-05 cs.HC cs.CV cs.LG 89%

Automated Label Placement on Maps via Large Language Models

Harry Shomer, Jiejun Xu

机构 * University of Texas at Arlington(德克萨斯理工大学) HRL Laboratories(HRL实验室)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);foundation model(abstract);分类 cs.LG

Comments Workshop on AI for Data Editing (AI4DE) at KDD 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10852 2025-08-05 cs.CL 89%

LLMs on Trial: Evaluating Judicial Fairness for Large Language Models

Yiran Hu, Zongyue Xue, Haitao Li, Siyuan Zheng, Qingjing Chen, Shaochun Wang, Xihan Zhang, Ning Zheng, Yun Liu, Qingyao Ai, Yiqun Liu, Charles L. A. Clarke, Weixing Shen

机构 * Tsinghua University, China(清华大学) University of Waterloo, Canada(滑铁卢大学) Yale Law School, USA(耶鲁法学院) Shanghai Jiao Tong University, China(上海交通大学) University of Bologna, Italy(博洛尼亚大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.12934 2025-08-05 cs.SE cs.LG 89%

Correctness Assessment of Code Generated by Large Language Models Using Internal Representations

Tuan-Dung Bui, Thanh Trong Vu, Thu-Trang Nguyen, Son Nguyen, Hieu Dinh Vo

机构 * Faculty of Information Technology, VNU University of Engineering and Technology(信息科技学院,越南工程大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.12307 2025-08-05 cs.CL 89%

Can Tool-augmented Large Language Models be Aware of Incomplete Conditions?

Seungbin Yang, ChaeHun Park, Taehee Kim, Jaegul Choo

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00673 2025-08-04 cs.CL 89%

MELAC: Massive Evaluation of Large Language Models with Alignment of Culture in Persian Language

Farhan Farsi, Farnaz Aghababaloo, Shahriar Shariati Motlagh, Parsa Ghofrani, MohammadAli SadraeiJavaheri, Shayan Bali, Amirhossein Shabani, Farbod Bijary, Ghazal Zamaninejad, AmirMohammad Salehoof, Saeedeh Momtazi

机构 * Amirkabir University of Technology(阿姆irkabir技术大学) Part AI Research Center(Part人工智能研究中心) University of Mazandaran(马赞德兰大学) King’s College London(伦敦国王学院)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments Preprint. Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22419 2025-07-31 cs.DB cs.AI 89%

Systematic Evaluation of Knowledge Graph Repair with Large Language Models

Tung-Wei Lin, Gabe Fierro, Han Li, Tianzhen Hong, Pierluigi Nuzzo, Alberto Sangiovanni-Vinentelli

机构 * UC Berkeley(加州大学伯克利分校) Lawrence Berkeley National Laboratory(伯克利国家实验室) National Renewable Energy Laboratory(国家可再生能源实验室) Colorado School of Mines(科罗拉多矿业学院)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19904 2025-07-29 cs.SE cs.AI 89%

CrossPL: Evaluating Large Language Models on Cross Programming Language Code Generation

Zhanhang Xiong, Dongxia Wang, Yuekang Li, Xinyuan An, Wenhai Wang

机构 * Zhejiang University(浙江大学) The University of New South Wales(新南威尔士大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10271 2025-07-29 cs.CL 89%

Benchmarking Linguistic Diversity of Large Language Models

Yanzhu Guo, Guokan Shang, Chloé Clavel

机构 * Inria Paris(巴黎国家信息与自动化研究所) MBZUAI(穆斯林人工智能研究所) École Polytechnique(巴黎高等理工学院)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.18558 2025-07-24 cs.SE cs.AI 89%

LangBiTe: A Platform for Testing Bias in Large Language Models

Sergio Morales, Robert Clarisó, Jordi Cabot

机构 * Universitat Oberta de Catalunya(开放大学) Luxembourg Institute of Science and Technology(卢森堡科学与技术研究所) University of Luxembourg(卢森堡大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16524 2025-07-23 cs.CV cs.AI 89%

Spatial 3D-LLM: Exploring Spatial Awareness in 3D Vision-Language Models

Xiaoyan Wang, Zeju Li, Yifan Xu, Jiaxing Qi, Zhifei Yang, Ruifei Ma, Xiangde Liu, Chao Zhang

机构 * Beijing Digital Native Digital City Research Center(北京数字原生数字城市研究中心) The Chinese University of Hong Kong(香港中文大学)

专题命中 评测与基准 :LLM(title,abstract);language model(title,abstract);large language model(abstract);分类 cs.AI

Comments Accepted by ICME2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15275 2025-07-22 cs.CL 89%

ChiMed 2.0: Advancing Chinese Medical Dataset in Facilitating Large Language Modeling

Yuanhe Tian, Junjie Liu, Zhizhou Kou, Yuxiang Li, Yan Song

机构 * University of Washington(华盛顿大学) University of Science and Technology of China(中国科学技术大学)

专题命中 评测与基准 :large language model(title);language model(title);LLM(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14107 2025-07-21 cs.AI cs.IR 89%

Automated Interpretation of Non-Destructive Evaluation Contour Maps Using Large Language Models for Bridge Condition Assessment

Viraj Nishesh Darji, Callie C. Liao, Duoduo Liao

机构 * School of Computing(计算学院) George Mason University(乔治·玛莎大学) College of Science(科学学院)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Journal ref IEEE BigData, Year: 2024; Page: 3258-3263

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.04631 2025-07-18 cs.CL 89%

On the Limitations of Large Language Models (LLMs): False Attribution

Tosin Adewumi, Nudrat Habib, Lama Alkhaled, Elisa Barney

机构 * Machine Learning Group, EISLAB, Luleå University of Technology(机器学习组、EISLAB、卢勒奥技术大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments This paper was accepted for presentation by Recent Advances in NLP (RANLP) 2025 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11527 2025-07-16 cs.AI cs.CE 89%

DrafterBench: Benchmarking Large Language Models for Tasks Automation in Civil Engineering

Yinsheng Li, Zhen Dong, Yi Shao

机构 * McGill University(麦吉尔大学) UC Santa Barbara(圣巴巴拉大学) NVIDIA(英伟达)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments Project page: https://github.com/Eason-Li-AIS/DrafterBench

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00972 2025-07-16 cs.AI cs.RO 89%

Seeking to Collide: Online Safety-Critical Scenario Generation for Autonomous Driving with Retrieval Augmented Large Language Models

Yuewen Mei, Tong Nie, Jian Sun, Ye Tian

机构 * Dept. of Traf. Eng. Tongji University Shanghai, China Dept. of Civ. \& Envir. Eng. The Hong Kong Polytechnic University Hong Kong SAR, China

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments Accepted at IEEE ITSC 2025

Journal ref IEEE International Conference on Intelligent Transportation Systems, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.00027 2025-07-15 cs.CL 89%

Personalization of Large Language Models: A Survey

Zhehao Zhang, Ryan A. Rossi, Branislav Kveton, Yijia Shao, Diyi Yang, Hamed Zamani, Franck Dernoncourt, Joe Barrow, Tong Yu, Sungchul Kim, Ruiyi Zhang, Jiuxiang Gu, Tyler Derr, Hongjie Chen, Junda Wu, Xiang Chen, Zichao Wang, Subrata Mitra, Nedim Lipka, Nesreen Ahmed, Yu Wang

机构 * Dartmouth College(达特茅斯学院) Adobe Research(Adobe研究) Stanford University(斯坦福大学) University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校) Pattern Data Vanderbilt University(范德比尔特大学) Dolby Research(Dolby研究) University of California San Diego(加州大学圣地亚哥分校) Cisco Research(思科研究) University of Oregon(俄勒冈大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments Accepted at the Transactions on Machine Learning Research (TMLR) journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12380 2025-07-15 cs.CL 89%

Evaluation of Attribution Bias in Generator-Aware Retrieval-Augmented Large Language Models

Amin Abolghasemi, Leif Azzopardi, Seyyed Hadi Hashemi, Maarten de Rijke, Suzan Verberne

机构 * Leiden University(莱顿大学) University of Strathclyde(斯特拉思克莱德大学) eBay Inc.(eBay公司) University of Amsterdam(阿姆斯特丹大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments Accepted at ACL 2025 (Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08459 2025-07-14 cs.CL 89%

Diagnosing Failures in Large Language Models' Answers: Integrating Error Attribution into Evaluation Framework

Zishan Xu, Shuyi Xie, Qingsong Lv, Shupei Xiao, Linlin Song, Sui Wenjuan, Fan Lin

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08019 2025-07-14 cs.CL econ.GN q-fin.EC 89%

Signal or Noise? Evaluating Large Language Models in Resume Screening Across Contextual Variations and Human Expert Benchmarks

Aryan Varshney, Venkat Ram Reddy Ganuthula

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13857 2025-07-14 cs.CL 89%

Enabling Inclusive Systematic Reviews: Incorporating Preprint Articles with Large Language Model-Driven Evaluations

Rui Yang, Jiayi Tong, Haoyuan Wang, Hui Huang, Ziyang Hu, Peiyu Li, Nan Liu, Christopher J. Lindsell, Michael J. Pencina, Yong Chen, Chuan Hong

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments 30 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07988 2025-07-11 cs.CL 89%

Automating Expert-Level Medical Reasoning Evaluation of Large Language Models

Shuang Zhou, Wenya Xie, Jiaxi Li, Zaifu Zhan, Meijia Song, Han Yang, Cheyenna Espinoza, Lindsay Welton, Xinnie Mai, Yanwei Jin, Zidu Xu, Yuen-Hei Chung, Yiyun Xing, Meng-Han Tsai, Emma Schaffer, Yucheng Shi, Ninghao Liu, Zirui Liu, Rui Zhang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments 22 pages,6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏