arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 32208 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 32208 篇

2410.03718 2025-04-08 cs.CL 88%

Performance Evaluation of Tokenizers in Large Language Models for the Assamese Language

Sagar Tamang, Dibya Jyoti Bora

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.02134 2025-04-07 cs.CL 88%

The current status of large language models in summarizing radiology report impressions

Danqing Hu, Shanyuan Zhang, Qing Liu, Xiaofeng Zhu, Bing Liu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00824 2025-04-04 cs.CL 88%

ScholarCopilot: Training Large Language Models for Academic Writing with Accurate Citations

Yubo Wang, Xueguang Ma, Ping Nie, Huaye Zeng, Zhiheng Lyu, Yuxuan Zhang, Benjamin Schneider, Yi Lu, Xiang Yue, Wenhu Chen

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01245 2025-04-03 cs.SE cs.LG 88%

Large Language Models for Code Generation: A Comprehensive Survey of Challenges, Techniques, Evaluation, and Applications

Nam Huynh, Beiyu Lin

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21360 2025-03-28 cs.CL 88%

From User Preferences to Optimization Constraints Using Large Language Models

Manuela Sanguinetti, Alessandra Perniciano, Luca Zedda, Andrea Loddo, Cecilia Di Ruberto, Maurizio Atzori

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.17258 2025-03-28 cs.LG 88%

Joint Estimation and Prediction of City-wide Delivery Demand: A Large Language Model Empowered Graph-based Learning Approach

Tong Nie, Junlin He, Yuewen Mei, Guoyang Qin, Guilong Li, Jian Sun, Wei Ma

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

Journal ref Transportation Research Part E: Logistics and Transportation Review, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20802 2025-03-28 cs.CR cs.AI 88%

CEFW: A Comprehensive Evaluation Framework for Watermark in Large Language Models

Shuhao Zhang, Bo Cheng, Jiale Han, Yuli Chen, Zhixuan Wu, Changbao Li, Pingli Gu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.19276 2025-03-26 cs.CV cs.AI 88%

Context-Aware Semantic Segmentation: Enhancing Pixel-Level Understanding with Large Language Models for Advanced Vision Applications

Ben Rahman

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16826 2025-03-24 cs.CL 88%

When Tom Eats Kimchi: Evaluating Cultural Bias of Multimodal Large Language Models in Cultural Mixture Contexts

Jun Seong Kim, Kyaw Ye Thu, Javad Ismayilzada, Junyeong Park, Eunsu Kim, Huzama Ahmad, Na Min An, James Thorne, Alice Oh

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16536 2025-03-24 cs.CL 88%

Word2Minecraft: Generating 3D Game Levels through Large Language Models

Shuo Huang, Muhammad Umair Nasir, Steven James, Julian Togelius

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15990 2025-03-21 cs.CL 88%

ECKGBench: Benchmarking Large Language Models in E-commerce Leveraging Knowledge Graph

Langming Liu, Haibin Chen, Yuhao Wang, Yujin Yuan, Shilei Liu, Wenbo Su, Xiangyu Zhao, Bo Zheng

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08923 2025-03-21 cs.LG cs.CR cs.PL 88%

Enhancing Large Language Models for Hardware Verification: A Novel SystemVerilog Assertion Dataset

Anand Menon, Samit S Miftah, Shamik Kundu, Souvik Kundu, Amisha Srivastava, Arnab Raha, Gabriel Theodor Sonnenschein, Suvadeep Banerjee, Deepak Mathaikutty, Kanad Basu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

Comments 29 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07563 2025-03-21 cs.AI 88%

Improving Grapheme-to-Phoneme Conversion through In-Context Knowledge Retrieval with Large Language Models

Dongrui Han, Mingyu Cui, Jiawen Kang, Xixin Wu, Xunying Liu, Helen Meng

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments accepted by ISCSLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.14163 2025-03-20 cs.RO cs.AI cs.CV 88%

Leveraging Large Language Model-based Room-Object Relationships Knowledge for Enhancing Multimodal-Input Object Goal Navigation

Leyuan Sun, Asako Kanezaki, Guillaume Caron, Yusuke Yoshiyasu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments will soon submit to the Elsevier journal, Advanced Engineering Informatics

Journal ref Advanced Engineering Informatics 65 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.02063 2025-03-19 cs.CL cs.CY 88%

AGGA: A Dataset of Academic Guidelines for Generative AI and Large Language Models

Junfeng Jiao, Saleh Afroogh, Kevin Chen, David Atkinson, Amit Dhurandhar

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments arXiv admin note: text overlap with arXiv:2406.18842, arXiv:2501.00959

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.09002 2025-03-19 cs.CL 88%

AttackEval: How to Evaluate the Effectiveness of Jailbreak Attacking on Large Language Models

Dong Shu, Chong Zhang, Mingyu Jin, Zihao Zhou, Lingyao Li, Yongfeng Zhang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments Accepted by ACM SIGKDD Explorations 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12100 2025-03-18 cs.CL 88%

Large Language Models in Legislative Content Analysis: A Dataset from the Polish Parliament

Arkadiusz Bryłkowski, Jakub Klikowski

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments 15 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10660 2025-03-18 cs.CL 88%

User Profile with Large Language Models: Construction, Updating, and Benchmarking

Nusrat Jahan Prottasha, Md Kowsher, Hafijur Raman, Israt Jahan Anny, Prakash Bhat, Ivan Garibay, Ozlem Garibay

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09219 2025-03-13 cs.CL 88%

Rethinking Prompt-based Debiasing in Large Language Models

Xinyi Yang, Runzhe Zhan, Derek F. Wong, Shu Yang, Junchao Wu, Lidia S. Chao

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08156 2025-03-12 cs.CV cs.LG 88%

Towards Large-scale Chemical Reaction Image Parsing via a Multimodal Large Language Model

Yufan Chen, Ching Ting Leung, Jianwei Sun, Yong Huang, Linyan Li, Hao Chen, Hanyu Gao

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07094 2025-03-11 cs.CL 88%

A Novel Ophthalmic Benchmark for Evaluating Multimodal Large Language Models with Fundus Photographs and OCT Images

Xiaoyi Liang, Mouxiao Bian, Moxin Chen, Lihao Liu, Junjun He, Jie Xu, Lin Li

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07041 2025-03-11 cs.CL 88%

TCM-3CEval: A Triaxial Benchmark for Assessing Responses from Large Language Models in Traditional Chinese Medicine

Tianai Huang, Lu Lu, Jiayuan Chen, Lihao Liu, Junjun He, Yuping Zhao, Wenchao Tang, Jie Xu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07003 2025-03-11 cs.CL 88%

Large Language Models Often Say One Thing and Do Another

Ruoxi Xu, Hongyu Lin, Xianpei Han, Jia Zheng, Weixiang Zhou, Le Sun, Yingfei Sun

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments Published on ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11903 2025-03-11 cs.CL 88%

MMRC: A Large-Scale Benchmark for Understanding Multimodal Large Language Model in Real-World Conversation

Haochen Xue, Feilong Tang, Ming Hu, Yexin Liu, Qidong Huang, Yulong Li, Chengzhi Liu, Zhongxing Xu, Chong Zhang, Chun-Mei Feng, Yutong Xie, Imran Razzak, Zongyuan Ge, Jionglong Su, Junjun He, Yu Qiao

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11779 2025-03-11 cs.CL 88%

Personality Alignment of Large Language Models

Minjun Zhu, Yixuan Weng, Linyi Yang, Yue Zhang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments Acecpt in ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01658 2025-03-06 cs.CL cs.CY cs.SI 88%

Large Language Models' Accuracy in Emulating Human Experts' Evaluation of Public Sentiments about Heated Tobacco Products on Social Media

Kwanho Kim, Soojong Kim

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03149 2025-03-06 cs.CL 88%

DSVD: Dynamic Self-Verify Decoding for Faithful Generation in Large Language Models

YiQiu Guo, Yuchen Yang, Zhe Chen, Pingjie Wang, Yusheng Liao, Ya Zhang, Yanfeng Wang, Yu Wang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.05364 2025-03-06 cs.CR cs.AI 88%

Is On-Device AI Broken and Exploitable? Assessing the Trust and Ethics in Small Language Models

Kalyan Nakka, Jimmy Dani, Nitesh Saxena

专题命中 评测与基准 :language model(title,abstract);small language model(title,abstract);分类 cs.AI

Comments 26 pages, 31 figures and 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09418 2025-03-05 cs.CL 88%

Beyond Exact Match: Semantically Reassessing Event Extraction by Large Language Models

Yi-Fan Lu, Xian-Ling Mao, Tian Lan, Heyan Huang, Chen Xu, Xiaoyan Gao

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00995 2025-03-04 cs.CL 88%

Evaluating Polish linguistic and cultural competency in large language models

Sławomir Dadas, Małgorzata Grębowiec, Michał Perełkiewicz, Rafał Poświata

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏