arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 32208 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 32208 篇

2410.10724 2025-02-18 cs.CL 89%

Large Language Models Are Active Critics in NLG Evaluation

Shuying Xu, Junjie Hu, Ming Jiang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16288 2025-02-18 cs.CL 89%

PlagBench: Exploring the Duality of Large Language Models in Plagiarism Generation and Detection

Jooyoung Lee, Toshini Agrawal, Adaku Uchendu, Thai Le, Jinghui Chen, Dongwon Lee

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments This is a camera-ready version of NAACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09799 2025-02-17 cs.HC cs.AI cs.CY 89%

Co-designing Large Language Model Tools for Project-Based Learning with K12 Educators

Prerna Ravi, John Masla, Gisella Kakoti, Grace Lin, Emma Anderson, Matt Taylor, Anastasia Ostrowski, Cynthia Breazeal, Eric Klopfer, Hal Abelson

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments 25 pages

Journal ref CHI Conference on Human Factors in Computing Systems (CHI '25), April 26-May 01, 2025, Yokohama, Japan. ACM, New York, NY, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.14497 2025-02-17 cs.CL 89%

Evaluating and Improving Graph to Text Generation with Large Language Models

Jie He, Yijun Yang, Wanqiu Long, Deyi Xiong, Victor Gutierrez-Basulto, Jeff Z. Pan

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

Comments NAACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.08796 2025-02-14 cs.CL cs.CY cs.HC 89%

A Systematic Review on the Evaluation of Large Language Models in Theory of Mind Tasks

Karahan Sarıtaş, Kıvanç Tezören, Yavuz Durmazkeser

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15504 2025-02-13 cs.CL 89%

Mitigating Social Bias in Large Language Models: A Multi-Objective Approach within a Multi-Agent Framework

Zhenjie Xu, Wenqing Chen, Yi Tang, Xuanying Li, Cheng Hu, Zhixuan Chu, Kui Ren, Zibin Zheng, Zhichao Lu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

Comments This work has been accepted at The 39th Annual AAAI Conference on Artificial Intelligence (AAAI-2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.18418 2025-02-13 cs.CL 89%

Know Your Limits: A Survey of Abstention in Large Language Models

Bingbing Wen, Jihan Yao, Shangbin Feng, Chenjun Xu, Yulia Tsvetkov, Bill Howe, Lucy Lu Wang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments TACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05701 2025-02-11 cs.LG 89%

TOKON: TOKenization-Optimized Normalization for time series analysis with a large language model

Janghoon Yang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.14059 2025-02-10 q-fin.CP cs.CE cs.CL 89%

UCFE: A User-Centric Financial Expertise Benchmark for Large Language Models

Yuzhe Yang, Yifei Zhang, Yan Hu, Yilin Guo, Ruoli Gan, Yueru He, Mingcong Lei, Xiao Zhang, Haining Wang, Qianqian Xie, Jimin Huang, Honghai Yu, Benyou Wang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02866 2025-02-06 cs.SE cs.AI 89%

A Systematic Approach for Assessing Large Language Models' Test Case Generation Capability

Hung-Fu Chang, Mohammad Shokrolah Shirazi

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments 17 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11668 2025-02-04 cs.CL 89%

"Not Aligned" is Not "Malicious": Being Careful about Hallucinations of Large Language Models' Jailbreak

Lingrui Mei, Shenghua Liu, Yiwei Wang, Baolong Bi, Jiayi Mao, Xueqi Cheng

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments COLING 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.18794 2025-02-03 q-bio.GN cs.AI 89%

Survey and Improvement Strategies for Gene Prioritization with Large Language Models

Matthew Neeley, Guantong Qi, Guanchu Wang, Ruixiang Tang, Dongxue Mao, Chaozhong Liu, Sasidhar Pasupuleti, Bo Yuan, Fan Xia, Pengfei Liu, Zhandong Liu, Xia Hu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments 11 pages, 4 figures, 10 pages of supplementary figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.18668 2025-02-03 cs.AI cs.SE 89%

Simulation Streams: A Programming Paradigm for Controlling Large Language Models and Building Complex Systems with Generative AI

Peter Sunehag, Joel Z. Leibo

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments Technical report accompanying the release of code on GitHub

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.18081 2025-01-31 cs.AI cs.CY 89%

Normative Evaluation of Large Language Models with Everyday Moral Dilemmas

Pratik S. Sachdeva, Tom van Nuenen

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.14499 2025-01-27 cs.LG cs.CY 89%

Automated Assignment Grading with Large Language Models: Insights From a Bioinformatics Course

Pavlin G. Poličar, Martin Špendl, Tomaž Curk, Blaž Zupan

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05208 2025-01-24 cs.AI cs.DB 89%

A Survey of Large Language Model-Based Generative AI for Text-to-SQL: Benchmarks, Applications, Use Cases, and Challenges

Aditi Singh, Akash Shetty, Abul Ehtesham, Saket Kumar, Tala Talaei Khoei

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.12975 2025-01-23 cs.CL 89%

OnionEval: An Unified Evaluation of Fact-conflicting Hallucination for Small-Large Language Models

Chongren Sun, Yuran Li, Di Wu, Benoit Boulet

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.17404 2025-01-23 cs.AI 89%

Grammar-based Game Description Generation using Large Language Models

Tsunehiko Tanaka, Edgar Simo-Serra

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments Accepted for publication at the IEEE Transactions on Games

Journal ref IEEE Transactions on Games, 2024 (early access)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.11354 2025-01-22 cs.SE cs.AI 89%

Towards Advancing Code Generation with Large Language Models: A Research Roadmap

Haolin Jin, Huaming Chen, Qinghua Lu, Liming Zhu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09655 2025-01-17 cs.LG 89%

A Survey of Research in Large Language Models for Electronic Design Automation

Jingyu Pan, Guanglei Zhou, Chen-Chia Chang, Isaac Jacobson, Jiang Hu, Yiran Chen

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

Comments 21 pages, 2 figures, 3 tables, accepted by TODAES

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.07837 2025-01-15 cs.AI 89%

A Driver Advisory System Based on Large Language Model for High-speed Train

Y. C. Luo, J. Xun, W. Wang, R. Z. Zhang, Z. C. Zhao

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments 18 pages, 7 figures, presented at 104th TRB Annual Meeting

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.07532 2025-01-14 cs.CL 89%

Investigating Large Language Models in Inferring Personality Traits from User Conversations

Jianfeng Zhu, Ruoming Jin, Karin G. Coifman

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.06271 2025-01-14 q-bio.QM cs.AI cs.CE 89%

Large Language Models for Bioinformatics

Wei Ruan, Yanjun Lyu, Jing Zhang, Jiazhang Cai, Peng Shu, Yang Ge, Yao Lu, Shang Gao, Yue Wang, Peilong Wang, Lin Zhao, Tao Wang, Yufang Liu, Luyang Fang, Ziyu Liu, Zhengliang Liu, Yiwei Li, Zihao Wu, Junhao Chen, Hanqi Jiang, Yi Pan, Zhenyuan Yang, Jingyuan Chen, Shizhe Liang, Wei Zhang, Terry Ma, Yuan Dou, Jianli Zhang, Xinyu Gong, Qi Gan, Yusong Zou, Zebang Chen, Yuanxin Qian, Shuo Yu, Jin Lu, Kenan Song, Xianqiao Wang, Andrea Sikora, Gang Li, Xiang Li, Quanzheng Li, Yingfeng Wang, Lu Zhang, Yohannes Abate, Lifang He, Wenxuan Zhong, Rongjie Liu, Chao Huang, Wei Liu, Ye Shen, Ping Ma, Hongtu Zhu, Yajun Yan, Dajiang Zhu, Tianming Liu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments 64 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.02315 2025-01-14 cs.CL q-fin.GN 89%

A Survey of Large Language Models in Finance (FinLLMs)

Jean Lee, Nicholas Stevens, Soyeon Caren Han, Minseok Song

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments More information on https://github.com/adlnlp/FinLLMs

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.04927 2025-01-10 cs.CL 89%

Investigating Numerical Translation with Large Language Models

Wei Tang, Jiawei Yu, Yuang Li, Yanqing Zhao, Weidong Zhang, Wei Feng, Min Zhang, Hao Yang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments Accepted by ICASSP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.03506 2025-01-10 eess.AS cs.LG cs.SD 89%

DiarizationLM: Speaker Diarization Post-Processing with Large Language Models

Quan Wang, Yiling Huang, Guanlong Zhao, Evan Clark, Wei Xia, Hank Liao

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

Journal ref Proc. Interspeech 2024, 3754-3758 (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.03566 2025-01-08 cs.MA cs.AI cs.SE 89%

Applying Large Language Models in Knowledge Graph-based Enterprise Modeling: Challenges and Opportunities

Benedikt Reitemeyer, Hans-Georg Fill

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.20340 2025-01-07 cs.SE cs.AI 89%

Distilling Desired Comments for Enhanced Code Review with Large Language Models

Yongda Yu, Lei Zhang, Guoping Rong, Haifeng Shen, Jiahao Zhang, Haoxiang Yan, Guohao Shi, Dong Shao, Ruiqi Pan, Yuan Li, Qiushi Wang, Zhao Tian

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments 12 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.12196 2025-01-07 cs.CR cs.AI 89%

Leveraging Large Language Models to Detect npm Malicious Packages

Nusrat Zahan, Philipp Burckhardt, Mikola Lysenko, Feross Aboukhadijeh, Laurie Williams

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments 13 pages, 2 Figure, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01273 2025-01-03 cs.CL stat.AP 89%

Does a Large Language Model Really Speak in Human-Like Language?

Mose Park, Yunjin Choi, Jong-June Jeon

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏