arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 32096 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 32096 篇

2309.10187 2024-12-05 cs.HC 89%

Collecting Qualitative Data at Scale with Large Language Models: A Case Study

Alejandro Cuevas, Jennifer V. Scurrell, Eva M. Brown, Jason Entenmann, Madeleine I. G. Daepp

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 27 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01868 2024-12-04 cs.LG cs.AI cs.CL stat.ML 89%

Composition of Experts: A Modular Compound AI System Leveraging Large Language Models

Swayambhoo Jain, Ravi Raju, Bo Li, Zoltan Csaki, Jonathan Li, Kaizhao Liang, Guoyao Feng, Urmish Thakkar, Anand Sampat, Raghu Prabhakar, Sumati Jairath

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00832 2024-12-03 cs.CV 89%

EventGPT: Event Stream Understanding with Multimodal Large Language Models

Shaoyu Liu, Jianing Li, Guanghui Zhao, Yunjian Zhang, Xin Meng, Fei Richard Yu, Xiangyang Ji, Ming Li

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00023 2024-12-03 cs.DB 89%

Evaluating Large Language Models on Business Process Modeling: Framework, Benchmark, and Self-Improvement Analysis

Humam Kourani, Alessandro Berti, Daniel Schuster, Wil M. P. van der Aalst

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17760 2024-11-28 cs.CL cs.AI cs.CV cs.LG 89%

Efficient Self-Improvement in Multimodal Large Language Models: A Model-Level Judge-Free Approach

Shijian Deng, Wentian Zhao, Yu-Jhe Li, Kun Wan, Daniel Miranda, Ajinkya Kale, Yapeng Tian

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.11066 2024-11-19 cs.CV 89%

TS-LLaVA: Constructing Visual Tokens through Thumbnail-and-Sampling for Training-Free Video Large Language Models

Tingyu Qu, Mingxiao Li, Tinne Tuytelaars, Marie-Francine Moens

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11109 2024-11-19 cs.CL cs.AI cs.LG 89%

Investigating Annotator Bias in Large Language Models for Hate Speech Detection

Amit Das, Zheng Zhang, Najib Hasan, Souvika Sarkar, Fatemeh Jamshidi, Tathagata Bhattacharya, Mostafa Rahgouy, Nilanjana Raychawdhary, Dongji Feng, Vinija Jain, Aman Chadha, Mary Sandage, Lauramarie Pope, Gerry Dozier, Cheryl Seals

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at NeurIPS Safe Generative AI Workshop, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07439 2024-11-13 cs.SD cs.IR eess.AS 89%

Music Discovery Dialogue Generation Using Human Intent Analysis and Large Language Models

SeungHeon Doh, Keunwoo Choi, Daeyong Kwon, Taesu Kim, Juhan Nam

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Accepted for publication at the 25th International Society for Music Information Retrieval Conference (ISMIR 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.01090 2024-11-08 cs.CV 89%

Learning Multiple Object States from Actions via Large Language Models

Masatoshi Tateno, Takuma Yagi, Ryosuke Furuta, Yoichi Sato

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments This is an accepted WACV 2025 paper. Project page: https://masatate.github.io/ObjStatefromAction.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.03659 2024-11-07 cs.CY 89%

Towards Scalable Automated Grading: Leveraging Large Language Models for Conceptual Question Evaluation in Engineering

Rujun Gao, Xiaosu Guo, Xiaodi Li, Arun Balajiee Lekshmi Narayanan, Naveen Thomas, Arun R. Srinivasa

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 21 pages, 21 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.03500 2024-11-07 cs.DB 89%

λ-Tune: Harnessing Large Language Models for Automated Database System Tuning

Victor Giannankouris, Immanuel Trummer

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments To be presented at SIGMOD 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.01368 2024-11-05 cs.IR q-fin.CP 89%

Combining Financial Data and News Articles for Stock Price Movement Prediction Using Large Language Models

Ali Elahi, Fatemeh Taghvaei

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.18927 2024-10-25 cs.CR 89%

SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models

Zonghao Ying, Aishan Liu, Siyuan Liang, Lei Huang, Jinyang Guo, Wenbo Zhou, Xianglong Liu, Dacheng Tao

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.18624 2024-10-25 cs.CL cs.AI cs.LG 89%

Prompting and Fine-Tuning of Small LLMs for Length-Controllable Telephone Call Summarization

David Thulke, Yingbo Gao, Rricha Jalota, Christian Dugast, Hermann Ney

专题命中 评测与基准 :prompting(title,abstract);large language model(abstract,comments);language model(abstract,comments);LLM(abstract)

Comments Accepted at the The International Conference on Foundation and Large Language Models (FLLM2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.05392 2024-10-22 cs.CL cs.AI cs.CY cs.LG 89%

Deconstructing The Ethics of Large Language Models from Long-standing Issues to New-emerging Dilemmas: A Survey

Chengyuan Deng, Yiqun Duan, Xin Jin, Heng Chang, Yijun Tian, Han Liu, Yichen Wang, Kuofeng Gao, Henry Peng Zou, Yiqiao Jin, Yijia Xiao, Shenghao Wu, Zongxing Xie, Weimin Lyu, Sihong He, Lu Cheng, Haohan Wang, Jun Zhuang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09962 2024-10-16 cs.CV 89%

LongHalQA: Long-Context Hallucination Evaluation for MultiModal Large Language Models

Han Qiu, Jiaxing Huang, Peng Gao, Qin Qi, Xiaoqin Zhang, Ling Shao, Shijian Lu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.11111 2024-10-16 cs.CL cs.AI cs.LG 89%

Inducing anxiety in large language models can induce bias

Julian Coda-Forno, Kristin Witte, Akshay K. Jagadish, Marcel Binz, Zeynep Akata, Eric Schulz

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.17139 2024-10-15 cs.LG cs.AI cs.CL cs.IT math.IT 89%

Diff-eRank: A Novel Rank-Based Metric for Evaluating Large Language Models

Lai Wei, Zhiquan Tan, Chenghai Li, Jindong Wang, Weiran Huang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.06011 2024-10-10 cs.DB 89%

Large Language Model Enhanced Text-to-SQL Generation: A Survey

Xiaohu Zhu, Qian Li, Lizhen Cui, Yongkang Liu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 14 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.18060 2024-10-10 cs.HC cs.SE 89%

Inferring Alt-text For UI Icons With Large Language Models During App Development

Sabrina Haque, Christoph Csallner

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.02525 2024-10-08 cs.SE 89%

Large Language Model for Vulnerability Detection and Repair: Literature Review and the Road Ahead

Xin Zhou, Sicong Cao, Xiaobing Sun, David Lo

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 24 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.06259 2024-10-08 cs.CL cs.AI cs.DB cs.IR cs.LG 89%

Editing Conceptual Knowledge for Large Language Models

Xiaohan Wang, Shengyu Mao, Ningyu Zhang, Shumin Deng, Yunzhi Yao, Yue Shen, Lei Liang, Jinjie Gu, Huajun Chen

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments EMNLP 2024 Findings; Code: https://github.com/zjunlp/EasyEdit Dataset: https://huggingface.co/datasets/zjunlp/ConceptEdit

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.07082 2024-10-07 cs.SE 89%

Evaluating Source Code Quality with Large Language Models: a comparative study

Igor Regis da Silva Simões, Elaine Venson

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.15468 2024-10-07 cs.CL cs.AI cs.LG 89%

MMLU-SR: A Benchmark for Stress-Testing Reasoning Capability of Large Language Models

Wentian Wang, Sarthak Jain, Paul Kantor, Jacob Feldman, Lazaros Gallos, Hao Wang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.02301 2024-10-04 cs.NE 89%

Large Language Model Aided Multi-objective Evolutionary Algorithm: a Low-cost Adaptive Approach

Wanyi Liu, Long Chen, Zhenzhou Tang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.06908 2024-10-03 cs.HC 89%

"I Want It That Way": Enabling Interactive Decision Support Using Large Language Models and Constraint Programming

Connor Lawless, Jakob Schoeffer, Lindy Le, Kael Rowan, Shilad Sen, Cristina St. Hill, Jina Suh, Bahareh Sarrafzadeh

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Journal ref ACM Trans. Interact. Intell. Syst., Vol. 14, No. 3, Article 22. 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.17561 2024-09-27 cs.SE 89%

TestBench: Evaluating Class-Level Test Case Generation Capability of Large Language Models

Quanjun Zhang, Ye Shang, Chunrong Fang, Siqi Gu, Jianyi Zhou, Zhenyu Chen

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16605 2024-09-26 cs.CL cs.AI cs.IR cs.LG 89%

Evaluating and Enhancing Large Language Models for Novelty Assessment in Scholarly Publications

Ethan Lin, Zhiyuan Peng, Yi Fang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.04219 2024-09-23 eess.AS 89%

Semi-supervised Learning for Code-Switching ASR with Large Language Model Filter

Yu Xi, Wen Ding, Kai Yu, Junjie Lai

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Accepted by SLT2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.08444 2024-09-16 cs.CV 89%

Towards Unified Facial Action Unit Recognition Framework by Large Language Models

Guohong Hu, Xing Lan, Hanyu Jiang, Jiayi Lyu, Jian Xue

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏