arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 22313 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 22313 篇

2403.07557 2024-03-13 cs.CL cs.LG 86%

SIFiD: Reassess Summary Factual Inconsistency Detection with LLM

Jiuding Yang, Hui Liu, Weidong Guo, Zhuwei Rao, Yu Xu, Di Niu

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.05636 2024-03-12 cs.AI cs.CL 86%

Tuning-Free Accountable Intervention for LLM Deployment -- A Metacognitive Approach

Zhen Tan, Jie Peng, Tianlong Chen, Huan Liu

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.04760 2024-03-08 cs.HC cs.AI cs.CY cs.LG 86%

iScore: Visual Analytics for Interpreting How Language Models Automatically Score Summaries

Adam Coscia, Langdon Holmes, Wesley Morris, Joon Suh Choi, Scott Crossley, Alex Endert

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.AI、cs.LG

Comments Accepted to IUI 2024. 16 pages, 5 figures, 1 table. For a demo video, see https://youtu.be/EYJX-_fQPf0 . For a live demo, visit https://adamcoscia.com/papers/iscore/demo/ . The source code is available at https://github.com/AdamCoscia/iScore

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.10294 2024-02-29 cs.HC cs.AI cs.CL cs.MM 86%

LAVE: LLM-Powered Agent Assistance and Language Augmentation for Video Editing

Bryan Wang, Yuliang Li, Zhaoyang Lv, Haijun Xia, Yan Xu, Raj Sodhi

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Paper accepted to the ACM Conference on Intelligent User Interfaces (ACM IUI) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.14590 2024-02-23 cs.IR cs.CL cs.LG 86%

Scaling Up LLM Reviews for Google Ads Content Moderation

Wei Qiao, Tushar Dogra, Otilia Stretcu, Yu-Han Lyu, Tiantian Fang, Dongjin Kwon, Chun-Ta Lu, Enming Luo, Yuan Wang, Chih-Chun Chia, Ariel Fuxman, Fangzhou Wang, Ranjay Krishna, Mehmet Tek

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.13741 2024-02-22 cs.CL cs.AI 86%

Unlocking Instructive In-Context Learning with Tabular Prompting for Relational Triple Extraction

Guozheng Li, Wenjun Ke, Peng Wang, Zijie Xu, Ke Ji, Jiajun Liu, Ziyu Shang, Qiqing Luo

专题命中 效率与部署 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments LREC-COLING 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.13485 2024-02-22 cs.LG cs.CL 86%

ProPD: Dynamic Token Tree Pruning and Generation for LLM Parallel Decoding

Shuzhang Zhong, Zebin Yang, Meng Li, Ruihao Gong, Runsheng Wang, Ru Huang

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.10196 2024-02-16 cs.CL cs.AI 86%

A Trembling House of Cards? Mapping Adversarial Attacks against Language Agents

Lingbo Mo, Zeyi Liao, Boyuan Zheng, Yu Su, Chaowei Xiao, Huan Sun

专题命中 效率与部署 :language agent(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.09360 2024-02-15 cs.LG cs.AI 86%

HiRE: High Recall Approximate Top-$k$ Estimation for Efficient LLM Inference

Yashas Samaga B L, Varun Yerram, Chong You, Srinadh Bhojanapalli, Sanjiv Kumar, Prateek Jain, Praneeth Netrapalli

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.02057 2024-02-06 cs.LG cs.CL 86%

Break the Sequential Dependency of LLM Inference Using Lookahead Decoding

Yichao Fu, Peter Bailis, Ion Stoica, Hao Zhang

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.13191 2024-01-12 cs.CL cs.AI 86%

Towards Robust Pruning: An Adaptive Knowledge-Retention Pruning Strategy for Language Models

Jianwei Li, Qi Lei, Wei Cheng, Dongkuan Xu

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);post-training(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.17276 2024-01-01 cs.CL cs.LG 86%

PanGu-$π$: Enhancing Language Model Architectures via Nonlinearity Compensation

Yunhe Wang, Hanting Chen, Yehui Tang, Tianyu Guo, Kai Han, Ying Nie, Xutao Wang, Hailin Hu, Zheyuan Bai, Yun Wang, Fangcheng Liu, Zhicheng Liu, Jianyuan Guo, Sinan Zeng, Yinchen Zhang, Qinghua Xu, Qun Liu, Jun Yao, Chao Xu, Dacheng Tao

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.15296 2023-12-27 cs.CL cs.AI 86%

DeTiME: Diffusion-Enhanced Topic Modeling using Encoder-decoder based LLM

Weijie Xu, Wenxiang Hu, Fanyou Wu, Srinivasan Sengamedu

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 19 pages, 4 figures, EMNLP 2023

Journal ref EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.02406 2023-12-12 cs.CL cs.LG 86%

Efficient Online Data Mixing For Language Model Pre-Training

Alon Albalak, Liangming Pan, Colin Raffel, William Yang Wang

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);pretraining(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.00471 2023-12-04 cs.LG cs.AI 86%

A Bayesian approach for prompt optimization in pre-trained language models

Antonio Sabbatella, Andrea Ponti, Antonio Candelieri, Ilaria Giordani, Francesco Archetti

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.06622 2023-11-27 cs.AI cs.CL 86%

TrainerAgent: Customizable and Efficient Model Training through LLM-Powered Multi-Agent System

Haoyuan Li, Hao Jiang, Tianke Zhang, Zhelun Yu, Aoxiong Yin, Hao Cheng, Siming Fu, Yuhao Zhang, Wanggui He

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.00603 2023-11-23 cs.CL cs.AI 86%

Faithful Explanations of Black-box NLP Models Using LLM-generated Counterfactuals

Yair Gat, Nitay Calderon, Amir Feder, Alexander Chapanin, Amit Sharma, Roi Reichart

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.20153 2023-11-01 cs.CL cs.AI 86%

Interactive Multi-fidelity Learning for Cost-effective Adaptation of Language Model with Sparse Human Supervision

Jiaxin Zhang, Zhuohang Li, Kamalika Das, Sricharan Kumar

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments This work has been accepted by NeurIPS 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.11403 2023-10-30 cs.CV cs.CL cs.LG 86%

eP-ALM: Efficient Perceptual Augmentation of Language Models

Mustafa Shukor, Corentin Dancette, Matthieu Cord

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);pretraining(abstract);分类 cs.CL、cs.LG

Comments Accepted at ICCV 2023. Project page: https://mshukor.github.io/eP-ALM.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.04089 2023-10-27 cs.LG cs.CL 86%

ZipLM: Inference-Aware Structured Pruning of Language Models

Eldar Kurtic, Elias Frantar, Dan Alistarh

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);post-training(abstract);分类 cs.CL、cs.LG

Comments Accepted to NeurIPS 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.15714 2023-10-18 cs.CL cs.AI 86%

Integrating LLM, EEG, and Eye-Tracking Biomarker Analysis for Word-Level Neural State Classification in Semantic Inference Reading Comprehension

Yuhong Zhang, Qin Li, Sujal Nahata, Tasnia Jamal, Shih-kuen Cheng, Gert Cauwenberghs, Tzyy-Ping Jung

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.17216 2023-10-16 cs.CL cs.CV cs.LG 86%

Generating Images with Multimodal Language Models

Jing Yu Koh, Daniel Fried, Ruslan Salakhutdinov

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.LG

Comments NeurIPS 2023. Project page: http://jykoh.com/gill

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.06837 2023-10-11 cs.CL cs.LG 86%

Generating and Evaluating Tests for K-12 Students with Language Model Simulations: A Case Study on Sentence Reading Efficiency

Eric Zelikman, Wanjing Anya Ma, Jasmine E. Tran, Diyi Yang, Jason D. Yeatman, Nick Haber

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.LG

Comments Accepted to EMNLP 2023 (Main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.11688 2023-09-22 cs.CL cs.AI 86%

LLM Guided Inductive Inference for Solving Compositional Problems

Abhigya Sodani, Lauren Moos, Matthew Mirman

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 5 pages, ICML TEACH Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.04623 2023-08-10 cs.AI cs.CL 86%

Accelerating LLM Inference with Staged Speculative Decoding

Benjamin Spector, Chris Re

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Published at ES-FOMO at ICML 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.18323 2023-05-31 cs.CL cs.AI 86%

ReWOO: Decoupling Reasoning from Observations for Efficient Augmented Language Models

Binfeng Xu, Zhiyuan Peng, Bowen Lei, Subhabrata Mukherjee, Yuchen Liu, Dongkuan Xu

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.07339 2022-11-11 cs.LG cs.AI 86%

LLM.int8(): 8-bit Matrix Multiplication for Transformers at Scale

Tim Dettmers, Mike Lewis, Younes Belkada, Luke Zettlemoyer

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Published at NeurIPS 2022. Camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05887 2026-01-06 cs.AI 86%

A three-Level Framework for LLM-Enhanced eXplainable AI: From technical explanations to natural language

一个三层框架用于LLM增强的可解释AI:从技术解释到自然语言

Marilyn Bello, Rafael Bello, Maria-Matilde García, Ann Nowé, Iván Sevillano-García, Francisco Herrera

机构 * Andalusian Research Institute in Data Science and Computational Intelligence(数据科学与计算智能安达卢西亚研究机构) Universidad de Granada(格拉纳达大学) Department of Computer Science(计算机科学系) Artificial Intelligence Lab(人工智能实验室) Vrije Universiteit Brussel(布鲁塞尔自由大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出一个三层框架,利用大型语言模型提升AI解释的可解释性,通过动态对话解释增强社会透明度和用户信任。

Comments 22 pages, 5 figures

Journal ref Bello, M., Bello, R., García, M. M., Nowé, A., Sevillano-García, I., & Herrera, F. (2025). A Three-level Framework for LLM-enhanced Explainable AI: From Technical Explanations to Natural Language. Information Systems Frontiers, 1-22

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11813 2025-10-15 cs.SE cs.CL cs.DB 86%

Task-Aware Reduction for Scalable LLM-Database Systems

Marcus Emmanuel Barnes, Taher A. Ghaleb, Safwat Hassan

机构 * Department of Computer Science Trent University Peterborough, Canada(计算机科学系特伦特大学彼得伯勒,加拿大) Faculty of Information University of Toronto Toronto, Canada(信息学院多伦多大学多伦多,加拿大)

专题命中 效率与部署 :LLM(title,abstract);language model(abstract,comments);large language model(abstract);分类 cs.CL

Comments Preprint. Accepted for presentation at the Workshop on Language Models and Databases (LMD), co-located with CASCON 2025 (IEEE). The final version will appear in IEEE Xplore

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09627 2025-09-22 cs.CL 86%

Benchmarking Debiasing Methods for LLM-based Parameter Estimates

Nicolas Audinet de Pieuchon, Adel Daoud, Connor T. Jerzak, Moa Johansson, Richard Johansson

机构 * Chalmers University of Technology(查尔姆斯理工大学) Linköping University(林肯大学) University of Texas at Austin(德克萨斯大学奥斯汀分校) University of Gothenburg(哥德堡大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments To appear as: Nicolas Audinet de Pieuchon, Adel Daoud, Connor T. Jerzak, Moa Johansson, Richard Johansson. Benchmarking Debiasing Methods for LLM-based Parameter Estimates. In: Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing (EMNLP), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏