arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-08-08 至 2025-08-08 共收录 27 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 27 篇

2406.15477 2025-08-08 cs.CL cs.AI 92%

CrisisSense-LLM: Instruction Fine-Tuned Large Language Model for Multi-label Social Media Text Classification in Disaster Informatics

Kai Yin, Bo Li, Chengkai Liu, Ali Mostafavi, Xia Hu

专题命中 效率与部署 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Relevant source code and data is available: https://github.com/KaiYin97/CrsisLLM

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05239 2025-08-08 cs.CL cs.AI cs.LG 90%

Pruning Large Language Models by Identifying and Preserving Functional Networks

Yiheng Liu, Junhao Ning, Sichen Xia, Xiaohui Gao, Ning Qiang, Bao Ge, Junwei Han, Xintao Hu

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05545 2025-08-08 cs.CR 89%

PRvL: Quantifying the Capabilities and Risks of Large Language Models for PII Redaction

Leon Garza, Anantaa Kotal, Aritran Piplai, Lavanya Elluri, Prajit Das, Aman Chadha

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.06402 2025-08-08 cs.RO cs.AI cs.HC 89%

Camera Control at the Edge with Language Models for Scene Understanding

Alexiy Buynitsky, Sina Ehsani, Bhanu Pallakonda, Pragyana Mishra

机构 * Purdue University(普渡大学)

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);SFT(abstract)

Comments 7 pages, 6 figures. This work was presented and published at the 11th IEEE International Conference on Control, Automation and Robotics (ICCAR) in 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05421 2025-08-08 quant-ph cs.AI physics.atom-ph 85%

LLM-based Multi-Agent Copilot for Quantum Sensor

Rong Sha, Binglin Wang, Jun Yang, Xiaoxiao Ma, Chengkun Wu, Liang Yan, Chao Zhou, Jixun Liu, Guochao Wang, Shuhua Yan, Lingxiao Zhu

机构 * National University of Defense Technology(国防科技大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 13 pages,4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05113 2025-08-08 cs.AI 83%

EasySize: Elastic Analog Circuit Sizing via LLM-Guided Heuristic Search

Xinyue Wu, Fan Hu, Shaik Jani Babu, Yi Zhao, Xinfei Guo

机构 * Global College Shanghai Jiao Tong University(上海交通大学全球学院)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.14964 2025-08-08 cs.CL cs.LG 82%

Efficient Knowledge Injection in LLMs via Self-Distillation

Kalle Kujanpää, Pekka Marttinen, Harri Valpola, Alexander Ilin

机构 * Aalto University(阿alto大学) Finnish Center for Artificial Intelligence (FCAI)(芬兰人工智能中心) System 2 AI

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11105 2025-08-08 cs.CL cs.AI cs.AR cs.SY eess.SY 79%

Enabling On-Device Medical AI Assistants via Input-Driven Saliency Adaptation

Uttej Kallakurik, Edward Humes, Rithvik Jonna, Xiaomin Lin, Tinoosh Mohsenin

机构 * Johns Hopkins Whiting School of Engineering(约翰霍普金斯大学惠蒂工程学院)

专题命中 效率与部署 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.CL、cs.AI

Comments Accepted for publication in the Proceedings of IEEE BioCAS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05598 2025-08-08 cs.CL cs.LG 79%

DEL: Context-Aware Dynamic Exit Layer for Efficient Self-Speculative Decoding

Hossein Entezari Zarch, Lei Gao, Chaoyi Jiang, Murali Annavaram

机构 * University of Southern California(南加州大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.06722 2025-08-08 cs.CL cs.LG 79%

Scaling Laws For Mixed Quantization

Zeyu Cao, Boyang Gu, Cheng Zhang, Pedro Gimenes, Jianqiao Lu, Jianyi Cheng, Xitong Gao, Yiren Zhao

机构 * Department of Computer Science and Technology, University of Cambridge(计算机科学与技术系,剑桥大学) Department of Electrical & Electronic Engineering, Imperial College London(电气与电子工程系,伦敦帝国学院) Department of Computer Science, University of Hong Kong(计算机科学系,香港大学) School of Informatics, University of Edinburgh(信息学院,爱丁堡大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04942 2025-08-08 cs.CV 78%

Accelerating Conditional Prompt Learning via Masked Image Modeling for Vision-Language Models

Phuoc-Nguyen Bui, Khanh-Binh Nguyen, Hyunseung Choo

机构 * Convergence Research Institute, Sungkyunkwan University(convergence research institute, 首尔大学) School of Information Technology, Deakin University(信息科技学院, 德金大学) Department of Electrical and Computer Engineering, Sungkyunkwan University(电气与计算机工程系, 首尔大学)

专题命中 效率与部署 :language model(title,abstract)

Comments ACMMM-LAVA 2025, 10 pages, camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04068 2025-08-08 eess.SP 78%

WiFo-CF: Wireless Foundation Model for CSI Feedback

Xuanyu Liu, Shijian Gao, Boxun Liu, Xiang Cheng, Liuqing Yang

专题命中 效率与部署 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.06608 2025-08-08 math.OC 78%

RideAgent: An LLM-Enhanced Optimization Framework for Automated Taxi Fleet Operations

Xinyu Jiang, Haoyu Zhang, Mengyi Sha, Zihao Jiao, Long He, Junbo Zhang, Wei Qi

专题命中 效率与部署 :LLM(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05199 2025-08-08 cs.SE cs.AI 77%

EvoGraph: Hybrid Directed Graph Evolution toward Software 3.0

Igor Costa, Christopher Baran

机构 * AutoHand AI

专题命中 效率与部署 :large language model(abstract);language model(abstract);small language model(abstract);分类 cs.AI

Comments 15 pages, 3 tables, 1 algorithm. Submitted to ICSE 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04721 2025-08-08 cs.SD cs.AI eess.AS 77%

Toward Low-Latency End-to-End Voice Agents for Telecommunications Using Streaming ASR, Quantized LLMs, and Real-Time TTS

Vignesh Ethiraj, Ashwath David, Sidhanth Menon, Divya Vijay

机构 * NetoAI

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01545 2025-08-08 cs.AI cs.HC 77%

Getting out of the Big-Muddy: Escalation of Commitment in LLMs

Emilio Barkett, Olivia Long, Paul Kröger

机构 * Columbia University(哥伦比亚大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08567 2025-08-08 cs.LG 77%

AbbIE: Autoregressive Block-Based Iterative Encoder for Efficient Sequence Modeling

Preslav Aleksandrov, Meghdad Kurmanji, Fernando Garcia Redondo, David O'Shea, William Shen, Alex Iacob, Lorenzo Sani, Xinchi Qiu, Nicola Cancedda, Nicholas D. Lane

机构 * University of Cambridge(剑桥大学) Meta

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments 14 pages and 6 figures. Submitted to NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06608 2025-08-08 cs.DC cs.LG 74%

Nexus:Proactive Intra-GPU Disaggregation of Prefill and Decode in LLM Serving

Xiaoxiang Shi, Colin Cai, Junjia Du, Zhihao Jia

机构 * Independent Researcher(独立研究者) Nanyang Technological University(南洋理工大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 效率与部署 :LLM(title);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02317 2025-08-08 cs.CL cs.AI cs.DC 73%

VeOmni: Scaling Any Modality Model Training with Model-Centric Distributed Recipe Zoo

Qianli Ma, Yaowei Zheng, Zhelun Shi, Zhongkai Zhao, Bin Jia, Ziyue Huang, Zhiqi Lin, Youjie Li, Jiacheng Yang, Yanghua Peng, Zhi Zhang, Xin Liu

机构 * ByteDance(字节跳动)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05619 2025-08-08 cs.AI nlin.AO physics.bio-ph physics.comp-ph physics.hist-ph 70%

The Missing Reward: Active Inference in the Era of Experience

Bo Wen

机构 * IBM T.J. Watson Research Center(IBM TJ沃森研究中心)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05257 2025-08-08 cs.LG 70%

MoBE: Mixture-of-Basis-Experts for Compressing MoE-based LLMs

Xiaodong Chen, Mingming Ha, Zhenzhong Lan, Jing Zhang, Jianguo Li

机构 * Renmin University of China(中国人民大学) Westlake University(西湖大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.06323 2025-08-08 cs.CL 70%

When in Doubt, Cascade: Towards Building Efficient and Capable Guardrails

Manish Nagireddy, Inkit Padhi, Soumya Ghosh, Prasanna Sattigeri

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05165 2025-08-08 cs.LG cs.AI cs.CL 67%

Aligning LLMs on a Budget: Inference-Time Alignment with Heuristic Reward Models

Mason Nakamura, Saaduddin Mahmud, Kyle H. Wray, Hamed Zamani, Shlomo Zilberstein

专题命中 效率与部署 :LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04757 2025-08-08 q-bio.GN cs.LG 57%

Embedding Is (Almost) All You Need: Retrieval-Augmented Inference for Generalizable Genomic Prediction Tasks

Nirjhor Datta, Swakkhar Shatabda, M Sohel Rahman

机构 * Department of Computer Science and Engineering, Bangladesh University of Engineering and Technology(孟加拉工程与技术大学计算机科学与工程系) Department of Computer Science and Engineering, BRAC University(布拉克大学计算机科学与工程系)

专题命中 效率与部署 :language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05323 2025-08-08 cs.CV 50%

Textual Inversion for Efficient Adaptation of Open-Vocabulary Object Detectors Without Forgetting

Frank Ruis, Gertjan Burghouts, Hugo Kuijf

机构 * TNO(荷兰技术院) Intelligent Imaging(智能成像)

专题命中 效率与部署 :language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04868 2025-08-08 cs.CV 50%

Dual-Stream Attention with Multi-Modal Queries for Object Detection in Transportation Applications

Noreen Anwar, Guillaume-Alexandre Bilodeau, Wassim Bouachir

机构 * LITIV, Polytechnique Montréal(Polytechnique Montréal 的 LITIV) Data Science Laboratory, Université du Québec (TELUQ)(Université du Québec (TELUQ) 的 Data Science Laboratory)

专题命中 效率与部署 :language model(abstract)

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11348 2025-08-08 stat.ME 50%

Analyzing zero-inflated clustered longitudinal ordinal outcomes using GEE-type models with an application to dental fluorosis studies

Shoumi Sarkar, Anish Mukherjee, Jeremy T. Gaskins, Steven Levy, Peihua Qiu, Somnath Datta

专题命中 效率与部署 :prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏