arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-11-19 至 2025-11-19 共收录 28 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 28 篇

2511.14694 2025-11-19 q-bio.GN cs.AI cs.LG q-bio.PE 90%

Near-Lossless Model Compression Enables Longer Context Inference in DNA Large Language Models

Rui Zhu, Xiaopu Zhou, Haixu Tang, Stephen W. Scherer, Lucila Ohno-Machado

机构 * Yale School of Medicine(耶鲁医学院) The Hospital for Sick Children(儿童医院) Luddy School of Informatics, Computing, and Engineering(信息学、计算与工程学院)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14650 2025-11-19 cs.AI 89%

AutoTool: Efficient Tool Selection for Large Language Model Agents

Jingyi Jia, Qinbin Li

机构 * Jingyi Jia, Qinbin Li

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments Accepted by AAAI 2026, 18 pages, 11 figures, Code: https://github.com/jiajingyyyyyy/AutoTool

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14454 2025-11-19 cs.CV 89%

Video Compression Commander: Plug-and-Play Inference Acceleration for Video Large Language Models

Xuyang Liu, Yiyu Wang, Junpeng Ma, Linfeng Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Sichuan University(四川大学) Fudan University(复旦大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments EMNLP 2025 main

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01273 2025-11-19 cs.CL cs.AI 88%

Anti-adversarial Learning: Desensitizing Prompts for Large Language Models

Xuan Li, Zhe Yin, Xiaodong Gu, Beijun Shen

机构 * Beijun Shen(沈贝俊)

专题命中 效率与部署 :language model(title,abstract);large language model(title);LLM(abstract);分类 cs.CL、cs.AI

Comments Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14662 2025-11-19 cs.CL 88%

Bias in, Bias out: Annotation Bias in Multilingual Large Language Models

Xia Cui, Ziyi Huang, Naeemeh Adel

机构 * Manchester Metropolitan University(曼彻斯特 Metropolitan 大学) Hubei University(湖北大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.16968 2025-11-19 cs.LG cs.AI 87%

BackSlash: Rate Constrained Optimized Training of Large Language Models

Jun Wu, Jiangtao Wen, Yuxing Han

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Computer Science, New York University(纽约大学计算机科学)

专题命中 效率与部署 :language model(title,abstract);large language model(title);分类 cs.AI、cs.LG

Journal ref Proceedings of the 42nd International Conference on Machine Learning, PMLR 267:67852-67863, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14528 2025-11-19 cs.SE 87%

LLM-Assisted Thematic Analysis: Opportunities, Limitations, and Recommendations

Tatiane Ornelas, Allysson Allex Araújo, Júlia Araújo, Marina Araújo, Bianca Trinkenreich, Marcos Kalinowski

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08383 2025-11-19 cs.LG cs.AI cs.CR 86%

Efficient Decoding Methods for Language Models on Encrypted Data

Matan Avitan, Moran Baruch, Nir Drucker, Itamar Zimerman, Yoav Goldberg

机构 * IBM Research(IBM研究院) Bar-Ilan University(巴伊兰大学) Tel Aviv University(特拉维夫大学) Allen Institute for Artificial Intelligence(人工智能研究院)

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14124 2025-11-19 cs.DC cs.LG 85%

10Cache: Heterogeneous Resource-Aware Tensor Caching and Migration for LLM Training

Sabiha Afroz, Redwan Ibne Seraj Khan, Hadeel Albahar, Jingoo Han, Ali R. Butt

机构 * Kuwait University, Kuwait(科威特大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments This paper accepted for presentation to the 16th ACM Symposium on Cloud Computing (SOCC'25)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12376 2025-11-19 cs.LG 85%

BitSnap: Checkpoint Sparsification and Quantization in LLM Training

Yanxin Peng, Qingping Li, Baodong Wu, Shigang Li, Guohao Dai, Shengen Yan, Yu Wang

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments 12 pages, numerous figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09087 2025-11-19 cs.NI cs.AI 85%

Tele-LLM-Hub: Building Context-Aware Multi-Agent LLM Systems for Telecom Networks

Pranshav Gajjar, Cong Shen, Vijay K Shah

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18544 2025-11-19 cs.DC 85%

SLICE: SLO-Driven Scheduling for LLM Inference on Edge Computing Devices

Will Chow

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments This work has been submitted to the IEEE for possible publication. This version is temporarily hosted anonymously for double-blind review

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13972 2025-11-19 cs.SE cs.CL 83%

Show and Tell: Prompt Strategies for Style Control in Multi-Turn LLM Code Generation

Jeremiah Bohr

专题命中 效率与部署 :LLM(title);language model(abstract);prompting(abstract);分类 cs.CL

Comments 23 pages, 2 figures, 3 tables. Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12673 2025-11-19 cs.CL cs.AI 81%

ACoRN: Noise-Robust Abstractive Compression in Retrieval-Augmented Language Models

Singon Kim, Gunho Jung, Seong-Whan Lee

机构 * Department of Artificial Intelligence Korea University Seoul, Republic of Korea(人工智能系韩国大学首尔韩国)

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted by IJCNN 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14293 2025-11-19 cs.SD cs.LG 79%

Segmentwise Pruning in Audio-Language Models

Marcel Gibier, Raphaël Duroselle, Pierre Serrano, Olivier Boeffard, Jean-François Bonastre

机构 * Inria Paris, France(巴黎研究所,法国)

专题命中 效率与部署 :language model(title,abstract);分类 cs.LG

Comments Submitted to ICASSP 2026 (under review)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13994 2025-11-19 cs.CL 79%

Hint-Augmented Re-ranking: Efficient Product Search using LLM-Based Query Decomposition

Yilun Zhu, Nikhita Vedula, Shervin Malmasi

机构 * Amazon.com, Inc.(亚马逊公司)

专题命中 效率与部署 :LLM(title,abstract);分类 cs.CL

Comments AACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17052 2025-11-19 cs.CL cs.AI 79%

SpecEdge: Scalable Edge-Assisted Serving Framework for Interactive LLMs

Jinwoo Park, Seunggeun Cho, Dongsu Han

机构 * KAIST(韩国科学技术院)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13841 2025-11-19 cs.LG 77%

Beat the long tail: Distribution-Aware Speculative Decoding for RL Training

Zelei Shao, Vikranth Srivatsa, Sanjana Srivastava, Qingyang Wu, Alpay Ariyak, Xiaoxia Wu, Ameen Patel, Jue Wang, Percy Liang, Tri Dao, Ce Zhang, Yiying Zhang, Ben Athiwaratkun, Chenfeng Xu, Junxiong Wang

专题命中 效率与部署 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14116 2025-11-19 cs.DC 75%

FailSafe: High-performance Resilient Serving

Ziyi Xu, Zhiqiang Xie, Swapnil Gandhi, Christos Kozyrakis

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14721 2025-11-19 cs.LG math.OC 74%

AdamHD: Decoupled Huber Decay Regularization for Language Model Pre-Training

Fu-Ming Guo, Yingfang Fan

机构 * Stanford University(斯坦福大学) Harvard Medical School(哈佛医学院)

专题命中 效率与部署 :language model(title);分类 cs.LG

Comments 39th Conference on Neural Information Processing Systems (NeurIPS 2025) Workshop: GPU-Accelerated and Scalable Optimization (ScaleOpt)

Journal ref 39th Conference on Neural Information Processing Systems (NeurIPS 2025) Workshop: GPU-Accelerated and Scalable Optimization (ScaleOpt)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13950 2025-11-19 cs.AR 71%

NL-DPE: An Analog In-memory Non-Linear Dot Product Engine for Efficient CNN and LLM Inference

Lei Zhao, Luca Buonanno, Archit Gajjar, John Moon, Aishwarya Natarajan, Sergey Serebryakov, Ron M. Roth, Xia Sheng, Youtao Zhang, Paolo Faraboschi, Jim Ignowski, Giacomo Pedretti

专题命中 效率与部署 :LLM(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14691 2025-11-19 cs.NE cs.AI cs.CV cs.ET stat.ML 70%

Attention via Synaptic Plasticity is All You Need: A Biologically Inspired Spiking Neuromorphic Transformer

Kallol Mondal, Ankush Kumar

机构 * Department of Electronics and Communication Engineering, National Institute of Technology Allahabad, Prayagraj, 211004, India(国家理工学院阿姆利达分校电子与通信工程系) Centre for Nanotechnology, Indian Institute of Technology Roorkee, Roorkee, Uttarakhand, 247667, India(印度理工学院罗奥基分校纳米技术中心)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

Comments 21 Pages, 5 Figures, 3 Table

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14018 2025-11-19 cs.AI 70%

ALEX:A Light Editing-knowledge Extractor

Minghu Wang, Shuliang Zhao, Yuanyuan Zhao, Hongxia Xu

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13442 2025-11-19 cs.CV cs.AI 70%

Unlocking the Forgery Detection Potential of Vanilla MLLMs: A Novel Training-Free Pipeline

Rui Zuo, Qinyue Tong, Zhe-Ming Lu, Ziqian Lu

机构 * Zhejiang University(浙江大学) Zhejiang Sci-Tech University(浙江科技学院)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.22463 2025-11-19 cs.CV cs.LG 57%

Modulated Diffusion: Accelerating Generative Modeling with Modulated Quantization

Weizhi Gao, Zhichao Hou, Junqi Yin, Feiyi Wang, Linyu Peng, Xiaorui Liu

机构 * Department of Computer Science, North Carolina State University(北卡罗来纳州立大学计算机科学系) National Center for Computational Science, Oak Ridge National Lab(橡树岭国家实验室计算科学中心) Department of Mechanical Engineering, Keio University(庆应大学机械工程系)

专题命中 效率与部署 :post-training(abstract);分类 cs.LG

Comments 26 pages, accepted by ICML 2025

Journal ref Proceedings of the 42nd International Conference on Machine Learning, PMLR 267, 18337-18362, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14716 2025-11-19 cs.CV 50%

Diffusion As Self-Distillation: End-to-End Latent Diffusion In One Model

Xiyuan Wang, Muhan Zhang

机构 * Institute of Artificial Intelligence(人工智能研究院) Peking University(北京大学)

专题命中 效率与部署 :foundation model(abstract)

Comments Tech Report. 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12089 2025-11-19 cs.CV 50%

Playmate2: Training-Free Multi-Character Audio-Driven Animation via Diffusion Transformer with Reward Feedback

Xingpei Ma, Shenneng Huang, Jiaran Cai, Yuansheng Guan, Shen Zheng, Hanfeng Zhao, Qiang Zhang, Shunsi Zhang

机构 * Project lead & Corresponding Author(项目负责人及通讯作者)

专题命中 效率与部署 :foundation model(abstract)

Comments AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14072 2025-11-19 cs.CV 50%

CORE: Compact Object-centric REpresentations as a New Paradigm for Token Merging in LVLMs

Jingyu Lei, Gaoang Wang, Der-Horng Lee

机构 * Zhejiang University(浙江大学)

专题命中 效率与部署 :language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏