arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-09-04 至 2025-09-04 共收录 19 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 19 篇

2509.03058 2025-09-04 cs.CR 89%

EverTracer: Hunting Stolen Large Language Models via Stealthy and Robust Probabilistic Fingerprint

Zhenhua Xu, Meng Han, Wenpeng Xing

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Accepted by EMNLP2025 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.15486 2025-09-04 cs.CL cs.AI cs.LG 87%

SampleAttention: Near-Lossless Acceleration of Long Context LLM Inference with Adaptive Structured Sparse Attention

Qianchao Zhu, Jiangfei Duan, Chang Chen, Siran Liu, Guanyu Feng, Xin Lv, Xiao Chuanfu, Dahua Lin, Chao Yang

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03462 2025-09-04 cs.AI cs.CV cs.RO 85%

sam-llm: interpretable lane change trajectoryprediction via parametric finetuning

Zhuo Cao, Yunxiao Shi, Min Xu

机构 * University of Queensland, School of Civil Engineering(昆士兰大学土木工程学院) University of Technology Sydney, Faculty of Engineering(悉尼科技大学工程学院)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 5 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10059 2025-09-04 cs.SE 85%

CodeGrad: Integrating Multi-Step Verification with Gradient-Based LLM Refinement

Yueke Zhang, Yifan Zhang, Kevin Leach, Yu Huang

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 6 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06463 2025-09-04 cs.SE 85%

Evaluating Efficiency and Novelty of LLM-Generated Code for Graph Analysis

Atieh Barati Nia, Mohammad Dindoost, David A. Bader

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 7 pages, v2: minor revision to match final paper published in the The 29th Annual IEEE High Performance Extreme Computing Conference (HPEC), Virtual, September 15-19, 2025. Outstanding Student Paper Award

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.16033 2025-09-04 cs.CL cs.AI cs.LG 83%

TreeBoN: Enhancing Inference-Time Alignment with Speculative Tree-Search and Best-of-N Sampling

Jiahao Qiu, Yifu Lu, Yifan Zeng, Jiacheng Guo, Jiayi Geng, Chenhao Zhu, Xinzhe Juan, Ling Yang, Huazheng Wang, Kaixuan Huang, Yue Wu, Mengdi Wang

专题命中 效率与部署 :large language model(abstract);language model(abstract);RLHF(abstract);preference optimization(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03018 2025-09-04 cs.DC cs.LG 79%

Mycroft: Tracing Dependencies in Collective Communication Towards Reliable LLM Training

Yangtao Deng, Lei Zhang, Qinlong Wang, Xiaoyun Zhi, Xinlei Zhang, Zhuo Jiang, Haohan Xu, Lei Wang, Zuquan Song, Gaohong Liu, Yang Bai, Shuguang Wang, Wencong Xiao, Jianxi Ye, Minlan Yu, Hong Xu

机构 * The Chinese University of Hong Kong(香港中文大学) ByteDance(字节跳动) ByteDance Seed(字节跳动种子) Harvard University(哈佛大学)

专题命中 效率与部署 :LLM(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.00079 2025-09-04 cs.DC cs.AI cs.AR 79%

Mooncake: A KVCache-centric Disaggregated Architecture for LLM Serving

Ruoyu Qin, Zheming Li, Weiran He, Mingxing Zhang, Yongwei Wu, Weimin Zheng, Xinran Xu

机构 * Moonshot AI Tsinghua University(清华大学)

专题命中 效率与部署 :LLM(title,abstract);分类 cs.AI

Comments 23 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19992 2025-09-04 cs.LG cs.AI 79%

HERCULES: Hierarchical Embedding-based Recursive Clustering Using LLMs for Efficient Summarization

Gabor Petnehazi, Bernadett Aradi

机构 * University of Debrecen(德布勒恩大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03047 2025-09-04 cs.DC cs.AI 77%

FlashRecovery: Fast and Low-Cost Recovery from Failures for Large-Scale Training of LLMs

Haijun Zhang, Jinxiang Wang, Zhenhua Yu, Yanyong Zhang, Xuejie Ji, Kaining Mao, Jun Zhang, Yaqing Zhang, Ting Wu, Fei Jie, Xiemin Huang, Zhifang Cai, Junhua Cheng, Shuwei Wang, Wei Li, Xiaoming Bao, Hua Xu, Shixiong Zhao, Jun Li, Hongwei Sun, Ziyang Zhang, Yi Xiong, Chunsheng Li

机构 * iFLYTEK AI Engineering Institute(iFLYTEK人工智能工程研究院) University of Science and Technology of China(中国科学技术大学) Huawei Technologies Co., Ltd(华为技术有限公司)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20301 2025-09-04 cs.CL 77%

Advancing Dialectal Arabic to Modern Standard Arabic Machine Translation

Abdullah Alabdullah, Lifeng Han, Chenghua Lin

机构 * University of Manchester(曼彻斯特大学) School of Informatics, University of Edinburgh(爱丁堡大学信息学院) Leiden University(莱顿大学) LIACS LUMC

专题命中 效率与部署 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00634 2025-09-04 cs.LG cs.AI 73%

Efficiently Editing Mixture-of-Experts Models with Compressed Experts

Yifei He, Yang Liu, Chen Liang, Hany Hassan Awadalla

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Microsoft(微软公司)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00096 2025-09-04 cs.LG cs.CL 73%

Pruning Weights but Not Truth: Safeguarding Truthfulness While Pruning LLMs

Yao Fu, Runchao Li, Xianxuan Long, Haotian Yu, Xiaotian Han, Yu Yin, Pan Li

机构 * Case Western Reserve University(凯斯西储大学) Hangzhou Dianzi University(杭州电子科技大学)

专题命中 效率与部署 :LLM(abstract);prompting(abstract);分类 cs.CL、cs.LG

Comments Accepted to EMNLP2025 findings (poster)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03136 2025-09-04 cs.DB cs.AI 70%

Adaptive KV-Cache Compression without Manually Setting Budget

Chenxia Tang, Jianchun Liu, Hongli Xu, Liusheng Huang

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03380 2025-09-04 cs.AI cs.CL 62%

Situating AI Agents in their World: Aspective Agentic AI for Dynamic Partially Observable Information Systems

Peter J. Bentley, Soo Ling Lim, Fuyuki Ishikawa

专题命中 效率与部署 :LLM(abstract);分类 cs.CL、cs.AI

Comments 9 pages

Journal ref 7th International Workshop on Agent-Based Modelling of Human Behaviour (ABMHuB'25), ALife 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03173 2025-09-04 eess.IV cs.CV cs.LG 57%

Deep Self-knowledge Distillation: A hierarchical supervised learning for coronary artery segmentation

Mingfeng Lin

机构 * Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学深圳学院) Xiamen University, Xiamen, China(厦门大学)

专题命中 效率与部署 :prompting(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02753 2025-09-04 cs.LG 57%

LExI: Layer-Adaptive Active Experts for Efficient MoE Model Inference

Krishna Teja Chitty-Venkata, Sandeep Madireddy, Murali Emani, Venkatram Vishwanath

机构 * Argonne National Laboratory(阿贡国家实验室)

专题命中 效率与部署 :post-training(abstract);分类 cs.LG

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03002 2025-09-04 cs.CV 50%

SOPSeg: Prompt-based Small Object Instance Segmentation in Remote Sensing Imagery

Chenhao Wang, Yingrui Ji, Yu Meng, Yunjian Zhang, Yao Zhu

专题命中 效率与部署 :prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02654 2025-09-04 cs.AR 50%

Breaking the HBM Bit Cost Barrier: Domain-Specific ECC for AI Inference Infrastructure

Rui Xie, Asad Ul Haq, Yunhua Fang, Linsen Ma, Sanchari Sen, Swagath Venkataramani, Liu Liu, Tong Zhang

专题命中 效率与部署 :LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏