arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-07-25 至 2025-07-25 共收录 24 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 24 篇

2401.17256 2025-07-25 cs.CL 88%

Weak-to-Strong Jailbreaking on Large Language Models

Xuandong Zhao, Xianjun Yang, Tianyu Pang, Chao Du, Lei Li, Yu-Xiang Wang, William Yang Wang

机构 * Sea AI Lab, Singapore(新加坡海智实验室) Carnegie Mellon University(卡内基梅隆大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18073 2025-07-25 cs.LG 87%

Squeeze10-LLM: Squeezing LLMs' Weights by 10 Times via a Staged Mixed-Precision Quantization Method

Qingcheng Zhu, Yangyang Ren, Linlin Yang, Mingbao Lin, Yanjing Li, Sheng Xu, Zichao Feng, Haodong Zhu, Yuguang Yang, Juan Zhang, Runqi Wang, Baochang Zhang

机构 * Beihang University(北航大学) Communication University of China(通信大学) Skywork AI Beijing Jiaotong University(北京交通大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15690 2025-07-25 cs.LG cs.AI cs.SI stat.ME 86%

LLM Web Dynamics: Tracing Model Collapse in a Network of LLMs

Tianyu Wang, Akira Horiguchi, Lingyou Pang, Carey E. Priebe

机构 * Johns Hopkins University(约翰霍普金斯大学) University of California, Davis(加州大学戴维斯分校)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01144 2025-07-25 cs.CL cs.LG 86%

BlockDialect: Block-wise Fine-grained Mixed Format Quantization for Energy-Efficient LLM Inference

Wonsuk Jang, Thierry Tambe

机构 * Department of Electrical Engineering, Stanford University, CA, USA(电气工程系,斯坦福大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18607 2025-07-25 cs.CG cs.LG 85%

Explainable Mapper: Charting LLM Embedding Spaces Using Perturbation-Based Explanation and Verification Agents

Xinyuan Yan, Rita Sevastjanova, Sinie van der Ben, Mennatallah El-Assady, Bei Wang

机构 * University of Utah(犹他大学) ETH Zürich(苏黎世联邦理工学院)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18343 2025-07-25 cs.CL 85%

Hybrid Annotation for Propaganda Detection: Integrating LLM Pre-Annotations with Human Intelligence

Ariana Sahitaj, Premtim Sahitaj, Veronika Solopova, Jiaao Li, Sebastian Möller, Vera Schmitt

机构 * Quality and Usability Lab, Technische Universität Berlin, Germany(柏林技术大学质量与可用性实验室) German Research Center for Artificial Intelligence (DFKI), Berlin, Germany(德国人工智能研究中心(DFKI))

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments NLP4PI at ACL

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17999 2025-07-25 cs.HC cs.LG 85%

Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving

Chang Xiao, Brenda Yang

机构 * Boston University(波士顿大学) Columbia University(哥伦比亚大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

Journal ref The 38th Annual ACM Symposium on User Interface Software and Technology (UIST 25), September 28-October 01, 2025, Busan, Republic of Korea

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18007 2025-07-25 cs.DC 85%

Cloud Native System for LLM Inference Serving

Minxian Xu, Junhan Liao, Jingfeng Wu, Yiyuan He, Kejiang Ye, Chengzhong Xu

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18006 2025-07-25 cs.DC 85%

Unlock the Potential of Fine-grained LLM Serving via Dynamic Module Scaling

Jingfeng Wu, Yiyuan He, Minxian Xu, Xitong Gao, Kejiang Ye, Chengzhong Xu

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17962 2025-07-25 cs.CR 85%

TimelyHLS: LLM-Based Timing-Aware and Architecture-Specific FPGA HLS Optimization

Nowfel Mashnoor, Mohammad Akyash, Hadi Kamali, Kimia Azar

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18587 2025-07-25 eess.SP cs.AI 79%

A Foundation Model for Massive MIMO Precoding with an Adaptive per-User Rate-Power Tradeoff

Jérôme Emery, Ali Hasanzadeh Karkan, Jean-François Frigon, François Leduc-Primeau

机构 * Department of Electrical Engineering, Polytechnique Montreal(电气工程系,蒙特利尔大学)

专题命中 效率与部署 :foundation model(title,abstract);分类 cs.AI

Comments 6 pages, 3 figures. Accepted to the IEEE International Symposium on Personal, Indoor and Mobile Radio Communications (PIMRC) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07588 2025-07-25 cs.CV cs.AI 79%

When Large Vision-Language Model Meets Large Remote Sensing Imagery: Coarse-to-Fine Text-Guided Token Pruning

Junwei Luo, Yingying Zhang, Xue Yang, Kang Wu, Qi Zhu, Lei Liang, Jingdong Chen, Yansheng Li

机构 * Wuhan University(武汉大学) Ant Group(蚂蚁集团) SAIS, Shanghai Jiao Tong University(上海交通大学国际学院)

专题命中 效率与部署 :language model(title,abstract);分类 cs.AI

Comments 18 pages, 6 figures, 18 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06788 2025-07-25 cs.CV cs.AI 79%

EVEv2: Improved Baselines for Encoder-Free Vision-Language Models

Haiwen Diao, Xiaotong Li, Yufeng Cui, Yueze Wang, Haoge Deng, Ting Pan, Wenxuan Wang, Huchuan Lu, Xinlong Wang

机构 * DLUT(大连理工大学) BAAI(北京人工智能研究院) PKU(北京大学) BUPT(北京邮电大学) UCAS(中国科学院大学) CASIA(中国科学院自动化研究所)

专题命中 效率与部署 :language model(title,abstract);分类 cs.AI

Comments 20 pages, 10 figures, Accepted by ICCV2025 (highlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18546 2025-07-25 cs.CL cs.AI 79%

GLiNER2: An Efficient Multi-Task Information Extraction System with Schema-Driven Interface

Urchade Zaratiana, Gil Pasternak, Oliver Boyd, George Hurn-Maloney, Ash Lewis

机构 * Fastino AI

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17769 2025-07-25 cs.DC cs.LG 77%

PolyServe: Efficient Multi-SLO Serving at Scale

Kan Zhu, Haiyang Shi, Le Xu, Jiaxin Shan, Arvind Krishnamurthy, Baris Kasikci, Liguang Xie

机构 * University of Washington(华盛顿大学) ByteDance(字节跳动)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17723 2025-07-25 cs.LG 77%

Statistical Runtime Verification for LLMs via Robustness Estimation

Natan Levy, Adiel Ashrov, Guy Katz

机构 * The Hebrew University of Jerusalem(耶路撒冷希伯来大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments 20 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16870 2025-07-25 cs.LG cs.AI cs.CL 75%

Sparse Logit Sampling: Accelerating Knowledge Distillation in LLMs

Anshumann, Mohd Abbas Zaidi, Akhil Kedia, Jinwoo Ahn, Taehwak Kwon, Kangwook Lee, Haejun Lee, Joohyung Lee

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted as Oral paper at ACL 2025. Source code is available at https://github.com/akhilkedia/RandomSamplingKD . Anshumann, Mohd Abbas Zaidi and Akhil Kedia have Equal Contribution

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17865 2025-07-25 cs.NI 75%

Talk with the Things: Integrating LLMs into IoT Networks

Alakesh Kalita

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

Comments arXiv admin note: text overlap with arXiv:2407.20970

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18212 2025-07-25 cs.CL 70%

Prune&Comp: Free Lunch for Layer-Pruned LLMs via Iterative Pruning with Magnitude Compensation

Xinrui Chen, Hongxing Zhang, Fanyi Zeng, Yongxian Wei, Yizhi Wang, Xitong Ling, Guanghao Li, Chun Yuan

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17778 2025-07-25 cs.DB cs.AI cs.SE 70%

An advanced AI driven database system

M. Tedeschi, S. Rizwan, C. Shringi, V. Devram Chandgir, S. Belich

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

Comments 10 pages, 5 figures, appears in EDULEARN25 Conference Proceedings

Journal ref EDULEARN25 Proceedings, pp. 5130 5139, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17774 2025-07-25 cs.HC cs.AI 70%

Human-AI Co-Creation: A Framework for Collaborative Design in Intelligent Systems

Zhangqi Liu

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23825 2025-07-25 cs.CV 67%

Flash-VStream: Efficient Real-Time Understanding for Long Video Streams

Haoji Zhang, Yiqin Wang, Yansong Tang, Yong Liu, Jiashi Feng, Xiaojie Jin

机构 * Tsinghua University(清华大学) Tsinghua Shenzhen International Graduate School(清华大学深圳国际研究生院) Beijing Jiaotong University(北京交通大学) ByteDance Inc(字节跳动公司)

专题命中 效率与部署 :large language model(abstract);language model(abstract)

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17801 2025-07-25 cs.CV 50%

Lumina-mGPT 2.0: Stand-Alone AutoRegressive Image Modeling

Yi Xin, Juncheng Yan, Qi Qin, Zhen Li, Dongyang Liu, Shicheng Li, Victor Shea-Jay Huang, Yupeng Zhou, Renrui Zhang, Le Zhuo, Tiancheng Han, Xiaoqing Sun, Siqi Luo, Mengmeng Wang, Bin Fu, Yuewen Cao, Hongsheng Li, Guangtao Zhai, Xiaohong Liu, Yu Qiao, Peng Gao

机构 * Shanghai AI Laboratory(上海人工智能实验室) Shanghai Innovation Institute(上海创新研究院) Nanjing University(南京大学) The Chinese University of Hong Kong(香港中文大学) Shanghai Jiao Tong University(上海交通大学) Zhejiang University of Technology(浙江工业大学)

专题命中 效率与部署 :foundation model(abstract)

Comments Tech Report, 23 pages, 11 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.06726 2025-07-25 cs.IT eess.SP math.IT 50%

Integrated Sensing and Edge AI: Realizing Intelligent Perception in 6G

Zhiyan Liu, Xu Chen, Hai Wu, Zhanwei Wang, Xianhao Chen, Dusit Niyato, Kaibin Huang

专题命中 效率与部署 :foundation model(abstract)

Comments To appear in IEEE Communications Surveys and Tutorials

详情

展开后加载摘要…

URL PDF HTML 收藏