arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-08-18 至 2025-08-18 共收录 16 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 16 篇

2310.06500 2025-08-18 cs.AI 89%

MetaAgents: Large Language Model Based Agents for Decision-Making on Teaming

Yuan Li, Lichao Sun, Yixuan Zhang

机构 * University of Cambridge(剑桥大学) Lehigh University(莱斯利大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11152 2025-08-18 q-fin.ST cs.AI 88%

AlphaAgents: Large Language Model based Multi-Agents for Equity Portfolio Constructions

Tianjiao Zhao, Jingrao Lyu, Stokes Jones, Harrison Garber, Stefano Pasquali, Dhagash Mehta

机构 * BlackRock, Inc.(BlackRock公司)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11454 2025-08-18 cs.CL cs.AI 86%

Reference Points in LLM Sentiment Analysis: The Role of Structured Context

Junichiro Niimi

机构 * Meijo University(名古屋大学) RIKEN(理化学研究所) AIP(Advanced Institute for Particle Physics)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11291 2025-08-18 cs.IT cs.AI cs.LG math.IT 84%

Dynamic Quality-Latency Aware Routing for LLM Inference in Wireless Edge-Device Networks

Rui Bao, Nan Xue, Yaping Sun, Zhiyong Chen

机构 * Cooperative Medianet Innovation Center, Shanghai Jiao Tong University, Shanghai 200240, China(上海交通大学 Cooperative Medianet Innovation Center) Department of Broadband Communication, Pengcheng Laboratory, Shenzhen 518000, China(鹏城实验室宽带通信系) Future Network of Intelligence Institute (FNii), CUHK (Shenzhen), Shenzhen 518172, China(CUHK(深圳)未来网络智能研究所)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments accepted by IEEE/CIC ICCC workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11287 2025-08-18 cs.IT cs.AI cs.LG math.IT 84%

CSGO: Generalized Optimization for Cold Start in Wireless Collaborative Edge LLM Systems

Xuran Liu, Nan Xue, Rui Bao, Yaping Sun, Zhiyong Chen, Meixia Tao, Xiaodong Xu, Shuguang Cui

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments submitted to Journal of Communications and Information Networks

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11318 2025-08-18 cs.CL 83%

LLM Compression: How Far Can We Go in Balancing Size and Performance?

Sahil Sk, Debasish Dhal, Sonal Khosla, Sk Shahid, Sambit Shekhar, Akash Dhaka, Shantipriya Parida, Dilip K. Prasad, Ondřej Bojar

机构 * Odia Generative AI, India(奥迪生成人工智能,印度) AMD Silo AI, Finland(AMD Silo AI,芬兰) The Arctic University of Norway, Norway(挪威北极大学,挪威) Charles University, MFF, ÚFAL, Czech Republic(查尔斯大学,捷克共和国)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

Comments This paper has been accepted for presentation at the RANLP 2025 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09023 2025-08-18 cs.DB cs.AI cs.CL 79%

E3-Rewrite: Learning to Rewrite SQL for Executability, Equivalence,and Efficiency

Dongjie Xu, Yue Cui, Weijie Shi, Qingzhi Ma, Hanghui Guo, Jiaming Li, Yao Zhao, Ruiyuan Zhang, Shimin Di, Jia Zhu, Kai Zheng, Jiajie Xu

机构 * stu.suda.edu.cn(苏州大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10111 2025-08-18 cs.LG cs.FL cs.PL cs.SE 77%

Constrained Decoding of Diffusion LLMs with Context-Free Grammars

Niels Mündler, Jasper Dekoninck, Martin Vechev

机构 * Department of Computer Science ETH Zurich(计算机科学系 高等理工大学苏黎世分校)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09615 2025-08-18 cs.LG cs.AI cs.PF 76%

SLiM: One-shot Quantization and Sparsity with Low-rank Approximation for LLM Weight Compression

Mohammad Mozaffari, Amir Yazdanbakhsh, Maryam Mehri Dehnavi

机构 * University of Toronto(多伦多大学) Google DeepMind(谷歌DeepMind) NVIDIA Research(NVIDIA研究)

专题命中 效率与部署 :LLM(title);分类 cs.AI、cs.LG

Comments Published at Proceedings of the 42 nd International Conference on Machine Learning (ICML 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11269 2025-08-18 cs.PF 75%

Inference performance evaluation for LLMs on edge devices with a novel benchmarking framework and metric

Hao Chen, Cong Tian, Zixuan He, Bin Yu, Yepang Liu, Jialun Cao

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.07088 2025-08-18 cs.CL 70%

SPA: Towards A Computational Friendly Cloud-Base and On-Devices Collaboration Seq2seq Personalized Generation with Casual Inference

Yanming Liu, Xinyue Peng, Ningjing Sang, Yafeng Yan, Xiaolan Ke, Zhiting Zheng, Shaobo Liu, Songhang Deng, Jiannan Cao, Le Dai, Xingzu Liu, Ruilin Nong, Weihao Liu

机构 * Zhejiang University(浙江大学) Southeast University(东南大学) The Fu Foundation School of Engineering and Applied Science, Columbia University(哥伦比亚大学工程与应用科学学院) Stevens Institute of Technology(斯蒂文斯理工学院) Harvard University(哈佛大学) MIT(麻省理工学院) UCLA(加州大学洛杉矶分校) Beijing Institute of Technology(北京理工大学) Tianjin University(天津大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Update for details

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.21569 2025-08-18 cs.SE 67%

A Systematic Literature Review of Parameter-Efficient Fine-Tuning for Large Code Models

Saima Afrin, Md Zahidul Haque, Antonio Mastropaolo

专题命中 效率与部署 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22402 2025-08-18 cs.DB cs.AI cs.CL 62%

EllieSQL: Cost-Efficient Text-to-SQL with Complexity-Aware Routing

Yizhang Zhu, Runzhi Jiang, Boyan Li, Nan Tang, Yuyu Luo

专题命中 效率与部署 :LLM(abstract);分类 cs.CL、cs.AI

Comments COLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11511 2025-08-18 eess.IV cs.CV cs.LG 57%

Semi-Supervised Learning with Online Knowledge Distillation for Skin Lesion Classification

Siyamalan Manivannan

机构 * Department of Computer Science, Faculty of Science, University of Jaffna, Sri Lanka(计算机科学系,科学学院,贾夫纳大学,斯里兰卡)

专题命中 效率与部署 :post-training(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11224 2025-08-18 cs.SD cs.CL eess.AS 57%

Benchmarking Prosody Encoding in Discrete Speech Tokens

Kentaro Onda, Satoru Fukayama, Daisuke Saito, Nobuaki Minematsu

机构 * The University of Tokyo, Japan(东京大学) National Institute of Advanced Industrial Science(国家工业科学与技术研究院)

专题命中 效率与部署 :language model(abstract);分类 cs.CL

Comments Accepted by ASRU2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10557 2025-08-18 cs.CV cs.AI 57%

PTQAT: A Hybrid Parameter-Efficient Quantization Algorithm for 3D Perception Tasks

Xinhao Wang, Zhiwei Lin, Zhongyu Xia, Yongtao Wang

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学计算机系研究所)

专题命中 效率与部署 :post-training(abstract);分类 cs.AI

Comments 8 pages, Accepted by ICCVW 2025

详情

展开后加载摘要…

URL PDF HTML 收藏