Differentially Private and Communication Efficient Large Language Model Split Inference via Stochastic Quantization and Soft Prompt
通过随机量化和软提示实现差分隐私和通信高效的大型语言模型分拆推理
机构 * Zhejiang University, Hangzhou, China(浙江大学) ; University of Science and Technology of China, Anhui, China(中国科学技术大学)
专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI
AI总结 本文提出DEL框架,通过随机量化和软提示实现差分隐私和通信高效的LLM分拆推理,有效平衡隐私与效用。