Cachemir: Fully Homomorphic Encrypted Inference of Generative Large Language Model with KV Cache
Cachemir: 生成式大语言模型的全同态加密推理与KV缓存
专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)
AI总结 Cachemir通过整合KV缓存优化同态加密推理,实现高效生成式大语言模型推理。
Comments 16 pages, 10 figures, 6 tables. Under review