ITADN

Add TurboQuant Support for KV Cache Quantization

#4499Closedjanakg 创建于 2026-04-06
J
janakgcommented
### Motivation TurboQuant - optimisation to run LLMs at lower VRAM requirements ### Related resources Is there a plan for TurboQuant support in near future? https://github.com/vllm-project/vllm/issues/38171 https://github.com/Alberto-Codes/turboquant-vllm ### Additional context _No response_
关闭于 2026-04-16 1 条评论