Add TurboQuant Support for KV Cache Quantization
### Motivation
TurboQuant - optimisation to run LLMs at lower VRAM requirements
### Related resources
Is there a plan for TurboQuant support in near future?
https://github.com/vllm-project/vllm/issues/38171
https://github.com/Alberto-Codes/turboquant-vllm
### Additional context
_No response_
关闭于 2026-04-16 1 条评论