TurboQuant+ KV Cache Compression

TurboQuant+ compresses llama.cpp KV caches on Apple Silicon up to 6.4x with minimal quality loss, enabling larger models and longer contexts efficiently.

Install

openclaw skills install @wukai8289/turboquant-plus