Turbo1bit

(★ 31)

Turbo1Bit: Combining 1-bit LLM weights (Bonsai) with TurboQuant KV cache compression for maximum inference efficiency. 4.2x KV cache compression + 16x weight compression = ~10x total memory reduction.

Turbo1bit 최신버젼 다운로드

최종 버전 다운로드 (.zip)
// repository documentation