llama.cpp-dgx

(★ 31)

llama.cpp fork optimized for NVIDIA DGX Spark / GB10 (Blackwell, SM 12.1) — TurboQuant weights + KV, NVFP4, DFlash MTP

llama.cpp-dgx Latest Version Download

Download Latest Version (.zip)
// repository documentation