personaplex-7b-quantized

Run NVIDIA PersonaPlex-7B on consumer GPUs (16GB VRAM) with 4-bit/8-bit quantization fixes and optimized inference.

// repository documentation