inference-optimization/Llama-3.1-8B-Instruct-NVFP4-GPTQ-BlockSize16 5B • Updated 14 days ago • 10 • 1
inference-optimization/Llama-3.1-8B-Instruct-NVFP4-GPTQ-BlockSize16 5B • Updated 14 days ago • 10 • 1