ReallyFloppyPenguin commited on
Commit
e4850ba
·
verified ·
1 Parent(s): c1d70a7

Upload README.md with huggingface_hub

Browse files
Files changed (1) hide show
  1. README.md +1 -1
README.md CHANGED
@@ -22,7 +22,7 @@ GGUF is a quantization method that allows you to run large language models on co
22
 
23
  | Filename | Quant type | File Size | Description |
24
  | -------- | ---------- | --------- | ----------- |
25
- | model-fp16.gguf | FP16 | Variable | fp16 quantization |
26
  | model-q4_0.gguf | Q4_0 | Small | 4-bit quantization |
27
  | model-q4_1.gguf | Q4_1 | Small | 4-bit quantization (higher quality) |
28
  | model-q5_0.gguf | Q5_0 | Medium | 5-bit quantization |
 
22
 
23
  | Filename | Quant type | File Size | Description |
24
  | -------- | ---------- | --------- | ----------- |
25
+ | model-f16.gguf | F16 | Large | Original precision |
26
  | model-q4_0.gguf | Q4_0 | Small | 4-bit quantization |
27
  | model-q4_1.gguf | Q4_1 | Small | 4-bit quantization (higher quality) |
28
  | model-q5_0.gguf | Q5_0 | Medium | 5-bit quantization |