fedric95
/

Meta-Llama-3.1-8B-GGUF

@@ -196,6 +196,46 @@ Using <a href="https://github.com/ggerganov/llama.cpp/">llama.cpp</a> release <a
 Original model: https://huggingface.co/meta-llama/Meta-Llama-3.1-8B
 ## Reproducibility
 ### Download original weights
@@ -238,45 +278,4 @@ cd llama.cpp
 ./llama-perplexity -m ../Meta-Llama-3.1-8B-Q3_K_M.gguf -f ../wikitext-2-raw/wiki.test.raw
 ./llama-perplexity -m ../Meta-Llama-3.1-8B-Q3_K_S.gguf -f ../wikitext-2-raw/wiki.test.raw
 ./llama-perplexity -m ../Meta-Llama-3.1-8B-Q2_K.gguf   -f ../wikitext-2-raw/wiki.test.raw
-```
-## Download a file (not the whole branch) from below:
-| Filename | Quant type | File Size | Perplexity (wikitext-2-raw-v1.test) |
-| -------- | ---------- | --------- | ----------- |
-| [Meta-Llama-3.1-8B-BF16.gguf](https://huggingface.co/fedric95/Meta-Llama-3.1-8B-GGUF/blob/main/Meta-Llama-3.1-8B-BF16.gguf) | BF16 | 16.07GB | 6.4006 +/- 0.03938 |
-| [Meta-Llama-3.1-8B-FP16.gguf](https://huggingface.co/fedric95/Meta-Llama-3.1-8B-GGUF/blob/main/Meta-Llama-3.1-8B-FP16.gguf) | FP16 | 16.07GB | 6.4016 +/- 0.03939 |
-| [Meta-Llama-3.1-8B-Q8_0.gguf](https://huggingface.co/fedric95/Meta-Llama-3.1-8B-GGUF/blob/main/Meta-Llama-3.1-8B-Q8_0.gguf) | Q8_0 | 8.54GB | 6.4070 +/- 0.03941 |
-| [Meta-Llama-3.1-8B-Q6_K.gguf](https://huggingface.co/fedric95/Meta-Llama-3.1-8B-GGUF/blob/main/Meta-Llama-3.1-8B-Q6_K.gguf) | Q6_K | 6.60GB | 6.4231 +/- 0.03957 |
-| [Meta-Llama-3.1-8B-Q5_K_M.gguf](https://huggingface.co/fedric95/Meta-Llama-3.1-8B-GGUF/blob/main/Meta-Llama-3.1-8B-Q5_K_M.gguf) | Q5_K_M | 5.73GB | 6.4623 +/- 0.03987 |
-| [Meta-Llama-3.1-8B-Q5_K_S.gguf](https://huggingface.co/fedric95/Meta-Llama-3.1-8B-GGUF/blob/main/Meta-Llama-3.1-8B-Q5_K_S.gguf) | Q5_K_S | 5.60GB | 6.5161 +/- 0.04028 |
-| [Meta-Llama-3.1-8B-Q4_K_M.gguf](https://huggingface.co/fedric95/Meta-Llama-3.1-8B-GGUF/blob/main/Meta-Llama-3.1-8B-Q4_K_M.gguf) | Q4_K_M | 4.92GB | 6.5837 +/- 0.04068 |
-| [Meta-Llama-3.1-8B-Q4_K_S.gguf](https://huggingface.co/fedric95/Meta-Llama-3.1-8B-GGUF/blob/main/Meta-Llama-3.1-8B-Q4_K_S.gguf) | Q4_K_S | 4.69GB | 6.6751 +/- 0.04125 |
-| [Meta-Llama-3.1-8B-Q3_K_L.gguf](https://huggingface.co/fedric95/Meta-Llama-3.1-8B-GGUF/blob/main/Meta-Llama-3.1-8B-Q3_K_L.gguf) | Q3_K_L | 4.32GB | 6.9458 +/- 0.04329 |
-| [Meta-Llama-3.1-8B-Q3_K_M.gguf](https://huggingface.co/fedric95/Meta-Llama-3.1-8B-GGUF/blob/main/Meta-Llama-3.1-8B-Q3_K_M.gguf) | Q3_K_M | 4.02GB | 7.0488 +/- 0.04384 |
-| [Meta-Llama-3.1-8B-Q3_K_S.gguf](https://huggingface.co/fedric95/Meta-Llama-3.1-8B-GGUF/blob/main/Meta-Llama-3.1-8B-Q3_K_S.gguf) | Q3_K_S | 3.66GB | 7.8823 +/- 0.04920 |
-| [Meta-Llama-3.1-8B-Q2_K.gguf](https://huggingface.co/fedric95/Meta-Llama-3.1-8B-GGUF/blob/main/Meta-Llama-3.1-8B-Q2_K.gguf) | Q2_K | 3.18GB | 9.7262 +/- 0.06393 |
-## Downloading using huggingface-cli
-First, make sure you have hugginface-cli installed:
-```
-pip install -U "huggingface_hub[cli]"
-```
-Then, you can target the specific file you want:
-```
-huggingface-cli download fedric95/Meta-Llama-3.1-8B-GGUF --include "Meta-Llama-3.1-8B-Q4_K_M.gguf" --local-dir ./
-```
-If the model is bigger than 50GB, it will have been split into multiple files. In order to download them all to a local folder, run:
-```
-huggingface-cli download fedric95/Meta-Llama-3.1-8B-GGUF --include "Meta-Llama-3.1-8B-Q8_0.gguf/*" --local-dir Meta-Llama-3.1-8B-Q8_0
-```
-You can either specify a new local-dir (Meta-Llama-3.1-8B-Q8_0) or download them all in place (./)

 Original model: https://huggingface.co/meta-llama/Meta-Llama-3.1-8B
+## Download a file (not the whole branch) from below:
+| Filename | Quant type | File Size | Perplexity (wikitext-2-raw-v1.test) |
+| -------- | ---------- | --------- | ----------- |
+| [Meta-Llama-3.1-8B-BF16.gguf](https://huggingface.co/fedric95/Meta-Llama-3.1-8B-GGUF/blob/main/Meta-Llama-3.1-8B.BF16.gguf) | BF16 | 16.07GB | 6.4006 +/- 0.03938 |
+| [Meta-Llama-3.1-8B-FP16.gguf](https://huggingface.co/fedric95/Meta-Llama-3.1-8B-GGUF/blob/main/Meta-Llama-3.1-8B.FP16.gguf) | FP16 | 16.07GB | 6.4016 +/- 0.03939 |
+| [Meta-Llama-3.1-8B-Q8_0.gguf](https://huggingface.co/fedric95/Meta-Llama-3.1-8B-GGUF/blob/main/Meta-Llama-3.1-8B-Q8_0.gguf) | Q8_0 | 8.54GB | 6.4070 +/- 0.03941 |
+| [Meta-Llama-3.1-8B-Q6_K.gguf](https://huggingface.co/fedric95/Meta-Llama-3.1-8B-GGUF/blob/main/Meta-Llama-3.1-8B-Q6_K.gguf) | Q6_K | 6.60GB | 6.4231 +/- 0.03957 |
+| [Meta-Llama-3.1-8B-Q5_K_M.gguf](https://huggingface.co/fedric95/Meta-Llama-3.1-8B-GGUF/blob/main/Meta-Llama-3.1-8B-Q5_K_M.gguf) | Q5_K_M | 5.73GB | 6.4623 +/- 0.03987 |
+| [Meta-Llama-3.1-8B-Q5_K_S.gguf](https://huggingface.co/fedric95/Meta-Llama-3.1-8B-GGUF/blob/main/Meta-Llama-3.1-8B-Q5_K_S.gguf) | Q5_K_S | 5.60GB | 6.5161 +/- 0.04028 |
+| [Meta-Llama-3.1-8B-Q4_K_M.gguf](https://huggingface.co/fedric95/Meta-Llama-3.1-8B-GGUF/blob/main/Meta-Llama-3.1-8B-Q4_K_M.gguf) | Q4_K_M | 4.92GB | 6.5837 +/- 0.04068 |
+| [Meta-Llama-3.1-8B-Q4_K_S.gguf](https://huggingface.co/fedric95/Meta-Llama-3.1-8B-GGUF/blob/main/Meta-Llama-3.1-8B-Q4_K_S.gguf) | Q4_K_S | 4.69GB | 6.6751 +/- 0.04125 |
+| [Meta-Llama-3.1-8B-Q3_K_L.gguf](https://huggingface.co/fedric95/Meta-Llama-3.1-8B-GGUF/blob/main/Meta-Llama-3.1-8B-Q3_K_L.gguf) | Q3_K_L | 4.32GB | 6.9458 +/- 0.04329 |
+| [Meta-Llama-3.1-8B-Q3_K_M.gguf](https://huggingface.co/fedric95/Meta-Llama-3.1-8B-GGUF/blob/main/Meta-Llama-3.1-8B-Q3_K_M.gguf) | Q3_K_M | 4.02GB | 7.0488 +/- 0.04384 |
+| [Meta-Llama-3.1-8B-Q3_K_S.gguf](https://huggingface.co/fedric95/Meta-Llama-3.1-8B-GGUF/blob/main/Meta-Llama-3.1-8B-Q3_K_S.gguf) | Q3_K_S | 3.66GB | 7.8823 +/- 0.04920 |
+| [Meta-Llama-3.1-8B-Q2_K.gguf](https://huggingface.co/fedric95/Meta-Llama-3.1-8B-GGUF/blob/main/Meta-Llama-3.1-8B-Q2_K.gguf) | Q2_K | 3.18GB | 9.7262 +/- 0.06393 |
+## Downloading using huggingface-cli
+First, make sure you have hugginface-cli installed:
+```
+pip install -U "huggingface_hub[cli]"
+```
+Then, you can target the specific file you want:
+```
+huggingface-cli download fedric95/Meta-Llama-3.1-8B-GGUF --include "Meta-Llama-3.1-8B-Q4_K_M.gguf" --local-dir ./
+```
+If the model is bigger than 50GB, it will have been split into multiple files. In order to download them all to a local folder, run:
+```
+huggingface-cli download fedric95/Meta-Llama-3.1-8B-GGUF --include "Meta-Llama-3.1-8B-Q8_0.gguf/*" --local-dir Meta-Llama-3.1-8B-Q8_0
+```
+You can either specify a new local-dir (Meta-Llama-3.1-8B-Q8_0) or download them all in place (./)
 ## Reproducibility
 ### Download original weights
 ./llama-perplexity -m ../Meta-Llama-3.1-8B-Q3_K_M.gguf -f ../wikitext-2-raw/wiki.test.raw
 ./llama-perplexity -m ../Meta-Llama-3.1-8B-Q3_K_S.gguf -f ../wikitext-2-raw/wiki.test.raw
 ./llama-perplexity -m ../Meta-Llama-3.1-8B-Q2_K.gguf   -f ../wikitext-2-raw/wiki.test.raw
+```