GGUF
conversational

F32: PPL = 32.7182 +/- 1.71769

F16: PPL = 32.7181 +/- 1.71770

Q8_0: PPL = 32.8167 +/- 1.72386

Q8_0_imatrix: PPL = 32.8167 +/- 1.72386

Q6_k: PPL = 32.8940 +/- 1.72423

Q6_k_imatrix: PPL = 32.6484 +/- 1.70532

Q5_k: PPL = 34.2154 +/- 1.81195

Q5_k_imatrix: PPL = 32.9705 +/- 1.72225

Q4_k: PPL = 33.3240 +/- 1.70520

Q4_k_imatrix: PPL = 32.4122 +/- 1.65334

Q3_k: PPL = 36.7779 +/- 1.97784

Q3_k_imatrix: PPL = 33.3135 +/- 1.72823

Q2_k: PPL = 42.4066 +/- 2.21654

Q2_k_imatrix: PPL = 36.7429 +/- 1.85125

iQ1_s_imatrix: PPL = 68.2231 +/- 3.41196

Downloads last month
46
GGUF
Model size
0.1B params
Architecture
llama
Hardware compatibility
Log In to add your hardware

1-bit

2-bit

6-bit

8-bit

16-bit

32-bit

Inference Providers NEW
This model isn't deployed by any Inference Provider. ๐Ÿ™‹ Ask for provider support