VRAM
calc
Calculator
All Models
Calculator
›
All Models
All Supported Models
29681 AI models · 198875 quantization formats tracked
D
Devarui379
2 models
portfolio-query-llama-3.2-3b-v3-cot-Q8_0-GGUF
3B
8K ctx
Q8_0
3.19GB file
5.24
GB
VersatiLlama-Llama-3.2-3B-Instruct-Abliterated-Imatrix-GGUF
3B
8K ctx
BF16
6GB file
8.05
GB
D
Devd2101
1 models
Llama-3.2-1B-Q4_K_M-GGUF
1B
8K ctx
Q4_0
0.56GB file
2.58
GB
FP16
2GB file
4.02
GB
D
Developerjeremylive
1 models
Gemopus-4-26B-A4B-it-GGUF-etheroi
26B
8K ctx
Q4_K_M
14.63GB file
17.06
GB
Q5_K_M
17.88GB file
20.31
GB
Q5_K_S
17.88GB file
20.31
GB
Q6_K
21.13GB file
23.56
GB
Q8_0
27.63GB file
30.06
GB
BF16
52GB file
54.43
GB
D
Developmentseed
1 models
gazet-model
0.8B
8K ctx
Q8_0
0.85GB file
2.86
GB
D
Deven367
1 models
Meta-Llama-3.1-8B-Instruct-Q5_K_M-GGUF
8B
8K ctx
Q5_0
5.5GB file
7.63
GB
FP16
16GB file
18.13
GB
D
Devgo Aida
1 models
Qwen2.5-Coder-7B-Instruct-IQ3_XXS-GGUF
7B
8K ctx
Q3_0
3.06GB file
5.17
GB
FP16
14GB file
16.11
GB
D
Devgupta
1 models
llama-3-8b-chat-qa
8B
8K ctx
Q4_K_M
4.5GB file
6.63
GB
D
Devingulliver
1 models
mamba-gguf
1.4B
8K ctx
Q2_0
0.44GB file
2.46
GB
Q3_0
0.61GB file
2.63
GB
Q4_0
0.79GB file
2.81
GB
Q5_0
0.96GB file
2.98
GB
Q6_0
1.14GB file
3.16
GB
Q8_0
1.49GB file
3.51
GB
D
Devisri050
29 models
gemma-3-1b-it-Q4_0-GGUF
1B
8K ctx
Q4_0
0.56GB file
2.58
GB
gemma-3-1b-it-Q4_K_M-GGUF
1B
8K ctx
Q4_0
0.56GB file
2.58
GB
FP16
2GB file
4.02
GB
gemma-3-1b-it-Q4_K_S-GGUF
1B
8K ctx
Q4_0
0.56GB file
2.58
GB
FP16
2GB file
4.02
GB
LaMini-Flan-T5-783M-Q4_0-GGUF
0B
8K ctx
Q4_0
0GB file
2
GB
LaMini-Flan-T5-783M-Q4_K_M-GGUF
Unknown
8K ctx
Q4_0
0GB file
2
GB
FP16
0GB file
2
GB
LaMini-Flan-T5-783M-Q4_K_S-GGUF
Unknown
8K ctx
Q4_0
0GB file
2
GB
FP16
0GB file
2
GB
Llama-3.2-1B-Q4_0-GGUF
1B
8K ctx
Q4_0
0.56GB file
2.58
GB
Llama-3.2-1B-Q4_K_M-GGUF
1B
8K ctx
Q4_0
0.56GB file
2.58
GB
FP16
2GB file
4.02
GB
Llama-3.2-1B-Q4_K_S-GGUF
1B
8K ctx
Q4_0
0.56GB file
2.58
GB
FP16
2GB file
4.02
GB
Llama-3.2-1B-Q8_0-GGUF
1B
8K ctx
Q8_0
1.06GB file
3.08
GB
Llama-3.2-3B-Q4_K_M-GGUF
3B
8K ctx
Q4_0
1.69GB file
3.74
GB
FP16
6GB file
8.05
GB
OpenMath-Nemotron-1.5B-Q4_0-GGUF
1.5B
8K ctx
Q4_0
0.84GB file
2.86
GB
OpenMath-Nemotron-1.5B-Q4_K_M-GGUF
1.5B
8K ctx
Q4_0
0.84GB file
2.86
GB
FP16
3GB file
5.02
GB
OpenMath-Nemotron-1.5B-Q4_K_S-GGUF
1.5B
8K ctx
Q4_0
0.84GB file
2.86
GB
FP16
3GB file
5.02
GB
Phi-3.5-mini-instruct-Q4_0-GGUF
0B
8K ctx
Q4_0
0GB file
2
GB
Phi-3.5-mini-instruct-Q4_K_M-GGUF
3.8B
8K ctx
Q4_0
2.14GB file
4.2
GB
FP16
7.6GB file
9.66
GB
Phi-3.5-mini-instruct-Q4_K_S-GGUF
3.8B
8K ctx
Q4_0
2.14GB file
4.2
GB
FP16
7.6GB file
9.66
GB
Phi-3.5-mini-instruct-Q8_0-GGUF
0B
8K ctx
Q8_0
0GB file
2
GB
Qwen2.5-0.5B-Q4_0-GGUF
0.5B
8K ctx
Q4_0
0.28GB file
2.29
GB
Qwen2.5-0.5B-Q4_K_M-GGUF
0.5B
8K ctx
Q4_0
0.28GB file
2.29
GB
FP16
1GB file
3.01
GB
Qwen2.5-0.5B-Q4_K_S-GGUF
0.5B
8K ctx
Q4_0
0.28GB file
2.29
GB
FP16
1GB file
3.01
GB
Qwen2.5-0.5B-Q8_0-GGUF
0.5B
8K ctx
Q8_0
0.53GB file
2.54
GB
Qwen2.5-1.5B-Q4_0-GGUF
1.5B
8K ctx
Q4_0
0.84GB file
2.86
GB
Qwen2.5-1.5B-Q4_K_S-GGUF
1.5B
8K ctx
Q4_0
0.84GB file
2.86
GB
FP16
3GB file
5.02
GB
Qwen2.5-1.5B-Q8_0-GGUF
1.5B
8K ctx
Q8_0
1.59GB file
3.61
GB
Qwen2.5-14B-Q4_0-GGUF
14B
8K ctx
Q4_0
7.88GB file
10.11
GB
Qwen2.5-14B-Q4_K_M-GGUF
14B
8K ctx
Q4_0
7.88GB file
10.11
GB
FP16
28GB file
30.23
GB
Qwen2.5-14B-Q4_K_S-GGUF
14B
8K ctx
Q4_0
7.88GB file
10.11
GB
FP16
28GB file
30.23
GB
Qwen2.5-14B-Q8_0-GGUF
14B
8K ctx
Q8_0
14.88GB file
17.11
GB
D
Devmasa
5 models
Qwen3-0.6B-Base-Q4_K_M-GGUF
0.6B
8K ctx
Q4_0
0.34GB file
2.35
GB
FP16
1.2GB file
3.21
GB
Qwen3-0.6B-Base-Q5_K_S-GGUF
0.6B
8K ctx
Q5_0
0.41GB file
2.42
GB
FP16
1.2GB file
3.21
GB
Qwen3-0.6B-Base-Q8_0-GGUF
0.6B
8K ctx
Q8_0
0.64GB file
2.65
GB
Qwen3-8B-Q6_K-GGUF
8B
8K ctx
Q6_0
6.5GB file
8.63
GB
FP16
16GB file
18.13
GB
Qwen3-8B-Q8_0-GGUF
8B
8K ctx
Q8_0
8.5GB file
10.63
GB
Previous
Next
Showing
1331
to
1340
of
5981
results
1
2
...
131
132
133
134
135
136
137
...
598
599