VRAM
calc
Calculator
All Models
Calculator
›
All Models
All Supported Models
29681 AI models · 198875 quantization formats tracked
F
Fengpeisheng1
10 models
collective-v0.1-chinese-roleplay-8b-IQ4_NL-GGUF
8B
8K ctx
Q4_0
4.5GB file
6.63
GB
FP16
16GB file
18.13
GB
Gemma-2-9B-Chinese-Chat-Uncensored-IQ4_NL-GGUF
9B
8K ctx
Q4_0
5.06GB file
7.21
GB
FP16
18GB file
20.15
GB
Josiefied-Qwen3-4B-Instruct-2507-gabliterated-v1-IQ4_NL-GGUF
4B
8K ctx
Q4_0
2.25GB file
4.32
GB
FP16
8GB file
10.07
GB
Josiefied-Qwen3-4B-Instruct-2507-gabliterated-v1-Q4_K_M-GGUF
4B
8K ctx
Q4_0
2.25GB file
4.32
GB
FP16
8GB file
10.07
GB
llama-3-sthenic-porpoise-v1-8B-IQ4_NL-GGUF
8B
8K ctx
Q4_0
4.5GB file
6.63
GB
FP16
16GB file
18.13
GB
Mistral-7B-v0.3-Chinese-Chat-uncensored-IQ4_NL-GGUF
7B
8K ctx
Q4_0
3.94GB file
6.05
GB
FP16
14GB file
16.11
GB
Peach-2.0-9B-8k-Roleplay-IQ4_NL-GGUF
9B
8K ctx
Q4_0
5.06GB file
7.21
GB
FP16
18GB file
20.15
GB
Peach-2.0-9B-8k-Roleplay-IQ4_XS-GGUF
9B
8K ctx
Q4_0
5.06GB file
7.21
GB
FP16
18GB file
20.15
GB
qwen2.5_yuna-IQ4_NL-GGUF
Unknown
8K ctx
FP16
0GB file
2
GB
Q4_0
0GB file
2
GB
Qwen3-4B-Instruct-2507-20250808-233922-0-IQ4_NL-GGUF
4B
8K ctx
Q4_0
2.25GB file
4.32
GB
FP16
8GB file
10.07
GB
F
Fenruspdx
2 models
output
3B
8K ctx
FP16
6GB file
8.05
GB
outputqt
3B
8K ctx
FP16
6GB file
8.05
GB
F
Fernandoruiz
43 models
ALIA-40b-Q4_0-GGUF
40B
8K ctx
Q4_0
22.5GB file
25.16
GB
aquif-3.5-A0.6B-Preview-Q4_0-GGUF
0.6B
8K ctx
Q4_0
0.34GB file
2.35
GB
bloom-560m-Q4_0-GGUF
0B
8K ctx
Q4_0
0GB file
2
GB
ERNIE-4.5-21B-A3B-PT-Q4_0-GGUF
21B
8K ctx
Q4_0
11.81GB file
14.15
GB
gemma-2-27b-it-Q4_0-GGUF
27B
8K ctx
Q4_0
15.19GB file
17.63
GB
gemma-2-27b-it-Q4_K_M-GGUF
27B
8K ctx
Q4_0
15.19GB file
17.63
GB
FP16
54GB file
56.44
GB
gemma-2-27b-it-Q4_K_S-GGUF
27B
8K ctx
Q4_0
15.19GB file
17.63
GB
FP16
54GB file
56.44
GB
gemma-2-2b-it-Q4_0-GGUF
2B
8K ctx
Q4_0
1.13GB file
3.16
GB
gemma-2-9b-it-Q4_0-GGUF
9B
8K ctx
Q4_0
5.06GB file
7.21
GB
gemma-3-1b-it-Q4_0-GGUF
1B
8K ctx
Q4_0
0.56GB file
2.58
GB
granite-3.1-3b-a800m-instruct-Q4_0-GGUF
3B
8K ctx
Q4_0
1.69GB file
3.74
GB
GroveMoE-Inst-Q4_0-GGUF
0B
8K ctx
Q4_0
0GB file
2
GB
Josiefied-Qwen3-30B-A3B-abliterated-v2-Q4_0-GGUF
30B
8K ctx
Q4_0
16.88GB file
19.37
GB
Ling-lite-Q4_0-GGUF
0B
8K ctx
Q4_0
0GB file
2
GB
Llama-3.1-8B-Instruct-Q4_0-GGUF
8B
8K ctx
Q4_0
4.5GB file
6.63
GB
Llama-3.2-1B-Instruct-Q4_0-GGUF
1B
8K ctx
Q4_0
0.56GB file
2.58
GB
Llama-3.2-3B-Instruct-Q4_0-GGUF
3B
8K ctx
Q4_0
1.69GB file
3.74
GB
medgemma-27b-text-it-Q4_0-GGUF
27B
8K ctx
Q4_0
15.19GB file
17.63
GB
MiniCPM4-8B-Q4_0-GGUF
8B
8K ctx
Q4_0
4.5GB file
6.63
GB
OLMo-2-0325-32B-Instruct-Q4_0-GGUF
32B
8K ctx
Q4_0
18GB file
20.52
GB
OLMoE-1B-7B-0125-Instruct-enron-Q4_0-GGUF
1B
8K ctx
Q4_0
0.56GB file
2.58
GB
OLMoE-1B-7B-0125-Instruct-Q4_0-GGUF
1B
8K ctx
Q4_0
0.56GB file
2.58
GB
PARD-Qwen2.5-0.5B-Q4_0-GGUF
0.5B
8K ctx
Q4_0
0.28GB file
2.29
GB
PARD-Qwen3-0.6B-Q4_0-GGUF
0.6B
8K ctx
Q4_0
0.34GB file
2.35
GB
Phi-3-medium-4k-instruct-Q4_K_M-GGUF
3.8B
8K ctx
Q4_0
2.14GB file
4.2
GB
FP16
7.6GB file
9.66
GB
Phi-3-medium-4k-instruct-Q4_K_S-GGUF
3.8B
8K ctx
Q4_0
2.14GB file
4.2
GB
FP16
7.6GB file
9.66
GB
Phi-3-mini-128k-instruct-Q4_0-GGUF
0B
8K ctx
Q4_0
0GB file
2
GB
Phi-3-mini-4k-instruct-Q4_K_M-GGUF
3.8B
8K ctx
Q4_0
2.14GB file
4.2
GB
FP16
7.6GB file
9.66
GB
Phi-3-mini-4k-instruct-Q4_K_S-GGUF
3.8B
8K ctx
Q4_0
2.14GB file
4.2
GB
FP16
7.6GB file
9.66
GB
Phi-3.5-mini-instruct-Q4_0-GGUF
0B
8K ctx
Q4_0
0GB file
2
GB
PowerMoE-3b-Q4_0-GGUF
3B
8K ctx
Q4_0
1.69GB file
3.74
GB
Qwen1.5-MoE-A2.7B-Chat-Q4_0-GGUF
2.7B
8K ctx
Q4_0
1.52GB file
3.56
GB
qwen25-05b-multiclinsum-distil-Q4_0-GGUF
05B
8K ctx
Q4_0
2.81GB file
4.89
GB
Qwen3-0.6B-abliterated-Q4_0-GGUF
0.6B
8K ctx
Q4_0
0.34GB file
2.35
GB
Qwen3-0.6B-Q4_0-GGUF
0.6B
8K ctx
Q4_0
0.34GB file
2.35
GB
Qwen3-1.7B-Q4_0-GGUF
1.7B
8K ctx
Q4_0
0.96GB file
2.99
GB
Qwen3-30B-A1.5B-High-Speed-Q4_0-GGUF
30B
8K ctx
Q4_0
16.88GB file
19.37
GB
Qwen3-30B-A3B-abliterated-Q4_0-GGUF
30B
8K ctx
Q4_0
16.88GB file
19.37
GB
Qwen3-30B-A3B-Q4_0-GGUF
30B
8K ctx
Q4_0
16.88GB file
19.37
GB
Qwen3-30B-A6B-16-Extreme-Q4_0-GGUF
30B
8K ctx
Q4_0
16.88GB file
19.37
GB
salamandra-2b-instruct-Q4_0-GGUF
2B
8K ctx
Q4_0
1.13GB file
3.16
GB
salamandra-7b-instruct-Q4_0-GGUF
7B
8K ctx
Q4_0
3.94GB file
6.05
GB
teapotllm-Q4_0-GGUF
0B
8K ctx
Q4_0
0GB file
2
GB
F
Fernandovdmrq
1 models
supergemma4-26b-uncensored-gguf-v2
26B
8K ctx
Q4_K_M
14.63GB file
17.06
GB
F
Fernandovmacedo
3 models
portuguese-Phi3-Tom-Cat-128k-instruct-IQ4_NL-GGUF
Unknown
8K ctx
FP16
0GB file
2
GB
Q4_0
0GB file
2
GB
portuguese-Phi3-Tom-Cat-128k-instruct-Q4_K_M-GGUF
Unknown
8K ctx
FP16
0GB file
2
GB
Q4_0
0GB file
2
GB
portuguese-Phi3-Tom-Cat-128k-instruct-Q4_K_S-GGUF
Unknown
8K ctx
FP16
0GB file
2
GB
Q4_0
0GB file
2
GB
F
Fesalfayed
1 models
gpt-oss-20b-hermes_agent-tool-finetune_gguf
20B
8K ctx
Q3_K_M
8.75GB file
11.08
GB
Q4_K_M
11.25GB file
13.58
GB
Q5_K_M
13.75GB file
16.08
GB
Q8_0
21.25GB file
23.58
GB
F
Ffddfre23
1 models
qwen2_5_3b_anton
3B
8K ctx
Q4_K_M
1.69GB file
3.74
GB
F
Ffftdtd5Dtft
21 models
gemma-2-27b-Q2_K-GGUF
27B
8K ctx
Q2_0
8.44GB file
10.88
GB
FP16
54GB file
56.44
GB
gemma-2-2b-IQ1_S-GGUF
2B
8K ctx
Q1_0
2GB file
4.03
GB
FP16
4GB file
6.03
GB
gemma-2-2b-it-IQ1_S-GGUF
2B
8K ctx
Q1_0
2GB file
4.03
GB
FP16
4GB file
6.03
GB
gemma-2-2b-it-Q2_K-GGUF
2B
8K ctx
Q2_0
0.63GB file
2.66
GB
FP16
4GB file
6.03
GB
gemma-2-9b-it-Q2_K-GGUF
9B
8K ctx
Q2_0
2.81GB file
4.96
GB
FP16
18GB file
20.15
GB
Meta-Llama-3.1-70B-Instruct-Q2_K-GGUF
70B
8K ctx
Q2_0
21.88GB file
25.03
GB
FP16
140GB file
143.15
GB
Meta-Llama-3.1-70B-Q2_K-GGUF
70B
8K ctx
Q2_0
21.88GB file
25.03
GB
FP16
140GB file
143.15
GB
Meta-Llama-3.1-8B-Instruct-Q2_K-GGUF
8B
8K ctx
Q2_0
2.5GB file
4.63
GB
FP16
16GB file
18.13
GB
Meta-Llama-3.1-8B-Q2_K-GGUF
8B
8K ctx
Q2_0
2.5GB file
4.63
GB
FP16
16GB file
18.13
GB
Phi-3-mini-128k-instruct-IQ2_XXS-GGUF
3.8B
8K ctx
Q2_0
1.19GB file
3.25
GB
FP16
7.6GB file
9.66
GB
Phi-3-mini-128k-instruct-Q2_K-GGUF
3.8B
8K ctx
Q2_0
1.19GB file
3.25
GB
FP16
7.6GB file
9.66
GB
Phi-3.5-mini-instruct-Q2_K-GGUF
3.8B
8K ctx
Q2_0
1.19GB file
3.25
GB
FP16
7.6GB file
9.66
GB
Qwen2-0.5B-Instruct-IQ1_S-GGUF
0.5B
8K ctx
Q1_0
0.5GB file
2.51
GB
FP16
1GB file
3.01
GB
Qwen2-0.5B-IQ1_S-GGUF
0.5B
8K ctx
Q1_0
0.5GB file
2.51
GB
FP16
1GB file
3.01
GB
Qwen2-1.5B-Instruct-Q2_K-GGUF
1.5B
8K ctx
Q2_0
0.47GB file
2.49
GB
FP16
3GB file
5.02
GB
Qwen2-7B-Instruct-Q2_K-GGUF
7B
8K ctx
Q2_0
2.19GB file
4.3
GB
FP16
14GB file
16.11
GB
Qwen2-Math-72B-Instruct-Q2_K-GGUF
72B
8K ctx
Q2_0
22.5GB file
25.68
GB
FP16
144GB file
147.18
GB
Qwen2-Math-7B-Instruct-Q2_K-GGUF
7B
8K ctx
Q2_0
2.19GB file
4.3
GB
FP16
14GB file
16.11
GB
shieldgemma-2b-Q2_K-GGUF
2B
8K ctx
Q2_0
0.63GB file
2.66
GB
FP16
4GB file
6.03
GB
starcoder2-15b-Q2_K-GGUF
15B
8K ctx
Q2_0
4.69GB file
6.94
GB
FP16
30GB file
32.25
GB
starcoder2-3b-Q2_K-GGUF
3B
8K ctx
Q2_0
0.94GB file
2.99
GB
FP16
6GB file
8.05
GB
F
Fhnw
2 models
2025H2-DPO-BAI-FHNW
20B
8K ctx
FP4
20GB file
22.33
GB
2025H2-SFT-BAI-FHNW
20B
8K ctx
FP4
20GB file
22.33
GB
F
Fibonacciai
3 models
fibonacci-1-EN-8b-chat.P1_5
7B
8K ctx
Q4_K_M
3.94GB file
6.05
GB
Q5_K_M
4.81GB file
6.92
GB
Q8_0
7.44GB file
9.55
GB
fibonacci-2-14B
8B
8K ctx
Q8_0
8.5GB file
10.63
GB
fibonacci-2-9b
8B
8K ctx
Q4_K_M
4.5GB file
6.63
GB
Q5_K_M
5.5GB file
7.63
GB
Q8_0
8.5GB file
10.63
GB
Previous
Next
Showing
1721
to
1730
of
5981
results
1
2
...
170
171
172
173
174
175
176
...
598
599