VRAM
calc
Calculator
All Models
Calculator
›
All Models
All Supported Models
29681 AI models · 198875 quantization formats tracked
F
Fs90
3 models
Llama-3.2-1B-Instruct-bnb-4bit-gsm8k-GGUF
1B
8K ctx
Q4_K_M
0.56GB file
2.58
GB
Q6_K
0.81GB file
2.83
GB
Q8_0
1.06GB file
3.08
GB
Llama-3.2-1B-Instruct-bnb-4bit-lima-GGUF
1B
8K ctx
Q4_K_M
0.56GB file
2.58
GB
Q6_K
0.81GB file
2.83
GB
Q8_0
1.06GB file
3.08
GB
Qwen3-1.7B-alpaca-cleaned-GGUF
1.7B
8K ctx
Q4_K_M
0.96GB file
2.99
GB
Q6_K
1.38GB file
3.41
GB
Q8_0
1.81GB file
3.84
GB
F
Fsantibanezleal
1 models
mate-v2
Unknown
8K ctx
Q4_K_S
0GB file
2
GB
F
Fspecii
1 models
2
8B
8K ctx
Q4_K_M
4.5GB file
6.63
GB
F
Fstp
2 models
Llama-2-7b-chat-hf-Q4_K_M-GGUF
7B
8K ctx
Q4_0
3.94GB file
6.05
GB
FP16
14GB file
16.11
GB
Walls1337bot-Llama2-7B-003.005.5000-Q8_0-GGUF
1337B
8K ctx
Q8_0
1420.56GB file
1444.47
GB
F
Fu01978
6 models
DialoGPT-medium-GGUF
Unknown
8K ctx
Q5_0
0GB file
2
GB
Q3_K_M
0GB file
2
GB
Q3_K_L
0GB file
2
GB
Q2_K
0GB file
2
GB
FP16
0GB file
2
GB
Q4_0
0GB file
2
GB
Q4_1
0GB file
2
GB
Q4_K_M
0GB file
2
GB
Q4_K_S
0GB file
2
GB
Q5_1
0GB file
2
GB
Q5_K_M
0GB file
2
GB
Q5_K_S
0GB file
2
GB
Q6_K
0GB file
2
GB
Q8_0
0GB file
2
GB
Hunyuan-0.5B-Instruct-GGUF
0.5B
8K ctx
Q2_K
0.16GB file
2.17
GB
Q3_K_L
0.22GB file
2.23
GB
Q3_K_S
0.22GB file
2.23
GB
Q3_K_M
0.22GB file
2.23
GB
Q4_K_S
0.28GB file
2.29
GB
Q4_K_M
0.28GB file
2.29
GB
Q4_0
0.28GB file
2.29
GB
Q5_K_S
0.34GB file
2.35
GB
Q5_K_M
0.34GB file
2.35
GB
Q5_0
0.34GB file
2.35
GB
Q6_K
0.41GB file
2.42
GB
Q8_0
0.53GB file
2.54
GB
FP16
1GB file
3.01
GB
Llama-3.2-1B-4B-Quad-MoE-Q4_K_M
1B
8K ctx
Q4_K_M
0.56GB file
2.58
GB
Llama-3.2-3B-MoE-4Expert-Q4_K_M-GGUF
3B
8K ctx
Q4_K_M
1.69GB file
3.74
GB
BF16
6GB file
8.05
GB
OLMo-2-1B-openai-gsm8k-GGUF
1B
8K ctx
Q4_K_M
0.56GB file
2.58
GB
Q5_K_M
0.69GB file
2.71
GB
Q6_K
0.81GB file
2.83
GB
Q8_0
1.06GB file
3.08
GB
Qwen2-0.5B-Instruct-Q2_K-GGUF
0.5B
8K ctx
Q2_0
0.16GB file
2.17
GB
FP16
1GB file
3.01
GB
F
Fukugawa
1 models
gemma-2-9b-finetuned-GGUF
9B
8K ctx
Q4_K_M
5.06GB file
7.21
GB
F
Fuland539
1 models
gemma-3-finetune-cn
4B
8K ctx
Q8_0
4.25GB file
6.32
GB
F
Fullname Name User
9 models
gemma-2-27b-it-Q4_K_M-GGUF
27B
8K ctx
Q4_0
15.19GB file
17.63
GB
FP16
54GB file
56.44
GB
gemma-2-2b-it-Q4_K_M-GGUF
2B
8K ctx
Q4_0
1.13GB file
3.16
GB
FP16
4GB file
6.03
GB
gemma-2-9b-it-Q4_K_M-GGUF
9B
8K ctx
Q4_0
5.06GB file
7.21
GB
FP16
18GB file
20.15
GB
Phi-3.5-MoE-instruct-Q4_K_M-GGUF
3.8B
8K ctx
Q4_0
2.14GB file
4.2
GB
FP16
7.6GB file
9.66
GB
phi-4-Q4_K_M-GGUF
14B
8K ctx
Q4_0
7.88GB file
10.11
GB
FP16
28GB file
30.23
GB
Qwen2.5-14B-Instruct-1M-Q4_K_M-GGUF
14B
8K ctx
Q4_0
7.88GB file
10.11
GB
FP16
28GB file
30.23
GB
Qwen2.5-7B-Instruct-1M-Q4_K_M-GGUF
7B
8K ctx
Q4_0
3.94GB file
6.05
GB
FP16
14GB file
16.11
GB
Qwen2.5-Coder-1.5B-Instruct-Q4_K_M-GGUF
1.5B
8K ctx
Q4_0
0.84GB file
2.86
GB
FP16
3GB file
5.02
GB
Qwen2.5-Coder-1.5B-Q4_K_M-GGUF
1.5B
8K ctx
Q4_0
0.84GB file
2.86
GB
FP16
3GB file
5.02
GB
F
Fungchen
1 models
Qwen2.5-0.5B-Instruct-GGUF
0.5B
8K ctx
BF16
1GB file
3.01
GB
F
Funny Meow
1 models
Llama-2-7b-chat-hf-Q4_K_M-GGUF
7B
8K ctx
Q4_0
3.94GB file
6.05
GB
FP16
14GB file
16.11
GB
Previous
Next
Showing
1811
to
1820
of
5981
results
1
2
...
179
180
181
182
183
184
185
...
598
599