VRAM
calc
Calculator
All Models
Calculator
›
All Models
All Supported Models
29681 AI models · 198875 quantization formats tracked
M
Mncster
2 models
Llama-2-7b-chat-hf-Q4_K_M-GGUF
7B
8K ctx
Q4_0
3.94GB file
6.05
GB
FP16
14GB file
16.11
GB
Llama-2-7b-chat-hf-Q8_0-GGUF
7B
8K ctx
Q8_0
7.44GB file
9.55
GB
M
Mo Alaa
1 models
Qwen2.5-1.5B-Instruct-Q2_K-GGUF
1.5B
8K ctx
Q2_0
0.47GB file
2.49
GB
FP16
3GB file
5.02
GB
M
Mo Monir
19 models
codegeex4-all-9b-GGUF
9B
8K ctx
Q4_K_M
5.06GB file
7.21
GB
Q5_K_M
6.19GB file
8.34
GB
Q6_K
7.31GB file
9.46
GB
FP16
18GB file
20.15
GB
codegemma-1.1-7b-it-GGUF
7B
8K ctx
Q4_K_M
3.94GB file
6.05
GB
Q5_K_M
4.81GB file
6.92
GB
Q6_K
5.69GB file
7.8
GB
CodeQwen1.5-7B-Chat-GGUF
7B
8K ctx
Q4_K_M
3.94GB file
6.05
GB
Q5_K_M
4.81GB file
6.92
GB
Q6_K
5.69GB file
7.8
GB
Coxcomb-GGUF
Unknown
8K ctx
Q5_K_M
0GB file
2
GB
Q4_K_M
0GB file
2
GB
Q6_K
0GB file
2
GB
deepseek-coder-6.7b-chat-and-function-calling-GGUF
6.7B
8K ctx
Q4_K_M
3.77GB file
5.88
GB
Q5_K_M
4.61GB file
6.72
GB
granite-8b-code-instruct-GGUF
8B
8K ctx
Q4_K_M
4.5GB file
6.63
GB
Q5_K_M
5.5GB file
7.63
GB
Q6_K
6.5GB file
8.63
GB
Llama-3-8B-Instruct-262k-GGUF
8B
8K ctx
Q4_K_M
4.5GB file
6.63
GB
Q5_K_M
5.5GB file
7.63
GB
Q6_K
6.5GB file
8.63
GB
Llama-3-8B-Instruct-Gradient-1048k-GGUF
8B
8K ctx
Q5_K_M
5.5GB file
7.63
GB
Q6_K
6.5GB file
8.63
GB
Q8_0
8.5GB file
10.63
GB
Llama3-ChatQA-1.5-8B-GGUF
8B
8K ctx
Q4_K_M
4.5GB file
6.63
GB
Q5_K_M
5.5GB file
7.63
GB
Q6_K
6.5GB file
8.63
GB
Meta-Llama-3-8B-Instruct-GGUF
8B
8K ctx
Q5_K_M
5.5GB file
7.63
GB
Q6_K
6.5GB file
8.63
GB
Meta-Llama-Guard-2-8B-GGUF
8B
8K ctx
Q4_K_M
4.5GB file
6.63
GB
Q5_K_M
5.5GB file
7.63
GB
Q6_K
6.5GB file
8.63
GB
Mistroll-7B-v2.2-GGUF
7B
8K ctx
Q4_K_M
3.94GB file
6.05
GB
Q5_K_M
4.81GB file
6.92
GB
Q6_K
5.69GB file
7.8
GB
openchat-3.6-8b-20240522-GGUF
8B
8K ctx
Q4_0
4.5GB file
6.63
GB
Q5_0
5.5GB file
7.63
GB
Q6_0
6.5GB file
8.63
GB
FP16
16GB file
18.13
GB
openhermes-gemma-2b-it-GGUF
2B
8K ctx
Q6_K
1.63GB file
3.66
GB
Q8_0
2.13GB file
4.16
GB
phi-2-super-GGUF
Unknown
8K ctx
Q8_0
0GB file
2
GB
Q5_K_M
0GB file
2
GB
Q6_K
0GB file
2
GB
Phi-3-medium-128k-instruct-GGUF
3.8B
8K ctx
Q4_K_M
2.14GB file
4.2
GB
Q5_K_M
2.61GB file
4.67
GB
Q6_K
3.09GB file
5.15
GB
Phi-3-mini-128k-instruct-GGUF
3.8B
8K ctx
Q4_K_M
2.14GB file
4.2
GB
Q5_K_M
2.61GB file
4.67
GB
Q6_K
3.09GB file
5.15
GB
Q8_0
4.04GB file
6.1
GB
Qwen2-7B-Instruct-GGUF
7B
8K ctx
Q4_0
3.94GB file
6.05
GB
Q5_0
4.81GB file
6.92
GB
Q6_0
5.69GB file
7.8
GB
FP16
14GB file
16.11
GB
wavecoder-ultra-6.7b-GGUF
6.7B
8K ctx
Q4_K_M
3.77GB file
5.88
GB
Q5_K_M
4.61GB file
6.72
GB
Q6_K
5.44GB file
7.55
GB
M
Moaminsharifi
1 models
gemma-2-2b-it-Q2_K-GGUF
2B
8K ctx
Q2_0
0.63GB file
2.66
GB
FP16
4GB file
6.03
GB
M
Moatamed8
3 models
Arabic-QA-Model
Unknown
8K ctx
FP16
0GB file
2
GB
Gemma-3-ArabicText-Large
1B
8K ctx
FP16
2GB file
4.02
GB
Qwen-4B-ArabicRAG
4B
8K ctx
FP16
8GB file
10.07
GB
M
Mobilint
4 models
EXAONE-3.5-2.4B-Instruct-GGUF
2.4B
8K ctx
FP16
4.8GB file
6.84
GB
Llama-3.1-8B-Instruct-GGUF
8B
8K ctx
FP16
16GB file
18.13
GB
Qwen3-0.6B-GGUF
0.6B
8K ctx
FP16
1.2GB file
3.21
GB
Qwen3-4B-GGUF
4B
8K ctx
FP16
8GB file
10.07
GB
M
Mobilism
2 models
kanana-1.5-2.1b-instruct-2505-Q4_K_M-GGUF
2.1B
8K ctx
Q4_0
1.18GB file
3.21
GB
FP16
4.2GB file
6.23
GB
kanana-1.5-8b-instruct-2505-Q8_0-GGUF
8B
8K ctx
Q8_0
8.5GB file
10.63
GB
M
Model Cloud
1 models
QwQ-32B-Preview-gguf-vortex-v1
32B
8K ctx
Q4_K_M
18GB file
20.52
GB
M
Modelfix
1 models
NVIDIA-Nemotron-3-Nano-30B-A3B-FP8-GGUF
30B
8K ctx
FP8
30GB file
32.49
GB
M
Modeltrainer1
1 models
Saba
Unknown
8K ctx
Q4_K_M
0GB file
2
GB
Previous
Next
Showing
3491
to
3500
of
5981
results
1
2
...
347
348
349
350
351
352
353
...
598
599