VRAM
calc
Calculator
All Models
Calculator
›
All Models
All Supported Models
29681 AI models · 198875 quantization formats tracked
T
Thesven
5 models
Llama-3-8B-Instruct-GGUF-Q4_K_M
8B
8K ctx
Q4_K_M
4.5GB file
6.63
GB
openchat-3.6-8b-20240522-GGUF
8B
8K ctx
Q2_K
2.5GB file
4.63
GB
Q2_S
2.5GB file
4.63
GB
Q2_XS
2.5GB file
4.63
GB
Q3_K
3.5GB file
5.63
GB
Q3_K_S
3.5GB file
5.63
GB
Q3_S
3.5GB file
5.63
GB
Q3_XXS
3.5GB file
5.63
GB
Q4_0
4.5GB file
6.63
GB
Q4_1
4.5GB file
6.63
GB
Q4_K
4.5GB file
6.63
GB
Q4_K_M
4.5GB file
6.63
GB
Q4_K_S
4.5GB file
6.63
GB
Q4_NL
4.5GB file
6.63
GB
Q4_XS
4.5GB file
6.63
GB
Q5_0
5.5GB file
7.63
GB
Q5_1
5.5GB file
7.63
GB
Q5_K
5.5GB file
7.63
GB
Q5_K_M
5.5GB file
7.63
GB
Q5_K_S
5.5GB file
7.63
GB
Q6_K
6.5GB file
8.63
GB
Q1_S
8GB file
10.13
GB
Q8_0
8.5GB file
10.63
GB
BF16
16GB file
18.13
GB
Phi-3-medium-128k-instruct-GGUF
3.8B
8K ctx
Q2_K
1.19GB file
3.25
GB
Q2_S
1.19GB file
3.25
GB
Q2_XS
1.19GB file
3.25
GB
Q3_K
1.66GB file
3.72
GB
Q3_K_S
1.66GB file
3.72
GB
Q3_S
1.66GB file
3.72
GB
Q3_XXS
1.66GB file
3.72
GB
Q4_0
2.14GB file
4.2
GB
Q4_1
2.14GB file
4.2
GB
Q4_K
2.14GB file
4.2
GB
Q4_K_M
2.14GB file
4.2
GB
Q4_K_S
2.14GB file
4.2
GB
Q4_NL
2.14GB file
4.2
GB
Q4_XS
2.14GB file
4.2
GB
Q5_0
2.61GB file
4.67
GB
Q5_1
2.61GB file
4.67
GB
Q5_K
2.61GB file
4.67
GB
Q5_K_M
2.61GB file
4.67
GB
Q5_K_S
2.61GB file
4.67
GB
Q6_K
3.09GB file
5.15
GB
Q1_S
3.8GB file
5.86
GB
Q8_0
4.04GB file
6.1
GB
BF16
7.6GB file
9.66
GB
Qwen2-0.5B-Instruct-GGUF
0.5B
8K ctx
Q2_S
0.16GB file
2.17
GB
Q2_XS
0.16GB file
2.17
GB
Q3_S
0.22GB file
2.23
GB
Q3_XXS
0.22GB file
2.23
GB
Q4_K_M
0.28GB file
2.29
GB
Q4_NL
0.28GB file
2.29
GB
Q4_XS
0.28GB file
2.29
GB
Q1_S
0.5GB file
2.51
GB
BF16
1GB file
3.01
GB
Qwen2-1.5B-Instruct-GGUF
1.5B
8K ctx
Q2_S
0.47GB file
2.49
GB
Q2_XS
0.47GB file
2.49
GB
Q3_S
0.66GB file
2.68
GB
Q3_XXS
0.66GB file
2.68
GB
Q4_K_M
0.84GB file
2.86
GB
Q4_NL
0.84GB file
2.86
GB
Q4_XS
0.84GB file
2.86
GB
Q1_S
1.5GB file
3.52
GB
BF16
3GB file
5.02
GB
T
Theta Lev
5 models
internlm2-math-plus-7b-Q8_0-GGUF
7B
8K ctx
Q8_0
7.44GB file
9.55
GB
L3.1-Dark-Reasoning-LewdPlay-evo-Hermes-R1-Uncensored-8B-Q5_K_M-GGUF
8B
8K ctx
Q5_0
5.5GB file
7.63
GB
FP16
16GB file
18.13
GB
Qwen2.5-7B-Instruct-1M-Q5_K_M-GGUF
7B
8K ctx
Q5_0
4.81GB file
6.92
GB
FP16
14GB file
16.11
GB
rho-math-1b-interpreter-v0.1-Q8_0-GGUF
1B
8K ctx
Q8_0
1.06GB file
3.08
GB
rho-math-7b-interpreter-v0.1-Q8_0-GGUF
7B
8K ctx
Q8_0
7.44GB file
9.55
GB
T
Thetima4
6 models
gemma-2-2b-IQ4_XS-GGUF
2B
8K ctx
Q4_0
1.13GB file
3.16
GB
FP16
4GB file
6.03
GB
gemma-2-2b-Q4_K_M-GGUF
2B
8K ctx
Q4_0
1.13GB file
3.16
GB
FP16
4GB file
6.03
GB
gemma-2-2b-Q5_K_M-GGUF
2B
8K ctx
Q5_0
1.38GB file
3.41
GB
FP16
4GB file
6.03
GB
Phi-3-mini-4k-instruct-Q4_K_M-GGUF
3.8B
8K ctx
Q4_0
2.14GB file
4.2
GB
FP16
7.6GB file
9.66
GB
Phi-3.5-mini-instruct-Q3_K_M-GGUF
3.8B
8K ctx
Q3_0
1.66GB file
3.72
GB
FP16
7.6GB file
9.66
GB
Phi-3.5-mini-instruct-Q4_K_M-GGUF
3.8B
8K ctx
Q4_0
2.14GB file
4.2
GB
FP16
7.6GB file
9.66
GB
T
Thetom Ai
3 models
Gemma-4-31B-it-TQPlus
31B
8K ctx
FP16
62GB file
64.51
GB
Qwen3.5-35B-A3B-TQPlus
35B
8K ctx
FP16
70GB file
72.57
GB
Qwen3.6-35B-A3B-ConfigI-GGUF
35B
8K ctx
FP16
70GB file
72.57
GB
T
Thezet
1 models
GLM-4-32B-0414-Q5_K_M-GGUF
32B
8K ctx
Q5_0
22GB file
24.52
GB
FP16
64GB file
66.52
GB
T
Thiagoteams
1 models
gemma-3-4b-it-vn-lora
4B
8K ctx
Q4_K_M
2.25GB file
4.32
GB
Q8_0
4.25GB file
6.32
GB
T
Thidayatpiliang
1 models
Qwen2.5-Coder-7B-Instruct-Q4_K_M-GGUF
7B
8K ctx
Q4_0
3.94GB file
6.05
GB
FP16
14GB file
16.11
GB
T
Thijs L202
4 models
CraneAILabs_swahili-gemma-1b-GGUF
1B
8K ctx
Q2_K
0.31GB file
2.33
GB
Q3_K_L
0.44GB file
2.46
GB
Q4_K_M
0.56GB file
2.58
GB
Q6_K
0.81GB file
2.83
GB
Q8_0
1.06GB file
3.08
GB
CraneAILabs_swahili-gemma-1b-im-GGUF
1B
8K ctx
Q2_K
0.31GB file
2.33
GB
Q2_K_S
0.31GB file
2.33
GB
Q2_XXS
0.31GB file
2.33
GB
Q3_K_L
0.44GB file
2.46
GB
Q3_M
0.44GB file
2.46
GB
Q4_K_M
0.56GB file
2.58
GB
Q4_NL
0.56GB file
2.58
GB
Q4_XS
0.56GB file
2.58
GB
Q6_K
0.81GB file
2.83
GB
Hermes-4.3-36B-heretic-Q6_K-GGUF
36B
8K ctx
Q6_0
29.25GB file
31.84
GB
FP16
72GB file
74.59
GB
Qwen3-30B-A7.5B-24-Grand-Brainstorm-Q8_0-GGUF
30B
8K ctx
Q8_0
31.88GB file
34.37
GB
T
Thilakkumar241100
1 models
Ai-unit-test-gen
7B
8K ctx
Q4_K_M
3.94GB file
6.05
GB
T
Think Py
2 models
gua-a_v0.1-ft_mistral-7b_GGUF
7B
8K ctx
Q4_K_M
3.94GB file
6.05
GB
gua-a_v0.2-dpo_mistral-7b_GGUF
7B
8K ctx
Q4_K_M
3.94GB file
6.05
GB
Previous
Next
Showing
5271
to
5280
of
5981
results
1
2
...
525
526
527
528
529
530
531
...
598
599