VRAM
calc
Calculator
All Models
Calculator
›
All Models
All Supported Models
29681 AI models · 198875 quantization formats tracked
U
Uruz7
1 models
Mental_Healthcare_LLM
7B
8K ctx
Q4_K_M
3.94GB file
6.05
GB
U
Us4
1 models
fin-llama3.1-8b
8B
8K ctx
Q4_0
4.5GB file
6.63
GB
Q5_0
5.5GB file
7.63
GB
Q8_0
8.5GB file
10.63
GB
U
Usamakenway
1 models
Qwen3-32B-Q2_K-GGUF
32B
8K ctx
Q2_0
10GB file
12.52
GB
FP16
64GB file
66.52
GB
U
Usarichari
2 models
Llama-3.2-1B-Instruct-Q4_K_M-GGUF
1B
8K ctx
Q4_0
0.56GB file
2.58
GB
FP16
2GB file
4.02
GB
Meta-Llama-3-8B-Instruct-Q4_K_M-GGUF
8B
8K ctx
Q4_0
4.5GB file
6.63
GB
FP16
16GB file
18.13
GB
U
User12043
1 models
Llama-3-8B-Instruct-GPTQ-8-Bit-IQ4_NL-GGUF
8B
8K ctx
Q4_0
4.5GB file
6.63
GB
FP16
16GB file
18.13
GB
U
User954738
1 models
open_steuerllm-Q4_K_M-GGUF
Unknown
8K ctx
Q4_0
0GB file
2
GB
FP16
0GB file
2
GB
U
Userb1Az
13 models
CodeLlama-34b-GGUF
34B
8K ctx
Q8_0
36.13GB file
38.69
GB
CodeLlama-34b-Instruct-hf-GGUF
34B
8K ctx
Q8_0
36.13GB file
38.69
GB
gpt-oss-120b-BF16-abliterated-GGUF
120B
8K ctx
Q8_0
127.5GB file
131.47
GB
BF16
240GB file
243.97
GB
gpt-oss-120b-GGUF
120B
8K ctx
Q8_0
127.5GB file
131.47
GB
BF16
240GB file
243.97
GB
gpt-oss-20b-GGUF
20B
8K ctx
FP4
20GB file
22.33
GB
Q8_0
21.25GB file
23.58
GB
BF16
40GB file
42.33
GB
Qwen1.5-7B-GGUF
7B
8K ctx
Q6_K
5.69GB file
7.8
GB
Q8_0
7.44GB file
9.55
GB
Qwen3-14B-GGUF
14B
8K ctx
Q4_K_M
7.88GB file
10.11
GB
Q5_K_M
9.63GB file
11.86
GB
Q6_K
11.38GB file
13.61
GB
Q8_0
14.88GB file
17.11
GB
BF16
28GB file
30.23
GB
Qwen3-30B-A3B-GGUF
30B
8K ctx
Q4_K_M
16.88GB file
19.37
GB
Q5_K_M
20.63GB file
23.12
GB
Q6_K
24.38GB file
26.87
GB
Q8_0
31.88GB file
34.37
GB
BF16
60GB file
62.49
GB
Qwen3-32B-GGUF
32B
8K ctx
Q4_K_M
18GB file
20.52
GB
Q5_K_M
22GB file
24.52
GB
Q6_K
26GB file
28.52
GB
Q8_0
34GB file
36.52
GB
BF16
64GB file
66.52
GB
Qwen3-Coder-30B-A3B-Instruct-GGUF
30B
8K ctx
Q4_K_M
16.88GB file
19.37
GB
Q5_K_M
20.63GB file
23.12
GB
Q6_K
24.38GB file
26.87
GB
Q8_0
31.88GB file
34.37
GB
BF16
60GB file
62.49
GB
Qwen3-Next-80B-A3B-Instruct-GGUF
80B
8K ctx
Q4_K_L
45GB file
48.31
GB
Q4_K_M
45GB file
48.31
GB
Q4_K_S
45GB file
48.31
GB
Q5_K_M
55GB file
58.31
GB
Q5_K_L
55GB file
58.31
GB
Q6_K
65GB file
68.31
GB
Q6_K_L
65GB file
68.31
GB
Q8_0
85GB file
88.31
GB
QwQ-32B-GGUF
32B
8K ctx
Q8_0
34GB file
36.52
GB
StarCoder2-15B-GGUF
15B
8K ctx
Q8_0
15.94GB file
18.19
GB
U
Username19O21
2 models
Qwen2.5-1.5B-Q4_0-GGUF
1.5B
8K ctx
Q4_0
0.84GB file
2.86
GB
Qwen2.5-1.5B-Q8_0-GGUF
1.5B
8K ctx
Q8_0
1.59GB file
3.61
GB
U
Usmanqadeer1
1 models
llama-3-1b-chat-doctor
1B
8K ctx
FP16
2GB file
4.02
GB
U
Usmanxia
2 models
llama3_1_roma_8bn_mergedv2
8B
8K ctx
FP16
16GB file
18.13
GB
resonance-it-ft
Unknown
8K ctx
FP16
0GB file
2
GB
Previous
Next
Showing
5481
to
5490
of
5981
results
1
2
...
546
547
548
549
550
551
552
...
598
599