VRAM
calc
Calculator
All Models
Calculator
›
All Models
All Supported Models
29681 AI models · 198875 quantization formats tracked
Y
Ysingh Aiml
1 models
tinyllama-alpaca-lora-gguf
1.1B
8K ctx
Q4_K_M
0.62GB file
2.64
GB
Q5_K_M
0.76GB file
2.78
GB
Q8_0
1.17GB file
3.19
GB
Y
Ysn Rfd
69 models
AceInstruct-1.5B-GGUF
1.5B
8K ctx
Q4_0
0.84GB file
2.86
GB
Q5_0
1.03GB file
3.05
GB
Q8_0
1.59GB file
3.61
GB
AceInstruct-7B-GGUF
7B
8K ctx
Q4_0
3.94GB file
6.05
GB
Q5_0
4.81GB file
6.92
GB
Arch-Function-Chat-3B-GGUF
3B
8K ctx
Q4_0
1.69GB file
3.74
GB
Q5_0
2.06GB file
4.11
GB
Q8_0
3.19GB file
5.24
GB
BabyMistral-GGUF
Unknown
8K ctx
Q4_0
0GB file
2
GB
Q5_0
0GB file
2
GB
Q8_0
0GB file
2
GB
BADMISTRAL-1.5B-GGUF
1.5B
8K ctx
Q8_0
1.59GB file
3.61
GB
beecoder-220M-python-Q8_0-GGUF
0B
8K ctx
Q8_0
0GB file
2
GB
bloomz-3b-GGUF
3B
8K ctx
Q4_0
1.69GB file
3.74
GB
Q5_0
2.06GB file
4.11
GB
Q8_0
3.19GB file
5.24
GB
calme-3.3-instruct-3b-GGUF
3B
8K ctx
Q4_0
1.69GB file
3.74
GB
Q5_0
2.06GB file
4.11
GB
Q8_0
3.19GB file
5.24
GB
calme-3.3-llamaloi-3b-GGUF
3B
8K ctx
Q4_0
1.69GB file
3.74
GB
Q5_0
2.06GB file
4.11
GB
Q8_0
3.19GB file
5.24
GB
CodeLlama-7b-Python-hf-Q2_K-GGUF
7B
8K ctx
Q2_0
2.19GB file
4.3
GB
FP16
14GB file
16.11
GB
CodeLlama-7b-Python-hf-Q4_K_M-GGUF
7B
8K ctx
Q4_0
3.94GB file
6.05
GB
FP16
14GB file
16.11
GB
DAN-Qwen3-1.7B-Q8_0-GGUF
1.7B
8K ctx
Q8_0
1.81GB file
3.84
GB
EXAONE-Deep-2.4B-GGUF
2.4B
8K ctx
Q4_0
1.35GB file
3.39
GB
Q5_0
1.65GB file
3.69
GB
Q8_0
2.55GB file
4.59
GB
gemma-3-1b-it-Q8_0-GGUF
1B
8K ctx
Q8_0
1.06GB file
3.08
GB
gemma-3-4b-persian-v0-Q8_0-GGUF
4B
8K ctx
Q8_0
4.25GB file
6.32
GB
gpt-oss-10.8b-specialized-all-pruned-moe-only-15-experts-Q4_0-GGUF
10.8B
8K ctx
Q4_0
6.08GB file
8.26
GB
gpt-oss-4.2b-specialized-all-pruned-moe-only-4-experts-Q8_0-GGUF
4.2B
8K ctx
Q8_0
4.46GB file
6.53
GB
gpt-oss-4.2b-specialized-harmful-pruned-moe-only-4-experts-Q8_0-GGUF
4.2B
8K ctx
Q8_0
4.46GB file
6.53
GB
gpt2-xl-conversational-GGUF
Unknown
8K ctx
Q4_0
0GB file
2
GB
Q5_0
0GB file
2
GB
Q6_0
0GB file
2
GB
Q8_0
0GB file
2
GB
gpt4all-falcon-Q2_K-GGUF
Unknown
8K ctx
FP16
0GB file
2
GB
Q2_0
0GB file
2
GB
granite-3.2-2b-instruct-GGUF
2B
8K ctx
Q4_0
1.13GB file
3.16
GB
Q5_0
1.38GB file
3.41
GB
Q8_0
2.13GB file
4.16
GB
h2o-danube3-4b-chat-Q4_0-GGUF
4B
8K ctx
Q4_0
2.25GB file
4.32
GB
h2o-danube3.1-4b-chat-Q4_0-GGUF
4B
8K ctx
Q4_0
2.25GB file
4.32
GB
h2o-danube3.1-4b-chat-Q5_0-GGUF
4B
8K ctx
Q5_0
2.75GB file
4.82
GB
h2o-danube3.1-4b-chat-Q8_0-GGUF
4B
8K ctx
Q8_0
4.25GB file
6.32
GB
HelpingAI2.5-2B-GGUF
2B
8K ctx
Q4_0
1.13GB file
3.16
GB
Q5_0
1.38GB file
3.41
GB
Q8_0
2.13GB file
4.16
GB
HelpingAI2.5-5B-GGUF
5B
8K ctx
Q4_0
2.81GB file
4.89
GB
Q5_0
3.44GB file
5.52
GB
Q8_0
5.31GB file
7.39
GB
Huihui-MoE-12B-A4B-abliterated-Q4_K_M-GGUF
12B
8K ctx
Q4_0
6.75GB file
8.95
GB
FP16
24GB file
26.2
GB
LFM2-8B-A1B-Q4_0-GGUF
8B
8K ctx
Q4_0
4.5GB file
6.63
GB
LFM2-8B-A1B-Q8_0-GGUF
8B
8K ctx
Q8_0
8.5GB file
10.63
GB
Ling-Coder-lite-Q8_0-GGUF
0B
8K ctx
Q8_0
0GB file
2
GB
LlamaCorn-1.1B-Chat-GGUF
1.1B
8K ctx
Q4_0
0.62GB file
2.64
GB
Q5_0
0.76GB file
2.78
GB
Q8_0
1.17GB file
3.19
GB
LLuMi_Think_3B-GGUF
3B
8K ctx
Q4_0
1.69GB file
3.74
GB
Q5_0
2.06GB file
4.11
GB
Q8_0
3.19GB file
5.24
GB
Ministral-3b-instruct-GGUF
3B
8K ctx
Q4_0
1.69GB file
3.74
GB
Q5_0
2.06GB file
4.11
GB
Q8_0
3.19GB file
5.24
GB
mommygpt-3B-GGUF
3B
8K ctx
Q4_0
1.69GB file
3.74
GB
Q5_0
2.06GB file
4.11
GB
Q6_0
2.44GB file
4.49
GB
Q8_0
3.19GB file
5.24
GB
NSFW-3B-GGUF
3B
8K ctx
Q4_0
1.69GB file
3.74
GB
Q5_0
2.06GB file
4.11
GB
Q8_0
3.19GB file
5.24
GB
NSFW-3B-Q2_K-GGUF
3B
8K ctx
Q2_0
0.94GB file
2.99
GB
FP16
6GB file
8.05
GB
OLMo-2-1124-7B-Instruct-GGUF
7B
8K ctx
Q4_0
3.94GB file
6.05
GB
Q5_0
4.81GB file
6.92
GB
Q8_0
7.44GB file
9.55
GB
OlympicCoder-7B-GGUF
7B
8K ctx
Q4_0
3.94GB file
6.05
GB
Open-RS3-GGUF
3B
8K ctx
Q4_0
1.69GB file
3.74
GB
Q5_0
2.06GB file
4.11
GB
Q8_0
3.19GB file
5.24
GB
Open-RS3-Q8_0-GGUF
0B
8K ctx
Q8_0
0GB file
2
GB
openchat_3.5-GGUF
3.5B
8K ctx
Q4_0
1.97GB file
4.03
GB
Q5_0
2.41GB file
4.47
GB
openchat_3.5-Q8_0-GGUF
0B
8K ctx
Q8_0
0GB file
2
GB
openchat-3.5-0106-GGUF
0106B
8K ctx
Q4_0
59.63GB file
63.37
GB
Q5_0
72.88GB file
76.62
GB
Q8_0
112.63GB file
116.37
GB
openchat-3.5-0106-Q8_0-GGUF
7B
8K ctx
Q8_0
7.44GB file
9.55
GB
OpenCoder-1.5B-Instruct-GGUF
1.5B
8K ctx
Q4_0
0.84GB file
2.86
GB
Q5_0
1.03GB file
3.05
GB
Q8_0
1.59GB file
3.61
GB
openhands-lm-1.5b-v0.1-GGUF
1.5B
8K ctx
Q4_0
0.84GB file
2.86
GB
Q5_0
1.03GB file
3.05
GB
Q8_0
1.59GB file
3.61
GB
openhands-lm-7b-v0.1-GGUF
7B
8K ctx
Q4_0
3.94GB file
6.05
GB
Q5_0
4.81GB file
6.92
GB
Q8_0
7.44GB file
9.55
GB
PersianMind-v1.0-GGUF
1.0B
8K ctx
Q5_0
0.69GB file
2.71
GB
Q6_0
0.81GB file
2.83
GB
Q8_0
1.06GB file
3.08
GB
PersianMind-v1.0-Q4_0-GGUF
0B
8K ctx
Q4_0
0GB file
2
GB
PersianMind-v1.0-Q4_K_M-GGUF
Unknown
8K ctx
Q4_0
0GB file
2
GB
Q4_K_M
0GB file
2
GB
Phi-4-mini-instruct-GGUF
14B
8K ctx
Q4_0
7.88GB file
10.11
GB
Q5_0
9.63GB file
11.86
GB
Q8_0
14.88GB file
17.11
GB
Qwen2-7B-Instruct-Q4_K_M-GGUF
7B
8K ctx
Q4_0
3.94GB file
6.05
GB
FP16
14GB file
16.11
GB
Qwen2.5-0.5B-Instruct-Q8_0-GGUF
0.5B
8K ctx
Q8_0
0.53GB file
2.54
GB
Qwen2.5-1.5B-Instruct-Q8_0-GGUF
1.5B
8K ctx
Q8_0
1.59GB file
3.61
GB
Qwen2.5-3B-Instruct-Q8_0-GGUF
3B
8K ctx
Q8_0
3.19GB file
5.24
GB
Qwen2.5-7B-Instruct-GGUF
7B
8K ctx
Q4_0
3.94GB file
6.05
GB
Qwen2.5-Coder-3B-Instruct-Q8_0-GGUF
3B
8K ctx
Q8_0
3.19GB file
5.24
GB
Qwen2.5-Coder-7B-Instruct-Q8_0-GGUF
7B
8K ctx
Q8_0
7.44GB file
9.55
GB
ReaderLM-v2-GGUF
2B
8K ctx
Q4_0
1.13GB file
3.16
GB
Q5_0
1.38GB file
3.41
GB
Q8_0
2.13GB file
4.16
GB
ReaderLM-v2-Q8_0-GGUF
0B
8K ctx
Q8_0
0GB file
2
GB
Refact-1_6B-fim-GGUF
6B
8K ctx
Q4_0
3.38GB file
5.48
GB
Q5_0
4.13GB file
6.23
GB
Q6_0
4.88GB file
6.98
GB
Q8_0
6.38GB file
8.48
GB
SmolLM2-1.7B-Instruct-Q8_0-GGUF
1.7B
8K ctx
Q8_0
1.81GB file
3.84
GB
starcoder2-3b-GGUF
3B
8K ctx
Q4_0
1.69GB file
3.74
GB
Q5_0
2.06GB file
4.11
GB
Q8_0
3.19GB file
5.24
GB
TinySwallow-1.5B-Instruct-GGUF
1.5B
8K ctx
Q4_0
0.84GB file
2.86
GB
Q5_0
1.03GB file
3.05
GB
Q6_0
1.22GB file
3.24
GB
Q8_0
1.59GB file
3.61
GB
TinySwallow-1.5B-Instruct-Q8_0-GGUF
1.5B
8K ctx
Q8_0
1.59GB file
3.61
GB
txgemma-2b-predict-GGUF
2B
8K ctx
Q4_0
1.13GB file
3.16
GB
Q5_0
1.38GB file
3.41
GB
Q8_0
2.13GB file
4.16
GB
xLAM-1b-fc-r-Q4_0-GGUF
1B
8K ctx
Q4_0
0.56GB file
2.58
GB
Z1-7B-GGUF
7B
8K ctx
Q4_0
3.94GB file
6.05
GB
Q5_0
4.81GB file
6.92
GB
Q8_0
7.44GB file
9.55
GB
Y
Ystemsrx
3 models
Qwen2.5-Interpreter
0.5B
8K ctx
FP16
1GB file
3.01
GB
Qwen2.5-Sex
1.5B
8K ctx
FP16
3GB file
5.02
GB
Qwen3-Sex
4B
8K ctx
Q8_0
4.25GB file
6.32
GB
BF16
8GB file
10.07
GB
Y
Yu Ching Lin
1 models
Taiwan-Llama3-70B-Instruct
70B
8K ctx
Q4_K_M
39.38GB file
42.53
GB
Q5_0
48.13GB file
51.28
GB
Y
Yu Yu1015
2 models
Huihui-Qwen3.6-27B-abliterated-UD-Q4_K_XL-MTP-GGUF
27B
8K ctx
Q4_K_XL
15.19GB file
17.63
GB
YuYu1015-Qwen3.5-0.8B-TW-CivicAligned-v1-GGUF
0.8B
8K ctx
Q6_K
0.65GB file
2.66
GB
Q8_0
0.85GB file
2.86
GB
Y
Yuiseki
16 models
tinyllama-coder-dolphin-en-v0.1
Unknown
8K ctx
Q4_K_M
0GB file
2
GB
tinyllama-coder-math-en-v0.1
Unknown
8K ctx
Q4_K_M
0GB file
2
GB
tinyllama-coder-math-ja-v0.1
Unknown
8K ctx
Q4_K_M
0GB file
2
GB
tinyllama-coder-math-ja-wikipedia-v0.1
Unknown
8K ctx
Q4_K_M
0GB file
2
GB
tinyllama-coder-python-en-alpaca-v0.1
Unknown
8K ctx
Q4_K_M
0GB file
2
GB
tinyllama-coder-python-ja-amenokaku-v0.1
Unknown
8K ctx
Q4_K_M
0GB file
2
GB
tinyllama-coder-python-ja-wikipedia-amenokaku-v0.1
Unknown
8K ctx
Q4_K_M
0GB file
2
GB
tinyllama-coder-sql-en-v0.1
Unknown
8K ctx
Q4_K_M
0GB file
2
GB
tinyllama-coder-wizardlm-en-v0.1
Unknown
8K ctx
Q4_K_M
0GB file
2
GB
tinyllama-fake-news-detector-en-1.5T-v0.1
Unknown
8K ctx
Q4_K_M
0GB file
2
GB
tinyllama-hate-speech-detector-en-v0.1
Unknown
8K ctx
Q4_K_M
0GB file
2
GB
tinyllama-ja-wikipedia-aya-1.5T-v0.1
Unknown
8K ctx
Q4_K_M
0GB file
2
GB
tinyllama-ja-wikipedia-databricks-dolly-v0.1
Unknown
8K ctx
Q4_K_M
0GB file
2
GB
tinyllama-ja-wikipedia-sakura-1.5T-v0.1
Unknown
8K ctx
Q4_K_M
0GB file
2
GB
tinyllama-sentiment-analyzer-en-v0.1
Unknown
8K ctx
Q4_K_M
0GB file
2
GB
tinyllama-sentiment-analyzer-ja-v0.1
Unknown
8K ctx
Q4_K_M
0GB file
2
GB
Y
Yukihamada
2 models
ElioChat-1.7B-Instruct-v3
1.7B
8K ctx
Q5_K_M
1.17GB file
3.2
GB
Photon-1.7B-Instruct-v1
1.7B
8K ctx
Q5_K_M
1.17GB file
3.2
GB
Y
Yuko29Hu
5 models
Qwen3-4B-Instruct-2507-Q3_K_M-GGUF
4B
8K ctx
Q3_0
1.75GB file
3.82
GB
FP16
8GB file
10.07
GB
Qwen3-4B-Instruct-2507-Q4_K_M-GGUF
4B
8K ctx
Q4_0
2.25GB file
4.32
GB
FP16
8GB file
10.07
GB
Qwen3-4B-Instruct-2507-Q5_K_M-GGUF
4B
8K ctx
Q5_0
2.75GB file
4.82
GB
FP16
8GB file
10.07
GB
Qwen3-4B-Instruct-2507-Q6_K-GGUF
4B
8K ctx
Q6_0
3.25GB file
5.32
GB
FP16
8GB file
10.07
GB
Qwen3-4B-Instruct-2507-Q8_0-GGUF
4B
8K ctx
Q8_0
4.25GB file
6.32
GB
Y
Yuliu1234
1 models
Meta-Llama-3-8B-Instruct-Q8_0-GGUF
8B
8K ctx
Q8_0
8.5GB file
10.63
GB
Y
Yuna1126
5 models
Tema_Q-R-0.4B-GGUF
0.4B
8K ctx
Q4_K_M
0.23GB file
2.24
GB
Tema_Q-X-4B-GGUF
4B
8K ctx
Q2_K
1.25GB file
3.32
GB
Q4_K_M
2.25GB file
4.32
GB
Tema_Q-X2-GGUF
2B
8K ctx
Q2_K
0.63GB file
2.66
GB
Q4_K_M
1.13GB file
3.16
GB
Tema_Q-X2-Thinking-GGUF
Unknown
8K ctx
Q2_K
0GB file
2
GB
Q3_K_M
0GB file
2
GB
Q4_K_M
0GB file
2
GB
Tema_Q-X3-Thinking-GGUF
Unknown
8K ctx
Q3_K_M
0GB file
2
GB
Previous
Next
Showing
5871
to
5880
of
5981
results
1
2
...
585
586
587
588
589
590
591
...
598
599