NVIDIA · consumer
GeForce RTX 3050 OEM
GeForce RTX 3050 OEM has 8 GB of VRAM at 224 GB/s — about 7.44 GiB usable after driver and compositor overhead. 1345 of 2118 indexed models fit at 32K context with q4_0 KV.
Spec sheet· bandwidth, theoreticalFrom the file· fit from summed bytesPredicted· speed
Memory
8 GB
GDDR6
Bandwidth
224 GB/s
128-bit bus
Tensor FP16
32 TF
dense
TDP
130 W
text 1152vision language 98image 2video 8embedding 26audio tts 21audio asr 38
What fits at 32K context
largest quantization that fits, per model · 1345 of 2118 indexed
| Model | Best quant | Params | Weights● | KV● | Total in memory◐ | Headroom◐ | tok/s◐ |
|---|---|---|---|---|---|---|---|
| L3.2-Rogue-Creative-Instruct-Uncensored-Abliterated-7B | Q4_K_M | 7.5B | 4.27 GiB | 2.36 GiB | 7.44 GiB | 0.00 GiB | 24±12.9% |
| OmniAtlas-Qwen3-30B-A3B | I1-IQ1_M | 31.7B | 6.59 GiB | 0.00 GiB | 7.44 GiB | 0.00 GiB | 25±12.9% |
| Qwen3-Omni-30B-A3B-Captioner | I1-IQ1_M | 31.7B | 6.59 GiB | 0.00 GiB | 7.44 GiB | 0.00 GiB | 25±12.9% |
| granite-4.1-8b | Q4_1 | 8.8B | 5.20 GiB | 1.41 GiB | 7.44 GiB | 0.00 GiB | 24±12.9% |
| Qwen3-VL-8B-Instruct-Heretic | I1-IQ2_S | 8.8B | 5.34 GiB | 1.27 GiB | 7.43 GiB | 0.01 GiB | 24±12.9% |
| Forsaken-Void-12B | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| Silver-Siren-ST-12B | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| Tess-3-Mistral-Nemo-12B | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| KrakenSakura-Maelstrom-12B-v1 | IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| MN-12B-Runeweaver-RP-RU | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| Dans-PersonalityEngine-V1.3.0-12b | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| Impish_Bloodmoon_12B | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| Wayfarer-2-12B | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| Wayfarer-12B | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| Muse-12B | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| mini-magnum-12b-v1.1 | IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| MN-Violet-Lotus-12B | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| Rocinante-X-12B-v1-Heretic-Uncensored | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| Mistral-Heretica-12B | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| arcee-fusion-lumaid-12B | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| Mistral-NeMo-12B-Abliterated | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| Captain-Eris_Violet-V0.420-12B | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| Rocinante-X-12B-v1-absolute-heresy | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| Rocinante-X-12B-v1 | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| Mistral-Nemo-2407-12B-Thinking-Claude-Gemini-GPT5.2-Uncensored-HERETIC | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| Dans-SakuraKaze-V1.0.0-12b | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| Mistral-Nemo-Inst-2407-12B-Thinking-Uncensored-HERETIC-HI-Claude-Opus | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| Mistral-Nemo-Instruct-2407-12B-Thinking-M-Claude-Opus-High-Reasoning | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| MN-12B-Mag-Mell-R1 | IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| Mordant-12B-Think | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| Riverfish-Rocinante-12B-SFT-DPO | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| MN-Violet-Lotus-12B-Heretic | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| Himeyuri-Magnum-12B-HereticMerge | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| Kinggaroo-12b-v1 | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| Magnum-Picaro-0.7-v2-12b | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| magnum-v2.5-12b-kto | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| Mistral-Nemo-Prism-12B | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| Nera_Noctis-12B | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| Chronos-Gold-12B-1.0 | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| patricide-12B-Unslop-Mell | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| MN-12B-Celeste-V1.9 | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| magnum-v2-12b | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| Peaceful-Days-12B | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| NemoMix-Unleashed-12B | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| Mistral-Nemo-Base-2407 | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| Blissful-Days-12B | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| Rocinante-12B-v1.1 | I1-IQ3_S | 12.2B | 5.18 GiB | 1.41 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| NVIDIA-Nemotron-Nano-9B-v2 | IQ2_S | 8.9B | 4.62 GiB | 1.97 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| granite-8b-code-instruct-4k | I1-Q5_K_M | 8.1B | 5.33 GiB | 1.27 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| granite-8b-code-base-4k | I1-Q5_K_M | 8.1B | 5.33 GiB | 1.27 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| NVIDIA-Nemotron-Nano-12B-v2 | Q2_K | 12.3B | 4.38 GiB | 2.18 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| gemma-7b | I1-IQ2_XS | 8.5B | 2.62 GiB | 3.94 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| Ministral-8B-Instruct-2410 | Q5_K_M | 8.0B | 5.33 GiB | 1.27 GiB | 7.43 GiB | 0.01 GiB | 24±12.9% |
| GLM-4.6V-Flash | Q5_K_S | 10.3B | 6.24 GiB | 0.35 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| GLM-Z1-9B-0414 | Q5_K_S | 9.4B | 6.24 GiB | 0.35 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| glm4.1v-9b-base-sft | I1-Q5_K_S | 10.3B | 6.24 GiB | 0.35 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| GLM-4-9B-0414 | Q5_K_S | 9.4B | 6.24 GiB | 0.35 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| GLM-4.1V-9B-Thinking | Q5_K_S | 10.3B | 6.24 GiB | 0.35 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| next-8b | I1-Q5_K_S | 8.2B | 5.33 GiB | 1.27 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
| Supertron2-Reranker-8B | I1-Q5_K_S | 8.8B | 5.33 GiB | 1.27 GiB | 7.43 GiB | 0.01 GiB | 25±12.9% |
Speed is modeled, not measured: decode is memory-bandwidth bound, so tokens per second is bytes read per token against achievable bandwidth. Mixture-of-experts models carry a wider band because only the routed experts are read each step, and few have been measured publicly.
Questions people ask
- What AI models can a GeForce RTX 3050 OEM run?
- 1345 of 2118 indexed open-weight models fit a GeForce RTX 3050 OEM at 32,768 context with q4_0 KV cache, the largest being L3.2-Rogue-Creative-Instruct-Uncensored-Abliterated-7B at Q4_K_M. That covers text, vision-language, image, video and speech models.
- How much usable memory does a GeForce RTX 3050 OEM actually have?
- Its nameplate is 8 GB, but about 7.44 GiB is available to a model once driver and compositor overhead is accounted for.
- Is a GeForce RTX 3050 OEM fast for local AI?
- Its memory bandwidth is 224 GB/s, and that figure — not teraflops — is what governs token generation speed. Capacity decides what you can run; bandwidth decides how fast it runs.