Intel · workstation
Arc Pro A40 6GB
Arc Pro A40 6GB has 6 GB of VRAM at 192 GB/s — about 5.58 GiB usable after driver and compositor overhead. 1188 of 2118 indexed models fit at 16K context with q4_0 KV.
Spec sheet· bandwidth, theoreticalFrom the file· fit from summed bytesPredicted· speed
Memory
6 GB
GDDR6
Bandwidth
192 GB/s
96-bit bus
Tensor FP16
—
dense
TDP
50 W
vision language 91text 1010audio asr 38audio tts 19embedding 26image 1video 3
What fits at 16K context
largest quantization that fits, per model · 1188 of 2118 indexed
| Model | Best quant | Params | Weights● | KV● | Total in memory◐ | Headroom◐ | tok/s◐ |
|---|---|---|---|---|---|---|---|
| gemma-4-12B-it | UD-IQ3_XXS | 12.0B | 4.32 GiB | 0.41 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| gemma-4-12B-it-heretic | IQ3_XXS | 12.0B | 4.32 GiB | 0.41 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| Foundation-Sec-8B-Instruct-heretic | IQ4_XS | 8.0B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| MiniCPM-Llama3-V-2_5 | IQ4_XS | 8.5B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| llama3.1-heretic-unsensored | IQ4_XS | 8.0B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| dolphin-2.9.4-llama3.1-8b | IQ4_XS | 8.0B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| Dolphin3.0-Llama3.1-8B-abliterated | IQ4_XS | 8.0B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| Deepseek-R1-Distill-NSFW-RPv1 | IQ4_XS | 8.0B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| Llama3-ChatQA-1.5-8B | IQ4_XS | 8.0B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| L3.1-Dark-Reasoning-LewdPlay-evo-Hermes-R1-Uncensored-8B-heretic | IQ4_XS | 8.0B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| Llama3.3-8B-Instruct-Thinking-Heretic-Uncensored-Claude-4.5-Opus-High-Reasoning | IQ4_XS | 8.0B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| Llama3.3-8B-Instruct-Thinking-Claude-4.5-Opus-High-Reasoning | IQ4_XS | 8.0B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| grok-oss-Apollyon-8B-heretic | IQ4_XS | 8.0B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| Llama3.1-GptDeluxe-8B | IQ4_XS | 8.0B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| SelfCite-8B-CC-SFT | IQ4_XS | 8.0B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| Llama-3.3-8B-Instruct-128K-Jbliterated | IQ4_XS | 8.0B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| ai-girlfriend-v2 | IQ4_XS | 8.0B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| Llama-3.3-8B-Instruct-128K_Abliterated | IQ4_XS | 8.0B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| grok-oss-Apollyon-8B | IQ4_XS | 8.0B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| Lumen-1.2.5 | IQ4_XS | 8.0B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| HARC-Llama-3.1-8B-Instruct | IQ4_XS | 8.0B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| grok-oss-Thanatos-8B | IQ4_XS | 8.0B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| L3-8B-Sunfall-v0.5-Stheno-v3.2 | IQ4_XS | 8.0B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| OpenElla-NovelWriter-Requiem-Ascended | IQ4_XS | 8.0B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| llama-joycaption-beta-one-hf-llava | IQ4_XS | 8.5B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| calme-2.3-legalkit-8b | IQ4_XS | 8.0B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| DarkIdol-Llama-3.1-8B-Instruct-1.3-Uncensored | IQ4_XS | 8.0B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| Llama3.1-DilemmaDeluxe-8B | IQ4_XS | 8.0B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| DarkIdol-Llama-3.1-8B-Instruct-1.2-Uncensored | IQ4_XS | 8.0B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| Humanish-Roleplay-Llama-3.1-8B | IQ4_XS | 8.0B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| Llama-3.1-8B-kali-pentester | IQ4_XS | 8.0B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| NeuralDaredevil-8B-abliterated | IQ4_XS | 8.0B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| Llama-3.3-8B-Instruct | IQ4_XS | 8.0B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| Hathor_Sofit-L3-8B-v1 | IQ4_XS | 8.0B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| llama3-8B-DarkIdol-2.3-Uncensored-32K | IQ4_XS | 8.0B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| Hathor_Unstable-L3-8B-v0.3 | IQ4_XS | 8.0B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| L3-8B-Stheno-v3.2 | IQ4_XS | 8.0B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| Llama-SEA-LION-v2-8B | IQ4_XS | 8.0B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| Turkish-Llama-8b-Instruct-v0.1 | IQ4_XS | 8.0B | 4.18 GiB | 0.56 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| Apriel-1.6-15b-Thinker | I1-IQ2_XXS | 14.9B | 3.89 GiB | 0.84 GiB | 5.58 GiB | 0.00 GiB | 22±30% |
| Gemma-4-E4B-it-Minecraft-MT-en-zh-v0.1 | I1-Q3_K_L | 8.0B | 4.68 GiB | 0.08 GiB | 5.57 GiB | 0.01 GiB | 22±30% |
| gemma-4-E4B-Queen-it-qat-q4_0-unquantized | I1-Q3_K_L | 8.0B | 4.68 GiB | 0.08 GiB | 5.57 GiB | 0.01 GiB | 22±30% |
| Gemma-4-E4B-Luchador-Rudo | I1-Q3_K_L | 8.0B | 4.68 GiB | 0.08 GiB | 5.57 GiB | 0.01 GiB | 22±30% |
| supergemma4-e4b-abliterated | I1-Q3_K_L | 7.5B | 4.68 GiB | 0.08 GiB | 5.57 GiB | 0.01 GiB | 22±30% |
| Gemma-4-E4B-Abliterated | I1-Q3_K_L | 8.0B | 4.68 GiB | 0.08 GiB | 5.57 GiB | 0.01 GiB | 22±30% |
| gemma-4-E4B-it-The-DECKARD-Claude-Opus-Expresso-Universe-HERETIC-UNCENSORED-Thinking | I1-Q3_K_L | 8.0B | 4.68 GiB | 0.08 GiB | 5.57 GiB | 0.01 GiB | 22±30% |
| gemma-4-E4B-it-The-DECKARD-Expresso-Universe-HERETIC-UNCENSORED-Thinking | I1-Q3_K_L | 8.0B | 4.68 GiB | 0.08 GiB | 5.57 GiB | 0.01 GiB | 22±30% |
| gemma-4-E4B-it-heretic | I1-Q3_K_L | 8.0B | 4.68 GiB | 0.08 GiB | 5.57 GiB | 0.01 GiB | 22±30% |
| gemma-4-E4B-it-Claude-Opus-4.5-HERETIC-UNCENSORED-Thinking | I1-Q3_K_L | 8.0B | 4.68 GiB | 0.08 GiB | 5.57 GiB | 0.01 GiB | 22±30% |
| Huihui-gemma-4-E4B-it-abliterated | I1-Q3_K_L | 8.0B | 4.68 GiB | 0.08 GiB | 5.57 GiB | 0.01 GiB | 22±30% |
| gemma-4-E4B-it-Uncensored-MAX | I1-Q3_K_L | 8.0B | 4.68 GiB | 0.08 GiB | 5.57 GiB | 0.01 GiB | 22±30% |
| Darkidol-Gemma-4-E4B-it | I1-Q3_K_L | 8.0B | 4.68 GiB | 0.08 GiB | 5.57 GiB | 0.01 GiB | 22±30% |
| gemma-4-E4B-it-abliterated | I1-Q3_K_L | 8.0B | 4.68 GiB | 0.08 GiB | 5.57 GiB | 0.01 GiB | 22±30% |
| gemma-4-E4B-it-ultra-uncensored-heretic | Q3_K_L | 8.0B | 4.68 GiB | 0.08 GiB | 5.57 GiB | 0.01 GiB | 22±30% |
| OpenMedResearch-Gemma-4E4N | I1-Q3_K_L | 8.0B | 4.68 GiB | 0.08 GiB | 5.57 GiB | 0.01 GiB | 22±30% |
| Reasoning-Medical0.1-E4B-sft | I1-Q3_K_L | 8.0B | 4.68 GiB | 0.08 GiB | 5.57 GiB | 0.01 GiB | 22±30% |
| gemma-4-E4B | Q3_K_L | 8.0B | 4.68 GiB | 0.08 GiB | 5.57 GiB | 0.01 GiB | 22±30% |
| granite-8b-code-instruct-4k | IQ4_XS | 8.1B | 4.10 GiB | 0.63 GiB | 5.57 GiB | 0.01 GiB | 22±30% |
| canary-qwen-2.5b | BF16 | 2.6B | 4.73 GiB | 0.00 GiB | 5.57 GiB | 0.01 GiB | 22±30% |
| EXAONE-Deep-7.8B | Q4_K_L | 7.8B | 4.73 GiB | 0.00 GiB | 5.57 GiB | 0.01 GiB | 22±30% |
Speed is modeled, not measured: decode is memory-bandwidth bound, so tokens per second is bytes read per token against achievable bandwidth. Mixture-of-experts models carry a wider band because only the routed experts are read each step, and few have been measured publicly.
Questions people ask
- What AI models can a Arc Pro A40 6GB run?
- 1188 of 2118 indexed open-weight models fit a Arc Pro A40 6GB at 16,384 context with q4_0 KV cache, the largest being gemma-4-12B-it at UD-IQ3_XXS. That covers text, vision-language, image, video and speech models.
- How much usable memory does a Arc Pro A40 6GB actually have?
- Its nameplate is 6 GB, but about 5.58 GiB is available to a model once driver and compositor overhead is accounted for.
- Is a Arc Pro A40 6GB fast for local AI?
- Its memory bandwidth is 192 GB/s, and that figure — not teraflops — is what governs token generation speed. Capacity decides what you can run; bandwidth decides how fast it runs.