Wat kost de
DGX Spark?
Bijgewerkt 13 september 2026
Een DGX Spark brengt maandelijkse kosten met zich mee. Hardware-afschrijving plus stroom onder load. Pas de aannames aan om een schatting voor jouw gebruik te maken.
02Aannames voor je eigen situatie
Hardware / maand€103amortisatie van de Spark
Stroom / maand€8170W × 22 werkdagen
Totaal / maand€111hardware plus stroom
03Hoe de getallen tot stand komen
De formule
kosten/maand = (hardware ÷ amortisatie) + (W ÷ 1000 × uren × 22 werkdagen × kWh-prijs)
De berekening telt afschrijving en stroom op. Hardware wordt lineair afgeschreven; stroom telt alleen tijdens de opgegeven on-load uren op 22 werkdagen per maand. Idle-uren en weekenden rekenen we niet mee.
Aannames
- Stroom rekent met 170W onder vLLM-load. Max TDP ligt rond 240W, in de praktijk zit hij lager.
- Hardware is de Founders Edition NL ex BTW. Pas aan als je 'm tweedehands kocht, belastingvoordeel hebt of via een ander kanaal aanschafte.
- Util-aanname: alle maandberekeningen gebruiken 22 werkdagen. Stroomkosten tellen alleen tijdens de opgegeven uren; idle, avonden en weekenden niet.
- Niet inbegrepen: internet, koeling, ruimte, jouw tijd om het te beheren. Deze schatting bevat dus niet alle kosten.
Wat dit getal je niet vertelt: of lokaal goedkoper is dan een cloud-API. Daarvoor moet je ook tokens-per-seconde meenemen, en die verschillen per model. Dat rekenen we hieronder uit, met de arena-throughput erbij. De bredere afweging staat in de Local AI-beslisgids.
04Lokaal versus cloud
Kosten per miljoen outputtokens
Per maand kost de Spark vrijwel hetzelfde, of je hem nu vol draait of niet. Deze vergelijking rekent expliciet met 8 uur per werkdag en 22 werkdagen per maand. De twee lokale kolommen gebruiken exact de Arena-profielen kantoorwerk en maandagochtend-piek.
Uitkomst bij deze aannames: de Mistral Small 4 API is goedkoper dan hetzelfde model op je eigen Spark. Tegen GPT-5 mini hangt de uitkomst af van het belastingprofiel: de piekrun komt iets lager uit, het kantoorprofiel hoger. Kies on-prem dus niet op een algemene prijsclaim, maar voor je echte bezetting, data-soevereiniteit en voorspelbaarheid.
| Model | Precisie | €/1M · kantoorwerk (c=10) | €/1M · maandagochtend-piek |
|---|---|---|---|
| Mistral Small 4 APImistral-small-2603 | VS, CLOUD Act | €0,51 elk volume | |
| GPT-5 mini APIgpt-5-mini-2025-08-07 | VS, CLOUD Act | €1,70 elk volume | |
| Qwen-3.5 0.8B | BF16 | €0,23 | €0,24 |
| Qwen-3.5 2B | BF16 | €0,46 | €0,29 |
| Gemma-4 E2B | BF16 | €0,47 | €0,35 |
| LFM2.5 2.6B | BF16 | €0,51 | €0,36 |
| Nemotron-3-Nano 4B | FP8 | €0,58 | €0,50 |
| gpt-oss-20b | MXFP4 | €1,24 | €0,57 |
| Nemotron-3-Nano 4B | BF16 | €0,83 | €0,61 |
| Gemma-4 E4B | BF16 | €1,20 | €0,66 |
| Nemotron-3 Nano Omni 30B-A3B | NVFP4 | €0,84 | €0,67 |
| Nemotron-3-Nano 30B-A3B | NVFP4 | €0,89 | €0,67 |
| Qwen-3.5 4B | BF16 | €0,88 | €0,67 |
| Qwen-3.6 35B-A3B | NVFP4 | €0,95 | €0,78 |
| Gemma-4 26B-A4B | NVFP4 | €1,01 | €0,81 |
| Gemma-4 26B-A4B | NVFP4 | €1,00 | €0,82 |
| Ministral-3 8B | BF16 | €0,85 | €0,84 |
| Nemotron-3-Nano 30B-A3B | FP8 | €1,35 | €0,93 |
| Qwen-3.6 35B-A3B | FP8 | €1,24 | €1,01 |
| Qwen-3.5 9B | BF16 | €1,54 | €1,10 |
| Nemotron-3 Nano Omni 30B-A3B | FP8 | €1,27 | - |
| Granite-4.1 8B | BF16 | €1,75 | €1,29 |
| Nemotron-3 Nano Omni 30B-A3B | BF16 | €2,35 | €1,38 |
| Gemma-4 26B-A4B | BF16 | €1,95 | €1,41 |
| Gemma-4 26B-A4B | BF16 | €1,97 | €1,41 |
| Nemotron-3-Nano 30B-A3B | BF16 | €2,35 | €1,44 |
| Qwen-3.6 35B-A3B | BF16 | €2,12 | €1,54 |
| Nemotron-Cascade-2 30B-A3B | BF16 | €2,36 | €1,54 |
| KAT-Coder V2.5 | BF16 | €2,24 | €1,56 |
| Mistral-Small 4 119B | NVFP4 | €1,97 | €1,65 |
| Nemotron-3-Super 120B-A12B | NVFP4 | €2,74 | €2,47 |
| Muse-Glimmer 30B | BF16 | €4,39 | €3,07 |
| Gemma-4 31B | NVFP4 | €4,02 | €3,43 |
| Qwen-3.8 27B | FP8 | €3,32 | €3,51 |
| Qwen-3.8 27B | BF16 | €4,80 | €3,51 |
| Qwen-3.6 27B | FP8 | €3,32 | €3,54 |
| Qwen-3.6 27B | BF16 | €4,88 | €3,56 |
| Muse-Glimmer 30B | BF16 | €2,73 | €4,33 |
| Gemma-4 31B | BF16 | €8,03 | €4,34 |
- Aanname: 8 uur echte load per werkdag, gedurende 22 werkdagen per maand. Bursty gebruik betekent minder tokens per maand en dus een hogere prijs per token.
- We vergelijken output-tokens, omdat de Arena decode meet. De kolom kantoorwerk gebruikt test 04, multi-turn met c=10. Maandagochtend-piek gebruikt test 10; de output-throughput is de totale doorvoer maal het output-aandeel van het scenario. Een ontbrekend profiel blijft leeg en valt niet terug op een andere test.
- Alleen gelijkwaardige modellen zijn eerlijk te vergelijken. Het zuiverste punt is Mistral-Small 4 119B NVFP4 lokaal tegenover de vaste Mistral Small 4 API-snapshot: dezelfde modelgeneratie, een andere uitvoerplek.
- De runs draaiden met prefix caching uit. Aan zou de lokale throughput verbeteren, en dus de prijs verlagen.
- Cloud-prijzen zijn output-tokens: Mistral Small 4 $0,60 en GPT-5 mini $2,00 per 1M. Beide zijn omgerekend tegen $1 = €0,85 (2026-08-21). Bronnen: Mistral, OpenAI en de ECB-referentiekoers.
- Energie: bij 170W is stroom maar ~7% van de maandkost, de rest is hardware-afschrijving. De afschrijving bepaalt bij deze aannames het grootste deel van de kosten. Eén miljoen output-tokens van Gemma-4 NVFP4 kost ruwweg 274 Wh, een paar cent. Schatting op die vlakke 170W, want we meten stroom niet per model.