Wat kost de
DGX Spark?

Bijgewerkt 13 september 2026

Een DGX Spark brengt maandelijkse kosten met zich mee. Hardware-afschrijving plus stroom onder load. Pas de aannames aan om een schatting voor jouw gebruik te maken.

Hardware / maand€103amortisatie van de Spark
Stroom / maand€8170W × 22 werkdagen
Totaal / maand€111hardware plus stroom

De formule

kosten/maand = (hardware ÷ amortisatie) + (W ÷ 1000 × uren × 22 werkdagen × kWh-prijs)

De berekening telt afschrijving en stroom op. Hardware wordt lineair afgeschreven; stroom telt alleen tijdens de opgegeven on-load uren op 22 werkdagen per maand. Idle-uren en weekenden rekenen we niet mee.

Aannames

  • Stroom rekent met 170W onder vLLM-load. Max TDP ligt rond 240W, in de praktijk zit hij lager.
  • Hardware is de Founders Edition NL ex BTW. Pas aan als je 'm tweedehands kocht, belastingvoordeel hebt of via een ander kanaal aanschafte.
  • Util-aanname: alle maandberekeningen gebruiken 22 werkdagen. Stroomkosten tellen alleen tijdens de opgegeven uren; idle, avonden en weekenden niet.
  • Niet inbegrepen: internet, koeling, ruimte, jouw tijd om het te beheren. Deze schatting bevat dus niet alle kosten.
Wat dit getal je niet vertelt: of lokaal goedkoper is dan een cloud-API. Daarvoor moet je ook tokens-per-seconde meenemen, en die verschillen per model. Dat rekenen we hieronder uit, met de arena-throughput erbij. De bredere afweging staat in de Local AI-beslisgids.

Kosten per miljoen outputtokens

Per maand kost de Spark vrijwel hetzelfde, of je hem nu vol draait of niet. Deze vergelijking rekent expliciet met 8 uur per werkdag en 22 werkdagen per maand. De twee lokale kolommen gebruiken exact de Arena-profielen kantoorwerk en maandagochtend-piek.

Uitkomst bij deze aannames: de Mistral Small 4 API is goedkoper dan hetzelfde model op je eigen Spark. Tegen GPT-5 mini hangt de uitkomst af van het belastingprofiel: de piekrun komt iets lager uit, het kantoorprofiel hoger. Kies on-prem dus niet op een algemene prijsclaim, maar voor je echte bezetting, data-soevereiniteit en voorspelbaarheid.
Model Precisie €/1M · kantoorwerk (c=10) €/1M · maandagochtend-piek
Mistral Small 4 APImistral-small-2603 VS, CLOUD Act €0,51 elk volume
GPT-5 mini APIgpt-5-mini-2025-08-07 VS, CLOUD Act €1,70 elk volume
Qwen-3.5 0.8B BF16 €0,23 €0,24
Qwen-3.5 2B BF16 €0,46 €0,29
Gemma-4 E2B BF16 €0,47 €0,35
LFM2.5 2.6B BF16 €0,51 €0,36
Nemotron-3-Nano 4B FP8 €0,58 €0,50
gpt-oss-20b MXFP4 €1,24 €0,57
Nemotron-3-Nano 4B BF16 €0,83 €0,61
Gemma-4 E4B BF16 €1,20 €0,66
Nemotron-3 Nano Omni 30B-A3B NVFP4 €0,84 €0,67
Nemotron-3-Nano 30B-A3B NVFP4 €0,89 €0,67
Qwen-3.5 4B BF16 €0,88 €0,67
Qwen-3.6 35B-A3B NVFP4 €0,95 €0,78
Gemma-4 26B-A4B NVFP4 €1,01 €0,81
Gemma-4 26B-A4B NVFP4 €1,00 €0,82
Ministral-3 8B BF16 €0,85 €0,84
Nemotron-3-Nano 30B-A3B FP8 €1,35 €0,93
Qwen-3.6 35B-A3B FP8 €1,24 €1,01
Qwen-3.5 9B BF16 €1,54 €1,10
Nemotron-3 Nano Omni 30B-A3B FP8 €1,27 -
Granite-4.1 8B BF16 €1,75 €1,29
Nemotron-3 Nano Omni 30B-A3B BF16 €2,35 €1,38
Gemma-4 26B-A4B BF16 €1,95 €1,41
Gemma-4 26B-A4B BF16 €1,97 €1,41
Nemotron-3-Nano 30B-A3B BF16 €2,35 €1,44
Qwen-3.6 35B-A3B BF16 €2,12 €1,54
Nemotron-Cascade-2 30B-A3B BF16 €2,36 €1,54
KAT-Coder V2.5 BF16 €2,24 €1,56
Mistral-Small 4 119B NVFP4 €1,97 €1,65
Nemotron-3-Super 120B-A12B NVFP4 €2,74 €2,47
Muse-Glimmer 30B BF16 €4,39 €3,07
Gemma-4 31B NVFP4 €4,02 €3,43
Qwen-3.8 27B FP8 €3,32 €3,51
Qwen-3.8 27B BF16 €4,80 €3,51
Qwen-3.6 27B FP8 €3,32 €3,54
Qwen-3.6 27B BF16 €4,88 €3,56
Muse-Glimmer 30B BF16 €2,73 €4,33
Gemma-4 31B BF16 €8,03 €4,34
  • Aanname: 8 uur echte load per werkdag, gedurende 22 werkdagen per maand. Bursty gebruik betekent minder tokens per maand en dus een hogere prijs per token.
  • We vergelijken output-tokens, omdat de Arena decode meet. De kolom kantoorwerk gebruikt test 04, multi-turn met c=10. Maandagochtend-piek gebruikt test 10; de output-throughput is de totale doorvoer maal het output-aandeel van het scenario. Een ontbrekend profiel blijft leeg en valt niet terug op een andere test.
  • Alleen gelijkwaardige modellen zijn eerlijk te vergelijken. Het zuiverste punt is Mistral-Small 4 119B NVFP4 lokaal tegenover de vaste Mistral Small 4 API-snapshot: dezelfde modelgeneratie, een andere uitvoerplek.
  • De runs draaiden met prefix caching uit. Aan zou de lokale throughput verbeteren, en dus de prijs verlagen.
  • Cloud-prijzen zijn output-tokens: Mistral Small 4 $0,60 en GPT-5 mini $2,00 per 1M. Beide zijn omgerekend tegen $1 = €0,85 (2026-08-21). Bronnen: Mistral, OpenAI en de ECB-referentiekoers.
  • Energie: bij 170W is stroom maar ~7% van de maandkost, de rest is hardware-afschrijving. De afschrijving bepaalt bij deze aannames het grootste deel van de kosten. Eén miljoen output-tokens van Gemma-4 NVFP4 kost ruwweg 274 Wh, een paar cent. Schatting op die vlakke 170W, want we meten stroom niet per model.