Combien coûte le
DGX Spark ?

Mis à jour le 14 septembre 2026

Un DGX Spark entraîne des coûts mensuels. Amortissement du hardware plus électricité sous charge. Modifiez les hypothèses pour estimer votre propre utilisation.

Hardware / mois€103amortissement du Spark
Électricité / mois€8170 W × 22 jours ouvrés
Total / mois€111hardware plus électricité

La formule

coût/mois = (matériel ÷ amortissement) + (W ÷ 1000 × heures × 22 jours ouvrés × prix du kWh)

Le calcul additionne l’amortissement et l’électricité. Le matériel est amorti de manière linéaire ; l’électricité ne compte que pendant les heures indiquées en charge, sur 22 jours ouvrés par mois. Les heures au repos et les week-ends sont exclus.

Hypothèses

  • Électricité suppose 170 W en charge sous vLLM. Le TDP maximal est d’environ 240 W ; la consommation réelle est plus faible.
  • Hardware : la Founders Edition NL HT. Ajuste si tu l'as acheté d'occasion, si tu as un avantage fiscal ou si tu l'as eu via un autre canal.
  • Hypothèse d'utilisation: tous les calculs mensuels utilisent 22 jours ouvrés. L’électricité ne compte que pendant les heures indiquées, hors repos, soirées et week-ends.
  • Non inclus: internet, refroidissement, espace et temps de maintenance. Cette estimation ne couvre donc pas tous les coûts.
Ce que ce chiffre ne te dit pas : si le local revient moins cher qu'une API cloud. Pour ça il faut aussi compter les tokens par seconde, et ils varient selon le modèle. On le calcule ci-dessous, avec le débit de l' arena. L'arbitrage plus large se trouve dans le guide de décision IA locale.

Coût par million de tokens de sortie

Le Spark coûte presque la même chose chaque mois, qu'il tourne à fond ou non. Cette comparaison suppose explicitement 8 heures par jour ouvré et 22 jours ouvrés par mois. Les deux colonnes locales utilisent exactement les profils Arena travail de bureau et pic du lundi matin.

Résultat avec ces hypothèses : l’API Mistral Small 4 est moins chère que le même modèle sur votre Spark. Face à GPT-5 mini, le résultat dépend de la charge : le test de pointe coûte un peu moins, le profil bureautique davantage. Fondez votre choix sur l’utilisation réelle, la souveraineté des données et la prévisibilité, plutôt que sur une promesse générale de prix.
Model Précision €/1M · travail de bureau (c=10) €/1M · pic du lundi matin
Mistral Small 4 APImistral-small-2603 US, CLOUD Act €0,51 tout volume
GPT-5 mini APIgpt-5-mini-2025-08-07 US, CLOUD Act €1,70 tout volume
Qwen-3.5 0.8B BF16 €0,23 €0,24
Qwen-3.5 2B BF16 €0,46 €0,29
Gemma-4 E2B BF16 €0,47 €0,35
LFM2.5 2.6B BF16 €0,51 €0,36
Nemotron-3-Nano 4B FP8 €0,58 €0,50
gpt-oss-20b MXFP4 €1,24 €0,57
Nemotron-3-Nano 4B BF16 €0,83 €0,61
Gemma-4 E4B BF16 €1,20 €0,66
Nemotron-3 Nano Omni 30B-A3B NVFP4 €0,84 €0,67
Nemotron-3-Nano 30B-A3B NVFP4 €0,89 €0,67
Qwen-3.5 4B BF16 €0,88 €0,67
Qwen-3.6 35B-A3B NVFP4 €0,95 €0,78
Gemma-4 26B-A4B NVFP4 €1,01 €0,81
Gemma-4 26B-A4B NVFP4 €1,00 €0,82
Ministral-3 8B BF16 €0,85 €0,84
Nemotron-3-Nano 30B-A3B FP8 €1,35 €0,93
Qwen-3.6 35B-A3B FP8 €1,24 €1,01
Qwen-3.5 9B BF16 €1,54 €1,10
Nemotron-3 Nano Omni 30B-A3B FP8 €1,27 -
Granite-4.1 8B BF16 €1,75 €1,29
Nemotron-3 Nano Omni 30B-A3B BF16 €2,35 €1,38
Gemma-4 26B-A4B BF16 €1,95 €1,41
Gemma-4 26B-A4B BF16 €1,97 €1,41
Nemotron-3-Nano 30B-A3B BF16 €2,35 €1,44
Qwen-3.6 35B-A3B BF16 €2,12 €1,54
Nemotron-Cascade-2 30B-A3B BF16 €2,36 €1,54
KAT-Coder V2.5 BF16 €2,24 €1,56
Mistral-Small 4 119B NVFP4 €1,97 €1,65
Nemotron-3-Super 120B-A12B NVFP4 €2,74 €2,47
Muse-Glimmer 30B BF16 €4,39 €3,07
Gemma-4 31B NVFP4 €4,02 €3,43
Qwen-3.8 27B FP8 €3,32 €3,51
Qwen-3.8 27B BF16 €4,80 €3,51
Qwen-3.6 27B FP8 €3,32 €3,54
Qwen-3.6 27B BF16 €4,88 €3,56
Muse-Glimmer 30B BF16 €2,73 €4,33
Gemma-4 31B BF16 €8,03 €4,34
  • Hypothèse : 8 heures de charge réelle par jour ouvré, 22 jours ouvrés par mois. Une utilisation intermittente produit moins de tokens par mois, donc un prix par token plus élevé.
  • On compare les tokens de sortie, car l'Arena mesure le decode. Le travail de bureau utilise le test 04, multi-turn à c=10. Le pic du lundi utilise le test 10 ; le débit de sortie est le débit total multiplié par la part de sortie du scénario. Un profil absent reste vide sans fallback vers un autre test.
  • Seuls des modèles équivalents se comparent honnêtement. Le point le plus net est Mistral-Small 4 119B NVFP4 en local face au snapshot fixe de l'API Mistral Small 4 : la même génération dans un autre emplacement.
  • Les runs ont tourné avec le prefix caching désactivé. Activé, il améliorerait le débit local, et donc baisserait le prix.
  • Les prix cloud concernent les tokens de sortie : Mistral Small 4 à 0,60 $ et GPT-5 mini à 2,00 $ par million. Conversion à 1 $ = 0,85 € (2026-08-21). Sources : Mistral, OpenAI et le taux de référence de la BCE.
  • Énergie : à 170 W, l’électricité ne représente qu’environ 7 % du coût mensuel ; le reste est l’amortissement du matériel. Avec ces hypothèses, l’amortissement domine. Un million de tokens de sortie de Gemma-4 NVFP4 consomme environ 274 Wh, soit quelques centimes. Estimation à 170 W constants : nous ne mesurons pas la consommation par modèle.