Combien coûte le
DGX Spark ?
Mis à jour le 14 septembre 2026
Un DGX Spark entraîne des coûts mensuels. Amortissement du hardware plus électricité sous charge. Modifiez les hypothèses pour estimer votre propre utilisation.
02Hypothèses pour ta propre situation
Hardware / mois€103amortissement du Spark
Électricité / mois€8170 W × 22 jours ouvrés
Total / mois€111hardware plus électricité
03Comment les chiffres se calculent
La formule
coût/mois = (matériel ÷ amortissement) + (W ÷ 1000 × heures × 22 jours ouvrés × prix du kWh)
Le calcul additionne l’amortissement et l’électricité. Le matériel est amorti de manière linéaire ; l’électricité ne compte que pendant les heures indiquées en charge, sur 22 jours ouvrés par mois. Les heures au repos et les week-ends sont exclus.
Hypothèses
- Électricité suppose 170 W en charge sous vLLM. Le TDP maximal est d’environ 240 W ; la consommation réelle est plus faible.
- Hardware : la Founders Edition NL HT. Ajuste si tu l'as acheté d'occasion, si tu as un avantage fiscal ou si tu l'as eu via un autre canal.
- Hypothèse d'utilisation: tous les calculs mensuels utilisent 22 jours ouvrés. L’électricité ne compte que pendant les heures indiquées, hors repos, soirées et week-ends.
- Non inclus: internet, refroidissement, espace et temps de maintenance. Cette estimation ne couvre donc pas tous les coûts.
Ce que ce chiffre ne te dit pas : si le local revient moins cher qu'une API cloud. Pour ça il faut aussi compter les tokens par seconde, et ils varient selon le modèle. On le calcule ci-dessous, avec le débit de l' arena. L'arbitrage plus large se trouve dans le guide de décision IA locale.
04Local contre cloud
Coût par million de tokens de sortie
Le Spark coûte presque la même chose chaque mois, qu'il tourne à fond ou non. Cette comparaison suppose explicitement 8 heures par jour ouvré et 22 jours ouvrés par mois. Les deux colonnes locales utilisent exactement les profils Arena travail de bureau et pic du lundi matin.
Résultat avec ces hypothèses : l’API Mistral Small 4 est moins chère que le même modèle sur votre Spark. Face à GPT-5 mini, le résultat dépend de la charge : le test de pointe coûte un peu moins, le profil bureautique davantage. Fondez votre choix sur l’utilisation réelle, la souveraineté des données et la prévisibilité, plutôt que sur une promesse générale de prix.
| Model | Précision | €/1M · travail de bureau (c=10) | €/1M · pic du lundi matin |
|---|---|---|---|
| Mistral Small 4 APImistral-small-2603 | US, CLOUD Act | €0,51 tout volume | |
| GPT-5 mini APIgpt-5-mini-2025-08-07 | US, CLOUD Act | €1,70 tout volume | |
| Qwen-3.5 0.8B | BF16 | €0,23 | €0,24 |
| Qwen-3.5 2B | BF16 | €0,46 | €0,29 |
| Gemma-4 E2B | BF16 | €0,47 | €0,35 |
| LFM2.5 2.6B | BF16 | €0,51 | €0,36 |
| Nemotron-3-Nano 4B | FP8 | €0,58 | €0,50 |
| gpt-oss-20b | MXFP4 | €1,24 | €0,57 |
| Nemotron-3-Nano 4B | BF16 | €0,83 | €0,61 |
| Gemma-4 E4B | BF16 | €1,20 | €0,66 |
| Nemotron-3 Nano Omni 30B-A3B | NVFP4 | €0,84 | €0,67 |
| Nemotron-3-Nano 30B-A3B | NVFP4 | €0,89 | €0,67 |
| Qwen-3.5 4B | BF16 | €0,88 | €0,67 |
| Qwen-3.6 35B-A3B | NVFP4 | €0,95 | €0,78 |
| Gemma-4 26B-A4B | NVFP4 | €1,01 | €0,81 |
| Gemma-4 26B-A4B | NVFP4 | €1,00 | €0,82 |
| Ministral-3 8B | BF16 | €0,85 | €0,84 |
| Nemotron-3-Nano 30B-A3B | FP8 | €1,35 | €0,93 |
| Qwen-3.6 35B-A3B | FP8 | €1,24 | €1,01 |
| Qwen-3.5 9B | BF16 | €1,54 | €1,10 |
| Nemotron-3 Nano Omni 30B-A3B | FP8 | €1,27 | - |
| Granite-4.1 8B | BF16 | €1,75 | €1,29 |
| Nemotron-3 Nano Omni 30B-A3B | BF16 | €2,35 | €1,38 |
| Gemma-4 26B-A4B | BF16 | €1,95 | €1,41 |
| Gemma-4 26B-A4B | BF16 | €1,97 | €1,41 |
| Nemotron-3-Nano 30B-A3B | BF16 | €2,35 | €1,44 |
| Qwen-3.6 35B-A3B | BF16 | €2,12 | €1,54 |
| Nemotron-Cascade-2 30B-A3B | BF16 | €2,36 | €1,54 |
| KAT-Coder V2.5 | BF16 | €2,24 | €1,56 |
| Mistral-Small 4 119B | NVFP4 | €1,97 | €1,65 |
| Nemotron-3-Super 120B-A12B | NVFP4 | €2,74 | €2,47 |
| Muse-Glimmer 30B | BF16 | €4,39 | €3,07 |
| Gemma-4 31B | NVFP4 | €4,02 | €3,43 |
| Qwen-3.8 27B | FP8 | €3,32 | €3,51 |
| Qwen-3.8 27B | BF16 | €4,80 | €3,51 |
| Qwen-3.6 27B | FP8 | €3,32 | €3,54 |
| Qwen-3.6 27B | BF16 | €4,88 | €3,56 |
| Muse-Glimmer 30B | BF16 | €2,73 | €4,33 |
| Gemma-4 31B | BF16 | €8,03 | €4,34 |
- Hypothèse : 8 heures de charge réelle par jour ouvré, 22 jours ouvrés par mois. Une utilisation intermittente produit moins de tokens par mois, donc un prix par token plus élevé.
- On compare les tokens de sortie, car l'Arena mesure le decode. Le travail de bureau utilise le test 04, multi-turn à c=10. Le pic du lundi utilise le test 10 ; le débit de sortie est le débit total multiplié par la part de sortie du scénario. Un profil absent reste vide sans fallback vers un autre test.
- Seuls des modèles équivalents se comparent honnêtement. Le point le plus net est Mistral-Small 4 119B NVFP4 en local face au snapshot fixe de l'API Mistral Small 4 : la même génération dans un autre emplacement.
- Les runs ont tourné avec le prefix caching désactivé. Activé, il améliorerait le débit local, et donc baisserait le prix.
- Les prix cloud concernent les tokens de sortie : Mistral Small 4 à 0,60 $ et GPT-5 mini à 2,00 $ par million. Conversion à 1 $ = 0,85 € (2026-08-21). Sources : Mistral, OpenAI et le taux de référence de la BCE.
- Énergie : à 170 W, l’électricité ne représente qu’environ 7 % du coût mensuel ; le reste est l’amortissement du matériel. Avec ces hypothèses, l’amortissement domine. Un million de tokens de sortie de Gemma-4 NVFP4 consomme environ 274 Wh, soit quelques centimes. Estimation à 170 W constants : nous ne mesurons pas la consommation par modèle.