Aller au contenu
EN 4 QUESTIONSTrouver mon modèle
Sur ma machine · Nvidia DGX et RTX Spark

Quelle IA faire tourner sur deux DGX Spark en grappe ?

Nvidia DGX256 Go224 Go utiles

En bref

Sur deux DGX Spark en grappe, nous comptons 224 Go de mémoire utile (87,5 % de la mémoire unifiée). Le modèle le mieux noté qui y tient, au score général de l'édition du 28 septembre 2026, est GLM-5.3-Flash, avec 84,7, en version allégée à 4 bits (220,8 Go).

Pour faire mieux au score général, il faut viser plus grand : DeepSeek V4.1 Flash (87,3, dans la marge d'erreur) demande 380,9 Go en version allégée à 4 bits, soit quatre DGX Spark en grappe.

Prix : 2 × 4 699 $ au prix du fabricant (forums.developer.nvidia.com, 25 février 2026) et 2 × 6 099,95 € constatés chez LDLC le 30 septembre 2026.

Ce qui tient, tâche par tâcheEstimation

Pour chaque tâche, le mieux noté parmi les modèles ouverts qui tiennent dans 224 Go utiles, et la version la plus complète qui y entre. La même règle que Trouver mon modèle.

TâcheModèleScoreVersion qui tientFace au meilleur en ligne
GénéralGLM-5.3-Flash84,7allégée à 4 bits, 220,8 Go16 points sous GPT-6.1 Sol
CodeGLM-5.3-Flash88,9allégée à 4 bits, 220,8 Go11 points sous Claude Opus 5.5
RaisonnementInkling-Small82,4allégée à 4 bits, 190,4 Go21,1 points sous GPT-6 Astra
AgentsGLM-5.3-Flash provisoire88,9allégée à 4 bits, 220,8 Go12 points sous Claude Sonnet 5.5
UsageGLM-5.3-Flash85,5allégée à 4 bits, 220,8 Go12 points sous Gemini 4 Argon (ex æquo)
FrançaisGLM-5.3-Flash86,3allégée à 4 bits, 220,8 Go22,2 points sous Claude Opus 5.5
ÉcritureGLM-5.3-Flash84,5allégée à 4 bits, 220,8 Go16,4 points sous Claude Opus 5.5
MathsGLM-5.3-Flash83,2allégée à 4 bits, 220,8 Go18,8 points sous GPT-6 Astra
SciencesMiMo-V2.6-Flash provisoire · classé : GLM-5.3-Flash (82,6)84,5allégée à 4 bits, 213,2 Go12,5 points sous GPT-5.6 Sol (ex æquo)
VisionGLM-5.3-Flash provisoire86,3allégée à 4 bits, 220,8 Go13,8 points sous Claude Opus 5.5
WebGLM-5.3-Flash91,0allégée à 4 bits, 220,8 Go12,5 points sous Claude Opus 5.5 (ex æquo)

Les mieux notés qui y tiennentScore général

  1. 1GLM-5.3-Flashallégée à 4 bits, 220,8 Go84,7
  2. 2DeepSeek-V4-Flashallégée à 4 bits, 196 Go82,6
  3. 3Qwen 3.8 27Bcomplète, 62,1 Go82,4
  4. 4MiMo-V2.6-Flashallégée à 4 bits, 213,2 Go80,6
  5. 5Inkling-Smallallégée à 4 bits, 190,4 Go79,8
  6. 6Qwen3.6 27Bcomplète, 63,9 Go75,6
  7. 7MiniMax-M2.7allégée à 4 bits, 158,7 Go75,1
  8. 8Gemma 4 31B ITcomplète, 71,3 Go74,8

La barre montre la mémoire que demande la version qui tient ; le pointillé, les 224 Go utiles de la machine.

Pour faire mieux

DeepSeek V4.1 Flash, mieux noté (87,3, dans la marge d’erreur), demande 380,9 Go en version allégée à 4 bits : 156,9 Go de trop pour deux DGX Spark en grappe. Il tient à partir de quatre DGX Spark en grappe (4 DGX Spark, 512 Go).

La machine

Mémoire
256 Go (2 machines de 128 Go)
Mémoire utile
224 Go Marge de prudence87,5 % de la mémoire unifiée. Le DGX Spark n'a pas de mémoire réservée au processeur graphique : les 128 Go servent aussi au système et au processeur, et Nvidia ne documente aucune part utile. On en garde un huitième pour le système, la règle déjà appliquée aux machines à mémoire unifiée depuis la première édition (112 Go utiles sur 128).En grappe, la mémoire s'additionne (256 Go à deux, 512 Go à quatre), mais le modèle est alors réparti entre les machines par le réseau : il faut un moteur qui sait le faire, comme vLLM.
Débit mémoire publié
Non relevé
Sortie
Non relevée
Prix conseillé
2 × 4 699 $Celui de chacune des 2 machines : prix conseillé de la Founders Edition, relevé de 3 999 $ à 4 699 $ en février 2026 pour cause de pénurie de mémoire. forums.developer.nvidia.com, 25 février 2026.
Prix constaté
2 × 6 099,95 €LDLC, 30 septembre 2026 : PNY NVIDIA DGX Spark, 128 Go et 4 To, délai de plus de 15 jours. ldlc.com.
À savoir
« two DGX Spark nodes provide 256 GB of unified memory (sufficient for ~400B-parameter models) ». Les deux machines se relient en direct par un câble QSFP (ConnectX-7, 200 Gbit/s), sans commutateur ; LDLC vend ce câble 119,95 €.
Sources
developer.nvidia.comblogs.nvidia.comldlc.comRelu le 30 septembre 2026.

Mis en avant par le fabricantDéclaré

  • DeepSeek v4 Flash284 milliards de paramètres, 13 milliards actifs : « can run locally on 2x DGX Spark cluster and DGX Station ». Nvidia, blogs.nvidia.com, 3 septembre 2026.

Ce que le fabricant écrit sur une page publique. Ce n'est pas notre calcul : le modèle qu'il cite peut demander une version plus compressée que la nôtre.

Ses voisines

Toutes les machines de ce palier · Quelle IA faire tourner sur son ordinateur