Aller au contenu
EN 4 QUESTIONSTrouver mon modèle
Sur ma machine · Nvidia DGX et RTX Spark

Quelle IA faire tourner sur une DGX Station ?

Nvidia DGX748 Go, dont 252 Go de processeur graphique252 Go utiles

En bref

Sur une DGX Station, nous comptons 252 Go de mémoire utile (les 252 Go de mémoire du processeur graphique). Le modèle le mieux noté qui y tient, au score général de l'édition du 28 septembre 2026, est GLM-5.3-Flash, avec 84,7, en version allégée à 4 bits (220,8 Go).

Pour faire mieux au score général, il faut viser plus grand : DeepSeek V4.1 Flash (87,3, dans la marge d'erreur) demande 380,9 Go en version allégée à 4 bits, soit quatre DGX Spark en grappe.

Prix : 88 000 € HT constatés chez pi3g le 14 septembre 2026.

Ce qui tient, tâche par tâcheEstimation

Pour chaque tâche, le mieux noté parmi les modèles ouverts qui tiennent dans 252 Go utiles, et la version la plus complète qui y entre. La même règle que Trouver mon modèle.

TâcheModèleScoreVersion qui tientFace au meilleur en ligne
GénéralGLM-5.3-Flash84,7allégée à 4 bits, 220,8 Go16 points sous GPT-6.1 Sol
CodeGLM-5.3-Flash88,9allégée à 4 bits, 220,8 Go11 points sous Claude Opus 5.5
RaisonnementInkling-Small82,4allégée à 4 bits, 190,4 Go21,1 points sous GPT-6 Astra
AgentsGLM-5.3-Flash provisoire88,9allégée à 4 bits, 220,8 Go12 points sous Claude Sonnet 5.5
UsageGLM-5.3-Flash85,5allégée à 4 bits, 220,8 Go12 points sous Gemini 4 Argon (ex æquo)
FrançaisGLM-5.3-Flash86,3allégée à 4 bits, 220,8 Go22,2 points sous Claude Opus 5.5
ÉcritureGLM-5.3-Flash84,5allégée à 4 bits, 220,8 Go16,4 points sous Claude Opus 5.5
MathsGLM-5.3-Flash83,2allégée à 4 bits, 220,8 Go18,8 points sous GPT-6 Astra
SciencesMiMo-V2.6-Flash provisoire · classé : GLM-5.3-Flash (82,6)84,5allégée à 4 bits, 213,2 Go12,5 points sous GPT-5.6 Sol (ex æquo)
VisionGLM-5.3-Flash provisoire86,3allégée à 4 bits, 220,8 Go13,8 points sous Claude Opus 5.5
WebGLM-5.3-Flash91,0allégée à 4 bits, 220,8 Go12,5 points sous Claude Opus 5.5 (ex æquo)

Les mieux notés qui y tiennentScore général

  1. 1GLM-5.3-Flashallégée à 4 bits, 220,8 Go84,7
  2. 2DeepSeek-V4-Flashallégée à 4 bits, 196 Go82,6
  3. 3Qwen 3.8 27Bcomplète, 62,1 Go82,4
  4. 4MiMo-V2.6-Flashallégée à 4 bits, 213,2 Go80,6
  5. 5Inkling-Smallallégée à 4 bits, 190,4 Go79,8
  6. 6Qwen3.6 27Bcomplète, 63,9 Go75,6
  7. 7MiniMax-M2.7allégée à 4 bits, 158,7 Go75,1
  8. 8Gemma 4 31B ITcomplète, 71,3 Go74,8

La barre montre la mémoire que demande la version qui tient ; le pointillé, les 252 Go utiles de la machine.

Pour faire mieux

DeepSeek V4.1 Flash, mieux noté (87,3, dans la marge d’erreur), demande 380,9 Go en version allégée à 4 bits : 128,9 Go de trop pour une DGX Station. Il tient à partir de quatre DGX Spark en grappe (4 DGX Spark, 512 Go).

La machine

Mémoire
748 Go en tout : 252 Go de processeur graphique et 496 Go de processeur
Mémoire utile
252 Go Publié par le fabricantles 252 Go de mémoire du processeur graphique. La DGX Station affiche 748 Go, mais en deux mémoires : 252 Go de HBM3e à 7,1 To/s pour le processeur graphique, 496 Go de LPDDR5X à 396 Go/s pour le processeur. On ne compte que la première : un modèle plus gros tourne, en débordant sur une mémoire dix-huit fois plus lente.748 Go affichés, dont 252 Go de mémoire de processeur graphique : seuls ceux-là comptent ici.
Débit mémoire publié
Non relevé
Calcul
jusqu'à 20 pétaflops en FP4
Sortie
Non relevée
Prix conseillé
Non relevé
Prix constaté
88 000 € HTpi3g, 14 septembre 2026 : Supermicro Super AI Station GB300 chez le revendeur allemand pi3g, prix indicatif hors taxes et hors livraison, délai de 8 à 16 semaines. pi3g.com.
Machines qui l’embarquent
ASUS, Dell, Exxact, Gigabyte, HP, MSI, Supermicro
À savoir
Puce GB300. Les 748 Go se composent de 252 Go de HBM3e à 7,1 To/s côté processeur graphique et de 496 Go de LPDDR5X à 396 Go/s côté processeur, reliés à 900 Go/s : un seul chiffre de débit serait trompeur, le champ reste vide. Nvidia ne publie pas de prix et vend par ses partenaires, sur devis ; aux États-Unis, Exxact en affichait une à 94 930 $ le 23 août 2026 (relevé de Tom's Hardware). Deux stations peuvent être reliées, sans mémoire totale publiée.

Mis en avant par le fabricantDéclaré

Ce que le fabricant écrit sur une page publique. Ce n'est pas notre calcul : le modèle qu'il cite peut demander une version plus compressée que la nôtre.

Ses voisines

Toutes les machines de ce palier · Quelle IA faire tourner sur son ordinateur