Aller au contenu
EN 4 QUESTIONSTrouver mon modèle
Sur ma machine · Cartes graphiques

Quelle IA faire tourner sur une GeForce RTX 5090 ?

GeForce RTX série 5032 Go GDDR730 Go utiles

En bref

Sur une GeForce RTX 5090, nous comptons 30 Go de mémoire utile (mémoire vidéo moins 2 Go). Le modèle le mieux noté qui y tient, au score général de l'édition du 28 septembre 2026, est Qwen 3.8 27B, avec 82,4, en version allégée à 4 bits (18,6 Go).

Pour faire mieux au score général, il faut viser plus grand : DeepSeek-V4-Flash (82,6, dans la marge d'erreur) demande 196 Go en version allégée à 4 bits, soit deux DGX Spark en grappe.

Prix : 2 099 € au prix du fabricant (nvidia.com, 30 septembre 2026) et 6 799,95 € constatés chez LDLC le 30 septembre 2026.

Ce qui tient, tâche par tâcheEstimation

Pour chaque tâche, le mieux noté parmi les modèles ouverts qui tiennent dans 30 Go utiles, et la version la plus complète qui y entre. La même règle que Trouver mon modèle.

TâcheModèleScoreVersion qui tientFace au meilleur en ligne
GénéralQwen 3.8 27B82,4allégée à 4 bits, 18,6 Go18,3 points sous GPT-6.1 Sol
CodeQwen 3.8 27B provisoire · classé : gpt-oss-20b (61,5)81,1allégée à 4 bits, 18,6 Go18,8 points sous Claude Opus 5.5
RaisonnementQwen 3.8 27B provisoire · classé : Qwen3.6 27B (74,0)81,6allégée à 4 bits, 18,6 Go21,9 points sous GPT-6 Astra
AgentsPhi-4 provisoire40,3allégée à 8 bits, 16,9 Go60,6 points sous Claude Sonnet 5.5
UsageQwen 3.8 27B80,6allégée à 4 bits, 18,6 Go16,9 points sous Gemini 4 Argon
FrançaisGemma 4 31B IT78,7allégée à 4 bits, 21,4 Go29,8 points sous Claude Opus 5.5
ÉcritureGemma 4 31B IT77,7allégée à 4 bits, 21,4 Go23,2 points sous Claude Opus 5.5
MathsQwen 3.8 27B provisoire81,6allégée à 4 bits, 18,6 Go20,4 points sous GPT-6 Astra
SciencesQwen 3.8 27B79,2allégée à 4 bits, 18,6 Go17,8 points sous GPT-5.6 Sol
VisionQwen 3.8 27B provisoire81,1allégée à 4 bits, 18,6 Go19 points sous Claude Opus 5.5
WebQwen 3.8 27B89,2allégée à 4 bits, 18,6 Go14,3 points sous Claude Opus 5.5

Les mieux notés qui y tiennentScore général

  1. 1Qwen 3.8 27Ballégée à 4 bits, 18,6 Go82,4
  2. 2Qwen3.6 27Ballégée à 4 bits, 19,2 Go75,6
  3. 3Gemma 4 31B ITallégée à 4 bits, 21,4 Go74,8
  4. 4Muse Glimmer 30Ballégée à 4 bits, 20,7 Go73,8
  5. 5Gemma 4 26B A4Ballégée à 4 bits, 17,9 Go72,7
  6. 6Qwen3.5-35B-A3Ballégée à 4 bits, 24,1 Go68,8
  7. 7Voxtral Smallallégée à 8 bits, 29 Go · provisoire68,8
  8. 8Qwen3.5-9Bcomplète, 22,2 Go65,7

La barre montre la mémoire que demande la version qui tient ; le pointillé, les 30 Go utiles de la machine.

Pour faire mieux

DeepSeek-V4-Flash, mieux noté (82,6, dans la marge d’erreur), demande 196 Go en version allégée à 4 bits : 166 Go de trop pour une GeForce RTX 5090. Il tient à partir de deux DGX Spark en grappe (2 DGX Spark, 256 Go).

La machine

Mémoire
32 Go de GDDR7
Mémoire utile
30 Go Marge de prudencemémoire vidéo moins 2 Go. La mémoire vidéo est la limite. Aucune marge n'est documentée pour l'affichage et le cache : les 2 Go retirés sont une marge de prudence, la même depuis la première édition (22 Go utiles sur 24).
Débit mémoire publié
Non relevé
Sortie
30 janvier 2025
Prix conseillé
2 099 €prix conseillé affiché par Nvidia France (« MSRP 2.099 € ») ; Nvidia ne dit pas s'il est toutes taxes comprises. nvidia.com, 30 septembre 2026.
Prix constaté
6 799,95 €LDLC, 30 septembre 2026 : carte neuve la moins chère en stock (ASUS ROG Astral LC). ldlc.com.
À savoir
Prix de lancement aux États-Unis : 1 999 $ (communiqué du 6 janvier 2025).

Mis en avant par le fabricantDéclaré

Ce que le fabricant écrit sur une page publique. Ce n'est pas notre calcul : le modèle qu'il cite peut demander une version plus compressée que la nôtre.

Repères de vitesse

  • Mesuré par un tiers205 jetons/sGPT-OSS 20B · MXFP4GeForce RTX 5090 Founders Edition. Ollama. Décodage, une requête à la fois.LMSYS, 13 octobre 2025 · lmsys.org · licence MIT
  • Mesuré par un tiers271,4 jetons/sLlama 3.2 3BGeForce RTX 5090, avec un processeur Intel 13900K. Ollama (étiquette llama3.2:3b). Débit de génération rapporté par Ollama, quantification non précisée.un contributeur du dépôt de Jeff Geerling, 8 février 2025 · github.com · licence MIT
  • Déclaré par Nvidia131 jetons/sQwen3.8 27B · Q4_K_MGeForce RTX 5090, avec un Intel Core Ultra 9 285K. llama.cpp, avec la prédiction de plusieurs jetons (MTP, n_max = 3). Banc speedbench, Windows 11, pilote 610.43 ; 77 jetons par seconde sans la prédiction de plusieurs jetons.Nvidia, 11 août 2026 · blogs.nvidia.com

Des repères, pas des comparaisons : modèle, moteur et conditions changent d'une ligne à l'autre. Comment les lire.

Ses voisines

Toutes les machines de ce palier · Quelle IA faire tourner sur son ordinateur