# Quelle IA faire tourner sur une GeForce RTX 5090 ?

> Une GeForce RTX 5090 : 30 Go de mémoire utile, le meilleur modèle qui y tient (Qwen 3.8 27B, 82,4), le meilleur par tâche, les prix datés et les machines voisines. Édition du 28 septembre 2026.

Page : https://quelleia.com/local/geforce-rtx-5090/

## En bref

Sur une GeForce RTX 5090, nous comptons 30 Go de mémoire utile (mémoire vidéo moins 2 Go). Le modèle le mieux noté qui y tient, au score général de l'édition du 28 septembre 2026, est Qwen 3.8 27B, avec 82,4, en version allégée à 4 bits (18,6 Go).
Pour faire mieux au score général, il faut viser plus grand : DeepSeek-V4-Flash (82,6, dans la marge d'erreur) demande 196 Go en version allégée à 4 bits, soit deux DGX Spark en grappe.
Prix : 2 099 € au prix du fabricant (nvidia.com, 30 septembre 2026) et 6 799,95 € constatés chez LDLC le 30 septembre 2026.

## La machine

- Famille : Cartes graphiques (GeForce RTX série 50)
- Mémoire : 32 Go GDDR7
- Mémoire utile : 30 Go (mémoire vidéo moins 2 Go, marge de prudence)
- Débit mémoire publié : non relevé
- État : En vente
- Prix du fabricant : 2 099 €, prix conseillé affiché par Nvidia France (« MSRP 2.099 € ») ; Nvidia ne dit pas s'il est toutes taxes comprises, 30 septembre 2026 (https://www.nvidia.com/content/dam/en-zz/Solutions/geforce/ada/pricejsmodule/pricelist.js)
- Prix constaté : 6 799,95 €, LDLC, 30 septembre 2026 (https://www.ldlc.com/recherche/geforce%20rtx%205090/)

## Ce qui tient, tâche par tâche

| Tâche | Modèle | Score | Version qui tient |
| --- | --- | ---: | --- |
| Général | [Qwen 3.8 27B](https://quelleia.com/modeles/qwen-3-8-27b/) | 82,4 | allégée à 4 bits, 18,6 Go |
| Code | [Qwen 3.8 27B](https://quelleia.com/modeles/qwen-3-8-27b/) (provisoire) | 81,1 | allégée à 4 bits, 18,6 Go |
| Raisonnement | [Qwen 3.8 27B](https://quelleia.com/modeles/qwen-3-8-27b/) (provisoire) | 81,6 | allégée à 4 bits, 18,6 Go |
| Agents | [Phi-4](https://quelleia.com/modeles/phi-4/) (provisoire) | 40,3 | allégée à 8 bits, 16,9 Go |
| Usage | [Qwen 3.8 27B](https://quelleia.com/modeles/qwen-3-8-27b/) | 80,6 | allégée à 4 bits, 18,6 Go |
| Français | [Gemma 4 31B IT](https://quelleia.com/modeles/gemma-4-31b-it/) | 78,7 | allégée à 4 bits, 21,4 Go |
| Écriture | [Gemma 4 31B IT](https://quelleia.com/modeles/gemma-4-31b-it/) | 77,7 | allégée à 4 bits, 21,4 Go |
| Maths | [Qwen 3.8 27B](https://quelleia.com/modeles/qwen-3-8-27b/) (provisoire) | 81,6 | allégée à 4 bits, 18,6 Go |
| Sciences | [Qwen 3.8 27B](https://quelleia.com/modeles/qwen-3-8-27b/) | 79,2 | allégée à 4 bits, 18,6 Go |
| Vision | [Qwen 3.8 27B](https://quelleia.com/modeles/qwen-3-8-27b/) (provisoire) | 81,1 | allégée à 4 bits, 18,6 Go |
| Web | [Qwen 3.8 27B](https://quelleia.com/modeles/qwen-3-8-27b/) | 89,2 | allégée à 4 bits, 18,6 Go |

## Les mieux notés qui y tiennent

1. [Qwen 3.8 27B](https://quelleia.com/modeles/qwen-3-8-27b/) : 82,4, version allégée à 4 bits (18,6 Go)
2. [Qwen3.6 27B](https://quelleia.com/modeles/qwen3-6-27b/) : 75,6, version allégée à 4 bits (19,2 Go)
3. [Gemma 4 31B IT](https://quelleia.com/modeles/gemma-4-31b-it/) : 74,8, version allégée à 4 bits (21,4 Go)
4. [Muse Glimmer 30B](https://quelleia.com/modeles/muse-glimmer-30b/) : 73,8, version allégée à 4 bits (20,7 Go)
5. [Gemma 4 26B A4B](https://quelleia.com/modeles/gemma-4-26b-a4b/) : 72,7, version allégée à 4 bits (17,9 Go)
6. [Qwen3.5-35B-A3B](https://quelleia.com/modeles/qwen3-5-35b-a3b/) : 68,8, version allégée à 4 bits (24,1 Go)
7. [Voxtral Small](https://quelleia.com/modeles/voxtral-small/) : 68,8, version allégée à 8 bits (29 Go)
8. [Qwen3.5-9B](https://quelleia.com/modeles/qwen3-5-9b/) : 65,7, version complète (22,2 Go)

## Pour faire mieux

DeepSeek-V4-Flash (82,6) demande 196 Go en version allégée à 4 bits : il faut deux DGX Spark en grappe.

## Mis en avant par le fabricant

- Qwen3.8 27B : modèle « sized for a single GPU », montré sur cette carte en Q4_K_M avec llama.cpp (Nvidia, https://blogs.nvidia.com/blog/local-ai-open-source-models-agents-nemotron/, 11 août 2026)
- Nemotron 3.5 Lightning : cité pour les PC GeForce RTX, sans carte précisée (Nvidia, https://blogs.nvidia.com/blog/local-ai-ifa-next-gen-agents-nv-pair-rtx-spark/, 3 septembre 2026)
- Muse Glimmer : cité pour les PC GeForce RTX, sans carte précisée (Nvidia, https://blogs.nvidia.com/blog/local-ai-ifa-next-gen-agents-nv-pair-rtx-spark/, 3 septembre 2026)

## Repères de vitesse

- 205 jetons par seconde, GPT-OSS 20B en MXFP4, Ollama, décodage, une requête à la fois. Mesuré par un tiers, LMSYS, 13 octobre 2025. https://www.lmsys.org/blog/2025-10-13-nvidia-dgx-spark/
- 271,4 jetons par seconde, Llama 3.2 3B, Ollama (étiquette llama3.2:3b), débit de génération rapporté par Ollama, quantification non précisée. Mesuré par un tiers, un contributeur du dépôt de Jeff Geerling, 8 février 2025. https://github.com/geerlingguy/ai-benchmarks/pull/18
- 131 jetons par seconde, Qwen3.8 27B en Q4_K_M, llama.cpp, avec la prédiction de plusieurs jetons (MTP, n_max = 3), banc speedbench, Windows 11, pilote 610.43 ; 77 jetons par seconde sans la prédiction de plusieurs jetons. Déclaré par Nvidia, Nvidia, 11 août 2026. https://blogs.nvidia.com/blog/local-ai-open-source-models-agents-nemotron/

## Ses voisines

- Le palier du dessous : [Intel Arc Pro B60](https://quelleia.com/local/intel-arc-pro-b60/), Carte graphique 24 Go
- Le palier du dessus : [Radeon PRO W7900](https://quelleia.com/local/radeon-pro-w7900/), Carte graphique 48 Go
- Même mémoire, autre famille : [Samsung Galaxy Book6 Pro 16 pouces, 32 Go](https://quelleia.com/local/samsung-galaxy-book6-pro-16/), PC portable Intel Core Ultra 32 Go
- Même mémoire, autre famille : [Mac mini M6, 32 Go](https://quelleia.com/local/mac-mini-m6-32go/), Mac 32 Go
- Même mémoire, autre famille : [Ryzen AI Max 385, 32 Go](https://quelleia.com/local/ryzen-ai-max-385-32go/), Ryzen AI Max 32 Go

Sources : https://www.nvidia.com/fr-fr/geforce/graphics-cards/50-series/rtx-5090/, https://www.nvidia.com/content/dam/en-zz/Solutions/geforce/ada/pricejsmodule/pricelist.js, https://nvidianews.nvidia.com/news/nvidia-blackwell-geforce-rtx-50-series-opens-new-world-of-ai-computer-graphics, https://blogs.nvidia.com/blog/local-ai-open-source-models-agents-nemotron/, https://blogs.nvidia.com/blog/local-ai-ifa-next-gen-agents-nv-pair-rtx-spark/, https://www.ldlc.com/recherche/geforce%20rtx%205090/. Relu le 30 septembre 2026.
