# Quelle IA faire tourner sur son ordinateur ?

> Quel modèle d'IA faire tourner chez soi selon sa machine : 64 cartes graphiques, PC portables, Mac, mini-PC Ryzen AI Max et DGX Spark, la mémoire utile de chacun et le meilleur modèle qui y tient, par tâche. Édition du 28 septembre 2026.

Page : https://quelleia.com/local/

## Comment on compte

- Poids d'un modèle : 0,6 Go par milliard de paramètres en version allégée, 4 bits, 1,05 Go par milliard de paramètres en version allégée, 8 bits, 2 Go par milliard de paramètres en version complète, 16 bits, fois 1,15 pour un contexte court.
- Mémoire utile, Cartes graphiques, PC portables GeForce RTX : mémoire vidéo moins 2 Go (marge de prudence). La mémoire vidéo est la limite. Aucune marge n'est documentée pour l'affichage et le cache : les 2 Go retirés sont une marge de prudence, la même depuis la première édition (22 Go utiles sur 24).
- Mémoire utile, Mac : 74 % de la mémoire unifiée (mesuré). Mesure maison : sur un Mac mini M6 de 24 Go sous macOS 27, Ollama voit 17,8 Gio utilisables par le processeur graphique (banc du 18 au 21 septembre 2026), soit 74 %. Apple ne publie pas cette part. macOS la donne par Metal (recommendedMaxWorkingSetSize), et llama.cpp comme MLX s'y tiennent.
- Mémoire utile, Mini-PC et PC portables Ryzen AI Max : le plafond publié par AMD : 96 Go sur 128, 160 Go sur 192 (publié par le fabricant). AMD publie la mémoire graphique maximale sous Windows : 96 Go sur une machine de 128 Go, 160 Go sur une machine de 192 Go. Pour 64 et 32 Go, AMD ne publie rien : on applique la même proportion, soit 48 et 24 Go, par prudence.
- Mémoire utile, DGX Spark : 87,5 % de la mémoire unifiée (marge de prudence). Le DGX Spark n'a pas de mémoire réservée au processeur graphique : les 128 Go servent aussi au système et au processeur, et Nvidia ne documente aucune part utile. On en garde un huitième pour le système, la règle déjà appliquée aux machines à mémoire unifiée depuis la première édition (112 Go utiles sur 128).
- Mémoire utile, DGX Station : les 252 Go de mémoire du processeur graphique (publié par le fabricant). La DGX Station affiche 748 Go, mais en deux mémoires : 252 Go de HBM3e à 7,1 To/s pour le processeur graphique, 496 Go de LPDDR5X à 396 Go/s pour le processeur. On ne compte que la première : un modèle plus gros tourne, en débordant sur une mémoire dix-huit fois plus lente.
- Mémoire utile, PC portables Intel Core Ultra : 57 % de la mémoire, la part qu'Intel donne par défaut au processeur graphique intégré (publié par le fabricant). Intel publie la part de la mémoire que le processeur graphique intégré d'un Core Ultra de série 2 ou plus récent peut prendre : « The default value is 57% ». Le réglage « Shared GPU Memory Override » d'Intel Graphics Software, sous Windows, la change, jusqu'à un maximum qu'Intel ne chiffre pas (« the maximum limit depends on the size of the system RAM »). Notre calcul garde le réglage d'origine.
- Mémoire utile, PC portables Snapdragon X2 : 11 Go, le compte d'un PC portable sans carte graphique (marge de prudence). Ni Qualcomm, ni la documentation de llama.cpp, de LM Studio ou de GenieX (l'outil de Qualcomm) ne disent quelle part de la mémoire le processeur graphique Adreno ou le NPU Hexagon d'un Snapdragon X2 peut prendre sous Windows. Microsoft écrivait en 2017 que Windows ne laisse un processeur graphique utiliser que la moitié de la mémoire physique (« only allowed to use half of physical memory at any given instant ») ; aucune page ne le confirme pour l'Adreno, et Intel donne 57 % pour les siens. Nous comptons donc comme sur un PC portable sans carte graphique, 11 Go, par prudence. Une mesure maison sur cette machine remplacera ce chiffre.
- Mémoire utile, Sans carte graphique : 11 Go sur 16 (marge de prudence). Gabarit sans machine précise : sur un PC de 16 Go sans carte graphique, le modèle tourne sur le processeur, dans la mémoire que lui laissent le système et les applications. On compte 11 Go, par prudence, comme depuis la première édition.
- Le facteur 1,15 vaut pour un contexte court. Ollama prend par défaut 4 000 jetons de contexte sous 24 Gio de mémoire vidéo, 32 000 entre 24 et 48 Gio et 256 000 au-delà : un agent qui travaille sur un long contexte demande plus de mémoire que notre estimation.

## L'escalier au score général

Sept marches, d'une carte graphique de 8 Go à quatre DGX Spark en grappe : de Qwen3.5-4B (63,1) à DeepSeek V4.1 Flash (87,3).

| Marche | Mémoire utile | Le mieux noté qui tient | Score | Gain | Paliers |
| --- | --- | --- | ---: | ---: | --- |
| 1 | 6 Go | [Qwen3.5-4B](https://quelleia.com/modeles/qwen3-5-4b/) (provisoire) | 63,1 |  | Carte graphique 8 Go (allégée à 8 bits), PC portable GeForce RTX 8 Go (allégée à 8 bits) |
| 2 | de 8 Go à 14 Go | [Qwen3.5-9B](https://quelleia.com/modeles/qwen3-5-9b/) | 65,7 | +2,6 (ex æquo) | Carte graphique 10 Go (allégée à 4 bits), Carte graphique 12 Go (allégée à 4 bits), PC portable GeForce RTX 12 Go (allégée à 4 bits), PC portable 16 Go (allégée à 4 bits), PC portable Snapdragon X2 48 Go (allégée à 4 bits), Mac 16 Go (allégée à 8 bits), Carte graphique 16 Go (allégée à 8 bits), PC portable GeForce RTX 16 Go (allégée à 8 bits) |
| 3 | 17,8 Go | [Voxtral Small](https://quelleia.com/modeles/voxtral-small/) (provisoire) | 68,8 | +3,1 (ex æquo) | Mac 24 Go (allégée à 4 bits) |
| 4 | 18,2 Go | [Gemma 4 26B A4B](https://quelleia.com/modeles/gemma-4-26b-a4b/) | 72,7 | +3,9 (ex æquo) | PC portable Intel Core Ultra 32 Go (allégée à 4 bits) |
| 5 | de 22 Go à 189,4 Go | [Qwen 3.8 27B](https://quelleia.com/modeles/qwen-3-8-27b/) | 82,4 | +9,7 | Carte graphique 24 Go (allégée à 4 bits), PC portable GeForce RTX 24 Go (allégée à 4 bits), Mac 32 Go (allégée à 4 bits), Ryzen AI Max 32 Go (allégée à 4 bits), Mac 36 Go (allégée à 4 bits), Carte graphique 32 Go (allégée à 4 bits), Mac 48 Go (allégée à 8 bits), Carte graphique 48 Go (allégée à 8 bits), Mac 64 Go (allégée à 8 bits), Ryzen AI Max 64 Go (allégée à 8 bits), Mac 96 Go (complète), Carte graphique 96 Go (complète), Mac 128 Go (complète), Ryzen AI Max 128 Go (complète), DGX Spark 128 Go (complète), Ryzen AI Max 192 Go (complète), Mac 256 Go (complète) |
| 6 | de 224 Go à 378,9 Go | [GLM-5.3-Flash](https://quelleia.com/modeles/glm-5-3-flash/) | 84,7 | +2,3 (ex æquo) | 2 DGX Spark, 256 Go (allégée à 4 bits), DGX Station (allégée à 4 bits), Mac 512 Go (allégée à 4 bits) |
| 7 | 448 Go | [DeepSeek V4.1 Flash](https://quelleia.com/modeles/deepseek-v4-1-flash/) | 87,3 | +2,6 (ex æquo) | 4 DGX Spark, 512 Go (allégée à 4 bits) |

Le mieux noté en ligne : [GPT-6.1 Sol](https://quelleia.com/modeles/gpt-6-1-sol/) (100,7).

## L'escalier en code

Six marches, d'une carte graphique de 8 Go à quatre DGX Spark en grappe : de Qwen3-8B (52,9) à GLM-5.3-Flash (88,9).

| Marche | Mémoire utile | Le mieux noté qui tient | Score | Gain | Paliers |
| --- | --- | --- | ---: | ---: | --- |
| 1 | 6 Go | [Qwen3-8B](https://quelleia.com/modeles/qwen3-8b/) (provisoire) | 52,9 |  | Carte graphique 8 Go (allégée à 4 bits), PC portable GeForce RTX 8 Go (allégée à 4 bits) |
| 2 | de 8 Go à 10 Go | [Qwen3.5-9B](https://quelleia.com/modeles/qwen3-5-9b/) (provisoire) | 59,9 | +7 (ex æquo) | Carte graphique 10 Go (allégée à 4 bits), Carte graphique 12 Go (allégée à 4 bits), PC portable GeForce RTX 12 Go (allégée à 4 bits) |
| 3 | de 11 Go à 17,8 Go | [Qwen3-14B](https://quelleia.com/modeles/qwen3-14b/) (provisoire) | 61,8 | +1,9 (ex æquo) | PC portable 16 Go (allégée à 4 bits), PC portable Snapdragon X2 48 Go (allégée à 4 bits), Mac 16 Go (allégée à 4 bits), Carte graphique 16 Go (allégée à 4 bits), PC portable GeForce RTX 16 Go (allégée à 4 bits), Mac 24 Go (allégée à 8 bits) |
| 4 | 18,2 Go | [Gemma 4 26B A4B](https://quelleia.com/modeles/gemma-4-26b-a4b/) (provisoire) | 68,3 | +6,5 (ex æquo) | PC portable Intel Core Ultra 32 Go (allégée à 4 bits) |
| 5 | de 22 Go à 189,4 Go | [Qwen 3.8 27B](https://quelleia.com/modeles/qwen-3-8-27b/) (provisoire) | 81,1 | +12,8 (ex æquo) | Carte graphique 24 Go (allégée à 4 bits), PC portable GeForce RTX 24 Go (allégée à 4 bits), Mac 32 Go (allégée à 4 bits), Ryzen AI Max 32 Go (allégée à 4 bits), Mac 36 Go (allégée à 4 bits), Carte graphique 32 Go (allégée à 4 bits), Mac 48 Go (allégée à 8 bits), Carte graphique 48 Go (allégée à 8 bits), Mac 64 Go (allégée à 8 bits), Ryzen AI Max 64 Go (allégée à 8 bits), Mac 96 Go (complète), Carte graphique 96 Go (complète), Mac 128 Go (complète), Ryzen AI Max 128 Go (complète), DGX Spark 128 Go (complète), Ryzen AI Max 192 Go (complète), Mac 256 Go (complète) |
| 6 | de 224 Go à 448 Go | [GLM-5.3-Flash](https://quelleia.com/modeles/glm-5-3-flash/) | 88,9 | +7,8 (ex æquo) | 2 DGX Spark, 256 Go (allégée à 4 bits), DGX Station (allégée à 4 bits), Mac 512 Go (allégée à 4 bits), 4 DGX Spark, 512 Go (allégée à 8 bits) |

Le mieux noté en ligne : [Claude Opus 5.5](https://quelleia.com/modeles/claude-opus-5-5/) (99,9).

## L'escalier en raisonnement

Six marches, d'une carte graphique de 8 Go à quatre DGX Spark en grappe : de Qwen3-4B (53,4) à DeepSeek V4.1 Flash (85,5).

| Marche | Mémoire utile | Le mieux noté qui tient | Score | Gain | Paliers |
| --- | --- | --- | ---: | ---: | --- |
| 1 | 6 Go | [Qwen3-4B](https://quelleia.com/modeles/qwen3-4b/) (provisoire) | 53,4 |  | Carte graphique 8 Go (allégée à 8 bits), PC portable GeForce RTX 8 Go (allégée à 8 bits) |
| 2 | de 8 Go à 17,8 Go | [Qwen3.5-9B](https://quelleia.com/modeles/qwen3-5-9b/) (provisoire) | 64,9 | +11,5 | Carte graphique 10 Go (allégée à 4 bits), Carte graphique 12 Go (allégée à 4 bits), PC portable GeForce RTX 12 Go (allégée à 4 bits), PC portable 16 Go (allégée à 4 bits), PC portable Snapdragon X2 48 Go (allégée à 4 bits), Mac 16 Go (allégée à 8 bits), Carte graphique 16 Go (allégée à 8 bits), PC portable GeForce RTX 16 Go (allégée à 8 bits), Mac 24 Go (allégée à 8 bits) |
| 3 | 18,2 Go | [Gemma 4 26B A4B](https://quelleia.com/modeles/gemma-4-26b-a4b/) (provisoire) | 68,3 | +3,4 (ex æquo) | PC portable Intel Core Ultra 32 Go (allégée à 4 bits) |
| 4 | de 22 Go à 189,4 Go | [Qwen 3.8 27B](https://quelleia.com/modeles/qwen-3-8-27b/) (provisoire) | 81,6 | +13,3 | Carte graphique 24 Go (allégée à 4 bits), PC portable GeForce RTX 24 Go (allégée à 4 bits), Mac 32 Go (allégée à 4 bits), Ryzen AI Max 32 Go (allégée à 4 bits), Mac 36 Go (allégée à 4 bits), Carte graphique 32 Go (allégée à 4 bits), Mac 48 Go (allégée à 8 bits), Carte graphique 48 Go (allégée à 8 bits), Mac 64 Go (allégée à 8 bits), Ryzen AI Max 64 Go (allégée à 8 bits), Mac 96 Go (complète), Carte graphique 96 Go (complète), Mac 128 Go (complète), Ryzen AI Max 128 Go (complète), DGX Spark 128 Go (complète), Ryzen AI Max 192 Go (complète), Mac 256 Go (complète) |
| 5 | de 224 Go à 378,9 Go | [Inkling-Small](https://quelleia.com/modeles/inkling-small/) | 82,4 | +0,8 (ex æquo) | 2 DGX Spark, 256 Go (allégée à 4 bits), DGX Station (allégée à 4 bits), Mac 512 Go (allégée à 8 bits) |
| 6 | 448 Go | [DeepSeek V4.1 Flash](https://quelleia.com/modeles/deepseek-v4-1-flash/) (provisoire) | 85,5 | +3,1 (ex æquo) | 4 DGX Spark, 512 Go (allégée à 4 bits) |

Le mieux noté en ligne : [GPT-6 Astra](https://quelleia.com/modeles/gpt-6-astra/) (103,5).

## L'escalier pour les agents

Six marches, d'une carte graphique de 8 Go à quatre DGX Spark en grappe : de Llama 3.1-8B (31,5) à GLM-5.3-Flash (88,9).

| Marche | Mémoire utile | Le mieux noté qui tient | Score | Gain | Paliers |
| --- | --- | --- | ---: | ---: | --- |
| 1 | de 6 Go à 8 Go | [Llama 3.1-8B](https://quelleia.com/modeles/llama-3-1-8b/) (provisoire) | 31,5 |  | Carte graphique 8 Go (allégée à 4 bits), PC portable GeForce RTX 8 Go (allégée à 4 bits), Carte graphique 10 Go (allégée à 4 bits) |
| 2 | de 10 Go à 48 Go | [Phi-4](https://quelleia.com/modeles/phi-4/) (provisoire) | 40,3 | +8,8 (ex æquo) | Carte graphique 12 Go (allégée à 4 bits), PC portable GeForce RTX 12 Go (allégée à 4 bits), PC portable 16 Go (allégée à 4 bits), PC portable Snapdragon X2 48 Go (allégée à 4 bits), Mac 16 Go (allégée à 4 bits), Carte graphique 16 Go (allégée à 4 bits), PC portable GeForce RTX 16 Go (allégée à 4 bits), Mac 24 Go (allégée à 8 bits), PC portable Intel Core Ultra 32 Go (allégée à 8 bits), Carte graphique 24 Go (allégée à 8 bits), PC portable GeForce RTX 24 Go (allégée à 8 bits), Mac 32 Go (allégée à 8 bits), Ryzen AI Max 32 Go (allégée à 8 bits), Mac 36 Go (allégée à 8 bits), Carte graphique 32 Go (allégée à 8 bits), Mac 48 Go (complète), Carte graphique 48 Go (complète), Mac 64 Go (complète), Ryzen AI Max 64 Go (complète) |
| 3 | 71 Go | [Llama 3.1-70B](https://quelleia.com/modeles/llama-3-1-70b/) (provisoire) | 53,7 | +13,4 (ex æquo) | Mac 96 Go (allégée à 4 bits) |
| 4 | de 94 Go à 112 Go | [gpt-oss-120b](https://quelleia.com/modeles/gpt-oss-120b/) (provisoire) | 57,6 | +3,9 (ex æquo) | Carte graphique 96 Go (allégée à 4 bits), Mac 128 Go (allégée à 4 bits), Ryzen AI Max 128 Go (allégée à 4 bits), DGX Spark 128 Go (allégée à 4 bits) |
| 5 | de 160 Go à 189,4 Go | [MiniMax-M2](https://quelleia.com/modeles/minimax-m2/) (provisoire) | 71,9 | +14,3 (ex æquo) | Ryzen AI Max 192 Go (allégée à 4 bits), Mac 256 Go (allégée à 4 bits) |
| 6 | de 224 Go à 448 Go | [GLM-5.3-Flash](https://quelleia.com/modeles/glm-5-3-flash/) (provisoire) | 88,9 | +17 | 2 DGX Spark, 256 Go (allégée à 4 bits), DGX Station (allégée à 4 bits), Mac 512 Go (allégée à 4 bits), 4 DGX Spark, 512 Go (allégée à 8 bits) |

Le mieux noté en ligne : [Claude Sonnet 5.5](https://quelleia.com/modeles/claude-sonnet-5-5/) (100,9).

## L'escalier en usage courant

Sept marches, d'une carte graphique de 8 Go à quatre DGX Spark en grappe : de Molmo 2 8B (51,3) à DeepSeek V4.1 Flash (86,8).

| Marche | Mémoire utile | Le mieux noté qui tient | Score | Gain | Paliers |
| --- | --- | --- | ---: | ---: | --- |
| 1 | de 6 Go à 8 Go | [Molmo 2 8B](https://quelleia.com/modeles/molmo-2-8b/) | 51,3 |  | Carte graphique 8 Go (allégée à 4 bits), PC portable GeForce RTX 8 Go (allégée à 4 bits), Carte graphique 10 Go (allégée à 4 bits) |
| 2 | de 10 Go à 14 Go | [Gemma 3 12B](https://quelleia.com/modeles/gemma-3-12b/) | 51,8 | +0,5 (ex æquo) | Carte graphique 12 Go (allégée à 4 bits), PC portable GeForce RTX 12 Go (allégée à 4 bits), PC portable 16 Go (allégée à 4 bits), PC portable Snapdragon X2 48 Go (allégée à 4 bits), Mac 16 Go (allégée à 4 bits), Carte graphique 16 Go (allégée à 4 bits), PC portable GeForce RTX 16 Go (allégée à 4 bits) |
| 3 | 17,8 Go | [Mistral Small 3.2](https://quelleia.com/modeles/mistral-small-3-2/) | 57,6 | +5,8 (ex æquo) | Mac 24 Go (allégée à 4 bits) |
| 4 | 18,2 Go | [Gemma 4 26B A4B](https://quelleia.com/modeles/gemma-4-26b-a4b/) | 75,1 | +17,5 | PC portable Intel Core Ultra 32 Go (allégée à 4 bits) |
| 5 | de 22 Go à 189,4 Go | [Qwen 3.8 27B](https://quelleia.com/modeles/qwen-3-8-27b/) | 80,6 | +5,5 (ex æquo) | Carte graphique 24 Go (allégée à 4 bits), PC portable GeForce RTX 24 Go (allégée à 4 bits), Mac 32 Go (allégée à 4 bits), Ryzen AI Max 32 Go (allégée à 4 bits), Mac 36 Go (allégée à 4 bits), Carte graphique 32 Go (allégée à 4 bits), Mac 48 Go (allégée à 8 bits), Carte graphique 48 Go (allégée à 8 bits), Mac 64 Go (allégée à 8 bits), Ryzen AI Max 64 Go (allégée à 8 bits), Mac 96 Go (complète), Carte graphique 96 Go (complète), Mac 128 Go (complète), Ryzen AI Max 128 Go (complète), DGX Spark 128 Go (complète), Ryzen AI Max 192 Go (complète), Mac 256 Go (complète) |
| 6 | de 224 Go à 378,9 Go | [GLM-5.3-Flash](https://quelleia.com/modeles/glm-5-3-flash/) | 85,5 | +4,9 (ex æquo) | 2 DGX Spark, 256 Go (allégée à 4 bits), DGX Station (allégée à 4 bits), Mac 512 Go (allégée à 4 bits) |
| 7 | 448 Go | [DeepSeek V4.1 Flash](https://quelleia.com/modeles/deepseek-v4-1-flash/) | 86,8 | +1,3 (ex æquo) | 4 DGX Spark, 512 Go (allégée à 4 bits) |

Le mieux noté en ligne : [Gemini 4 Argon](https://quelleia.com/modeles/gemini-4-argon/) (97,5).

## L'escalier en français

Six marches, d'une carte graphique de 8 Go à quatre DGX Spark en grappe : de LFM 2 8B A1B (62,8) à GLM-5.3-Flash (86,3).

| Marche | Mémoire utile | Le mieux noté qui tient | Score | Gain | Paliers |
| --- | --- | --- | ---: | ---: | --- |
| 1 | de 6 Go à 8 Go | [LFM 2 8B A1B](https://quelleia.com/modeles/lfm-2-8b-a1b/) (provisoire) | 62,8 |  | Carte graphique 8 Go (allégée à 4 bits), PC portable GeForce RTX 8 Go (allégée à 4 bits), Carte graphique 10 Go (allégée à 4 bits) |
| 2 | de 10 Go à 14 Go | [Ministral 3 14B](https://quelleia.com/modeles/ministral-3-14b/) | 64,6 | +1,8 (ex æquo) | Carte graphique 12 Go (allégée à 4 bits), PC portable GeForce RTX 12 Go (allégée à 4 bits), PC portable 16 Go (allégée à 4 bits), PC portable Snapdragon X2 48 Go (allégée à 4 bits), Mac 16 Go (allégée à 4 bits), Carte graphique 16 Go (allégée à 4 bits), PC portable GeForce RTX 16 Go (allégée à 4 bits) |
| 3 | 17,8 Go | [Voxtral Small](https://quelleia.com/modeles/voxtral-small/) | 69,1 | +4,5 (ex æquo) | Mac 24 Go (allégée à 4 bits) |
| 4 | 18,2 Go | [Gemma 4 26B A4B](https://quelleia.com/modeles/gemma-4-26b-a4b/) | 76,6 | +7,5 (ex æquo) | PC portable Intel Core Ultra 32 Go (allégée à 4 bits) |
| 5 | de 22 Go à 189,4 Go | [Gemma 4 31B IT](https://quelleia.com/modeles/gemma-4-31b-it/) | 78,7 | +2,1 (ex æquo) | Carte graphique 24 Go (allégée à 4 bits), PC portable GeForce RTX 24 Go (allégée à 4 bits), Mac 32 Go (allégée à 4 bits), Ryzen AI Max 32 Go (allégée à 4 bits), Mac 36 Go (allégée à 4 bits), Carte graphique 32 Go (allégée à 4 bits), Mac 48 Go (allégée à 4 bits), Carte graphique 48 Go (allégée à 8 bits), Mac 64 Go (allégée à 8 bits), Ryzen AI Max 64 Go (allégée à 8 bits), Mac 96 Go (allégée à 8 bits), Carte graphique 96 Go (complète), Mac 128 Go (complète), Ryzen AI Max 128 Go (complète), DGX Spark 128 Go (complète), Ryzen AI Max 192 Go (complète), Mac 256 Go (complète) |
| 6 | de 224 Go à 448 Go | [GLM-5.3-Flash](https://quelleia.com/modeles/glm-5-3-flash/) | 86,3 | +7,6 (ex æquo) | 2 DGX Spark, 256 Go (allégée à 4 bits), DGX Station (allégée à 4 bits), Mac 512 Go (allégée à 4 bits), 4 DGX Spark, 512 Go (allégée à 8 bits) |

Le mieux noté en ligne : [Claude Opus 5.5](https://quelleia.com/modeles/claude-opus-5-5/) (108,5).

## L'escalier en écriture

Sept marches, d'une carte graphique de 8 Go à quatre DGX Spark en grappe : de Gemma 3n E4B (51,8) à DeepSeek V4.1 Flash (86,3).

| Marche | Mémoire utile | Le mieux noté qui tient | Score | Gain | Paliers |
| --- | --- | --- | ---: | ---: | --- |
| 1 | de 6 Go à 8 Go | [Gemma 3n E4B](https://quelleia.com/modeles/gemma-3n-e4b/) | 51,8 |  | Carte graphique 8 Go (allégée à 4 bits), PC portable GeForce RTX 8 Go (allégée à 4 bits), Carte graphique 10 Go (allégée à 4 bits) |
| 2 | de 10 Go à 14 Go | [Gemma 3 12B](https://quelleia.com/modeles/gemma-3-12b/) | 54,4 | +2,6 (ex æquo) | Carte graphique 12 Go (allégée à 4 bits), PC portable GeForce RTX 12 Go (allégée à 4 bits), PC portable 16 Go (allégée à 4 bits), PC portable Snapdragon X2 48 Go (allégée à 4 bits), Mac 16 Go (allégée à 4 bits), Carte graphique 16 Go (allégée à 4 bits), PC portable GeForce RTX 16 Go (allégée à 4 bits) |
| 3 | 17,8 Go | [Mistral Small 3.2](https://quelleia.com/modeles/mistral-small-3-2/) | 57,6 | +3,2 (ex æquo) | Mac 24 Go (allégée à 4 bits) |
| 4 | 18,2 Go | [Gemma 4 26B A4B](https://quelleia.com/modeles/gemma-4-26b-a4b/) | 74,5 | +16,9 | PC portable Intel Core Ultra 32 Go (allégée à 4 bits) |
| 5 | de 22 Go à 189,4 Go | [Gemma 4 31B IT](https://quelleia.com/modeles/gemma-4-31b-it/) | 77,7 | +3,2 (ex æquo) | Carte graphique 24 Go (allégée à 4 bits), PC portable GeForce RTX 24 Go (allégée à 4 bits), Mac 32 Go (allégée à 4 bits), Ryzen AI Max 32 Go (allégée à 4 bits), Mac 36 Go (allégée à 4 bits), Carte graphique 32 Go (allégée à 4 bits), Mac 48 Go (allégée à 4 bits), Carte graphique 48 Go (allégée à 8 bits), Mac 64 Go (allégée à 8 bits), Ryzen AI Max 64 Go (allégée à 8 bits), Mac 96 Go (allégée à 8 bits), Carte graphique 96 Go (complète), Mac 128 Go (complète), Ryzen AI Max 128 Go (complète), DGX Spark 128 Go (complète), Ryzen AI Max 192 Go (complète), Mac 256 Go (complète) |
| 6 | de 224 Go à 378,9 Go | [GLM-5.3-Flash](https://quelleia.com/modeles/glm-5-3-flash/) | 84,5 | +6,8 (ex æquo) | 2 DGX Spark, 256 Go (allégée à 4 bits), DGX Station (allégée à 4 bits), Mac 512 Go (allégée à 4 bits) |
| 7 | 448 Go | [DeepSeek V4.1 Flash](https://quelleia.com/modeles/deepseek-v4-1-flash/) | 86,3 | +1,8 (ex æquo) | 4 DGX Spark, 512 Go (allégée à 4 bits) |

Le mieux noté en ligne : [Claude Opus 5.5](https://quelleia.com/modeles/claude-opus-5-5/) (100,9).

## L'escalier en maths

Sept marches, d'une carte graphique de 8 Go à quatre DGX Spark en grappe : de Qwen3.5-4B (63,8) à DeepSeek V4.1 Flash (88,6).

| Marche | Mémoire utile | Le mieux noté qui tient | Score | Gain | Paliers |
| --- | --- | --- | ---: | ---: | --- |
| 1 | 6 Go | [Qwen3.5-4B](https://quelleia.com/modeles/qwen3-5-4b/) (provisoire) | 63,8 |  | Carte graphique 8 Go (allégée à 8 bits), PC portable GeForce RTX 8 Go (allégée à 8 bits) |
| 2 | de 8 Go à 10 Go | [Qwen3.5-9B](https://quelleia.com/modeles/qwen3-5-9b/) (provisoire) | 65,7 | +1,9 (ex æquo) | Carte graphique 10 Go (allégée à 4 bits), Carte graphique 12 Go (allégée à 4 bits), PC portable GeForce RTX 12 Go (allégée à 4 bits) |
| 3 | de 11 Go à 17,8 Go | [Qwen3-14B](https://quelleia.com/modeles/qwen3-14b/) (provisoire) | 67,0 | +1,3 (ex æquo) | PC portable 16 Go (allégée à 4 bits), PC portable Snapdragon X2 48 Go (allégée à 4 bits), Mac 16 Go (allégée à 4 bits), Carte graphique 16 Go (allégée à 4 bits), PC portable GeForce RTX 16 Go (allégée à 4 bits), Mac 24 Go (allégée à 8 bits) |
| 4 | 18,2 Go | [Gemma 4 26B A4B](https://quelleia.com/modeles/gemma-4-26b-a4b/) (provisoire) | 73,8 | +6,8 (ex æquo) | PC portable Intel Core Ultra 32 Go (allégée à 4 bits) |
| 5 | de 22 Go à 189,4 Go | [Qwen 3.8 27B](https://quelleia.com/modeles/qwen-3-8-27b/) (provisoire) | 81,6 | +7,8 (ex æquo) | Carte graphique 24 Go (allégée à 4 bits), PC portable GeForce RTX 24 Go (allégée à 4 bits), Mac 32 Go (allégée à 4 bits), Ryzen AI Max 32 Go (allégée à 4 bits), Mac 36 Go (allégée à 4 bits), Carte graphique 32 Go (allégée à 4 bits), Mac 48 Go (allégée à 8 bits), Carte graphique 48 Go (allégée à 8 bits), Mac 64 Go (allégée à 8 bits), Ryzen AI Max 64 Go (allégée à 8 bits), Mac 96 Go (complète), Carte graphique 96 Go (complète), Mac 128 Go (complète), Ryzen AI Max 128 Go (complète), DGX Spark 128 Go (complète), Ryzen AI Max 192 Go (complète), Mac 256 Go (complète) |
| 6 | de 224 Go à 378,9 Go | [GLM-5.3-Flash](https://quelleia.com/modeles/glm-5-3-flash/) | 83,2 | +1,6 (ex æquo) | 2 DGX Spark, 256 Go (allégée à 4 bits), DGX Station (allégée à 4 bits), Mac 512 Go (allégée à 4 bits) |
| 7 | 448 Go | [DeepSeek V4.1 Flash](https://quelleia.com/modeles/deepseek-v4-1-flash/) (provisoire) | 88,6 | +5,4 | 4 DGX Spark, 512 Go (allégée à 4 bits) |

Le mieux noté en ligne : [GPT-6 Astra](https://quelleia.com/modeles/gpt-6-astra/) (102,0).

## L'escalier en sciences

Quatre marches, d'une carte graphique de 8 Go à quatre DGX Spark en grappe : de Qwen3-8B (57,3) à MiMo-V2.6-Flash (84,5).

| Marche | Mémoire utile | Le mieux noté qui tient | Score | Gain | Paliers |
| --- | --- | --- | ---: | ---: | --- |
| 1 | 6 Go | [Qwen3-8B](https://quelleia.com/modeles/qwen3-8b/) (provisoire) | 57,3 |  | Carte graphique 8 Go (allégée à 4 bits), PC portable GeForce RTX 8 Go (allégée à 4 bits) |
| 2 | de 8 Go à 18,2 Go | [Qwen3.5-9B](https://quelleia.com/modeles/qwen3-5-9b/) (provisoire) | 70,9 | +13,6 | Carte graphique 10 Go (allégée à 4 bits), Carte graphique 12 Go (allégée à 4 bits), PC portable GeForce RTX 12 Go (allégée à 4 bits), PC portable 16 Go (allégée à 4 bits), PC portable Snapdragon X2 48 Go (allégée à 4 bits), Mac 16 Go (allégée à 8 bits), Carte graphique 16 Go (allégée à 8 bits), PC portable GeForce RTX 16 Go (allégée à 8 bits), Mac 24 Go (allégée à 8 bits), PC portable Intel Core Ultra 32 Go (allégée à 8 bits) |
| 3 | de 22 Go à 189,4 Go | [Qwen 3.8 27B](https://quelleia.com/modeles/qwen-3-8-27b/) | 79,2 | +8,3 (ex æquo) | Carte graphique 24 Go (allégée à 4 bits), PC portable GeForce RTX 24 Go (allégée à 4 bits), Mac 32 Go (allégée à 4 bits), Ryzen AI Max 32 Go (allégée à 4 bits), Mac 36 Go (allégée à 4 bits), Carte graphique 32 Go (allégée à 4 bits), Mac 48 Go (allégée à 8 bits), Carte graphique 48 Go (allégée à 8 bits), Mac 64 Go (allégée à 8 bits), Ryzen AI Max 64 Go (allégée à 8 bits), Mac 96 Go (complète), Carte graphique 96 Go (complète), Mac 128 Go (complète), Ryzen AI Max 128 Go (complète), DGX Spark 128 Go (complète), Ryzen AI Max 192 Go (complète), Mac 256 Go (complète) |
| 4 | de 224 Go à 448 Go | [MiMo-V2.6-Flash](https://quelleia.com/modeles/mimo-v2-6-flash/) (provisoire) | 84,5 | +5,3 (ex æquo) | 2 DGX Spark, 256 Go (allégée à 4 bits), DGX Station (allégée à 4 bits), Mac 512 Go (allégée à 8 bits), 4 DGX Spark, 512 Go (allégée à 8 bits) |

Le mieux noté en ligne : [GPT-5.6 Sol](https://quelleia.com/modeles/gpt-5-6-sol/) (97,0).

## L'escalier en vision

Cinq marches, d'une carte graphique de 8 Go à quatre DGX Spark en grappe : de Molmo 2 8B (50,3) à GLM-5.3-Flash (86,3).

| Marche | Mémoire utile | Le mieux noté qui tient | Score | Gain | Paliers |
| --- | --- | --- | ---: | ---: | --- |
| 1 | de 6 Go à 14 Go | [Molmo 2 8B](https://quelleia.com/modeles/molmo-2-8b/) (provisoire) | 50,3 |  | Carte graphique 8 Go (allégée à 4 bits), PC portable GeForce RTX 8 Go (allégée à 4 bits), Carte graphique 10 Go (allégée à 4 bits), Carte graphique 12 Go (allégée à 4 bits), PC portable GeForce RTX 12 Go (allégée à 4 bits), PC portable 16 Go (allégée à 8 bits), PC portable Snapdragon X2 48 Go (allégée à 8 bits), Mac 16 Go (allégée à 8 bits), Carte graphique 16 Go (allégée à 8 bits), PC portable GeForce RTX 16 Go (allégée à 8 bits) |
| 2 | 17,8 Go | [Mistral Small 3.2](https://quelleia.com/modeles/mistral-small-3-2/) (provisoire) | 55,8 | +5,5 (ex æquo) | Mac 24 Go (allégée à 4 bits) |
| 3 | 18,2 Go | [Gemma 4 26B A4B](https://quelleia.com/modeles/gemma-4-26b-a4b/) (provisoire) | 75,6 | +19,8 | PC portable Intel Core Ultra 32 Go (allégée à 4 bits) |
| 4 | de 22 Go à 189,4 Go | [Qwen 3.8 27B](https://quelleia.com/modeles/qwen-3-8-27b/) (provisoire) | 81,1 | +5,5 (ex æquo) | Carte graphique 24 Go (allégée à 4 bits), PC portable GeForce RTX 24 Go (allégée à 4 bits), Mac 32 Go (allégée à 4 bits), Ryzen AI Max 32 Go (allégée à 4 bits), Mac 36 Go (allégée à 4 bits), Carte graphique 32 Go (allégée à 4 bits), Mac 48 Go (allégée à 8 bits), Carte graphique 48 Go (allégée à 8 bits), Mac 64 Go (allégée à 8 bits), Ryzen AI Max 64 Go (allégée à 8 bits), Mac 96 Go (complète), Carte graphique 96 Go (complète), Mac 128 Go (complète), Ryzen AI Max 128 Go (complète), DGX Spark 128 Go (complète), Ryzen AI Max 192 Go (complète), Mac 256 Go (complète) |
| 5 | de 224 Go à 448 Go | [GLM-5.3-Flash](https://quelleia.com/modeles/glm-5-3-flash/) (provisoire) | 86,3 | +5,2 (ex æquo) | 2 DGX Spark, 256 Go (allégée à 4 bits), DGX Station (allégée à 4 bits), Mac 512 Go (allégée à 4 bits), 4 DGX Spark, 512 Go (allégée à 8 bits) |

Le mieux noté en ligne : [Claude Opus 5.5](https://quelleia.com/modeles/claude-opus-5-5/) (100,1).

## L'escalier pour le web

Cinq marches, d'une carte graphique de 8 Go à quatre DGX Spark en grappe : de Granite 4.1 8B (60,5) à DeepSeek V4.1 Flash (91,5).

| Marche | Mémoire utile | Le mieux noté qui tient | Score | Gain | Paliers |
| --- | --- | --- | ---: | ---: | --- |
| 1 | de 6 Go à 17,8 Go | [Granite 4.1 8B](https://quelleia.com/modeles/granite-4-1-8b/) | 60,5 |  | Carte graphique 8 Go (allégée à 4 bits), PC portable GeForce RTX 8 Go (allégée à 4 bits), Carte graphique 10 Go (allégée à 4 bits), Carte graphique 12 Go (allégée à 8 bits), PC portable GeForce RTX 12 Go (allégée à 8 bits), PC portable 16 Go (allégée à 8 bits), PC portable Snapdragon X2 48 Go (allégée à 8 bits), Mac 16 Go (allégée à 8 bits), Carte graphique 16 Go (allégée à 8 bits), PC portable GeForce RTX 16 Go (allégée à 8 bits), Mac 24 Go (allégée à 8 bits) |
| 2 | 18,2 Go | [Gemma 4 26B A4B](https://quelleia.com/modeles/gemma-4-26b-a4b/) | 74,3 | +13,8 | PC portable Intel Core Ultra 32 Go (allégée à 4 bits) |
| 3 | de 22 Go à 189,4 Go | [Qwen 3.8 27B](https://quelleia.com/modeles/qwen-3-8-27b/) | 89,2 | +14,9 | Carte graphique 24 Go (allégée à 4 bits), PC portable GeForce RTX 24 Go (allégée à 4 bits), Mac 32 Go (allégée à 4 bits), Ryzen AI Max 32 Go (allégée à 4 bits), Mac 36 Go (allégée à 4 bits), Carte graphique 32 Go (allégée à 4 bits), Mac 48 Go (allégée à 8 bits), Carte graphique 48 Go (allégée à 8 bits), Mac 64 Go (allégée à 8 bits), Ryzen AI Max 64 Go (allégée à 8 bits), Mac 96 Go (complète), Carte graphique 96 Go (complète), Mac 128 Go (complète), Ryzen AI Max 128 Go (complète), DGX Spark 128 Go (complète), Ryzen AI Max 192 Go (complète), Mac 256 Go (complète) |
| 4 | de 224 Go à 378,9 Go | [GLM-5.3-Flash](https://quelleia.com/modeles/glm-5-3-flash/) | 91,0 | +1,8 (ex æquo) | 2 DGX Spark, 256 Go (allégée à 4 bits), DGX Station (allégée à 4 bits), Mac 512 Go (allégée à 4 bits) |
| 5 | 448 Go | [DeepSeek V4.1 Flash](https://quelleia.com/modeles/deepseek-v4-1-flash/) | 91,5 | +0,5 (ex æquo) | 4 DGX Spark, 512 Go (allégée à 4 bits) |

Le mieux noté en ligne : [Claude Opus 5.5](https://quelleia.com/modeles/claude-opus-5-5/) (103,5).

## Toutes les machines

| Machine | Famille | Mémoire utile | Le mieux noté qui tient (score général) | Prix du fabricant | Prix constaté | Page |
| --- | --- | ---: | --- | --- | --- | --- |
| GeForce RTX 5090 | Cartes graphiques | 30 Go | Qwen 3.8 27B (82,4), allégée à 4 bits | 2 099 €, 30 septembre 2026 | 6 799,95 €, LDLC, 30 septembre 2026 | https://quelleia.com/local/geforce-rtx-5090/ |
| GeForce RTX 5080 | Cartes graphiques | 14 Go | Qwen3.5-9B (65,7), allégée à 8 bits | 1 059 €, 30 septembre 2026 | 1 849,95 €, LDLC, 30 septembre 2026 | https://quelleia.com/local/geforce-rtx-5080/ |
| GeForce RTX 5070 Ti | Cartes graphiques | 14 Go | Qwen3.5-9B (65,7), allégée à 8 bits | 884 €, 30 septembre 2026 | 1 399,95 €, LDLC, 30 septembre 2026 | https://quelleia.com/local/geforce-rtx-5070-ti/ |
| GeForce RTX 5070 | Cartes graphiques | 10 Go | Qwen3.5-9B (65,7), allégée à 4 bits | 589 €, 30 septembre 2026 | 969,95 €, LDLC, 30 septembre 2026 | https://quelleia.com/local/geforce-rtx-5070/ |
| GeForce RTX 5060 Ti 16 Go | Cartes graphiques | 14 Go | Qwen3.5-9B (65,7), allégée à 8 bits |  | 819,95 €, LDLC, 30 septembre 2026 | https://quelleia.com/local/geforce-rtx-5060-ti-16go/ |
| GeForce RTX 5060 Ti 8 Go | Cartes graphiques | 6 Go | Qwen3.5-4B (63,1), allégée à 8 bits | 399 €, 30 septembre 2026 | 579,95 €, LDLC, 30 septembre 2026 | https://quelleia.com/local/geforce-rtx-5060-ti-8go/ |
| GeForce RTX 5060 | Cartes graphiques | 6 Go | Qwen3.5-4B (63,1), allégée à 8 bits | 319 €, 30 septembre 2026 | 539,95 €, LDLC, 30 septembre 2026 | https://quelleia.com/local/geforce-rtx-5060/ |
| GeForce RTX 5050 | Cartes graphiques | 6 Go | Qwen3.5-4B (63,1), allégée à 8 bits | 249 $, 30 septembre 2026 | 469,95 €, LDLC, 30 septembre 2026 | https://quelleia.com/local/geforce-rtx-5050/ |
| RTX PRO 4000 Blackwell | Cartes graphiques | 22 Go | Qwen 3.8 27B (82,4), allégée à 4 bits |  | 3 689,95 €, LDLC, 30 septembre 2026 | https://quelleia.com/local/rtx-pro-4000-blackwell/ |
| RTX PRO 4500 Blackwell | Cartes graphiques | 30 Go | Qwen 3.8 27B (82,4), allégée à 4 bits |  | 5 779,95 €, LDLC, 30 septembre 2026 | https://quelleia.com/local/rtx-pro-4500-blackwell/ |
| RTX PRO 5000 Blackwell 48 Go | Cartes graphiques | 46 Go | Qwen 3.8 27B (82,4), allégée à 8 bits |  | 9 899,95 €, LDLC, 30 septembre 2026 | https://quelleia.com/local/rtx-pro-5000-blackwell-48go/ |
| RTX PRO 6000 Blackwell | Cartes graphiques | 94 Go | Qwen 3.8 27B (82,4), complète |  | 17 679,95 €, LDLC, 30 septembre 2026 | https://quelleia.com/local/rtx-pro-6000-blackwell/ |
| Radeon RX 9070 XT | Cartes graphiques | 14 Go | Qwen3.5-9B (65,7), allégée à 8 bits | 599 $, 28 février 2025 | 1 069,95 €, LDLC, 30 septembre 2026 | https://quelleia.com/local/radeon-rx-9070-xt/ |
| Radeon RX 9070 | Cartes graphiques | 14 Go | Qwen3.5-9B (65,7), allégée à 8 bits | 549 $, 28 février 2025 | 999,95 €, LDLC, 30 septembre 2026 | https://quelleia.com/local/radeon-rx-9070/ |
| Radeon RX 9070 GRE | Cartes graphiques | 10 Go | Qwen3.5-9B (65,7), allégée à 4 bits |  | 699,95 €, LDLC, 30 septembre 2026 | https://quelleia.com/local/radeon-rx-9070-gre/ |
| Radeon RX 9060 XT 16 Go | Cartes graphiques | 14 Go | Qwen3.5-9B (65,7), allégée à 8 bits | 349 $, 20 mai 2025 | 799,95 €, LDLC, 30 septembre 2026 | https://quelleia.com/local/radeon-rx-9060-xt-16go/ |
| Radeon RX 9060 XT 8 Go | Cartes graphiques | 6 Go | Qwen3.5-4B (63,1), allégée à 8 bits | 299 $, 20 mai 2025 | 549,95 €, LDLC, 30 septembre 2026 | https://quelleia.com/local/radeon-rx-9060-xt-8go/ |
| Radeon AI PRO R9700 | Cartes graphiques | 30 Go | Qwen 3.8 27B (82,4), allégée à 4 bits |  | 2 199,95 €, LDLC, 30 septembre 2026 | https://quelleia.com/local/radeon-ai-pro-r9700/ |
| Radeon PRO W7900 | Cartes graphiques | 46 Go | Qwen 3.8 27B (82,4), allégée à 8 bits |  | 3 349,95 €, LDLC, 30 septembre 2026 | https://quelleia.com/local/radeon-pro-w7900/ |
| Radeon RX 7900 XTX (plus vendue) | Cartes graphiques | 22 Go | Qwen 3.8 27B (82,4), allégée à 4 bits |  |  | https://quelleia.com/local/radeon-rx-7900-xtx/ |
| Intel Arc Pro B70 | Cartes graphiques | 30 Go | Qwen 3.8 27B (82,4), allégée à 4 bits | 949 $, 25 mars 2026 | 1 899,95 €, LDLC, 30 septembre 2026 | https://quelleia.com/local/intel-arc-pro-b70/ |
| Intel Arc Pro B65 | Cartes graphiques | 30 Go | Qwen 3.8 27B (82,4), allégée à 4 bits |  | 1 499,95 €, LDLC, 30 septembre 2026 | https://quelleia.com/local/intel-arc-pro-b65/ |
| Intel Arc Pro B60 Dual 48 Go (deux puces) | Cartes graphiques | 46 Go | Qwen 3.8 27B (82,4), allégée à 8 bits |  |  | https://quelleia.com/local/intel-arc-pro-b60-dual-48go/ |
| Intel Arc Pro B60 | Cartes graphiques | 22 Go | Qwen 3.8 27B (82,4), allégée à 4 bits |  | 799,95 €, LDLC, 30 septembre 2026 | https://quelleia.com/local/intel-arc-pro-b60/ |
| Intel Arc Pro B50 | Cartes graphiques | 14 Go | Qwen3.5-9B (65,7), allégée à 8 bits |  |  | https://quelleia.com/local/intel-arc-pro-b50/ |
| Intel Arc B580 | Cartes graphiques | 10 Go | Qwen3.5-9B (65,7), allégée à 4 bits | 249 $, 30 septembre 2026 | 429,95 €, LDLC, 30 septembre 2026 | https://quelleia.com/local/intel-arc-b580/ |
| Intel Arc B570 | Cartes graphiques | 8 Go | Qwen3.5-9B (65,7), allégée à 4 bits | 219 $, 3 décembre 2024 | 339,95 €, LDLC, 30 septembre 2026 | https://quelleia.com/local/intel-arc-b570/ |
| PC portable avec GeForce RTX 5090 | PC portables GeForce RTX | 22 Go | Qwen 3.8 27B (82,4), allégée à 4 bits | 6 008,16 €, 30 septembre 2026 |  | https://quelleia.com/local/pc-portable-geforce-rtx-5090/ |
| PC portable avec GeForce RTX 5080 | PC portables GeForce RTX | 14 Go | Qwen3.5-9B (65,7), allégée à 8 bits | 4 099,01 €, 30 septembre 2026 |  | https://quelleia.com/local/pc-portable-geforce-rtx-5080/ |
| PC portable avec GeForce RTX 5070 Ti | PC portables GeForce RTX | 10 Go | Qwen3.5-9B (65,7), allégée à 4 bits | 2 736,16 €, 30 septembre 2026 |  | https://quelleia.com/local/pc-portable-geforce-rtx-5070-ti/ |
| PC portable avec GeForce RTX 5070 | PC portables GeForce RTX | 6 Go | Qwen3.5-4B (63,1), allégée à 8 bits | 2 899,01 €, 30 septembre 2026 |  | https://quelleia.com/local/pc-portable-geforce-rtx-5070/ |
| PC portable avec GeForce RTX 5060 | PC portables GeForce RTX | 6 Go | Qwen3.5-4B (63,1), allégée à 8 bits | 2 200,66 €, 30 septembre 2026 |  | https://quelleia.com/local/pc-portable-geforce-rtx-5060/ |
| PC portable avec GeForce RTX 5050 | PC portables GeForce RTX | 6 Go | Qwen3.5-4B (63,1), allégée à 8 bits | 1 799 €, 30 septembre 2026 |  | https://quelleia.com/local/pc-portable-geforce-rtx-5050/ |
| Samsung Galaxy Book6 Pro 16 pouces, 32 Go | PC portables Intel Core Ultra | 18,2 Go | Gemma 4 26B A4B (72,7), allégée à 4 bits | 3 199 €, 30 septembre 2026 |  | https://quelleia.com/local/samsung-galaxy-book6-pro-16/ |
| ASUS Zenbook A16 (2026), Snapdragon X2 Elite Extreme, 48 Go | PC portables Snapdragon X2 | 11 Go | Qwen3.5-9B (65,7), allégée à 4 bits |  | 2 499,95 €, LDLC, 30 septembre 2026 | https://quelleia.com/local/asus-zenbook-a16-2026-snapdragon-x2-48go/ |
| Mac mini M6, 16 Go | Mac | 11,8 Go | Qwen3.5-9B (65,7), allégée à 8 bits | 1 049 €, 30 septembre 2026 |  | https://quelleia.com/local/mac-mini-m6-16go/ |
| Mac mini M6, 24 Go | Mac | 17,8 Go | Voxtral Small (68,8), allégée à 4 bits |  |  | https://quelleia.com/local/mac-mini-m6-24go/ |
| Mac mini M6, 32 Go | Mac | 23,7 Go | Qwen 3.8 27B (82,4), allégée à 4 bits |  |  | https://quelleia.com/local/mac-mini-m6-32go/ |
| Mac mini M5 Pro, 24 Go | Mac | 17,8 Go | Voxtral Small (68,8), allégée à 4 bits | 1 999 €, 30 septembre 2026 |  | https://quelleia.com/local/mac-mini-m5-pro-24go/ |
| Mac mini M5 Pro, 48 Go | Mac | 35,5 Go | Qwen 3.8 27B (82,4), allégée à 8 bits |  |  | https://quelleia.com/local/mac-mini-m5-pro-48go/ |
| Mac mini M5 Pro, 64 Go | Mac | 47,4 Go | Qwen 3.8 27B (82,4), allégée à 8 bits |  |  | https://quelleia.com/local/mac-mini-m5-pro-64go/ |
| Mac Studio M5 Max, 36 Go | Mac | 26,6 Go | Qwen 3.8 27B (82,4), allégée à 4 bits | 2 999 €, 30 septembre 2026 |  | https://quelleia.com/local/mac-studio-m5-max-36go/ |
| Mac Studio M5 Max, 48 Go | Mac | 35,5 Go | Qwen 3.8 27B (82,4), allégée à 8 bits |  |  | https://quelleia.com/local/mac-studio-m5-max-48go/ |
| Mac Studio M5 Max, 64 Go | Mac | 47,4 Go | Qwen 3.8 27B (82,4), allégée à 8 bits |  |  | https://quelleia.com/local/mac-studio-m5-max-64go/ |
| Mac Studio M5 Max, 128 Go | Mac | 94,7 Go | Qwen 3.8 27B (82,4), complète |  |  | https://quelleia.com/local/mac-studio-m5-max-128go/ |
| Mac Studio M5 Ultra, 96 Go | Mac | 71 Go | Qwen 3.8 27B (82,4), complète | 6 599 €, 30 septembre 2026 |  | https://quelleia.com/local/mac-studio-m5-ultra-96go/ |
| Mac Studio M5 Ultra, 256 Go | Mac | 189,4 Go | Qwen 3.8 27B (82,4), complète |  |  | https://quelleia.com/local/mac-studio-m5-ultra-256go/ |
| Mac Studio M5 Ultra, 512 Go (annoncé) | Mac | 378,9 Go | GLM-5.3-Flash (84,7), allégée à 4 bits |  |  | https://quelleia.com/local/mac-studio-m5-ultra-512go/ |
| MacBook Air M5 | Mac | 11,8 Go | Qwen3.5-9B (65,7), allégée à 8 bits | 1 399 €, 30 septembre 2026 |  | https://quelleia.com/local/macbook-air-m5/ |
| MacBook Pro 14 pouces M5 | Mac | 11,8 Go | Qwen3.5-9B (65,7), allégée à 8 bits | 2 199 €, 30 septembre 2026 |  | https://quelleia.com/local/macbook-pro-m5/ |
| MacBook Pro M5 Pro | Mac | 17,8 Go | Voxtral Small (68,8), allégée à 4 bits | 2 899 €, 30 septembre 2026 |  | https://quelleia.com/local/macbook-pro-m5-pro/ |
| MacBook Pro M5 Max | Mac | 26,6 Go | Qwen 3.8 27B (82,4), allégée à 4 bits | 4 799 €, 30 septembre 2026 |  | https://quelleia.com/local/macbook-pro-m5-max/ |
| Ryzen AI Max 385, 32 Go | Mini-PC et PC portables Ryzen AI Max | 24 Go | Qwen 3.8 27B (82,4), allégée à 4 bits | 1 429 €, 30 septembre 2026 |  | https://quelleia.com/local/ryzen-ai-max-385-32go/ |
| Ryzen AI Max+ 395, 64 Go | Mini-PC et PC portables Ryzen AI Max | 48 Go | Qwen 3.8 27B (82,4), allégée à 8 bits | 2 209 €, 30 septembre 2026 |  | https://quelleia.com/local/ryzen-ai-max-plus-395-64go/ |
| Ryzen AI Max+ 395, 128 Go | Mini-PC et PC portables Ryzen AI Max | 96 Go | Qwen 3.8 27B (82,4), complète | 3 889 €, 30 septembre 2026 |  | https://quelleia.com/local/ryzen-ai-max-plus-395-128go/ |
| Ryzen AI Max+ PRO 495, 192 Go | Mini-PC et PC portables Ryzen AI Max | 160 Go | Qwen 3.8 27B (82,4), complète | 7 659 €, 30 septembre 2026 |  | https://quelleia.com/local/ryzen-ai-max-plus-pro-495-192go/ |
| ASUS ROG Flow Z13 (2025) | Mini-PC et PC portables Ryzen AI Max | 24 Go | Qwen 3.8 27B (82,4), allégée à 4 bits | 2 499,99 €, 30 septembre 2026 |  | https://quelleia.com/local/asus-rog-flow-z13-2025/ |
| HP ZBook Ultra G1a, Ryzen AI Max+ PRO 395, 128 Go | Mini-PC et PC portables Ryzen AI Max | 96 Go | Qwen 3.8 27B (82,4), complète | 6 995,95 €, 30 septembre 2026 |  | https://quelleia.com/local/hp-zbook-ultra-g1a/ |
| Nvidia DGX Spark | Nvidia DGX et RTX Spark | 112 Go | Qwen 3.8 27B (82,4), complète | 4 699 $, 25 février 2026 | 6 099,95 €, LDLC, 30 septembre 2026 | https://quelleia.com/local/dgx-spark/ |
| Deux DGX Spark en grappe | Nvidia DGX et RTX Spark | 224 Go | GLM-5.3-Flash (84,7), allégée à 4 bits | 2 × 4 699 $, 25 février 2026 | 2 × 6 099,95 €, LDLC, 30 septembre 2026 | https://quelleia.com/local/dgx-spark-x2/ |
| Quatre DGX Spark en grappe | Nvidia DGX et RTX Spark | 448 Go | DeepSeek V4.1 Flash (87,3), allégée à 4 bits | 4 × 4 699 $, 25 février 2026 | 4 × 6 099,95 €, LDLC, 30 septembre 2026 | https://quelleia.com/local/dgx-spark-x4/ |
| Nvidia DGX Station | Nvidia DGX et RTX Spark | 252 Go | GLM-5.3-Flash (84,7), allégée à 4 bits |  | 88 000 € HT, pi3g, 14 septembre 2026 | https://quelleia.com/local/dgx-station/ |
| Nvidia RTX Spark (annoncé) | Nvidia DGX et RTX Spark | non calculée | pas de calcul tant que rien n'est en vente |  |  | https://quelleia.com/local/rtx-spark/ |
| PC portable 16 Go, sans carte graphique (gabarit) | Sans carte graphique | 11 Go | Qwen3.5-9B (65,7), allégée à 4 bits |  |  | https://quelleia.com/local/pc-portable-16-go/ |

## Créer des images et des vidéos chez soi

| Modèle | Classement | Rang | Score | Licence | Mémoire annoncée par l'éditeur |
| --- | --- | ---: | ---: | --- | --- |
| [Qwen-Image-2.1](https://quelleia.com/modeles/qwen-image-2-1/) | Texte vers image | 16 | 78,5 | Qwen Research License | non documentée |
| [Ideogram 4.0](https://quelleia.com/modeles/ideogram-4-0/) | Texte vers image | 17 | 76,0 | Ideogram 4 Non-Commercial License | non documentée |
| [HunyuanImage 3.0-Instruct](https://quelleia.com/modeles/hunyuanimage-3-0-instruct/) | Édition d'image | 23 | 68,1 | Tencent Hunyuan Community License, hors Union européenne, Royaume-Uni et Corée du Sud | 640 Go (mémoire recommandée, pas un minimum : au moins huit cartes de 80 Go), https://huggingface.co/tencent/HunyuanImage-3.0-Instruct |
| [Cosmos3-Super-Text2Image](https://quelleia.com/modeles/cosmos3-super-text2image/) | Texte vers image | 24 | 71,6 | OpenMDW 1.1 | non documentée |
| [HunyuanImage 3.0](https://quelleia.com/modeles/hunyuanimage-3-0/) | Texte vers image | 31 | 69,9 | Tencent Hunyuan Community License, hors Union européenne, Royaume-Uni et Corée du Sud | 240 Go (mémoire recommandée, pas un minimum : au moins trois cartes de 80 Go), https://github.com/Tencent-Hunyuan/HunyuanImage-3.0 |
| [FLUX.2 [dev]](https://quelleia.com/modeles/flux-2-dev/) | Texte vers image | 34 | 69,5 | FLUX Non-Commercial License | 20 Go (version quantifiée à 4 bits du modèle et de l'encodeur de texte, l'encodeur déchargé vers le processeur ; le modèle complet demande l'équivalent d'une H100), https://github.com/black-forest-labs/flux2/blob/main/docs/flux2_dev_hf.md |
| [Qwen-Image-Edit](https://quelleia.com/modeles/qwen-image-edit/) | Édition d'image | 34 | 59,3 | Apache 2.0 | non documentée |
| [Qwen-Image-Edit-2511](https://quelleia.com/modeles/qwen-image-edit-2511/) | Édition d'image | 36 | 58,2 | Apache 2.0 | non documentée |
| [Qwen-Image-2512](https://quelleia.com/modeles/qwen-image-2512/) | Texte vers image | 40 | 67,3 | Apache 2.0 | non documentée |
| [HiDream-O1-Image](https://quelleia.com/modeles/hidream-o1-image/) | Texte vers image | 43 | 66,2 | MIT | non documentée |
| [Krea 2 Turbo](https://quelleia.com/modeles/krea-2-turbo/) | Texte vers image | 46 | 65,9 | Krea 2 Community License | non documentée |
| [Z-Image-Turbo](https://quelleia.com/modeles/z-image-turbo/) | Texte vers image | 53 | 62,7 | Apache 2.0 | 16 Go (« appareils grand public à 16 Go de mémoire vidéo », sans résolution ni quantification précisées), https://huggingface.co/Tongyi-MAI/Z-Image-Turbo |
| [Step1X-Edit](https://quelleia.com/modeles/step1x-edit/) | Édition d'image | 54 | 24,5 | Apache 2.0 | 18 Go (pic mesuré par l'éditeur avec les poids en FP8 et déchargement vers le processeur ; de 42,5 à 49,8 Go sans ces réglages), https://github.com/stepfun-ai/Step1X-Edit |
| [FLUX.2 [klein] 9B](https://quelleia.com/modeles/flux-2-klein-9b/) | Texte vers image | 56 | 61,2 | FLUX Non-Commercial License | 29 Go (environ 29 Go, « RTX 4090 and above » selon l'éditeur), https://huggingface.co/black-forest-labs/FLUX.2-klein-9B |
| [Qwen-Image avec extension du prompt](https://quelleia.com/modeles/qwen-image-avec-extension-du-prompt/) | Texte vers image | 57 | 60,1 | Apache 2.0 | non documentée |
| [Qwen-Image](https://quelleia.com/modeles/qwen-image/) | Texte vers image | 60 | 59,8 | Apache 2.0 | non documentée |
| [FLUX.2 [klein] 4B](https://quelleia.com/modeles/flux-2-klein-4b/) | Texte vers image | 64 | 56,8 | Apache 2.0 | 13 Go (environ 13 Go selon la carte du modèle ; le dépôt de l'éditeur écrit environ 8 Go), https://huggingface.co/black-forest-labs/FLUX.2-klein-4B |
| [GLM-Image](https://quelleia.com/modeles/glm-image/) | Texte vers image | 70 | 54,8 | MIT | 23 Go (environ 23 Go avec le modèle déchargé vers le processeur, plus lent ; le dépôt de l'éditeur demande plus de 80 Go sans déchargement), https://huggingface.co/zai-org/GLM-Image |
| [FLUX.1 [dev]](https://quelleia.com/modeles/flux-1-dev/) | Texte vers image | 72 | 50,2 | FLUX.1 [dev] Non-Commercial License | non documentée |
| [FLUX.1 Kontext [dev]](https://quelleia.com/modeles/flux-1-kontext-dev/) | Texte vers image | 74 | 47,1 | FLUX.1 [dev] Non-Commercial License | non documentée |
| [Stable Diffusion 3.5 Large](https://quelleia.com/modeles/stable-diffusion-3-5-large/) | Texte vers image | 75 | 46,8 | Stability AI Community License | non documentée |
| [BAGEL](https://quelleia.com/modeles/bagel/) | Texte vers image | 76 | 42,3 | Apache 2.0 | 12 Go (de 12 à 32 Go avec une quantification NF4 ; plus de 32 Go sans quantification), https://github.com/ByteDance-Seed/Bagel |
| [MiniMax H3](https://quelleia.com/modeles/minimax-h3/) | Texte vers vidéo | 5 | 92,1 | MiniMax H3 Community License, hors Union européenne, Royaume-Uni, Corée du Sud et États-Unis | non documentée |
| [Kandinsky 5.0 Video Pro](https://quelleia.com/modeles/kandinsky-5-0-video-pro/) | Texte vers vidéo | 28 | 51,5 | MIT | non documentée |
| [HunyuanVideo 1.5](https://quelleia.com/modeles/hunyuanvideo-1-5/) | Texte vers vidéo | 29 | 50,6 | Tencent Hunyuan Community License, hors Union européenne, Royaume-Uni et Corée du Sud | 14 Go (minimum annoncé, avec le modèle déchargé vers le processeur), https://huggingface.co/tencent/HunyuanVideo-1.5 |
| [LTX-2](https://quelleia.com/modeles/ltx-2/) | Texte vers vidéo | 32 | 48,5 | LTX-2 Community License Agreement | non documentée |
| [Wan 2.2 A14B](https://quelleia.com/modeles/wan-2-2-a14b/) | Texte vers vidéo | 33 | 45,3 | Apache 2.0 | 80 Go (sur une seule carte, en 1 280 × 720, avec le modèle déchargé vers le processeur), https://huggingface.co/Wan-AI/Wan2.2-T2V-A14B |
| [Mochi 1](https://quelleia.com/modeles/mochi-1/) | Texte vers vidéo | 38 | 27,6 | Apache 2.0 | 22 Go (variante bfloat16 des poids, avec déchargement vers le processeur ; 42 Go pour la meilleure qualité), https://huggingface.co/genmo/mochi-1-preview |
| [Kandinsky 5.0 Video Lite](https://quelleia.com/modeles/kandinsky-5-0-video-lite/) | Texte vers vidéo | provisoire | 42,6 | MIT | non documentée |

## Repères de vitesse

- Ces chiffres ne sont pas comparables entre eux : le modèle, sa quantification, le moteur, la longueur du contexte et la date changent d'une ligne à l'autre.
- Un débit dépend d'abord du modèle : un petit modèle sort plusieurs centaines de jetons par seconde là où un gros en sort quelques dizaines, sur la même machine.
- Le débit baisse quand le contexte s'allonge : sur le DGX Spark, llama.cpp mesure 83,4 jetons par seconde à contexte vide et 61,7 avec 32 768 jetons de contexte, pour le même modèle.
- Quelle IA ne calcule ni n'estime aucune vitesse. Une machine sans mesure publiée reste sans chiffre.

- GeForce RTX 5090 Founders Edition : 205 jetons par seconde, GPT-OSS 20B en MXFP4, Ollama, décodage, une requête à la fois. Mesuré par un tiers, LMSYS, 13 octobre 2025. https://www.lmsys.org/blog/2025-10-13-nvidia-dgx-spark/
- GeForce RTX 5090, avec un processeur Intel 13900K : 271,4 jetons par seconde, Llama 3.2 3B, Ollama (étiquette llama3.2:3b), débit de génération rapporté par Ollama, quantification non précisée. Mesuré par un tiers, un contributeur du dépôt de Jeff Geerling, 8 février 2025. https://github.com/geerlingguy/ai-benchmarks/pull/18
- GeForce RTX 5090, avec un Intel Core Ultra 9 285K : 131 jetons par seconde, Qwen3.8 27B en Q4_K_M, llama.cpp, avec la prédiction de plusieurs jetons (MTP, n_max = 3), banc speedbench, Windows 11, pilote 610.43 ; 77 jetons par seconde sans la prédiction de plusieurs jetons. Déclaré par Nvidia, Nvidia, 11 août 2026. https://blogs.nvidia.com/blog/local-ai-open-source-models-agents-nemotron/
- RTX PRO 6000 Blackwell Workstation Edition : 215 jetons par seconde, GPT-OSS 20B en MXFP4, Ollama, décodage, une requête à la fois. Mesuré par un tiers, LMSYS, 13 octobre 2025. https://www.lmsys.org/blog/2025-10-13-nvidia-dgx-spark/
- Radeon AI PRO R9700, dans un PC à processeur Intel 265K : 163,3 jetons par seconde, gpt-oss 20B en Q4_K_M, llama.cpp, Vulkan, llama-bench, génération de 128 jetons ; 332,9 W en pointe. Mesuré par un tiers, Jeff Geerling, 25 novembre 2025. https://github.com/geerlingguy/ai-benchmarks/issues/35
- Radeon RX 9070 XT, reliée à un Raspberry Pi : 89,6 jetons par seconde, Llama 3.2 3B en Q4_K_M, llama.cpp, Vulkan, llama-bench, génération de 128 jetons  ; 304 W en pointe. Mesuré par un tiers, Jeff Geerling, 30 septembre 2025. https://github.com/geerlingguy/ai-benchmarks/issues/25
- Mac à puce M2 Ultra (génération précédente, hors registre) : 130 jetons par seconde, gpt-oss 20B en MXFP4, llama.cpp, Metal, version 7948, llama-bench, génération de 32 jetons à contexte vide. Mesuré par un tiers, llama.cpp (ggml-org). https://github.com/ggml-org/llama.cpp/blob/master/benches/mac-m2-ultra/mac-m2-ultra.md
- Mac à puce M2 Ultra (génération précédente, hors registre) : 85,6 jetons par seconde, gpt-oss 120B en MXFP4, llama.cpp, Metal, version 7948, llama-bench, génération de 32 jetons à contexte vide. Mesuré par un tiers, llama.cpp (ggml-org). https://github.com/ggml-org/llama.cpp/blob/master/benches/mac-m2-ultra/mac-m2-ultra.md
- Framework Desktop de présérie, Ryzen AI Max+ 395, 128 Go : 50,1 jetons par seconde, gpt-oss 120B en MXFP4, llama.cpp, Vulkan (AMDVLK), version 6792, llama-bench, génération de 32 jetons à contexte vide, sous Linux ; 31,54 jetons par seconde avec 32 768 jetons de contexte ; 46,56 avec le moteur ROCm. Mesuré par un tiers, lhl (strix-halo-testing), octobre 2025. https://github.com/lhl/strix-halo-testing
- Framework Desktop de présérie, Ryzen AI Max+ 395, 128 Go : 88,1 jetons par seconde, Llama 3.2 3B en Q4_K_M, llama.cpp, Vulkan, llama-bench, génération de 128 jetons ; 133 W en pointe. Mesuré par un tiers, Jeff Geerling, 7 août 2025. https://github.com/geerlingguy/ai-benchmarks/issues/21
- AMD Ryzen AI Halo de présérie, Ryzen AI Max+ 395, 128 Go : 36 jetons par seconde, modèle non nommé par AMD, LM Studio 0.4.12, llama.cpp en Vulkan, débit soutenu en sortie avec 128 000 jetons de contexte (446 jetons par seconde en entrée), pilotes Adrenalin 26.10.08 ; note SHO-49 du billet AMD. Déclaré par AMD, AMD, 28 septembre 2026. https://www.amd.com/en/blogs/2026/how-amd-ryzen-ai-max-pro-400-series-processors-bring-local-agentic-ai-to-business-customers.html
- Nvidia DGX Spark : 83,4 jetons par seconde, gpt-oss 20B en MXFP4, llama.cpp, CUDA, version 7941, llama-bench, génération de 32 jetons à contexte vide ; 61,65 jetons par seconde avec 32 768 jetons de contexte. Mesuré par un tiers, llama.cpp (ggml-org), 5 février 2026. https://github.com/ggml-org/llama.cpp/blob/master/benches/dgx-spark/dgx-spark.md
- Nvidia DGX Spark : 58,7 jetons par seconde, gpt-oss 120B en MXFP4, llama.cpp, CUDA, version 7941, llama-bench, génération de 32 jetons à contexte vide ; 42,76 jetons par seconde avec 32 768 jetons de contexte. Mesuré par un tiers, llama.cpp (ggml-org), 5 février 2026. https://github.com/ggml-org/llama.cpp/blob/master/benches/dgx-spark/dgx-spark.md
- Nvidia DGX Spark : 48,7 jetons par seconde, GLM-4.7-Flash en Q8_0, llama.cpp, CUDA, version 7941, llama-bench, génération de 32 jetons à contexte vide ; 32,65 jetons par seconde avec 32 768 jetons de contexte. Mesuré par un tiers, llama.cpp (ggml-org), 5 février 2026. https://github.com/ggml-org/llama.cpp/blob/master/benches/dgx-spark/dgx-spark.md
- Dell Pro Max with GB10 (la puce du DGX Spark) : 88 jetons par seconde, gpt-oss 20B en Q4_K_M, llama.cpp, CUDA, llama-bench, génération de 128 jetons ; 122,8 W en pointe. Mesuré par un tiers, Jeff Geerling, 22 novembre 2025. https://github.com/geerlingguy/ai-benchmarks/issues/34
- Nvidia DGX Spark, en accès anticipé : 49,7 jetons par seconde, GPT-OSS 20B en MXFP4, Ollama, décodage, une requête à la fois ; logiciel d'octobre 2025, que l'auteur dit susceptible de progresser. Mesuré par un tiers, LMSYS, 13 octobre 2025. https://www.lmsys.org/blog/2025-10-13-nvidia-dgx-spark/

## En bref

**Quelle IA faire tourner sur son ordinateur ?** Tout dépend de la mémoire que le modèle peut occuper. Au score général de l'édition du 28 septembre 2026, le mieux noté qui tient sur un PC portable de 16 Go est Qwen3.5-9B (65,7), en version allégée à 4 bits ; sur une carte graphique de 16 Go, Qwen3.5-9B (65,7), en version allégée à 8 bits ; sur une carte graphique de 32 Go, Qwen 3.8 27B (82,4), en version allégée à 4 bits ; sur un DGX Spark, Qwen 3.8 27B (82,4), en version complète. Le meilleur modèle qui tient sur une des machines suivies reste ex æquo avec GPT-6.1 Sol, le mieux noté en ligne.

**Combien de mémoire faut-il pour faire tourner un modèle d'IA ?** Comptez environ 0,6 Go par milliard de paramètres pour la version allégée à 4 bits, 1,05 Go à 8 bits et 2 Go pour la version complète, plus 15 % pour un contexte court. Qwen3.5-9B compte 9,7 milliards de paramètres : 9,7 × 0,6 × 1,15 = 6,7 Go en version allégée à 4 bits. Il faut ensuite la comparer à la mémoire utile de la machine, plus petite que sa mémoire affichée.

**Quelle carte graphique choisir pour l'IA locale ?** La mémoire vidéo compte plus que la puissance. Avec une carte graphique de 16 Go, le mieux noté qui tient est Qwen3.5-9B (65,7) ; à partir d'une carte graphique de 24 Go, c'est Qwen 3.8 27B (82,4), soit 16,7 points de plus au score général. Plus de carte grand public de 24 Go en vente : la gamme grand public passe de 16 à 32 Go. En 24 Go, il reste des cartes professionnelles, comme la RTX PRO 4000 Blackwell de Nvidia ou l'Arc Pro B60 d'Intel. Les applications d'agents que Nvidia met en avant (OpenClaw pour Windows, Perplexity Portable Computer) demandent une carte RTX d'au moins 24 Go.

**Combien de mémoire un Mac laisse-t-il à l'IA ?** Nous comptons 74 % de la mémoire unifiée. Mesure maison : sur un Mac mini M6 de 24 Go sous macOS 27, Ollama voit 17,8 Gio utilisables par le processeur graphique (banc du 18 au 21 septembre 2026), soit 74 %. Apple ne publie pas cette part. macOS la donne par Metal (`recommendedMaxWorkingSetSize`), et llama.cpp comme MLX s'y tiennent. Un Mac de 16 Go offre donc 11,8 Go utiles, un Mac de 512 Go en offre 378,9.

**Que peut-on faire tourner sur un ou plusieurs DGX Spark ?** Un DGX Spark a 128 Go de mémoire unifiée, dont nous comptons 112 Go utiles : le mieux noté qui y tient est Qwen 3.8 27B (82,4), en version complète. Deux DGX Spark reliés en grappe additionnent leur mémoire (224 Go utiles) : GLM-5.3-Flash (84,7), en version allégée à 4 bits. Le modèle est alors réparti entre les deux machines par le réseau, ce qui demande un moteur qui sait le faire, comme vLLM.

**Quelle vitesse attendre d'un modèle en local ?** Quelle IA ne calcule aucune vitesse. Nous citons des mesures publiées sous licence ouverte et des chiffres déclarés par les fabricants, avec leurs conditions : ils ne sont pas comparables entre eux : le modèle, sa quantification, le moteur, la longueur du contexte et la date changent d'une ligne à l'autre. Aucune mesure à licence ouverte n'existe encore pour le Mac mini M6, le Mac Studio M5, le Ryzen AI Max+ PRO 495 ni RTX Spark : ces machines sont trop récentes.

Source : Quelle IA, édition du 28 septembre 2026. Registre des machines relevé le 30 septembre 2026. https://quelleia.com
