Sur une machine à Ryzen AI Max+ 395 de 128 Go, nous comptons 96 Go de mémoire utile (le plafond publié par AMD : 96 Go sur 128, 160 Go sur 192). Le modèle le mieux noté qui y tient, au score général de l'édition du 28 septembre 2026, est Qwen 3.8 27B, avec 82,4, en version complète (62,1 Go).
Pour faire mieux au score général, il faut viser plus grand : DeepSeek-V4-Flash (82,6, dans la marge d'erreur) demande 196 Go en version allégée à 4 bits, soit deux DGX Spark en grappe.
Prix : 3 889 € au prix du fabricant (frame.work, 30 septembre 2026).
Ce qui tient, tâche par tâcheEstimation
Pour chaque tâche, le mieux noté parmi les modèles ouverts qui tiennent dans 96 Go utiles, et la version la plus complète qui y entre. La même règle que Trouver mon modèle.
La barre montre la mémoire que demande la version qui tient ; le pointillé, les 96 Go utiles de la machine.
Pour faire mieux
DeepSeek-V4-Flash, mieux noté (82,6, dans la marge d’erreur), demande 196 Go en version allégée à 4 bits : 100 Go de trop pour une machine à Ryzen AI Max+ 395 de 128 Go. Il tient à partir de deux DGX Spark en grappe (2 DGX Spark, 256 Go).
La machine
Mémoire
128 Go
Mémoire utile
96 GoPublié par le fabricantle plafond publié par AMD : 96 Go sur 128, 160 Go sur 192. AMD publie la mémoire graphique maximale sous Windows : 96 Go sur une machine de 128 Go, 160 Go sur une machine de 192 Go. Pour 64 et 32 Go, AMD ne publie rien : on applique la même proportion, soit 48 et 24 Go, par prudence.Sous Linux, le plafond se règle dans le noyau (ttm.pages_limit) et peut dépasser celui de Windows : sur notre mini-PC Ryzen AI Max de 128 Go, 96 Gio de mémoire graphique partagée s'ajoutent à 32 Gio dédiés (mesure maison du 30 septembre 2026). Notre calcul reste au plafond publié.
Débit mémoire publié
Non relevé
Sortie
Non relevée
Prix conseillé
3 889 €Framework Desktop à monter soi-même, Max+ 395 et 128 Go, sans stockage ni système, prix affiché sur frame.work/fr. frame.work, 30 septembre 2026.
Prix constaté
Non relevé
Machines qui l’embarquent
Framework Desktop, AMD Ryzen AI Halo (3 999 $, vendu aux États-Unis seulement), GMKtec EVO-X2 (128 Go), HP Z2 Mini G1a (version PRO 395), HP ZBook Ultra G1a (PC portable, 128 Go), ASUS ROG Flow Z13 2025 (tablette, 128 Go)
À savoir
128 Go est le maximum de la puce (LPDDR5x-8000 sur 256 bits), dont « up to 96GB reserved for GPU workloads » selon AMD. La version PRO 395 a les mêmes caractéristiques mémoire.
DeepSeek V4 Flash 0731 (UD-IQ2_XXS)« modèle recommandé (en septembre 2026) » pour cette configuration, 90,9 Go de mémoire utilisée, avec une quantification à 2 bits. Framework, frame.work, 30 septembre 2026.
Ce que le fabricant écrit sur une page publique. Ce n'est pas notre calcul : le modèle qu'il cite peut demander une version plus compressée que la nôtre.
Repères de vitesse
Mesuré par un tiers50,1 jetons/sgpt-oss 120B · MXFP4Framework Desktop de présérie, Ryzen AI Max+ 395, 128 Go. llama.cpp, Vulkan (AMDVLK), version 6792. Llama-bench, génération de 32 jetons à contexte vide, sous Linux ; 31,54 jetons par seconde avec 32 768 jetons de contexte ; 46,56 avec le moteur ROCm.lhl (strix-halo-testing), octobre 2025 · github.com · licence Apache-2.0
Mesuré par un tiers88,1 jetons/sLlama 3.2 3B · Q4_K_MFramework Desktop de présérie, Ryzen AI Max+ 395, 128 Go. llama.cpp, Vulkan. Llama-bench, génération de 128 jetons ; 133 W en pointe.Jeff Geerling, 7 août 2025 · github.com · licence MIT
Déclaré par AMD36 jetons/smodèle non nommé par AMDAMD Ryzen AI Halo de présérie, Ryzen AI Max+ 395, 128 Go. LM Studio 0.4.12, llama.cpp en Vulkan. Débit soutenu en sortie avec 128 000 jetons de contexte (446 jetons par seconde en entrée), pilotes Adrenalin 26.10.08 ; note SHO-49 du billet AMD.AMD, 28 septembre 2026 · amd.com
Des repères, pas des comparaisons : modèle, moteur et conditions changent d'une ligne à l'autre. Comment les lire.