Sur une Radeon AI PRO R9700, nous comptons 30 Go de mémoire utile (mémoire vidéo moins 2 Go). Le modèle le mieux noté qui y tient, au score général de l'édition du 28 septembre 2026, est Qwen 3.8 27B, avec 82,4, en version allégée à 4 bits (18,6 Go).
Pour faire mieux au score général, il faut viser plus grand : DeepSeek-V4-Flash (82,6, dans la marge d'erreur) demande 196 Go en version allégée à 4 bits, soit deux DGX Spark en grappe.
Prix : 2 199,95 € constatés chez LDLC le 30 septembre 2026.
Ce qui tient, tâche par tâcheEstimation
Pour chaque tâche, le mieux noté parmi les modèles ouverts qui tiennent dans 30 Go utiles, et la version la plus complète qui y entre. La même règle que Trouver mon modèle.
La barre montre la mémoire que demande la version qui tient ; le pointillé, les 30 Go utiles de la machine.
Pour faire mieux
DeepSeek-V4-Flash, mieux noté (82,6, dans la marge d’erreur), demande 196 Go en version allégée à 4 bits : 166 Go de trop pour une Radeon AI PRO R9700. Il tient à partir de deux DGX Spark en grappe (2 DGX Spark, 256 Go).
La machine
Mémoire
32 Go de GDDR6
Mémoire utile
30 GoMarge de prudencemémoire vidéo moins 2 Go. La mémoire vidéo est la limite. Aucune marge n'est documentée pour l'affichage et le cache : les 2 Go retirés sont une marge de prudence, la même depuis la première édition (22 Go utiles sur 24).
Débit mémoire publié
640 Go/s
Sortie
juillet 2025
Prix conseillé
Non relevé
Prix constaté
2 199,95 €LDLC, 30 septembre 2026 : carte neuve la moins chère en stock (ASUS TURBO) ; une Gigabyte AI TOP est affichée 1 649,95 € avec un délai de plus de 15 jours. ldlc.com.
À savoir
Disponibilité annoncée « starting in July 2025 » (communiqué du 20 mai 2025), jour non publié. Prix conseillé non vérifié.
DeepSeek R1 Distill Qwen 32B (Q6)28 Go de mémoire vidéo selon le tableau « Utilisation typique de la VRAM ». AMD, amd.com, 30 septembre 2026.
Mistral Small 3.1 24B Instruct 2503 (Q8)27 Go de mémoire vidéo selon le même tableau. AMD, amd.com, 30 septembre 2026.
Ce que le fabricant écrit sur une page publique. Ce n'est pas notre calcul : le modèle qu'il cite peut demander une version plus compressée que la nôtre.
Repères de vitesse
Mesuré par un tiers163,3 jetons/sgpt-oss 20B · Q4_K_MRadeon AI PRO R9700, dans un PC à processeur Intel 265K. llama.cpp, Vulkan. Llama-bench, génération de 128 jetons ; 332,9 W en pointe.Jeff Geerling, 25 novembre 2025 · github.com · licence MIT
Des repères, pas des comparaisons : modèle, moteur et conditions changent d'une ligne à l'autre. Comment les lire.