Sur un Mac Studio M5 Max de 36 Go, nous comptons 26,6 Go de mémoire utile (74 % de la mémoire unifiée). Le modèle le mieux noté qui y tient, au score général de l'édition du 28 septembre 2026, est Qwen 3.8 27B, avec 82,4, en version allégée à 4 bits (18,6 Go).
Pour faire mieux au score général, il faut viser plus grand : DeepSeek-V4-Flash (82,6, dans la marge d'erreur) demande 196 Go en version allégée à 4 bits, soit un Mac de 512 Go.
Prix : 2 999 € au prix du fabricant (apple.com, 30 septembre 2026).
Ce qui tient, tâche par tâcheEstimation
Pour chaque tâche, le mieux noté parmi les modèles ouverts qui tiennent dans 26,6 Go utiles, et la version la plus complète qui y entre. La même règle que Trouver mon modèle.
La barre montre la mémoire que demande la version qui tient ; le pointillé, les 26,6 Go utiles de la machine.
Pour faire mieux
DeepSeek-V4-Flash, mieux noté (82,6, dans la marge d’erreur), demande 196 Go en version allégée à 4 bits : 169,4 Go de trop pour un Mac Studio M5 Max de 36 Go. Il tient à partir d'un Mac de 512 Go (Mac 512 Go).
La machine
Mémoire
36 Go
Mémoire utile
26,6 GoMesuré74 % de la mémoire unifiée. Mesure maison : sur un Mac mini M6 de 24 Go sous macOS 27, Ollama voit 17,8 Gio utilisables par le processeur graphique (banc du 18 au 21 septembre 2026), soit 74 %. Apple ne publie pas cette part. macOS la donne par Metal (recommendedMaxWorkingSetSize), et llama.cpp comme MLX s'y tiennent.On peut relever cette limite à la main, à ses risques : sudo sysctl iogpu.wired_limit_mb=N (documentation de MLX, macOS 15 au minimum). Notre calcul garde le réglage d'origine.
Débit mémoire publié
460 Go/s
Sortie
22 septembre 2026
Prix conseillé
2 999 €prix de départ sur apple.com/fr (M5 Max à CPU 18 cœurs et GPU 32 cœurs, 36 Go, SSD de 512 Go). apple.com, 30 septembre 2026.
Gemma, Kimi et Mistralfamilles citées pour le Mac Studio, sans taille ni configuration : « Déployez des grands modèles de langage comme Gemma, Kimi et Mistral ». Apple, apple.com, 30 septembre 2026.
Ce que le fabricant écrit sur une page publique. Ce n'est pas notre calcul : le modèle qu'il cite peut demander une version plus compressée que la nôtre.