GLM-4.5-Air
Z.ai (Zhipu AI) · Chine · sorti le Z.ai (Zhipu AI) · Chine · 20 juillet 2025
- Avec réflexion
- Poids ouverts
- Carte graphique 96 Go
Score général
Les dix tâches
- Raisonnement62,5Provisoire · 11 %
- Code64,1Provisoire · 15 %
- AgentsNon mesuré
- Usage62,8Rang 154 · 100 %
- Maths64,6Provisoire · 12 %
- Sciences62,8Provisoire · 40 %
- Français60,2Rang 90 · 56 %
- VisionNon mesuré
- Écriture61,2Rang 156 · 100 %
- WebNon mesuré
Artificial Analysis
Hors du scoreArtificial Analysis évalue les modèles de son côté et publie son propre indice, l'Artificial Analysis Intelligence Index v4.3. C'est un autre indice, qui ne compte pas dans le score IA de Quelle IA et ne se compare pas directement à lui.
| Version évaluée | Indice v4.3 | Rang chez eux | Vitesse | Premier jeton | Prix par million de jetonsentrée / sortie |
|---|---|---|---|---|---|
| GLM-4.5-Air | 11,1estimé | hors classement | 76,9 jetons/s | 2,46 s | 0,17 $ / 0,98 $ |
Médianes de leurs mesures : vitesse en jetons produits par seconde, délai avant le premier jeton en secondes. Prix en dollars par million de jetons, en entrée puis en sortie. Rang parmi les 193 modèles que leur indice classe ; un indice qu'ils estiment reste hors de ce classement. Relevé le 1er octobre 2026 sur leur site, reproduit avec leur accord.
Source : Artificial Analysis
Peut-il tourner chez vous ?ESTIMATION
Tient à partir d'une carte graphique de 96 Go (94 Go utiles), en version allégée à 4 bits, par exemple une RTX PRO 6000 Blackwell. Mémoire estimée : 76,2 Go.
- Carte graphique 96 Gopar exemple RTX PRO 6000 BlackwellOui, allégé 4 bits
- PC portables GeForce RTXTrop juste
- PC portables Intel Core UltraTrop juste
- PC portables Snapdragon X2Trop juste
- Mac 128 Gopar exemple Mac Studio M5 Max, 128 GoOui, allégé 4 bits
- Ryzen AI Max 128 Gopar exemple Ryzen AI Max+ 395, 128 Go, et une autre machineOui, allégé 4 bits
- DGX Spark 128 Gopar exemple Nvidia DGX SparkOui, allégé 4 bits
- Sans carte graphiqueTrop juste
- ServeurOui
Les benchmarks mesurent la version complète du modèle. La version allégée fait un peu moins bien. À télécharger avec Ollama, LM Studio ou llama.cpp. Comment on compte la mémoire.
Fiche technique
- Prix
- 0,18 € / 0,97 €entrée / sortie, par million de jetons
- Fenêtre de contexte
- 131 072 jetonsenviron 98 000 mots
- Entrées
- Texte
- Réflexion
- Non communiqué
- Paramètres
- 110,5 milliards
- Licence
- Poids ouvertspoids ouverts, téléchargeables
- Classe énergétique
- Non communiquée
- Hébergement en Europe
- Non communiqué
- Connaissances jusqu'à
- Avril 2025
Où le trouver
Liens directs, sans affiliation- TéléchargerHugging FaceLes poids officiels du modèle
- Sur votre machineOllamaChercher le modèle, une commande pour le lancer
- Sur votre machineLM StudioInterface graphique, Windows, Mac et Linux
- Par APIOpenRouterUne clé pour tous les modèles, prix au jeton
- Par APIAPI Z.ai (Zhipu AI)L'offre officielle de l'éditeur
- L'essayerZ.aiLa discussion en ligne de l'éditeur
Toutes les mesures
19 mesures · la matière du scoreVoir les 7 autres mesures
En bref
- Quel est le score de GLM-4.5-Air ?
- GLM-4.5-Air obtient un score IA de 62,3, avec une marge de 53,7 à 70,8, dans l'édition du 28 septembre 2026. Il est classé 144e sur 246 modèles, à partir de 14 mesures.
- Dans quelles tâches GLM-4.5-Air est-il le plus fort ?
- Ses deux meilleures tâches sont maths (64,6) et code (64,1). Sa tâche la plus faible est français (60,2).
- GLM-4.5-Air peut-il tourner en local ?
- Tient à partir d'une carte graphique de 96 Go (94 Go utiles), en version allégée à 4 bits, par exemple une RTX PRO 6000 Blackwell. Mémoire estimée : 76,2 Go.
- Combien coûte GLM-4.5-Air ?
- 0,18 € par million de jetons en entrée et 0,97 € en sortie, au tarif affiché par les fournisseurs. Le coût réel d'une tâche dépend du nombre de jetons que le modèle consomme.
- Qui édite GLM-4.5-Air ?
- GLM-4.5-Air est édité par Z.ai (Zhipu AI) (Chine), et il est sorti le 20 juillet 2025. Ses poids sont ouverts.