Aller au contenu
EN 4 QUESTIONSTrouver mon modèle
Fiche modèle · édition du

Qwen3-8B

Alibaba · Chine · sorti le Alibaba · Chine · 28 avril 2025

  • Sans réflexion
  • Poids ouverts · Apache 2.0
  • Carte graphique 8 Go
  • Classe énergétique A
58,1de 50,9 à 65,3Rang 159 · 60 %
Empreinte
Raisonnement52,1Code52,9AgentsUsageMaths63,8Sciences57,3Français43,5VisionÉcritureWeb

Score général

58,1de 50,9 à 65,3

Rang159Groupe 11, ex æquoCouverture60 %16 mesures
Pourquoi ce score ? →

Les dix tâches

  • Raisonnement
    52,1Provisoire · 33 %
  • Code
    52,9Provisoire · 8 %
  • Agents
    Non mesuré
  • Usage
    Non mesuré
  • Maths
    63,8Provisoire · 12 %
  • Sciences
    57,3Provisoire · 40 %
  • Français
    43,5Rang 134 · 75 %
  • Vision
    Non mesuré
  • Écriture
    Non mesuré
  • Web
    Non mesuré

Artificial Analysis

Hors du score

Artificial Analysis évalue les modèles de son côté et publie son propre indice, l'Artificial Analysis Intelligence Index v4.3. C'est un autre indice, qui ne compte pas dans le score IA de Quelle IA et ne se compare pas directement à lui.

Version évaluéeIndice v4.3Rang chez euxVitessePremier jetonPrix par million de jetonsentrée / sortie
Qwen3 8B (Reasoning)7,3estiméhors classement41,8 jetons/s3,81 s0,18 $ / 2,1 $
Qwen3 8B (Non-reasoning)6,0estiméhors classement41,7 jetons/s3,76 s0,18 $ / 0,7 $

Médianes de leurs mesures : vitesse en jetons produits par seconde, délai avant le premier jeton en secondes. Prix en dollars par million de jetons, en entrée puis en sortie. Rang parmi les 193 modèles que leur indice classe ; un indice qu'ils estiment reste hors de ce classement. Relevé le 1er octobre 2026 sur leur site, reproduit avec leur accord.

Source : Artificial Analysis

Peut-il tourner chez vous ?ESTIMATION

Tient à partir d'une carte graphique de 8 Go (6 Go utiles), en version allégée à 4 bits, par exemple une GeForce RTX 5050. Mémoire estimée : 5,5 Go.

Mémoire selon la versionAllégée, 4 bits5,5 GoAllégée, 8 bits9,7 GoComplète, 16 bits18,4 GoLe pointillé marque 6 Go, la mémoire utile d'une carte graphique de 8 Go. Au-delà, le modèle ne tient plus sur cette machine.

Les benchmarks mesurent la version complète du modèle. La version allégée fait un peu moins bien. À télécharger avec Ollama, LM Studio ou llama.cpp. Comment on compte la mémoire.

Fiche technique

Prix
0,04 € / 0,35 €entrée / sortie, par million de jetons
Fenêtre de contexte
131 072 jetonsenviron 98 000 mots
Entrées
Texte
Réflexion
Non communiqué
Paramètres
8 milliards
Licence
Apache 2.0poids ouverts, téléchargeables
Classe énergétique
Asur une échelle de A à G
Hébergement en Europe
Possible
Connaissances jusqu'à
Avril 2025

Où le trouver

Liens directs, sans affiliation

Toutes les mesures

25 mesures · la matière du score
BenchmarkPubliéSuggèreRéflexionÉtatSource
Fiction.LiveBench62,1 %64,8InconnueARCHIVÉepoch.ai
OTIS Mock AIME 2024-202556,1 %64,0InconnueSATURÉepoch.ai
GPQA Diamond56,8 %57,2InconnueACTIFepoch.ai
Voir les 13 autres mesures
DTBench59,7 %52,0InconnueSATURÉconceptualreasoning.ai
GPQA Diamond47,5 %50,8SansACTIFepoch.ai
compar:IA864,0 Elo3,2InconnueACTIFarene.comparia.beta.gouv.fr
SciCode22,6 %47,0InconnueACTIFartificialanalysis.ai
OTIS Mock AIME 2024-202522,2 %53,8SansSATURÉepoch.ai
LMCA8,8246,3InconnueACTIFconceptualreasoning.ai
Chess Puzzles5 %47,6InconnueACTIFepoch.ai
CritPt0 %61,2InconnueACTIFepoch.ai
Chess Puzzles0 %47,6SansACTIFepoch.ai

En bref

Quel est le score de Qwen3-8B ?
Qwen3-8B obtient un score IA de 58,1, avec une marge de 50,9 à 65,3, dans l'édition du 28 septembre 2026. Il est classé 159e sur 246 modèles, à partir de 16 mesures.
Dans quelles tâches Qwen3-8B est-il le plus fort ?
Ses deux meilleures tâches sont maths (63,8) et sciences (57,3). Sa tâche la plus faible est français (43,5).
Qwen3-8B peut-il tourner en local ?
Tient à partir d'une carte graphique de 8 Go (6 Go utiles), en version allégée à 4 bits, par exemple une GeForce RTX 5050. Mémoire estimée : 5,5 Go.
Combien coûte Qwen3-8B ?
0,04 € par million de jetons en entrée et 0,35 € en sortie, au tarif affiché par les fournisseurs. Le coût réel d'une tâche dépend du nombre de jetons que le modèle consomme.
Qui édite Qwen3-8B ?
Qwen3-8B est édité par Alibaba (Chine), et il est sorti le 28 avril 2025. Ses poids sont ouverts, sous licence Apache 2.0.

Ses voisins