# Classement général des modèles de langage

> Dans l'édition du 28 septembre 2026, Claude Opus 5.5 (Anthropic) est en tête du classement général avec un score IA de 99,9, ex æquo avec GPT-6 Astra et Claude Sonnet 5.5. La marge du premier va de 98,6 à 101,2 ; deux modèles dont les marges se recouvrent sont ex æquo. 246 modèles sont classés, 194 autres ont un score provisoire. 152 modèles historiques, que plus aucun benchmark vivant ne mesure, restent dans le catalogue sans être classés.

Page : https://quelleia.com/classement/
Édition : 2026-W40, 28 septembre 2026
Question : Quel est le meilleur modèle, tous usages confondus ?

## Comment lire ce classement

Le score IA résume les résultats d'un modèle sur les benchmarks où il a été mesuré. 100 correspond au meilleur modèle au lancement du site, 50 à GPT-4o de fin 2024. La barre indique la marge d'erreur : deux modèles dont les barres se chevauchent sont ex æquo.

## Modèles classés (246)

| Rang | Modèle | Éditeur | Score | Marge à 90 % | Couverture | Mesures | Prix entrée / sortie (€ par million de jetons) |
| --- | --- | --- | --- | --- | --- | --- | --- |
| 1 | Claude Opus 5.5 | Anthropic | 99,9 | de 98,6 à 101,2 | 100 % | 26 | 4 € / 20 € |
| 2 | GPT-6 Astra | OpenAI | 99,1 | de 97,6 à 100,5 | 100 % | 44 | 8,78 € / 44 € |
| 3 | Claude Sonnet 5.5 | Anthropic | 98,0 | de 96,8 à 99,3 | 75 % | 14 | 2 € / 10 € |
| 4 | Claude Fable 5.1 | Anthropic | 97,3 | de 96,2 à 98,4 | 100 % | 34 | 8,78 € / 44 € |
| 5 | Claude Opus 5 | Anthropic | 95,2 | de 94,2 à 96,1 | 100 % | 37 | 4,39 € / 22 € |
| 6 | GPT-6 Sol | OpenAI | 94,9 | de 91,0 à 98,8 | 85 % | 10 | 2 € / 10 € |
| 7 | Claude Fable 5 | Anthropic | 94,4 | de 92,8 à 96,0 | 100 % | 39 | 8,78 € / 44 € |
| 8 | GPT-5.6 Sol | OpenAI | 93,9 | de 92,5 à 95,2 | 100 % | 49 | 3,51 € / 18 € |
| 9 | GPT-5.4 Pro | OpenAI | 92,6 | de 91,0 à 94,1 | 50 % | 13 | 26 € / 158 € |
| 10 | GPT-5.6 Terra | OpenAI | 92,0 | de 90,3 à 93,8 | 100 % | 41 | 2,17 € / 13 € |
| 11 | GPT-5.5 | OpenAI | 91,3 | de 90,0 à 92,5 | 100 % | 45 | 4,34 € / 26 € |
| 12 | Claude Opus 4.8 | Anthropic | 90,7 | de 89,7 à 91,8 | 100 % | 41 | 4,39 € / 22 € |
| 13 | MiMo-V2.6-Pro | Xiaomi | 90,5 | de 84,4 à 96,6 | 70 % | 8 | 0,44 € / 0,87 € |
| 14 | Kimi K3 | Moonshot | 90,2 | de 88,7 à 91,7 | 100 % | 35 | 2,60 € / 13 € |
| 15 | Muse Spark 1.3 | Meta AI | 90,2 | de 88,1 à 92,3 | 100 % | 20 | 1,25 € / 4,25 € |
| 16 | Gemini 3.7 Flash | Google DeepMind | 89,9 | de 88,6 à 91,3 | 100 % | 36 | 1,50 € / 7,50 € |
| 17 | Gemini 3.8 Flash | Google DeepMind | 89,7 | de 87,8 à 91,6 | 100 % | 31 | 1,50 € / 7,50 € |
| 18 | Claude Sonnet 5 | Anthropic | 89,2 | de 87,4 à 91,0 | 100 % | 32 | 1,73 € / 8,67 € |
| 19 | Grok 4.6 | xAI | 89,2 | de 87,8 à 90,5 | 100 % | 32 | 1,76 € / 5,27 € |
| 20 | GPT-5.4 | OpenAI | 88,9 | de 87,9 à 89,9 | 100 % | 50 | 2,17 € / 13 € |
| 21 | Qwen 3.8 Max | Alibaba | 88,9 | de 87,6 à 90,3 | 50 % | 13 | 1,76 € / 5,27 € |
| 22 | Qwen3.8 Max (0902) | Alibaba | 88,9 | de 86,2 à 91,6 | 85 % | 16 | 1,76 € / 5,27 € |
| 23 | Claude Opus 4.7 | Anthropic | 88,6 | de 87,8 à 89,5 | 100 % | 40 | 4,39 € / 22 € |
| 24 | GLM-5.3 | Z.ai (Zhipu AI) | 88,4 | de 86,7 à 90,0 | 95 % | 25 | 1,40 € / 4,40 € |
| 25 | GPT-5.6 Luna | OpenAI | 88,1 | de 86,2 à 90,1 | 100 % | 41 | 0,87 € / 5,20 € |
| 26 | Claude Opus 4.6 | Anthropic | 87,6 | de 86,5 à 88,7 | 100 % | 38 | 4,39 € / 22 € |
| 27 | DeepSeek V4 Pro 0813 | DeepSeek | 87,6 | de 86,2 à 89,0 | 65 % | 16 | 0,61 € / 1,82 € |
| 28 | GPT-6 Luna | OpenAI | 87,6 | de 79,0 à 96,2 | 70 % | 9 | 0,10 € / 0,50 € |
| 29 | DeepSeek V4.1 Flash | DeepSeek | 87,3 | de 83,4 à 91,3 | 80 % | 15 | 0,15 € / 0,60 € |
| 30 | Grok 4.5 | xAI | 87,3 | de 85,4 à 89,3 | 100 % | 31 | 1,76 € / 5,27 € |
| 31 | Grok 4.7 | xAI | 87,3 | de 83,9 à 90,8 | 60 % | 12 | 1,76 € / 5,27 € |
| 32 | Muse Spark 1.2 | Meta AI | 87,1 | de 85,2 à 89,0 | 100 % | 17 | 1,25 € / 4,25 € |
| 33 | DeepSeek V4 Flash 0731 | DeepSeek | 86,8 | de 85,1 à 88,6 | 50 % | 16 | 0,18 € / 0,35 € |
| 34 | Gemini 3.6 Flash | Google DeepMind | 86,6 | de 85,3 à 87,8 | 100 % | 36 | 1,30 € / 6,50 € |
| 35 | Gemini 3.1 Pro | Google DeepMind | 86,0 | de 84,4 à 87,7 | 100 % | 44 | 2 € / 12 € |
| 36 | Gemini 3.5 Flash | Google DeepMind | 85,8 | de 84,3 à 87,3 | 100 % | 36 | 1,30 € / 7,80 € |
| 37 | Muse Spark 1.1 | Meta AI | 85,5 | de 83,4 à 87,6 | 100 % | 17 | 1,10 € / 3,73 € |
| 38 | Claude Sonnet 4.6 | Anthropic | 84,7 | de 82,7 à 86,8 | 100 % | 41 | 2,63 € / 13 € |
| 39 | GLM-5.3-Flash | Z.ai (Zhipu AI) | 84,7 | de 82,3 à 87,2 | 100 % | 30 | 0,15 € / 0,50 € |
| 40 | Qwen3.7-Max | Alibaba | 84,7 | de 82,8 à 86,6 | 95 % | 22 | 1,08 € / 3,25 € |
| 41 | Muse Spark | Meta AI | 84,5 | de 81,9 à 87,0 | 65 % | 15 | inconnu |
| 42 | GPT-5.2 | OpenAI | 84,2 | de 82,4 à 86,0 | 100 % | 44 | 1,52 € / 12 € |
| 43 | GLM-5.2 | Z.ai (Zhipu AI) | 83,9 | de 81,9 à 86,0 | 95 % | 31 | 0,98 € / 3,08 € |
| 44 | Grok 4.20 | xAI | 83,7 | de 80,8 à 86,6 | 70 % | 15 | 1,08 € / 2,17 € |
| 45 | Gemini 3 Pro | Google DeepMind | 83,4 | de 81,6 à 85,3 | 100 % | 37 | 1,73 € / 10 € |
| 46 | Kimi K2.6 | Moonshot | 82,9 | de 81,3 à 84,5 | 100 % | 30 | 0,59 € / 2,96 € |
| 47 | DeepSeek-V4-Flash | DeepSeek | 82,6 | de 75,9 à 89,3 | 80 % | 14 | 0,09 € / 0,17 € |
| 48 | Gemini 3 Flash | Google DeepMind | 82,4 | de 81,0 à 83,8 | 100 % | 40 | 0,43 € / 2,60 € |
| 49 | Qwen 3.8 27B | Alibaba | 82,4 | de 77,5 à 87,3 | 85 % | 23 | 0,35 € / 2,75 € |
| 50 | DeepSeek-V4-Pro | DeepSeek | 82,1 | de 79,2 à 85,1 | 95 % | 25 | 0,38 € / 0,75 € |
| 51 | Claude Opus 4.5 | Anthropic | 81,9 | de 80,1 à 83,7 | 100 % | 36 | 4,39 € / 22 € |
| 52 | GLM-5.1 | Z.ai (Zhipu AI) | 81,9 | de 79,9 à 83,8 | 95 % | 23 | 0,85 € / 2,67 € |
| 53 | MiMo-V2.5-Pro | Xiaomi | 81,9 | de 78,4 à 85,4 | 80 % | 12 | 0,38 € / 0,76 € |
| 54 | GPT-5 Pro | OpenAI | 81,3 | de 78,6 à 84,0 | 50 % | 9 | 13 € / 105 € |
| 55 | Kimi K2.7 Code | Moonshot | 81,3 | de 79,5 à 83,2 | 70 % | 16 | 0,83 € / 3,51 € |
| 56 | GPT-5.3 Chat | OpenAI | 80,8 | de 71,6 à 90,0 | 60 % | 7 | 1,52 € / 12 € |
| 57 | Qwen 3.6 Max (Preview) | Alibaba | 80,8 | de 78,2 à 83,4 | 95 % | 18 | 1,14 € / 6,85 € |
| 58 | MiMo-V2.6-Flash | Xiaomi | 80,6 | de 70,7 à 90,4 | 65 % | 7 | 0,14 € / 0,28 € |
| 59 | GPT-5 | OpenAI | 79,8 | de 77,9 à 81,6 | 100 % | 42 | 1,08 € / 8,67 € |
| 60 | GPT-5.1 | OpenAI | 79,8 | de 78,0 à 81,5 | 100 % | 31 | 1,08 € / 8,67 € |
| 61 | Inkling-Small | Thinking Machines | 79,8 | de 76,5 à 83,0 | 85 % | 20 | 0,45 € / 1,20 € |
| 62 | MiniMax-M3 | MiniMax | 79,8 | de 76,6 à 82,9 | 100 % | 26 | 0,24 € / 0,97 € |
| 63 | MiMo-V2.5 | Xiaomi | 79,2 | de 75,2 à 83,3 | 70 % | 11 | 0,12 € / 0,25 € |
| 64 | GPT-5.4 Mini | OpenAI | 79,0 | de 77,1 à 80,8 | 100 % | 36 | 0,65 € / 3,90 € |
| 65 | Inkling | Thinking Machines | 79,0 | de 76,6 à 81,4 | 95 % | 25 | 0,95 € / 4,05 € |
| 66 | Qwen 3.6 Plus | Alibaba | 79,0 | de 76,6 à 81,4 | 95 % | 21 | 0,28 € / 1,69 € |
| 67 | Qwen3.7-Plus | Alibaba | 78,7 | de 75,7 à 81,7 | 95 % | 19 | 0,28 € / 1,11 € |
| 68 | Grok 4.3 Beta | xAI | 77,9 | de 74,8 à 81,1 | 100 % | 22 | 1,08 € / 2,17 € |
| 69 | Kimi K2.5 | Moonshot | 77,9 | de 76,1 à 79,8 | 100 % | 25 | 0,35 € / 1,65 € |
| 70 | Qwen3.5 397B-A17B | Alibaba | 77,2 | de 74,4 à 79,9 | 100 % | 17 | 0,34 € / 2,03 € |
| 71 | Claude Sonnet 4.5 | Anthropic | 76,9 | de 75,1 à 78,7 | 95 % | 44 | 2,60 € / 13 € |
| 72 | GPT-5.5 Instant | OpenAI | 76,6 | de 71,6 à 81,7 | 80 % | 14 | 4,39 € / 26 € |
| 73 | o3 | OpenAI | 76,6 | de 74,9 à 78,4 | 95 % | 33 | 1,76 € / 7,02 € |
| 74 | Gemini 3.5 Flash-Lite | Google DeepMind | 76,4 | de 73,5 à 79,3 | 85 % | 31 | 0,26 € / 2,17 € |
| 75 | Grok 4 | xAI | 76,4 | de 74,1 à 78,7 | 95 % | 21 | 2,63 € / 13 € |
| 76 | GLM-5 | Z.ai (Zhipu AI) | 76,1 | de 73,5 à 78,7 | 95 % | 21 | 0,52 € / 1,66 € |
| 77 | Nemotron 3 Ultra | NVIDIA | 75,9 | de 72,2 à 79,5 | 75 % | 17 | inconnu |
| 78 | Qwen 3.5 Plus (hosted 397B-A17B) | Alibaba | 75,9 | de 72,9 à 78,8 | 50 % | 9 | 0,35 € / 2,11 € |
| 79 | Qwen3.6 27B | Alibaba | 75,6 | de 72,5 à 78,7 | 60 % | 17 | 0,53 € / 3,16 € |
| 80 | DeepSeek-V3.2 | DeepSeek | 75,3 | de 73,4 à 77,2 | 80 % | 19 | 0,20 € / 0,30 € |
| 81 | GPT-5.4 Nano | OpenAI | 75,3 | de 72,7 à 77,9 | 80 % | 33 | 0,17 € / 1,08 € |
| 82 | MiniMax-M2.7 | MiniMax | 75,1 | de 70,6 à 79,5 | 65 % | 14 | 0,24 € / 1,04 € |
| 83 | Gemma 4 31B IT | Google DeepMind | 74,8 | de 71,8 à 77,8 | 85 % | 26 | 0,10 € / 0,31 € |
| 84 | GLM-4.7 | Z.ai (Zhipu AI) | 74,5 | de 70,9 à 78,2 | 95 % | 19 | 0,35 € / 1,52 € |
| 85 | GPT-5 mini | OpenAI | 74,5 | de 71,3 à 77,8 | 95 % | 38 | 0,22 € / 1,73 € |
| 86 | MiniMax-M2.5 | MiniMax | 74,5 | de 69,3 à 79,8 | 95 % | 13 | 0,13 € / 1 € |
| 87 | Claude Opus 4.1 | Anthropic | 74,3 | de 71,6 à 77,0 | 95 % | 27 | 13 € / 66 € |
| 88 | Kimi K2 Thinking | Moonshot | 74,3 | de 71,4 à 77,1 | 95 % | 16 | 0,52 € / 2,17 € |
| 89 | o4-mini | OpenAI | 74,3 | de 71,5 à 77,1 | 95 % | 33 | 0,95 € / 3,82 € |
| 90 | Qwen3.5-122B-A10B | Alibaba | 74,0 | de 70,0 à 78,0 | 85 % | 13 | 0,35 € / 2,81 € |
| 91 | Muse Glimmer 30B | Meta AI | 73,8 | de 68,4 à 79,2 | 65 % | 7 | 0,30 € / 1,10 € |
| 92 | Gemini 2.5 Pro (Jun 2025) | Google DeepMind | 73,2 | de 70,6 à 75,9 | 100 % | 38 | 1,10 € / 8,78 € |
| 93 | Qwen 3.6 35B-A3B | Alibaba | 73,2 | de 69,6 à 76,9 | 50 % | 12 | 0,22 € / 1,30 € |
| 94 | Qwen3.5-27B | Alibaba | 73,2 | de 69,3 à 77,2 | 100 % | 12 | 0,26 € / 2,11 € |
| 95 | DeepSeek-V3.1-Terminus | DeepSeek | 73,0 | de 67,0 à 79,0 | 65 % | 8 | 0,24 € / 0,88 € |
| 96 | Grok 4.1 Fast | xAI | 73,0 | de 66,5 à 79,5 | 100 % | 21 | 0,17 € / 0,43 € |
| 97 | MiniMax-M2.1 | MiniMax | 73,0 | de 67,2 à 78,8 | 65 % | 8 | 0,26 € / 1,05 € |
| 98 | Gemma 4 26B A4B | Google DeepMind | 72,7 | de 69,2 à 76,2 | 85 % | 25 | 0,05 € / 0,29 € |
| 99 | Gemini 3.1 Flash-Lite | Google DeepMind | 72,5 | de 68,7 à 76,2 | 100 % | 30 | 0,22 € / 1,30 € |
| 100 | DeepSeek-V3.2-Exp | DeepSeek | 72,2 | de 67,2 à 77,2 | 95 % | 13 | 0,25 € / 0,38 € |
| 101 | Claude Opus 4 | Anthropic | 71,9 | de 69,0 à 74,8 | 95 % | 25 | 13 € / 66 € |
| 102 | DeepSeek-V3.1 | DeepSeek | 71,7 | de 67,0 à 76,3 | 75 % | 12 | 0,18 € / 0,69 € |
| 103 | Qwen3-Max | Alibaba | 71,7 | de 68,1 à 75,2 | 90 % | 15 | 0,68 € / 3,38 € |
| 104 | GLM-4.6 | Z.ai (Zhipu AI) | 71,4 | de 67,5 à 75,3 | 65 % | 13 | 0,37 € / 1,51 € |
| 105 | Claude Haiku 4.5 | Anthropic | 70,9 | de 68,4 à 73,3 | 100 % | 33 | 0,88 € / 4,39 € |
| 106 | Kimi K2 (Sep 2025) | Moonshot | 70,9 | de 63,2 à 78,5 | 75 % | 8 | 0,55 € / 2,22 € |
| 107 | Claude Sonnet 4 | Anthropic | 70,6 | de 68,4 à 72,8 | 95 % | 26 | 2,60 € / 13 € |
| 108 | Mistral Medium 3.5 | Mistral AI | 70,6 | de 66,9 à 74,4 | 85 % | 17 | 1,30 € / 6,50 € |
| 109 | Qwen 3.5 Flash (hosted 35B-A3B) | Alibaba | 70,4 | de 67,1 à 73,6 | 95 % | 17 | 0,09 € / 0,35 € |
| 110 | Qwen3-235B-A22B-Thinking (Jul 2025) | Alibaba | 70,4 | de 66,6 à 74,1 | 90 % | 22 | 0,26 € / 2,55 € |
| 111 | GLM-4.5 | Z.ai (Zhipu AI) | 70,1 | de 63,2 à 77,0 | 60 % | 9 | 0,52 € / 1,91 € |
| 112 | Grok 4 Fast | xAI | 70,1 | de 64,9 à 75,3 | 80 % | 12 | 0,17 € / 0,43 € |
| 113 | MiMo-V2-Flash | Xiaomi | 70,1 | de 63,9 à 76,3 | 65 % | 9 | 0,12 € / 0,25 € |
| 114 | Gemini 2.5 Flash (Jun 2025) | Google DeepMind | 69,6 | de 66,1 à 73,1 | 95 % | 23 | 0,26 € / 2,17 € |
| 115 | Gemini 2.5 Flash (Apr 2025) | Google DeepMind | 69,3 | de 65,6 à 73,1 | 60 % | 7 | 0,13 € / 0,53 € |
| 116 | Gemini 2.5 Flash (May 2025) | Google DeepMind | 69,3 | de 66,7 à 72,0 | 50 % | 6 | 0,12 € / 2,77 € |
| 117 | Gemini 2.5 Flash (Sep 2025) | Google DeepMind | 69,1 | de 63,7 à 74,4 | 65 % | 9 | 0,26 € / 2,19 € |
| 118 | Qwen3.5-35B-A3B | Alibaba | 68,8 | de 65,5 à 72,1 | 80 % | 23 | 0,12 € / 0,87 € |
| 119 | o1 | OpenAI | 68,8 | de 66,8 à 70,9 | 95 % | 20 | 13 € / 53 € |
| 120 | Kimi K2 (Jul 2025) | Moonshot | 68,5 | de 62,7 à 74,3 | 75 % | 11 | 0,50 € / 2,02 € |
| 121 | Qwen3-Coder-480B-A35B | Alibaba | 68,5 | de 64,3 à 72,8 | 65 % | 11 | 0,19 € / 1,56 € |
| 122 | Claude 3.7 Sonnet | Anthropic | 68,3 | de 65,5 à 71,1 | 95 % | 25 | 2,63 € / 13 € |
| 123 | DeepSeek-R1 (May 2025) | DeepSeek | 68,3 | de 65,5 à 71,0 | 90 % | 15 | 0,43 € / 1,86 € |
| 124 | Qwen3-235B-A22B-Instruct (Jul 2025) | Alibaba | 67,5 | de 62,6 à 72,4 | 75 % | 16 | 0,19 € / 0,77 € |
| 125 | o3-mini | OpenAI | 67,5 | de 64,0 à 71,0 | 75 % | 29 | 0,97 € / 3,86 € |
| 126 | Grok-3 mini | xAI | 66,7 | de 63,1 à 70,3 | 75 % | 17 | 0,26 € / 0,43 € |
| 127 | Qwen3-235B-A22B | Alibaba | 66,5 | de 62,6 à 70,3 | 75 % | 17 | 0,61 € / 2,46 € |
| 128 | Trinity Large Thinking | Arcee AI | 66,2 | de 61,4 à 71,0 | 65 % | 11 | 0,19 € / 0,74 € |
| 129 | chutes/Qwen3-Next-80B-A3B-Instruct | Alibaba | 66,2 | de 56,6 à 75,7 | 60 % | 11 | 0,44 € / 1,76 € |
| 130 | gpt-oss-120b | OpenAI | 66,2 | de 61,6 à 70,8 | 90 % | 30 | 0,03 € / 0,16 € |
| 131 | Mistral Large 3 | Mistral AI | 65,9 | de 60,4 à 71,4 | 85 % | 13 | 0,43 € / 1,30 € |
| 132 | Mistral Medium 3.1 | Mistral AI | 65,9 | de 60,1 à 71,8 | 80 % | 13 | 0,35 € / 1,73 € |
| 133 | Qwen3-30B-A3B-Thinking (Jul 2025) | Alibaba | 65,7 | de 62,0 à 69,4 | 50 % | 7 | 0,32 € / 1,14 € |
| 134 | Qwen3.5-9B | Alibaba | 65,7 | de 62,1 à 69,2 | 60 % | 16 | 0,10 € / 0,15 € |
| 135 | Grok 3 | xAI | 65,4 | de 62,1 à 68,7 | 90 % | 20 | 2,63 € / 13 € |
| 136 | MiniMax-M2 | MiniMax | 65,4 | de 57,0 à 73,8 | 80 % | 10 | 0,22 € / 0,87 € |
| 137 | GPT-4.5 | OpenAI | 64,9 | de 59,8 à 69,9 | 80 % | 16 | inconnu |
| 138 | DeepSeek-R1 | DeepSeek | 64,4 | de 61,9 à 66,8 | 65 % | 11 | inconnu |
| 139 | GPT-5 nano | OpenAI | 64,1 | de 58,7 à 69,5 | 80 % | 31 | 0,04 € / 0,35 € |
| 140 | GPT-4.1 | OpenAI | 63,1 | de 59,8 à 66,4 | 80 % | 31 | 1,76 € / 7,02 € |
| 141 | Qwen3-14B | Alibaba | 63,1 | de 58,5 à 67,6 | 60 % | 15 | 0,31 € / 1,23 € |
| 142 | Qwen3-32B | Alibaba | 62,8 | de 58,6 à 67,0 | 75 % | 21 | 0,07 € / 0,24 € |
| 143 | Qwen3-30B-A3B-Instruct (Jul 2025) | Alibaba | 62,5 | de 58,4 à 66,7 | 75 % | 11 | 0,26 € / 0,44 € |
| 144 | GLM-4.5-Air | Z.ai (Zhipu AI) | 62,3 | de 53,7 à 70,8 | 75 % | 14 | 0,18 € / 0,97 € |
| 145 | GPT-4.1 mini | OpenAI | 62,3 | de 59,6 à 65,0 | 80 % | 26 | 0,35 € / 1,39 € |
| 146 | DeepSeek-R1-Distill-Qwen-32B | DeepSeek | 62,0 | de 50,2 à 73,8 | 60 % | 9 | 0,25 € / 0,76 € |
| 147 | DeepSeek-V3 (Mar 2025) | DeepSeek | 62,0 | de 58,3 à 65,7 | 90 % | 16 | 0,17 € / 0,67 € |
| 148 | Gemini 2.5 Flash-Lite (Jun 2025) | Google DeepMind | 61,8 | de 56,0 à 67,5 | 80 % | 18 | 0,09 € / 0,35 € |
| 149 | Qwen3-Next-80B-A3B Thinking | Alibaba | 61,8 | de 52,7 à 70,8 | 60 % | 11 | inconnu |
| 150 | glm-4.7-flash | Z.ai (Zhipu AI) | 61,8 | de 57,8 à 65,7 | 75 % | 17 | inconnu |
| 151 | QwQ-32B | Alibaba | 61,2 | de 54,7 à 67,8 | 75 % | 15 | 0,13 € / 0,35 € |
| 152 | o1-preview | OpenAI | 60,2 | de 55,2 à 65,2 | 90 % | 12 | inconnu |
| 153 | gpt-oss-20b | OpenAI | 59,9 | de 53,9 à 66,0 | 75 % | 23 | 0,03 € / 0,12 € |
| 154 | Nemotron 3 Super 120B | NVIDIA | 59,7 | de 50,4 à 69,0 | 60 % | 7 | 0,08 € / 0,39 € |
| 155 | Qwen3-30B-A3B | Alibaba | 59,7 | de 54,1 à 65,2 | 75 % | 18 | 0,10 € / 0,43 € |
| 156 | Mistral Medium 3 | Mistral AI | 59,1 | de 55,4 à 62,8 | 80 % | 12 | 0,35 € / 1,76 € |
| 157 | o1-mini | OpenAI | 59,1 | de 55,0 à 63,3 | 75 % | 13 | 0,97 € / 3,86 € |
| 158 | Gemini 2.0 Flash (Feb 2025) | Google DeepMind | 58,9 | de 55,5 à 62,3 | 80 % | 14 | 0,09 € / 0,37 € |
| 159 | Qwen3-8B | Alibaba | 58,1 | de 50,9 à 65,3 | 60 % | 16 | 0,04 € / 0,35 € |
| 160 | Qwen2.5-Max | Alibaba | 57,1 | de 51,8 à 62,3 | 60 % | 9 | 1,40 € / 5,62 € |
| 161 | Cohere Command A | Cohere | 56,8 | de 50,3 à 63,2 | 75 % | 9 | 2,17 € / 8,67 € |
| 162 | Nemotron 3.5 Lightning | NVIDIA | 56,8 | de 46,5 à 67,1 | 60 % | 7 | 0,08 € / 0,20 € |
| 163 | Claude 3.5 Sonnet | Anthropic | 56,3 | de 51,3 à 61,2 | 95 % | 17 | 2,63 € / 13 € |
| 164 | Claude 3.5 Sonnet (October 2024) | Anthropic | 56,0 | de 50,4 à 61,6 | 65 % | 13 | inconnu |
| 165 | Llama 4 Maverick | Meta AI | 56,0 | de 51,8 à 60,2 | 80 % | 22 | 0,13 € / 0,52 € |
| 166 | Mistral Small 3.2 | Mistral AI | 56,0 | de 52,2 à 59,8 | 80 % | 22 | 0,07 € / 0,17 € |
| 167 | Gemini 1.5 Pro (Sept 2024) | Google DeepMind | 55,8 | de 52,1 à 59,4 | 95 % | 15 | inconnu |
| 168 | DeepSeek-V3 | DeepSeek | 54,4 | de 49,0 à 59,9 | 65 % | 8 | inconnu |
| 169 | Magistral Small 1.2 | Mistral AI | 54,4 | de 49,8 à 59,1 | 60 % | 11 | 0,44 € / 1,32 € |
| 170 | Gemma 3 27B | Google DeepMind | 54,2 | de 49,6 à 58,8 | 80 % | 23 | 0,07 € / 0,14 € |
| 171 | Gemini 2.0 Flash-Lite | Google DeepMind | 53,9 | de 45,3 à 62,6 | 80 % | 9 | 0,07 € / 0,26 € |
| 172 | GPT-4o (May 2024) | OpenAI | 53,7 | de 49,0 à 58,3 | 95 % | 13 | 4,39 € / 13 € |
| 173 | Qwen Plus (Jan 2025) | Alibaba | 53,7 | de 48,8 à 58,5 | 50 % | 7 | 0,35 € / 1,05 € |
| 174 | Grok-2 (Dec 2024) | xAI | 53,1 | de 48,5 à 57,8 | 60 % | 11 | inconnu |
| 175 | Granite 4.1 8B | IBM | 52,9 | de 41,8 à 64,0 | 65 % | 7 | 0,04 € / 0,09 € |
| 176 | Llama 3.1-405B | Meta AI | 52,6 | de 48,6 à 56,6 | 75 % | 18 | 2,38 € / 2,60 € |
| 177 | OLMo 3.1 32B Instruct | Allen Institute for AI | 52,4 | de 43,1 à 61,6 | 60 % | 12 | inconnu |
| 178 | GPT-4.1 nano | OpenAI | 51,3 | de 46,5 à 56,1 | 80 % | 17 | 0,09 € / 0,35 € |
| 179 | Nemotron 3 Nano 30B | NVIDIA | 51,3 | de 41,8 à 60,9 | 60 % | 14 | inconnu |
| 180 | Llama 4 Scout | Meta AI | 51,1 | de 46,8 à 55,3 | 80 % | 23 | 0,09 € / 0,26 € |
| 181 | GPT-4o (Aug 2024) | OpenAI | 50,8 | de 45,8 à 55,8 | 95 % | 14 | 2,19 € / 8,78 € |
| 182 | Llama 3.3 70B | Meta AI | 50,5 | de 46,4 à 54,6 | 90 % | 25 | 0,09 € / 0,28 € |
| 183 | GPT-4 Turbo (Apr 2024) | OpenAI | 50,3 | de 45,6 à 54,9 | 95 % | 15 | inconnu |
| 184 | Gemma 3n E4B | Google DeepMind | 50,3 | de 41,0 à 59,6 | 60 % | 13 | 0,05 € / 0,10 € |
| 185 | Mistral Large 2 (Jul 2024) | Mistral AI | 50,3 | de 45,7 à 54,8 | 75 % | 11 | 1,76 € / 5,27 € |
| 186 | Mistral Large 2 (Nov 2024) | Mistral AI | 50,3 | de 45,4 à 55,1 | 75 % | 11 | 1,76 € / 5,27 € |
| 187 | Qwen2.5-72B | Alibaba | 50,3 | de 46,1 à 54,5 | 95 % | 23 | 2,46 € / 7,37 € |
| 188 | Claude 3 Opus | Anthropic | 50,0 | de 45,8 à 54,3 | 95 % | 17 | 13 € / 66 € |
| 189 | GPT-4o (Nov 2024) | OpenAI | 50,0 | de 45,4 à 54,6 | 65 % | 12 | 2,19 € / 8,78 € |
| 190 | Gemini 1.5 Pro (May 2024) | Google DeepMind | 50,0 | de 45,4 à 54,7 | 80 % | 11 | inconnu |
| 191 | Magistral Medium 1.1 | Mistral AI | 50,0 | de 39,9 à 60,1 | 75 % | 9 | 1,73 € / 4,34 € |
| 192 | Mistral Small 3.1 | Mistral AI | 49,7 | de 45,1 à 54,4 | 80 % | 21 | 0,09 € / 0,26 € |
| 193 | GPT-4 Turbo (Nov 2023) | OpenAI | 49,5 | de 44,4 à 54,6 | 90 % | 10 | 8,78 € / 26 € |
| 194 | Gemini 1.5 Flash (Sep 2024) | Google DeepMind | 49,0 | de 44,2 à 53,8 | 95 % | 14 | inconnu |
| 195 | Claude 3.5 Haiku | Anthropic | 48,7 | de 43,6 à 53,8 | 95 % | 16 | 0,70 € / 3,51 € |
| 196 | Gemma 3 12B | Google DeepMind | 48,7 | de 42,8 à 54,6 | 75 % | 21 | 0,04 € / 0,13 € |
| 197 | Llama-3.1-Nemotron-70B-Instruct | NVIDIA | 48,2 | de 37,9 à 58,4 | 60 % | 11 | 0,52 € / 0,52 € |
| 198 | Llama 3.1-70B | Meta AI | 47,9 | de 43,1 à 52,8 | 90 % | 20 | 0,63 € / 0,63 € |
| 199 | GPT-4o mini | OpenAI | 46,1 | de 40,8 à 51,4 | 95 % | 18 | 0,13 € / 0,53 € |
| 200 | Llama 3.2 90B | Meta AI | 45,8 | de 37,6 à 54,0 | 50 % | 4 | 0,31 € / 0,35 € |
| 201 | OLMo 3 32B Think | Ai2 | 45,0 | de 33,4 à 56,7 | 60 % | 7 | 0,13 € / 0,43 € |
| 202 | Phi-4 | Microsoft | 45,0 | de 34,9 à 55,2 | 90 % | 16 | 0,06 € / 0,12 € |
| 203 | Mistral Small 3 | Mistral AI | 44,5 | de 36,5 à 52,6 | 75 % | 14 | 0,04 € / 0,07 € |
| 204 | Llama 3-70B | Meta AI | 43,5 | de 37,4 à 49,5 | 75 % | 15 | inconnu |
| 205 | GPT-4 (Jun 2023) | OpenAI | 43,0 | de 36,0 à 49,9 | 90 % | 15 | inconnu |
| 206 | GPT-4 (Mar 2023) | OpenAI | 43,0 | de 36,2 à 49,7 | 75 % | 9 | 26 € / 53 € |
| 207 | Gemini 1.5 Flash (May 2024) | Google DeepMind | 43,0 | de 36,8 à 49,1 | 80 % | 11 | inconnu |
| 208 | Gemma 2 27B | Google DeepMind | 42,7 | de 36,2 à 49,2 | 75 % | 15 | 0,57 € / 0,57 € |
| 209 | Amazon Nova Pro | Amazon | 42,4 | de 32,3 à 52,5 | 65 % | 8 | 0,70 € / 2,81 € |
| 210 | Claude 3 Sonnet | Anthropic | 42,4 | de 36,1 à 48,8 | 80 % | 11 | inconnu |
| 211 | Qwen2-72B | Alibaba | 40,1 | de 32,4 à 47,7 | 75 % | 9 | inconnu |
| 212 | Gemma 3 4B | Google DeepMind | 39,8 | de 31,1 à 48,5 | 75 % | 19 | 0,04 € / 0,09 € |
| 213 | Mistral Large | Mistral AI | 38,8 | de 30,3 à 47,2 | 75 % | 9 | 0,44 € / 1,32 € |
| 214 | Gemini 1.5 Flash 8B | Google DeepMind | 37,7 | de 30,2 à 45,3 | 80 % | 10 | inconnu |
| 215 | Claude 2.1 | Anthropic | 37,5 | de 28,1 à 46,8 | 50 % | 5 | inconnu |
| 216 | Claude 3 Haiku | Anthropic | 37,5 | de 30,0 à 44,9 | 80 % | 13 | 0,22 € / 1,10 € |
| 217 | Amazon Nova Lite | Amazon | 37,0 | de 26,6 à 47,3 | 65 % | 8 | 0,05 € / 0,21 € |
| 218 | Gemma 2 9B | Google DeepMind | 37,0 | de 27,6 à 46,3 | 60 % | 13 | inconnu |
| 219 | Qwen2.5-7B | Alibaba | 36,7 | de 27,5 à 45,9 | 50 % | 6 | 0,15 € / 0,61 € |
| 220 | Mistral NeMo | Mistral AI | 35,9 | de 26,7 à 45,2 | 50 % | 8 | 0,13 € / 0,13 € |
| 221 | Mixtral 8x22B | Mistral AI | 34,1 | de 24,3 à 43,8 | 75 % | 10 | 1,76 € / 5,27 € |
| 222 | Mistral Medium | Mistral AI | 32,8 | de 21,5 à 44,0 | 75 % | 7 | 1,32 € / 6,58 € |
| 223 | Ministral 8B | Mistral AI | 32,5 | de 22,6 à 42,4 | 75 % | 12 | 0,09 € / 0,09 € |
| 224 | Qwen1.5-110B | Alibaba | 31,5 | de 19,9 à 43,1 | 75 % | 7 | inconnu |
| 225 | Qwen1.5-72B | Alibaba | 31,0 | de 20,3 à 41,6 | 60 % | 7 | inconnu |
| 226 | Yi-1.5-34B | 01.AI | 30,4 | de 19,0 à 41,9 | 60 % | 12 | inconnu |
| 227 | GPT-3.5 Turbo (Jan 2024) | OpenAI | 29,6 | de 19,6 à 39,7 | 75 % | 15 | 0,44 € / 1,32 € |
| 228 | Llama 3.1-8B | Meta AI | 28,9 | de 20,0 à 37,7 | 90 % | 24 | 0,02 € / 0,03 € |
| 229 | Llama 3-8B | Meta AI | 28,1 | de 18,2 à 38,0 | 75 % | 16 | inconnu |
| 230 | Mixtral 8x7B | Mistral AI | 28,1 | de 17,3 à 38,9 | 75 % | 14 | 0,61 € / 0,61 € |
| 231 | GPT-3.5 Turbo (Nov 2023) | OpenAI | 24,9 | de 12,7 à 37,2 | 60 % | 7 | 0,88 € / 1,76 € |
| 232 | DBRX | Databricks | 24,7 | de 12,1 à 37,2 | 60 % | 7 | inconnu |
| 233 | Qwen1.5-32B | Alibaba | 24,4 | de 11,6 à 37,2 | 60 % | 7 | inconnu |
| 234 | Qwen1.5-14B | Alibaba | 23,4 | de 11,0 à 35,7 | 60 % | 11 | inconnu |
| 235 | DeepSeek LLM 67B | DeepSeek | 19,7 | de 3,6 à 35,8 | 65 % | 7 | inconnu |
| 236 | Yi-34B | 01.AI | 19,5 | de 6,0 à 32,9 | 60 % | 7 | inconnu |
| 237 | Llama 2-70B | Meta AI | 16,9 | de 4,2 à 29,5 | 75 % | 15 | inconnu |
| 238 | Llama 3.2 3B | Meta AI | 16,1 | de 2,6 à 29,5 | 75 % | 14 | 0,04 € / 0,29 € |
| 239 | QwQ-32B-Preview | Alibaba | 15,5 | de 0,0 à 32,2 | 65 % | 6 | inconnu |
| 240 | phi-3-mini 3.8B | Microsoft | 10,6 | de 0,0 à 26,9 | 75 % | 7 | inconnu |
| 241 | Mistral 7B v0.2 | Mistral AI | 10,3 | de 0,0 à 24,5 | 60 % | 11 | 0,14 € / 0,19 € |
| 242 | Gemma 7B | Google DeepMind | 10,1 | de 0,0 à 24,4 | 60 % | 11 | inconnu |
| 243 | Llama 2-13B | Meta AI | 8,2 | de 0,0 à 23,5 | 75 % | 13 | inconnu |
| 244 | Llama 2-7B | Meta AI | 1,7 | de 0,0 à 19,3 | 75 % | 11 | inconnu |
| 245 | Gemma 2B | Google DeepMind | 0,0 | de 0,0 à 18,0 | 50 % | 9 | inconnu |
| 246 | Llama 3.2 1B | Meta AI | 0,0 | de 0,0 à 16,6 | 90 % | 17 | 0,02 € / 0,18 € |

## Scores provisoires (194)

Ces modèles n'ont pas encore assez de mesures pour recevoir un rang. Ils sont listés du score le plus haut au plus bas.

| Rang | Modèle | Éditeur | Score | Marge à 90 % | Couverture | Mesures | Prix entrée / sortie (€ par million de jetons) |
| --- | --- | --- | --- | --- | --- | --- | --- |
| provisoire | GPT-6.1 Sol | OpenAI | 100,7 | de 90,3 à 111,0 | 5 % | 1 | 1,76 € / 8,78 € |
| provisoire | Claude Mythos Preview | Anthropic | 97,8 | de 81,0 à 114,6 | 15 % | 1 | inconnu |
| provisoire | Gemini 4 Argon | Google DeepMind | 97,0 | de 89,7 à 104,3 | 55 % | 6 | inconnu |
| provisoire | AI Co-Mathematician | Google DeepMind | 96,0 | de 93,5 à 98,4 | 10 % | 2 | inconnu |
| provisoire | GPT-5.5 Pro | OpenAI | 95,2 | de 93,1 à 97,2 | 35 % | 13 | 26 € / 158 € |
| provisoire | SWE-2 | Cognition | 94,4 | de 89,4 à 99,4 | 15 % | 1 | inconnu |
| provisoire | Qwen3.8 Flash Next | Alibaba | 93,1 | de 86,0 à 100,2 | 5 % | 1 | 0,13 € / 0,41 € |
| provisoire | Gemini 3 Deep Think | Google DeepMind | 92,8 | de 89,6 à 96,1 | 25 % | 3 | inconnu |
| provisoire | Tencent Hy4 preview | Tencent | 92,3 | de 89,5 à 95,1 | 15 % | 2 | 0,74 € / 2,23 € |
| provisoire | SWE-1.7 | Cognition | 91,0 | de 85,9 à 96,1 | 15 % | 1 | inconnu |
| provisoire | Step 5 Preview | StepFun | 89,4 | de 84,4 à 94,5 | 30 % | 3 | 0,95 € / 2,71 € |
| provisoire | GPT-5.2 Pro | OpenAI | 88,1 | de 85,8 à 90,4 | 25 % | 6 | 18 € / 147 € |
| provisoire | Grok 4.20 Beta 1 | xAI | 85,8 | de 76,1 à 95,5 | 60 % | 6 | inconnu |
| provisoire | GPT-5.2 Chat | OpenAI | 84,7 | de 75,8 à 93,6 | 65 % | 7 | 1,54 € / 12 € |
| provisoire | Grok 4.20 Multi Agent Beta | xAI | 84,5 | de 75,5 à 93,4 | 65 % | 7 | 1,10 € / 2,19 € |
| provisoire | Qwen3.5 Max Preview | Alibaba | 84,5 | de 75,2 à 93,8 | 60 % | 6 | inconnu |
| provisoire | ERNIE 5.1 | Baidu | 83,9 | de 74,7 à 93,2 | 60 % | 6 | 0,66 € / 2,63 € |
| provisoire | Hy3 | Tencent | 83,9 | de 79,0 à 88,9 | 65 % | 7 | 0,15 € / 0,50 € |
| provisoire | GPT-5.3 Codex | OpenAI | 82,1 | de 75,1 à 89,2 | 35 % | 6 | 1,54 € / 12 € |
| provisoire | Composer 2.5 | Cursor | 81,9 | de 76,3 à 87,4 | 15 % | 2 | inconnu |
| provisoire | Seed 2.0 Pro | ByteDance | 81,1 | de 72,3 à 89,8 | 65 % | 7 | 0,44 € / 2,63 € |
| provisoire | Gemini 2.5 Deep Think | Google DeepMind | 80,8 | de 78,3 à 83,4 | 10 % | 2 | inconnu |
| provisoire | GPT-5.1-Codex-Max | OpenAI | 80,3 | de 77,3 à 83,3 | 40 % | 3 | 1,10 € / 8,78 € |
| provisoire | Grok Build 0.1 | xAI | 80,0 | de 73,2 à 86,8 | 25 % | 3 | 0,88 € / 1,76 € |
| provisoire | MiMo-V2-Pro | Xiaomi | 80,0 | de 75,3 à 84,8 | 65 % | 7 | 0,38 € / 0,76 € |
| provisoire | ERNIE 5.0 | Baidu | 79,5 | de 70,8 à 88,3 | 65 % | 7 | 0,74 € / 2,96 € |
| provisoire | Grok 4.20 Beta (0309) | xAI | 78,5 | de 71,1 à 85,8 | 70 % | 8 | 1,76 € / 5,27 € |
| provisoire | ChatGPT-4o Latest | OpenAI | 77,9 | de 69,1 à 86,8 | 65 % | 7 | 4,39 € / 18 € |
| provisoire | GLM-5V-Turbo | Z.ai (Zhipu AI) | 77,2 | de 72,6 à 81,8 | 70 % | 8 | 1,05 € / 3,51 € |
| provisoire | Kimi K2.5 Instant | Moonshot | 76,9 | de 72,0 à 81,8 | 70 % | 8 | inconnu |
| provisoire | GPT-5.2 Codex | OpenAI | 76,6 | de 69,2 à 84,0 | 20 % | 2 | 1,54 € / 12 € |
| provisoire | GPT-5-Codex | OpenAI | 76,4 | de 73,0 à 79,8 | 15 % | 2 | 1,10 € / 8,78 € |
| provisoire | o3-pro | OpenAI | 76,4 | de 73,7 à 79,1 | 30 % | 5 | 18 € / 70 € |
| provisoire | DeepSeek-V3.2-Speciale | DeepSeek | 76,1 | de 69,9 à 82,3 | 30 % | 2 | 0,51 € / 1,47 € |
| provisoire | MiMo V2 Omni | Xiaomi | 76,1 | de 67,6 à 84,7 | 65 % | 7 | 0,12 € / 0,25 € |
| provisoire | GPT-5.1-Codex | OpenAI | 75,6 | de 69,9 à 81,3 | 20 % | 2 | 1,10 € / 8,78 € |
| provisoire | Qwen3.7 Flash | Alibaba | 74,0 | de 69,8 à 78,2 | 35 % | 5 | 0,03 € / 0,11 € |
| provisoire | Hunyuan Hy3 Preview | Tencent | 73,2 | de 67,9 à 78,6 | 65 % | 7 | inconnu |
| provisoire | Ring-2.6-1T | Ant Group | 73,2 | de 61,0 à 85,5 | 25 % | 2 | 0,26 € / 2,19 € |
| provisoire | Mercury 2.5 | Inception Labs | 73,0 | de 53,7 à 92,3 | 10 % | 1 | 0,04 € / 0,13 € |
| provisoire | Grok 4 Fast Chat | xAI | 72,7 | de 62,7 à 82,7 | 50 % | 5 | inconnu |
| provisoire | GPT-5.1-Codex-mini | OpenAI | 72,2 | de 62,4 à 82,0 | 20 % | 2 | 0,22 € / 1,76 € |
| provisoire | Gemini 2.5 Pro (Mar 2025) | Google DeepMind | 71,9 | de 67,3 à 76,6 | 40 % | 7 | 2,19 € / 8,78 € |
| provisoire | Qwen 3.6 Flash | Alibaba | 71,9 | de 69,1 à 74,7 | 35 % | 10 | 0,16 € / 0,99 € |
| provisoire | Solar Pro 4 | Upstage | 71,9 | de 64,1 à 79,8 | 65 % | 7 | 0,26 € / 1,05 € |
| provisoire | Nova 2.0 Pro Preview | Amazon | 71,7 | de 55,2 à 88,1 | 25 % | 2 | inconnu |
| provisoire | Qwen3 VL 235B A22B Instruct | Alibaba | 71,7 | de 63,0 à 80,4 | 65 % | 7 | 0,47 € / 2,34 € |
| provisoire | tiny-recursion-model | inconnu | 71,7 | de 68,8 à 74,5 | 15 % | 2 | inconnu |
| provisoire | Grok 4.1 | xAI | 71,4 | de 60,4 à 82,4 | 65 % | 7 | 1,76 € / 8,78 € |
| provisoire | Grok 4 Heavy | xAI | 71,2 | de 50,5 à 91,8 | 10 % | 1 | inconnu |
| provisoire | Laguna M.1 | Poolside | 71,2 | de 63,6 à 78,7 | 25 % | 3 | inconnu |
| provisoire | Laguna XS.2 | Poolside | 70,4 | de 59,2 à 81,6 | 15 % | 2 | inconnu |
| provisoire | Step 3.7 Flash | StepFun | 70,4 | de 57,2 à 83,5 | 25 % | 2 | 0,19 € / 1,16 € |
| provisoire | Cogito v2.1 | Deep Cogito | 70,1 | de 54,0 à 86,3 | 25 % | 2 | inconnu |
| provisoire | SWE-1.6 | Cognition | 69,1 | de 54,6 à 83,5 | 15 % | 1 | inconnu |
| provisoire | Voxtral Small | Mistral AI | 68,8 | de 50,3 à 87,3 | 10 % | 6 | inconnu |
| provisoire | LongCat Flash Chat | Meituan | 68,5 | de 59,0 à 78,0 | 60 % | 6 | inconnu |
| provisoire | Magistral Medium 1.2 | Mistral AI | 68,5 | de 52,8 à 84,3 | 25 % | 2 | inconnu |
| provisoire | codex-mini-2025-05-16 | OpenAI | 68,3 | de 63,8 à 72,8 | 15 % | 2 | 1,32 € / 5,27 € |
| provisoire | Hunyuan Vision 1.5 | Tencent | 68,0 | de 56,3 à 79,8 | 35 % | 4 | inconnu |
| provisoire | Qwen Plus (Apr 2025) | Alibaba | 68,0 | de 61,1 à 74,9 | 25 % | 3 | inconnu |
| provisoire | Qwen3 VL 235B A22B Thinking | Alibaba | 67,8 | de 58,1 à 77,4 | 55 % | 6 | 0,61 € / 2,46 € |
| provisoire | Step 3.5 Flash | StepFun | 67,8 | de 58,6 à 76,9 | 60 % | 6 | 0,08 € / 0,26 € |
| provisoire | Hunyuan-T1 | Tencent | 67,5 | de 57,4 à 77,6 | 50 % | 5 | inconnu |
| provisoire | Command A+ | Cohere | 67,2 | de 51,8 à 82,7 | 25 % | 2 | 2,19 € / 8,78 € |
| provisoire | seed-oss-36b-instruct | ByteDance | 67,2 | de 64,0 à 70,5 | 35 % | 3 | inconnu |
| provisoire | o1-pro | OpenAI | 66,7 | de 60,9 à 72,5 | 25 % | 3 | 132 € / 527 € |
| provisoire | Nemotron 3 Super | NVIDIA | 66,5 | de 59,4 à 73,5 | 25 % | 3 | 0,01 € / 0,53 € |
| provisoire | qwen3-coder-next | Alibaba | 65,4 | de 56,6 à 74,3 | 35 % | 4 | 0,10 € / 0,69 € |
| provisoire | Qwen-VL-Max | Alibaba | 65,1 | de 47,8 à 82,5 | 5 % | 1 | 0,70 € / 2,81 € |
| provisoire | Ministral 3 14B | Mistral AI | 64,6 | de 46,5 à 82,8 | 10 % | 8 | inconnu |
| provisoire | Gemini 2.5 Flash-Lite (Sep 2025) | Google DeepMind | 64,4 | de 55,7 à 73,0 | 65 % | 7 | 0,09 € / 0,35 € |
| provisoire | Gemini 2.5 Pro (May 2025) | Google DeepMind | 64,4 | de 55,5 à 73,2 | 25 % | 3 | 2,19 € / 8,78 € |
| provisoire | GLM-4.6V | Z.ai (Zhipu AI) | 64,4 | de 54,3 à 74,4 | 45 % | 5 | inconnu |
| provisoire | Hunyuan-TurboS | Tencent | 64,1 | de 54,6 à 73,6 | 60 % | 6 | inconnu |
| provisoire | grok-code-fast-1 | xAI | 63,6 | de 56,6 à 70,6 | 20 % | 3 | 0,18 € / 1,32 € |
| provisoire | Devstral 2 | Mistral AI | 63,3 | de 55,0 à 71,6 | 5 % | 1 | inconnu |
| provisoire | Mistral Small 4 | Mistral AI | 63,3 | de 57,2 à 69,5 | 25 % | 3 | 0,13 € / 0,52 € |
| provisoire | Qwen3.5-4B | Alibaba | 63,1 | de 51,6 à 74,6 | 20 % | 9 | 0,04 € / 0,06 € |
| provisoire | Gemini 2.0 Pro | Google DeepMind | 62,8 | de 55,1 à 70,5 | 25 % | 2 | 1,75 € / 6,98 € |
| provisoire | LFM 2 8B A1B | Liquid AI | 62,5 | de 35,5 à 89,6 | 10 % | 1 | 0,09 € / 0,17 € |
| provisoire | QWQ-Plus | Alibaba | 62,5 | de 57,2 à 67,8 | 10 % | 1 | 0,70 € / 2,11 € |
| provisoire | Gemini 2.0 Flash Thinking (Jan 2025) | Google DeepMind | 61,8 | de 56,8 à 66,7 | 35 % | 5 | inconnu |
| provisoire | Ministral 3 8B | Mistral AI | 61,2 | de 44,9 à 77,5 | 10 % | 8 | inconnu |
| provisoire | MiniMax-M1-80k | MiniMax | 61,0 | de 51,8 à 70,1 | 60 % | 6 | 0,12 € / 1,10 € |
| provisoire | Gemini 2.0 Flash (Dec 2024) | Google DeepMind | 60,2 | de 49,4 à 71,0 | 15 % | 1 | 1,10 € / 4,39 € |
| provisoire | Mercury 2 | Inception Labs | 60,2 | de 52,8 à 67,6 | 45 % | 8 | 0,22 € / 0,66 € |
| provisoire | DeepSeek-R1-Distill-Llama-70B | DeepSeek | 59,7 | de 47,4 à 71,9 | 30 % | 8 | 0,61 € / 0,69 € |
| provisoire | Qwen3.8 2.4T A95B | Alibaba | 59,4 | de 32,3 à 86,5 | 10 % | 1 | 2 € / 6 € |
| provisoire | GLM-4.5V | Z.ai (Zhipu AI) | 59,1 | de 49,4 à 68,9 | 55 % | 6 | inconnu |
| provisoire | Llama 3.1 Nemotron Ultra 253B | NVIDIA | 59,1 | de 47,5 à 70,8 | 40 % | 4 | inconnu |
| provisoire | INTELLECT-3 | Prime Intellect | 58,9 | de 48,6 à 69,1 | 50 % | 5 | inconnu |
| provisoire | Aya Expanse 32B | Cohere | 58,1 | de 41,3 à 74,9 | 10 % | 6 | 0,69 € / 0,69 € |
| provisoire | Step 3 | StepFun | 58,1 | de 48,5 à 67,7 | 55 % | 6 | inconnu |
| provisoire | qwen3-4b-instruct-2507 | Alibaba | 57,8 | de 47,1 à 68,6 | 45 % | 8 | 0,18 € / 0,18 € |
| provisoire | Hermes 4 70B | Nous Research | 57,6 | de 30,5 à 84,7 | 10 % | 1 | 0,11 € / 0,35 € |
| provisoire | Llama 3.3 Nemotron Super 49B v1.5 | NVIDIA | 57,6 | de 47,0 à 68,1 | 50 % | 5 | inconnu |
| provisoire | Mistral Saba | Mistral AI | 57,6 | de 30,5 à 84,7 | 10 % | 1 | 0,17 € / 0,52 € |
| provisoire | Devstral Small 2 | Mistral AI | 56,8 | de 41,9 à 71,7 | 25 % | 2 | inconnu |
| provisoire | Magistral Small 1.0 | Mistral AI | 56,8 | de 53,6 à 60,0 | 45 % | 10 | 0,43 € / 1,30 € |
| provisoire | DeepSeek-R1-Distill-Qwen-14B | DeepSeek | 56,5 | de 39,4 à 73,7 | 45 % | 8 | 0,13 € / 0,38 € |
| provisoire | Gemini Robotics-ER 1.6 | Google DeepMind | 56,5 | de 29,5 à 83,6 | 5 % | 1 | 0,88 € / 4,39 € |
| provisoire | Devstral Medium 1.0 | Mistral AI | 55,2 | de 42,2 à 68,3 | 5 % | 1 | inconnu |
| provisoire | Granite 4.2 30B | IBM | 55,0 | de 42,5 à 67,4 | 40 % | 4 | inconnu |
| provisoire | Ling-flash-2.0 | Ant Group | 55,0 | de 43,8 à 66,2 | 50 % | 5 | inconnu |
| provisoire | Grok-2 (Aug 2024) | xAI | 54,2 | de 44,6 à 63,8 | 60 % | 6 | inconnu |
| provisoire | Qwen3-4B | Alibaba | 53,9 | de 47,7 à 60,1 | 35 % | 10 | 0,03 € / 0,03 € |
| provisoire | Reka Flash 3 | Reka AI | 53,9 | de 36,1 à 71,8 | 25 % | 6 | 0,09 € / 0,18 € |
| provisoire | Yi-Lightning | 01.AI | 52,9 | de 43,4 à 62,3 | 60 % | 6 | inconnu |
| provisoire | Granite 4.1 30B | IBM | 52,6 | de 36,6 à 68,6 | 25 % | 2 | inconnu |
| provisoire | DeepSeek-V2.5 (Dec 2024) | DeepSeek | 52,4 | de 41,7 à 63,0 | 50 % | 5 | inconnu |
| provisoire | glm-4.7-flash_none | Z.ai (Zhipu AI) | 51,8 | de 46,4 à 57,3 | 35 % | 3 | inconnu |
| provisoire | Ring-flash-2.0 | Ant Group | 51,8 | de 40,4 à 63,3 | 50 % | 5 | inconnu |
| provisoire | LFM2 24B A2B | Liquid AI | 51,6 | de 24,3 à 78,8 | 10 % | 1 | 0,03 € / 0,10 € |
| provisoire | EuroLLM 22B Instruct | EuroLLM | 51,3 | de 39,6 à 63,0 | 10 % | 9 | 0,17 € / 0,35 € |
| provisoire | Molmo 2 8B | Allen Institute for AI | 51,3 | de 35,1 à 67,5 | 15 % | 2 | inconnu |
| provisoire | Solar Pro 3 | Upstage | 51,1 | de 34,4 à 67,7 | 25 % | 2 | 0,13 € / 0,53 € |
| provisoire | Apertus v1.5 70B | Swiss AI (EPFL, ETH Zurich) | 50,0 | de 31,9 à 68,1 | 10 % | 9 | 0,82 € / 2,92 € |
| provisoire | Qwen2.5-32B | Alibaba | 48,4 | de 42,5 à 54,4 | 35 % | 3 | 0,61 € / 2,46 € |
| provisoire | DeepSeek-V2.5 (Sep 2024) | DeepSeek | 47,9 | de 38,1 à 57,7 | 60 % | 6 | inconnu |
| provisoire | Tulu 3 (Tülu 3) 70B | Allen Institute for AI | 47,9 | de 40,5 à 55,3 | 20 % | 2 | inconnu |
| provisoire | Grok-2 mini | xAI | 47,7 | de 37,8 à 57,5 | 60 % | 6 | inconnu |
| provisoire | WizardLM-2 8x22B | Microsoft | 47,7 | de 40,6 à 54,7 | 10 % | 1 | 0,54 € / 0,54 € |
| provisoire | Pixtral Large | Mistral AI | 45,8 | de 25,7 à 66,0 | 20 % | 2 | 1,76 € / 5,27 € |
| provisoire | Qwen-Turbo | Alibaba | 45,8 | de 39,4 à 52,3 | 20 % | 2 | 0,04 € / 0,18 € |
| provisoire | Ministral 3 3B | Mistral AI | 45,6 | de 30,1 à 61,0 | 10 % | 8 | inconnu |
| provisoire | Command R+ | Cohere | 44,3 | de 33,2 à 55,3 | 15 % | 3 | 2,19 € / 8,78 € |
| provisoire | mistral-small-2402 | Mistral AI | 44,0 | de 34,8 à 53,2 | 15 % | 1 | 0,13 € / 0,53 € |
| provisoire | Qwen3.8 Flash | Alibaba | 43,7 | de 16,2 à 71,3 | 10 % | 1 | 0,15 € / 0,47 € |
| provisoire | Apertus 70B Instruct | Swiss AI (EPFL, ETH Zurich) | 43,5 | de 26,9 à 60,0 | 10 % | 6 | 0,52 € / 0,69 € |
| provisoire | Granite 4.2 8B | IBM | 43,5 | de 28,9 à 58,1 | 40 % | 4 | 0,05 € / 0,22 € |
| provisoire | Llama 3.2 11B | Meta AI | 43,5 | de 24,4 à 62,5 | 15 % | 1 | 0,04 € / 0,59 € |
| provisoire | Hermes 2 Theta Llama-3 70B | Nous Research | 41,7 | de 33,0 à 50,4 | 20 % | 2 | inconnu |
| provisoire | Claude 2 | Anthropic | 40,1 | de 32,6 à 47,6 | 35 % | 3 | inconnu |
| provisoire | GLM-4 (0520) | Z.ai (Zhipu AI) | 40,1 | de 28,5 à 51,6 | 50 % | 5 | inconnu |
| provisoire | Nemotron-4 340B | NVIDIA | 40,1 | de 29,5 à 50,6 | 60 % | 6 | inconnu |
| provisoire | Qwen2.5-Coder-32B-Instruct | Alibaba | 39,3 | de 27,3 à 51,4 | 50 % | 5 | 0,25 € / 0,76 € |
| provisoire | Mistral Small v24.09 | Mistral AI | 39,0 | de 27,7 à 50,4 | 15 % | 1 | inconnu |
| provisoire | Apertus 1.5 8B | Swiss AI (EPFL, ETH Zurich) | 38,5 | de 10,8 à 66,3 | 10 % | 1 | 0,09 € / 0,17 € |
| provisoire | Luciole 23B Instruct 1.1 | OpenLLM-France | 38,3 | de 23,4 à 53,1 | 10 % | 8 | inconnu |
| provisoire | Eurus-2-7B-PRIME | Tsinghua University | 38,0 | de 26,3 à 49,7 | 10 % | 1 | inconnu |
| provisoire | c4ai-command-r-08-2024 | Cohere | 37,7 | de 25,7 à 49,8 | 25 % | 7 | inconnu |
| provisoire | Qwen2-VL-72B-Instruct | Alibaba | 36,7 | de 14,9 à 58,5 | 15 % | 1 | inconnu |
| provisoire | EuroLLM 9B Instruct (2512) | EuroLLM | 35,1 | de 18,9 à 51,4 | 10 % | 8 | inconnu |
| provisoire | Gemini 1.0 Pro | Google DeepMind | 34,9 | de 24,4 à 45,3 | 35 % | 3 | inconnu |
| provisoire | Amazon Nova Micro | Amazon | 34,1 | de 22,7 à 45,4 | 60 % | 6 | 0,03 € / 0,12 € |
| provisoire | GPT-3.5 Turbo Instruct | OpenAI | 34,1 | de 20,2 à 48,0 | 15 % | 1 | 1,32 € / 1,76 € |
| provisoire | deepseek-r1-0528-qwen3-8b | DeepSeek | 33,6 | de 7,7 à 59,4 | 45 % | 8 | 0,05 € / 0,08 € |
| provisoire | Ministral 3B | Mistral AI | 33,6 | de 17,4 à 49,8 | 25 % | 3 | 0,04 € / 0,04 € |
| provisoire | granite-4.0-micro | IBM | 33,3 | de 18,7 à 47,9 | 45 % | 9 | 0,01 € / 0,10 € |
| provisoire | Qwen3-1.7B | Alibaba | 33,0 | de 12,6 à 53,5 | 45 % | 11 | inconnu |
| provisoire | Claude Instant | Anthropic | 32,0 | de 16,2 à 47,8 | 15 % | 1 | inconnu |
| provisoire | nvidia-nemotron-nano-9b-v2 | NVIDIA | 31,7 | de 14,7 à 48,8 | 10 % | 5 | 0,05 € / 0,20 € |
| provisoire | Pixtral 12B | Mistral AI | 31,7 | de 10,4 à 53,1 | 5 % | 1 | 0,13 € / 0,13 € |
| provisoire | GPT-3 175B (davinci) | OpenAI | 27,6 | de 11,3 à 43,8 | 15 % | 1 | inconnu |
| provisoire | phi-3-medium 14B | Microsoft | 27,3 | de 5,0 à 49,6 | 10 % | 1 | inconnu |
| provisoire | Qwen3.5-2B | Alibaba | 24,9 | de 5,7 à 44,2 | 25 % | 9 | inconnu |
| provisoire | Qwen2-VL-7B-Instruct | Alibaba | 24,7 | de 2,7 à 46,7 | 20 % | 2 | inconnu |
| provisoire | OLMo 2 Furious 13B | Allen Institute for AI | 22,9 | de 8,9 à 36,8 | 10 % | 5 | inconnu |
| provisoire | Apertus 8B Instruct | Swiss AI (EPFL | 22,6 | de 4,7 à 40,5 | 10 % | 5 | inconnu |
| provisoire | granite-4.0-1b | IBM | 21,8 | de 0,0 à 55,2 | 35 % | 3 | inconnu |
| provisoire | granite-4.0-350m | IBM | 21,8 | de 0,0 à 55,3 | 35 % | 3 | inconnu |
| provisoire | EuroLLM 9B Instruct | EuroLLM | 21,0 | de 5,2 à 36,9 | 10 % | 8 | inconnu |
| provisoire | MiniCPM-V-2_6 | OpenBMB | 20,5 | de 0,0 à 44,3 | 5 % | 1 | inconnu |
| provisoire | phi-3-small 7.4B | Microsoft | 19,7 | de 5,8 à 33,6 | 60 % | 6 | inconnu |
| provisoire | GPT-2 (1.5B) | OpenAI | 18,4 | de 0,0 à 39,0 | 15 % | 1 | inconnu |
| provisoire | Falcon-180B | Technology Innovation Institute | 17,9 | de 0,0 à 37,3 | 15 % | 2 | inconnu |
| provisoire | Luciole 8B Instruct 1.1 | OpenLLM-France | 16,6 | de 2,2 à 30,9 | 10 % | 8 | inconnu |
| provisoire | MPT-30B | MosaicML | 14,5 | de 0,0 à 32,1 | 40 % | 4 | inconnu |
| provisoire | Phi-3.5-vision-instruct | Microsoft | 14,0 | de 0,0 à 39,3 | 5 % | 1 | inconnu |
| provisoire | Falcon 2 11B | Technology Innovation Institute | 12,9 | de 0,0 à 29,7 | 10 % | 5 | inconnu |
| provisoire | Qwen-14B | Alibaba | 12,2 | de 0,0 à 30,7 | 40 % | 4 | inconnu |
| provisoire | Qwen1.5-7B | Alibaba | 12,2 | de 0,0 à 29,3 | 50 % | 5 | inconnu |
| provisoire | Mistral 7B v0.3 | Mistral AI | 10,3 | de 0,0 à 27,8 | 45 % | 9 | 0,22 € / 0,22 € |
| provisoire | Qwen2.5-1.5B | Alibaba | 9,0 | de 0,0 à 27,0 | 10 % | 5 | inconnu |
| provisoire | Mistral 7B v0.1 | Mistral AI | 7,7 | de 0,0 à 32,9 | 10 % | 5 | inconnu |
| provisoire | ALIA-40b | Barcelona Supercomputing Center | 7,2 | de 0,0 à 35,1 | 10 % | 5 | inconnu |
| provisoire | chatglm2-6b | Z.ai (Zhipu AI) | 0,0 | de 0,0 à 16,9 | 40 % | 4 | inconnu |
| provisoire | DeepSeek-R1-Distill-Llama-8B | DeepSeek | 0,0 | de 0,0 à 3,8 | 10 % | 5 | inconnu |
| provisoire | DeepSeek-R1-Distill-Qwen-1.5B | DeepSeek | 0,0 | de 0,0 à 0,0 | 45 % | 8 | inconnu |
| provisoire | DeepSeek-R1-Distill-Qwen-7B | DeepSeek | 0,0 | de 0,0 à 0,1 | 10 % | 5 | 0,06 € / 0,13 € |
| provisoire | Dolly 2.0-12b | Databricks | 0,0 | de 0,0 à 13,9 | 40 % | 4 | inconnu |
| provisoire | Gemma 3 1B | Google DeepMind | 0,0 | de 0,0 à 0,7 | 45 % | 11 | inconnu |
| provisoire | Gemma 3 270M | Google DeepMind | 0,0 | de 0,0 à 0,0 | 10 % | 8 | inconnu |
| provisoire | LLaMA-13B | Meta AI | 0,0 | de 0,0 à 12,1 | 40 % | 4 | inconnu |
| provisoire | MPT-7B | MosaicML | 0,0 | de 0,0 à 20,8 | 40 % | 4 | inconnu |
| provisoire | Phi-2 | Microsoft | 0,0 | de 0,0 à 0,0 | 10 % | 5 | inconnu |
| provisoire | Phi-4 Mini | Microsoft | 0,0 | de 0,0 à 0,0 | 35 % | 7 | 0,07 € / 0,26 € |
| provisoire | Phi-4 Reasoning | Microsoft | 0,0 | de 0,0 à 0,0 | 10 % | 5 | 0,11 € / 0,44 € |
| provisoire | Phi-4-Reasoning-plus | Microsoft | 0,0 | de 0,0 à 0,0 | 10 % | 3 | 0,11 € / 0,44 € |
| provisoire | Qwen3-0.6B | Alibaba | 0,0 | de 0,0 à 0,0 | 10 % | 8 | inconnu |
| provisoire | Qwen3.5-0.8B | Alibaba | 0,0 | de 0,0 à 0,0 | 10 % | 8 | inconnu |
| provisoire | Salamandra 7B Instruct | Barcelona Supercomputing Center | 0,0 | de 0,0 à 0,0 | 10 % | 8 | inconnu |
| provisoire | stablelm-tuned-alpha-7b | Stability AI | 0,0 | de 0,0 à 11,9 | 40 % | 4 | inconnu |

## Ce qui compose le score

Le score général pondère dix tâches. Chaque tâche agrège ses benchmarks. Données et Sécurité restent des dossiers, sans poids, faute de sources solides.

- Raisonnement : 15 % du score général, 9 benchmarks
- Code : 15 % du score général, 13 benchmarks
- Agents : 15 % du score général, 9 benchmarks
- Usage : 10 % du score général, 1 benchmark
- Maths : 10 % du score général, 8 benchmarks
- Sciences : 10 % du score général, 5 benchmarks
- Français : 10 % du score général, 10 benchmarks
- Vision : 5 % du score général, 3 benchmarks
- Écriture : 5 % du score général, 1 benchmark
- Web : 5 % du score général, 1 benchmark

Source : Quelle IA, édition du 28 septembre 2026. https://quelleia.com
