# Classement Code des modèles de langage

> Dans l'édition du 28 septembre 2026, Claude Opus 5.5 (Anthropic) est premier en code avec un score Code de 99,9, ex æquo avec 4 autres modèles dont Claude Fable 5.1 et Claude Sonnet 5.5. La marge du premier va de 97,9 à 101,8 ; deux modèles dont les marges se recouvrent sont ex æquo. 62 modèles sont classés, 263 autres ont un score provisoire.

Page : https://quelleia.com/classement/code/
Édition : 2026-W40, 28 septembre 2026
Question : Quel est le meilleur modèle pour programmer ?

## Comment lire ce classement

Le score Code résume les résultats d'un modèle sur les benchmarks de code où il a été mesuré. L'échelle est celle du score général : 100 correspond au meilleur modèle au lancement du site, 50 à GPT-4o de fin 2024. La barre indique la marge d'erreur : deux modèles dont les barres se chevauchent sont ex æquo.

## Modèles classés (62)

| Rang | Modèle | Éditeur | Score | Marge à 90 % | Couverture | Mesures | Prix entrée / sortie (€ par million de jetons) |
| --- | --- | --- | --- | --- | --- | --- | --- |
| 1 | Claude Opus 5.5 | Anthropic | 99,9 | de 97,9 à 101,8 | 46 % | 6 | 4 € / 20 € |
| 2 | Claude Fable 5.1 | Anthropic | 98,6 | de 96,6 à 100,5 | 62 % | 8 | 8,78 € / 44 € |
| 3 | Claude Sonnet 5.5 | Anthropic | 98,3 | de 95,6 à 101,0 | 31 % | 4 | 2 € / 10 € |
| 4 | GPT-6 Astra | OpenAI | 97,8 | de 95,1 à 100,4 | 62 % | 8 | 8,78 € / 44 € |
| 5 | Claude Fable 5 | Anthropic | 96,0 | de 93,7 à 98,2 | 69 % | 9 | 8,78 € / 44 € |
| 6 | Claude Opus 5 | Anthropic | 95,4 | de 93,7 à 97,1 | 69 % | 9 | 4,39 € / 22 € |
| 7 | Claude Opus 4.8 | Anthropic | 92,3 | de 90,6 à 94,0 | 54 % | 7 | 4,39 € / 22 € |
| 8 | GPT-5.6 Terra | OpenAI | 91,8 | de 88,9 à 94,6 | 46 % | 6 | 2,17 € / 13 € |
| 9 | GLM-5.3 | Z.ai (Zhipu AI) | 91,5 | de 89,3 à 93,7 | 46 % | 6 | 1,40 € / 4,40 € |
| 10 | GPT-5.6 Sol | OpenAI | 91,3 | de 89,3 à 93,2 | 77 % | 10 | 3,51 € / 18 € |
| 11 | Grok 4.6 | xAI | 91,0 | de 88,6 à 93,4 | 54 % | 7 | 1,76 € / 5,27 € |
| 12 | Grok 4.7 | xAI | 91,0 | de 87,4 à 94,6 | 31 % | 4 | 1,76 € / 5,27 € |
| 13 | Claude Sonnet 5 | Anthropic | 90,7 | de 88,2 à 93,2 | 62 % | 8 | 1,73 € / 8,67 € |
| 14 | Grok 4.5 | xAI | 90,7 | de 86,3 à 95,1 | 46 % | 6 | 1,76 € / 5,27 € |
| 15 | Gemini 3.8 Flash | Google DeepMind | 90,5 | de 87,5 à 93,4 | 54 % | 7 | 1,50 € / 7,50 € |
| 16 | Kimi K3 | Moonshot | 90,5 | de 88,6 à 92,3 | 62 % | 8 | 2,60 € / 13 € |
| 17 | GPT-5.5 | OpenAI | 90,2 | de 88,6 à 91,8 | 77 % | 10 | 4,34 € / 26 € |
| 18 | Gemini 3.7 Flash | Google DeepMind | 90,2 | de 87,5 à 92,9 | 38 % | 5 | 1,50 € / 7,50 € |
| 19 | Claude Opus 4.7 | Anthropic | 89,9 | de 88,0 à 91,9 | 69 % | 9 | 4,39 € / 22 € |
| 20 | GPT-5.6 Luna | OpenAI | 89,4 | de 85,5 à 93,3 | 54 % | 7 | 0,87 € / 5,20 € |
| 21 | Claude Opus 4.6 | Anthropic | 89,2 | de 87,4 à 91,0 | 54 % | 7 | 4,39 € / 22 € |
| 22 | GLM-5.3-Flash | Z.ai (Zhipu AI) | 88,9 | de 84,9 à 92,9 | 31 % | 4 | 0,15 € / 0,50 € |
| 23 | GPT-5.4 | OpenAI | 88,9 | de 87,5 à 90,4 | 69 % | 9 | 2,17 € / 13 € |
| 24 | Muse Spark 1.2 | Meta AI | 86,6 | de 83,3 à 89,9 | 38 % | 5 | 1,25 € / 4,25 € |
| 25 | Claude Sonnet 4.6 | Anthropic | 86,0 | de 80,6 à 91,4 | 62 % | 8 | 2,63 € / 13 € |
| 26 | Gemini 3.6 Flash | Google DeepMind | 85,2 | de 81,9 à 88,6 | 38 % | 5 | 1,30 € / 6,50 € |
| 27 | GPT-5.2 | OpenAI | 84,7 | de 81,3 à 88,2 | 38 % | 5 | 1,52 € / 12 € |
| 28 | Muse Spark 1.1 | Meta AI | 84,7 | de 80,4 à 89,0 | 31 % | 4 | 1,10 € / 3,73 € |
| 29 | Claude Opus 4.5 | Anthropic | 84,2 | de 81,1 à 87,3 | 46 % | 6 | 4,39 € / 22 € |
| 30 | Gemini 3 Pro | Google DeepMind | 84,2 | de 81,1 à 87,4 | 38 % | 5 | 1,73 € / 10 € |
| 31 | GLM-5.2 | Z.ai (Zhipu AI) | 82,9 | de 79,7 à 86,1 | 54 % | 7 | 0,98 € / 3,08 € |
| 32 | Gemini 3.5 Flash | Google DeepMind | 82,6 | de 79,8 à 85,4 | 46 % | 6 | 1,30 € / 7,80 € |
| 33 | GPT-5.4 Mini | OpenAI | 82,4 | de 77,9 à 86,8 | 31 % | 4 | 0,65 € / 3,90 € |
| 34 | Gemini 3.1 Pro | Google DeepMind | 82,1 | de 77,8 à 86,4 | 69 % | 9 | 2 € / 12 € |
| 35 | Gemini 3 Flash | Google DeepMind | 81,6 | de 78,2 à 85,0 | 38 % | 5 | 0,43 € / 2,60 € |
| 36 | Qwen3.7-Max | Alibaba | 80,8 | de 75,2 à 86,5 | 31 % | 4 | 1,08 € / 3,25 € |
| 37 | Kimi K2.6 | Moonshot | 80,6 | de 75,5 à 85,6 | 38 % | 5 | 0,59 € / 2,96 € |
| 38 | Kimi K2.7 Code | Moonshot | 80,3 | de 76,7 à 83,8 | 38 % | 5 | 0,83 € / 3,51 € |
| 39 | GLM-5.1 | Z.ai (Zhipu AI) | 79,2 | de 74,6 à 83,9 | 38 % | 5 | 0,85 € / 2,67 € |
| 40 | DeepSeek-V4-Pro | DeepSeek | 79,0 | de 73,6 à 84,3 | 38 % | 5 | 0,38 € / 0,75 € |
| 41 | GLM-5 | Z.ai (Zhipu AI) | 78,2 | de 74,5 à 81,9 | 31 % | 4 | 0,52 € / 1,66 € |
| 42 | GPT-5 | OpenAI | 78,2 | de 75,0 à 81,4 | 46 % | 6 | 1,08 € / 8,67 € |
| 43 | GPT-5.1 | OpenAI | 78,2 | de 75,1 à 81,3 | 46 % | 6 | 1,08 € / 8,67 € |
| 44 | MiniMax-M3 | MiniMax | 77,4 | de 71,7 à 83,2 | 31 % | 4 | 0,24 € / 0,97 € |
| 45 | Claude Sonnet 4.5 | Anthropic | 77,2 | de 73,9 à 80,4 | 46 % | 6 | 2,60 € / 13 € |
| 46 | Kimi K2.5 | Moonshot | 76,4 | de 72,5 à 80,2 | 38 % | 5 | 0,35 € / 1,65 € |
| 47 | Claude Opus 4.1 | Anthropic | 74,8 | de 70,5 à 79,1 | 31 % | 4 | 13 € / 66 € |
| 48 | MiniMax-M2.7 | MiniMax | 74,8 | de 69,0 à 80,7 | 38 % | 5 | 0,24 € / 1,04 € |
| 49 | o3 | OpenAI | 74,8 | de 69,8 à 79,8 | 31 % | 4 | 1,76 € / 7,02 € |
| 50 | Claude Opus 4 | Anthropic | 74,3 | de 68,7 à 79,8 | 31 % | 4 | 13 € / 66 € |
| 51 | Claude Haiku 4.5 | Anthropic | 73,2 | de 69,8 à 76,7 | 31 % | 4 | 0,88 € / 4,39 € |
| 52 | GPT-5 mini | OpenAI | 73,2 | de 69,9 à 76,6 | 38 % | 5 | 0,22 € / 1,73 € |
| 53 | Gemini 2.5 Pro (Jun 2025) | Google DeepMind | 72,7 | de 69,2 à 76,2 | 46 % | 6 | 1,10 € / 8,78 € |
| 54 | Claude Sonnet 4 | Anthropic | 72,2 | de 67,0 à 77,4 | 31 % | 4 | 2,60 € / 13 € |
| 55 | Nemotron 3 Ultra | NVIDIA | 72,2 | de 66,8 à 77,6 | 31 % | 4 | inconnu |
| 56 | Mistral Medium 3.5 | Mistral AI | 70,9 | de 65,6 à 76,2 | 31 % | 4 | 1,30 € / 6,50 € |
| 57 | Inkling | Thinking Machines | 70,6 | de 61,7 à 79,6 | 38 % | 5 | 0,95 € / 4,05 € |
| 58 | Kimi K2 (Jul 2025) | Moonshot | 69,8 | de 65,9 à 73,8 | 31 % | 4 | 0,50 € / 2,02 € |
| 59 | Qwen3-Coder-480B-A35B | Alibaba | 69,8 | de 66,1 à 73,6 | 31 % | 4 | 0,19 € / 1,56 € |
| 60 | o3-mini | OpenAI | 69,3 | de 63,7 à 74,9 | 31 % | 4 | 0,97 € / 3,86 € |
| 61 | gpt-oss-120b | OpenAI | 67,8 | de 62,3 à 73,2 | 31 % | 4 | 0,03 € / 0,16 € |
| 62 | gpt-oss-20b | OpenAI | 61,5 | de 53,6 à 69,4 | 31 % | 4 | 0,03 € / 0,12 € |

## Scores provisoires (263)

Ces modèles n'ont pas encore assez de mesures pour recevoir un rang. Ils sont listés du score le plus haut au plus bas.

| Rang | Modèle | Éditeur | Score | Marge à 90 % | Couverture | Mesures | Prix entrée / sortie (€ par million de jetons) |
| --- | --- | --- | --- | --- | --- | --- | --- |
| provisoire | Gemini 4 Argon | Google DeepMind | 96,0 | de 87,8 à 104,1 | 8 % | 1 | inconnu |
| provisoire | SWE-2 | Cognition | 94,6 | de 90,1 à 99,2 | 8 % | 1 | inconnu |
| provisoire | Step 5 Preview | StepFun | 92,0 | de 84,0 à 100,1 | 8 % | 1 | 0,95 € / 2,71 € |
| provisoire | GPT-6 Sol | OpenAI | 91,3 | de 83,1 à 99,4 | 8 % | 1 | 2 € / 10 € |
| provisoire | Muse Spark 1.3 | Meta AI | 91,3 | de 85,6 à 96,9 | 23 % | 3 | 1,25 € / 4,25 € |
| provisoire | SWE-1.7 | Cognition | 91,0 | de 86,3 à 95,7 | 8 % | 1 | inconnu |
| provisoire | MiMo-V2.6-Pro | Xiaomi | 90,5 | de 82,3 à 98,6 | 8 % | 1 | 0,44 € / 0,87 € |
| provisoire | GPT-5.3 Codex | OpenAI | 89,2 | de 83,4 à 94,9 | 23 % | 3 | 1,54 € / 12 € |
| provisoire | Qwen 3.8 Max | Alibaba | 87,9 | de 85,0 à 90,7 | 23 % | 3 | 1,76 € / 5,27 € |
| provisoire | DeepSeek V4.1 Flash | DeepSeek | 87,3 | de 80,7 à 94,0 | 23 % | 3 | 0,15 € / 0,60 € |
| provisoire | Qwen3.8 Max (0902) | Alibaba | 86,8 | de 79,3 à 94,4 | 15 % | 2 | 1,76 € / 5,27 € |
| provisoire | GPT-6 Luna | OpenAI | 86,0 | de 77,8 à 94,2 | 8 % | 1 | 0,10 € / 0,50 € |
| provisoire | Muse Spark | Meta AI | 85,5 | de 77,9 à 93,1 | 15 % | 2 | inconnu |
| provisoire | DeepSeek V4 Pro 0813 | DeepSeek | 85,2 | de 81,0 à 89,5 | 23 % | 3 | 0,61 € / 1,82 € |
| provisoire | GPT-5.2 Chat | OpenAI | 84,7 | de 76,5 à 92,9 | 8 % | 1 | 1,54 € / 12 € |
| provisoire | Grok 4.20 Beta 1 | xAI | 84,7 | de 76,5 à 92,9 | 8 % | 1 | inconnu |
| provisoire | Qwen3.5 Max Preview | Alibaba | 84,5 | de 76,3 à 92,7 | 8 % | 1 | inconnu |
| provisoire | ERNIE 5.1 | Baidu | 84,2 | de 76,0 à 92,4 | 8 % | 1 | 0,66 € / 2,63 € |
| provisoire | Grok 4.20 Multi Agent Beta | xAI | 83,9 | de 75,7 à 92,1 | 8 % | 1 | 1,10 € / 2,19 € |
| provisoire | MiMo-V2.5-Pro | Xiaomi | 83,7 | de 76,1 à 91,2 | 15 % | 2 | 0,38 € / 0,76 € |
| provisoire | Qwen 3.6 Max (Preview) | Alibaba | 83,4 | de 76,2 à 90,6 | 15 % | 2 | 1,14 € / 6,85 € |
| provisoire | GPT-5.2 Codex | OpenAI | 83,2 | de 79,4 à 86,9 | 8 % | 1 | 1,54 € / 12 € |
| provisoire | MiMo-V2.6-Flash | Xiaomi | 83,2 | de 75,0 à 91,4 | 8 % | 1 | 0,14 € / 0,28 € |
| provisoire | Hy3 | Tencent | 82,9 | de 74,7 à 91,1 | 8 % | 1 | 0,15 € / 0,50 € |
| provisoire | Seed 2.0 Pro | ByteDance | 82,6 | de 74,4 à 90,8 | 8 % | 1 | 0,44 € / 2,63 € |
| provisoire | Composer 2.5 | Cursor | 82,1 | de 77,1 à 87,1 | 15 % | 2 | inconnu |
| provisoire | GPT-5.4 Pro | OpenAI | 82,1 | de 75,6 à 88,6 | 8 % | 1 | 26 € / 158 € |
| provisoire | DeepSeek V4 Flash 0731 | DeepSeek | 81,6 | de 76,6 à 86,6 | 23 % | 3 | 0,18 € / 0,35 € |
| provisoire | GPT-5 Pro | OpenAI | 81,6 | de 75,1 à 88,0 | 8 % | 1 | 13 € / 105 € |
| provisoire | GPT-5.1-Codex-Max | OpenAI | 81,3 | de 77,7 à 84,9 | 8 % | 1 | 1,10 € / 8,78 € |
| provisoire | GPT-5.1-Codex-mini | OpenAI | 81,3 | de 77,7 à 84,9 | 8 % | 1 | 0,22 € / 1,76 € |
| provisoire | Grok 4.20 Beta (0309) | xAI | 81,1 | de 72,9 à 89,3 | 8 % | 1 | 1,76 € / 5,27 € |
| provisoire | MiMo-V2-Pro | Xiaomi | 81,1 | de 72,9 à 89,3 | 8 % | 1 | 0,38 € / 0,76 € |
| provisoire | Qwen 3.8 27B | Alibaba | 81,1 | de 73,4 à 88,7 | 15 % | 2 | 0,35 € / 2,75 € |
| provisoire | GPT-5.3 Chat | OpenAI | 80,8 | de 72,6 à 89,0 | 8 % | 1 | 1,52 € / 12 € |
| provisoire | GPT-5.5 Instant | OpenAI | 80,8 | de 73,3 à 88,3 | 15 % | 2 | 4,39 € / 26 € |
| provisoire | GPT-5.1-Codex | OpenAI | 80,3 | de 76,8 à 83,8 | 8 % | 1 | 1,10 € / 8,78 € |
| provisoire | Grok 4.20 | xAI | 79,8 | de 75,8 à 83,7 | 15 % | 2 | 1,08 € / 2,17 € |
| provisoire | Grok Build 0.1 | xAI | 79,8 | de 73,2 à 86,4 | 15 % | 2 | 0,88 € / 1,76 € |
| provisoire | ERNIE 5.0 | Baidu | 79,5 | de 71,3 à 87,7 | 8 % | 1 | 0,74 € / 2,96 € |
| provisoire | Inkling-Small | Thinking Machines | 79,5 | de 71,7 à 87,4 | 15 % | 2 | 0,45 € / 1,20 € |
| provisoire | Kimi K2.5 Instant | Moonshot | 79,5 | de 71,3 à 87,7 | 8 % | 1 | inconnu |
| provisoire | o3-pro | OpenAI | 79,5 | de 73,1 à 85,9 | 8 % | 1 | 18 € / 70 € |
| provisoire | Qwen3.5 397B-A17B | Alibaba | 78,2 | de 70,0 à 86,4 | 8 % | 1 | 0,34 € / 2,03 € |
| provisoire | GLM-5V-Turbo | Z.ai (Zhipu AI) | 77,9 | de 69,7 à 86,2 | 8 % | 1 | 1,05 € / 3,51 € |
| provisoire | MiMo V2 Omni | Xiaomi | 77,4 | de 69,2 à 85,6 | 8 % | 1 | 0,12 € / 0,25 € |
| provisoire | MiMo-V2.5 | Xiaomi | 77,4 | de 69,7 à 85,2 | 15 % | 2 | 0,12 € / 0,25 € |
| provisoire | GPT-5-Codex | OpenAI | 76,6 | de 73,4 à 79,9 | 15 % | 2 | 1,10 € / 8,78 € |
| provisoire | ChatGPT-4o Latest | OpenAI | 76,4 | de 68,2 à 84,6 | 8 % | 1 | 4,39 € / 18 € |
| provisoire | Gemma 4 31B IT | Google DeepMind | 76,4 | de 70,7 à 82,0 | 23 % | 3 | 0,10 € / 0,31 € |
| provisoire | Grok 4.3 Beta | xAI | 76,4 | de 70,4 à 82,4 | 23 % | 3 | 1,08 € / 2,17 € |
| provisoire | Grok 4.1 | xAI | 76,1 | de 67,9 à 84,3 | 8 % | 1 | 1,76 € / 8,78 € |
| provisoire | Qwen3.7-Plus | Alibaba | 75,6 | de 68,4 à 82,8 | 23 % | 3 | 0,28 € / 1,11 € |
| provisoire | MiniMax-M2.5 | MiniMax | 75,3 | de 70,9 à 79,8 | 15 % | 2 | 0,13 € / 1 € |
| provisoire | Muse Glimmer 30B | Meta AI | 75,3 | de 67,1 à 83,5 | 8 % | 1 | 0,30 € / 1,10 € |
| provisoire | GPT-5.4 Nano | OpenAI | 75,1 | de 69,3 à 80,9 | 23 % | 3 | 0,17 € / 1,08 € |
| provisoire | DeepSeek-V3.2 | DeepSeek | 74,8 | de 71,2 à 78,4 | 15 % | 2 | 0,20 € / 0,30 € |
| provisoire | DeepSeek-V4-Flash | DeepSeek | 74,8 | de 68,3 à 81,4 | 23 % | 3 | 0,09 € / 0,17 € |
| provisoire | Gemini 3.1 Flash-Lite | Google DeepMind | 74,8 | de 69,1 à 80,5 | 23 % | 3 | 0,22 € / 1,30 € |
| provisoire | Qwen3-Max | Alibaba | 74,3 | de 66,1 à 82,5 | 8 % | 1 | 0,68 € / 3,38 € |
| provisoire | o4-mini | OpenAI | 73,8 | de 67,2 à 80,3 | 23 % | 3 | 0,95 € / 3,82 € |
| provisoire | Ring-2.6-1T | Ant Group | 73,8 | de 65,7 à 81,8 | 8 % | 1 | 0,26 € / 2,19 € |
| provisoire | MiniMax-M2.1 | MiniMax | 73,5 | de 69,0 à 78,0 | 15 % | 2 | 0,26 € / 1,05 € |
| provisoire | Nova 2.0 Pro Preview | Amazon | 73,5 | de 65,4 à 81,6 | 8 % | 1 | inconnu |
| provisoire | GLM-4.7 | Z.ai (Zhipu AI) | 73,2 | de 68,6 à 77,9 | 23 % | 3 | 0,35 € / 1,52 € |
| provisoire | DeepSeek-V3.2-Speciale | DeepSeek | 73,0 | de 66,7 à 79,3 | 8 % | 1 | 0,51 € / 1,47 € |
| provisoire | Grok 4.1 Fast | xAI | 73,0 | de 64,8 à 81,2 | 8 % | 1 | 0,17 € / 0,43 € |
| provisoire | Kimi K2 Thinking | Moonshot | 73,0 | de 69,1 à 76,9 | 23 % | 3 | 0,52 € / 2,17 € |
| provisoire | Solar Pro 4 | Upstage | 72,7 | de 64,5 à 80,9 | 8 % | 1 | 0,26 € / 1,05 € |
| provisoire | DeepSeek-V3.1-Terminus | DeepSeek | 72,5 | de 64,9 à 80,0 | 15 % | 2 | 0,24 € / 0,88 € |
| provisoire | Grok 4 Fast Chat | xAI | 72,5 | de 64,2 à 80,7 | 8 % | 1 | inconnu |
| provisoire | Qwen3 VL 235B A22B Instruct | Alibaba | 72,5 | de 64,2 à 80,7 | 8 % | 1 | 0,47 € / 2,34 € |
| provisoire | Hunyuan Hy3 Preview | Tencent | 72,2 | de 64,0 à 80,4 | 8 % | 1 | inconnu |
| provisoire | Qwen 3.6 Plus | Alibaba | 72,2 | de 64,7 à 79,7 | 23 % | 3 | 0,28 € / 1,69 € |
| provisoire | LongCat Flash Chat | Meituan | 71,7 | de 63,5 à 79,9 | 8 % | 1 | inconnu |
| provisoire | Cogito v2.1 | Deep Cogito | 71,4 | de 63,3 à 79,5 | 8 % | 1 | inconnu |
| provisoire | Qwen3.6 27B | Alibaba | 71,2 | de 63,0 à 79,3 | 8 % | 1 | 0,53 € / 3,16 € |
| provisoire | Gemini 3.5 Flash-Lite | Google DeepMind | 70,9 | de 63,1 à 78,7 | 23 % | 3 | 0,26 € / 2,17 € |
| provisoire | Step 3.7 Flash | StepFun | 70,9 | de 62,8 à 79,0 | 8 % | 1 | 0,19 € / 1,16 € |
| provisoire | Grok 4 | xAI | 70,6 | de 67,0 à 74,3 | 23 % | 3 | 2,63 € / 13 € |
| provisoire | o1 | OpenAI | 70,6 | de 64,2 à 77,1 | 15 % | 2 | 13 € / 53 € |
| provisoire | Claude 3.7 Sonnet | Anthropic | 70,1 | de 64,0 à 76,3 | 23 % | 3 | 2,63 € / 13 € |
| provisoire | Qwen3.5-122B-A10B | Alibaba | 70,1 | de 62,1 à 78,2 | 15 % | 2 | 0,35 € / 2,81 € |
| provisoire | MiniMax-M2 | MiniMax | 69,8 | de 61,0 à 78,7 | 15 % | 2 | 0,22 € / 0,87 € |
| provisoire | Qwen3-235B-A22B-Thinking (Jul 2025) | Alibaba | 69,8 | de 64,0 à 75,7 | 23 % | 3 | 0,26 € / 2,55 € |
| provisoire | DeepSeek-R1 (May 2025) | DeepSeek | 69,6 | de 63,3 à 75,9 | 15 % | 2 | 0,43 € / 1,86 € |
| provisoire | DeepSeek-V3.2-Exp | DeepSeek | 69,6 | de 63,4 à 75,8 | 23 % | 3 | 0,25 € / 0,38 € |
| provisoire | Grok 4 Fast | xAI | 69,6 | de 63,6 à 75,6 | 15 % | 2 | 0,17 € / 0,43 € |
| provisoire | Magistral Medium 1.2 | Mistral AI | 69,6 | de 61,5 à 77,7 | 8 % | 1 | inconnu |
| provisoire | o1-preview | OpenAI | 69,6 | de 60,9 à 78,3 | 15 % | 2 | inconnu |
| provisoire | GLM-4.6 | Z.ai (Zhipu AI) | 69,3 | de 65,0 à 73,7 | 23 % | 3 | 0,37 € / 1,51 € |
| provisoire | Qwen3 VL 235B A22B Thinking | Alibaba | 69,3 | de 61,1 à 77,5 | 8 % | 1 | 0,61 € / 2,46 € |
| provisoire | SWE-1.6 | Cognition | 69,3 | de 61,1 à 77,5 | 8 % | 1 | inconnu |
| provisoire | GLM-4.5 | Z.ai (Zhipu AI) | 69,1 | de 62,8 à 75,3 | 15 % | 2 | 0,52 € / 1,91 € |
| provisoire | Qwen 3.5 Flash (hosted 35B-A3B) | Alibaba | 69,1 | de 60,8 à 77,3 | 8 % | 1 | 0,09 € / 0,35 € |
| provisoire | Step 3.5 Flash | StepFun | 69,1 | de 60,8 à 77,3 | 8 % | 1 | 0,08 € / 0,26 € |
| provisoire | Mistral Large 3 | Mistral AI | 68,8 | de 60,6 à 77,0 | 15 % | 2 | 0,43 € / 1,30 € |
| provisoire | Qwen3.5-27B | Alibaba | 68,8 | de 62,4 à 75,2 | 15 % | 2 | 0,26 € / 2,11 € |
| provisoire | Gemini 2.5 Flash (Apr 2025) | Google DeepMind | 68,5 | de 62,1 à 75,0 | 8 % | 1 | 0,13 € / 0,53 € |
| provisoire | Gemini 2.5 Flash (May 2025) | Google DeepMind | 68,5 | de 62,1 à 75,0 | 8 % | 1 | 0,12 € / 2,77 € |
| provisoire | DeepSeek-V3.1 | DeepSeek | 68,3 | de 61,6 à 74,9 | 15 % | 2 | 0,18 € / 0,69 € |
| provisoire | Gemma 4 26B A4B | Google DeepMind | 68,3 | de 60,8 à 75,7 | 23 % | 3 | 0,05 € / 0,29 € |
| provisoire | Qwen3-235B-A22B-Instruct (Jul 2025) | Alibaba | 68,3 | de 61,2 à 75,3 | 15 % | 2 | 0,19 € / 0,77 € |
| provisoire | Command A+ | Cohere | 68,0 | de 59,9 à 76,2 | 8 % | 1 | 2,19 € / 8,78 € |
| provisoire | chutes/Qwen3-Next-80B-A3B-Instruct | Alibaba | 67,8 | de 59,5 à 76,0 | 8 % | 1 | 0,44 € / 1,76 € |
| provisoire | GPT-4.5 | OpenAI | 67,8 | de 61,5 à 74,0 | 15 % | 2 | inconnu |
| provisoire | grok-code-fast-1 | xAI | 67,8 | de 62,6 à 72,9 | 15 % | 2 | 0,18 € / 1,32 € |
| provisoire | Hunyuan Vision 1.5 | Tencent | 67,8 | de 59,5 à 76,0 | 8 % | 1 | inconnu |
| provisoire | Grok-3 mini | xAI | 67,5 | de 59,6 à 75,4 | 15 % | 2 | 0,26 € / 0,43 € |
| provisoire | Kimi K2 (Sep 2025) | Moonshot | 67,5 | de 59,9 à 75,1 | 15 % | 2 | 0,55 € / 2,22 € |
| provisoire | Mercury 2 | Inception Labs | 67,2 | de 60,3 à 74,1 | 23 % | 3 | 0,22 € / 0,66 € |
| provisoire | Qwen 3.6 35B-A3B | Alibaba | 67,2 | de 62,6 à 71,9 | 23 % | 3 | 0,22 € / 1,30 € |
| provisoire | Trinity Large Thinking | Arcee AI | 67,2 | de 59,6 à 74,9 | 15 % | 2 | 0,19 € / 0,74 € |
| provisoire | Gemini 2.5 Flash (Sep 2025) | Google DeepMind | 66,7 | de 62,1 à 71,3 | 23 % | 3 | 0,26 € / 2,19 € |
| provisoire | GPT-4.1 mini | OpenAI | 66,7 | de 60,8 à 72,7 | 23 % | 3 | 0,35 € / 1,39 € |
| provisoire | GPT-5 nano | OpenAI | 66,5 | de 61,1 à 71,8 | 23 % | 3 | 0,04 € / 0,35 € |
| provisoire | Nemotron 3 Super | NVIDIA | 66,5 | de 60,5 à 72,4 | 15 % | 2 | 0,01 € / 0,53 € |
| provisoire | Qwen3-235B-A22B | Alibaba | 66,5 | de 60,2 à 72,7 | 15 % | 2 | 0,61 € / 2,46 € |
| provisoire | Grok 3 | xAI | 66,2 | de 59,9 à 72,4 | 15 % | 2 | 2,63 € / 13 € |
| provisoire | Claude 3.5 Sonnet (October 2024) | Anthropic | 65,7 | de 57,0 à 74,4 | 15 % | 2 | inconnu |
| provisoire | Gemini 2.5 Flash (Jun 2025) | Google DeepMind | 65,7 | de 60,4 à 70,9 | 15 % | 2 | 0,26 € / 2,17 € |
| provisoire | DeepSeek-R1 | DeepSeek | 65,1 | de 59,1 à 71,2 | 15 % | 2 | inconnu |
| provisoire | Qwen3-30B-A3B-Instruct (Jul 2025) | Alibaba | 65,1 | de 56,9 à 73,4 | 8 % | 1 | 0,26 € / 0,44 € |
| provisoire | DeepSeek-V3 (Mar 2025) | DeepSeek | 64,9 | de 59,2 à 70,6 | 23 % | 3 | 0,17 € / 0,67 € |
| provisoire | GPT-4.1 | OpenAI | 64,9 | de 58,9 à 70,8 | 23 % | 3 | 1,76 € / 7,02 € |
| provisoire | Mistral Medium 3.1 | Mistral AI | 64,4 | de 57,9 à 70,8 | 23 % | 3 | 0,35 € / 1,73 € |
| provisoire | GLM-4.5-Air | Z.ai (Zhipu AI) | 64,1 | de 55,9 à 72,3 | 15 % | 2 | 0,18 € / 0,97 € |
| provisoire | Qwen3-30B-A3B-Thinking (Jul 2025) | Alibaba | 64,1 | de 55,9 à 72,3 | 8 % | 1 | 0,32 € / 1,14 € |
| provisoire | GLM-4.6V | Z.ai (Zhipu AI) | 63,8 | de 55,6 à 72,1 | 8 % | 1 | inconnu |
| provisoire | Hunyuan-T1 | Tencent | 63,8 | de 55,6 à 72,1 | 8 % | 1 | inconnu |
| provisoire | Qwen3.5-35B-A3B | Alibaba | 63,8 | de 55,1 à 72,6 | 15 % | 2 | 0,12 € / 0,87 € |
| provisoire | qwen3-coder-next | Alibaba | 63,6 | de 57,4 à 69,8 | 15 % | 2 | 0,10 € / 0,69 € |
| provisoire | MiMo-V2-Flash | Xiaomi | 63,3 | de 52,7 à 73,9 | 15 % | 2 | 0,12 € / 0,25 € |
| provisoire | Qwen3-32B | Alibaba | 63,3 | de 55,4 à 71,2 | 15 % | 2 | 0,07 € / 0,24 € |
| provisoire | glm-4.7-flash | Z.ai (Zhipu AI) | 63,1 | de 54,8 à 71,3 | 8 % | 1 | inconnu |
| provisoire | Qwen3-Next-80B-A3B Thinking | Alibaba | 63,1 | de 54,8 à 71,3 | 8 % | 1 | inconnu |
| provisoire | Mistral Medium 3 | Mistral AI | 62,8 | de 54,6 à 71,0 | 8 % | 1 | 0,35 € / 1,76 € |
| provisoire | o1-mini | OpenAI | 62,8 | de 55,1 à 70,5 | 15 % | 2 | 0,97 € / 3,86 € |
| provisoire | Gemini 2.5 Flash-Lite (Jun 2025) | Google DeepMind | 62,5 | de 55,3 à 69,8 | 15 % | 2 | 0,09 € / 0,35 € |
| provisoire | Hunyuan-TurboS | Tencent | 62,0 | de 53,8 à 70,2 | 8 % | 1 | inconnu |
| provisoire | MiniMax-M1-80k | MiniMax | 62,0 | de 53,8 à 70,2 | 8 % | 1 | 0,12 € / 1,10 € |
| provisoire | Gemini 2.5 Flash-Lite (Sep 2025) | Google DeepMind | 61,8 | de 53,5 à 70,0 | 8 % | 1 | 0,09 € / 0,35 € |
| provisoire | Qwen3-14B | Alibaba | 61,8 | de 53,6 à 70,0 | 8 % | 1 | 0,31 € / 1,23 € |
| provisoire | Claude 3.5 Sonnet | Anthropic | 61,2 | de 54,5 à 67,9 | 15 % | 2 | 2,63 € / 13 € |
| provisoire | INTELLECT-3 | Prime Intellect | 61,0 | de 52,8 à 69,2 | 8 % | 1 | inconnu |
| provisoire | DeepSeek-V3 | DeepSeek | 60,5 | de 52,2 à 68,7 | 8 % | 1 | inconnu |
| provisoire | Nemotron 3 Super 120B | NVIDIA | 60,5 | de 52,2 à 68,7 | 8 % | 1 | 0,08 € / 0,39 € |
| provisoire | Magistral Small 1.2 | Mistral AI | 60,2 | de 52,0 à 68,4 | 8 % | 1 | 0,44 € / 1,32 € |
| provisoire | Nemotron 3.5 Lightning | NVIDIA | 60,2 | de 52,0 à 68,4 | 8 % | 1 | 0,08 € / 0,20 € |
| provisoire | Qwen3.5-9B | Alibaba | 59,9 | de 53,0 à 66,9 | 15 % | 2 | 0,10 € / 0,15 € |
| provisoire | Step 3 | StepFun | 59,9 | de 51,7 à 68,1 | 8 % | 1 | inconnu |
| provisoire | GLM-4.5V | Z.ai (Zhipu AI) | 59,7 | de 51,5 à 67,9 | 8 % | 1 | inconnu |
| provisoire | Qwen3-30B-A3B | Alibaba | 59,4 | de 52,7 à 66,1 | 15 % | 2 | 0,10 € / 0,43 € |
| provisoire | Llama 3.3 Nemotron Super 49B v1.5 | NVIDIA | 58,9 | de 50,7 à 67,1 | 8 % | 1 | inconnu |
| provisoire | QwQ-32B | Alibaba | 58,9 | de 50,7 à 67,1 | 8 % | 1 | 0,13 € / 0,35 € |
| provisoire | Llama 3.1 Nemotron Ultra 253B | NVIDIA | 58,4 | de 50,2 à 66,6 | 8 % | 1 | inconnu |
| provisoire | Qwen2.5-Max | Alibaba | 58,4 | de 50,2 à 66,6 | 8 % | 1 | 1,40 € / 5,62 € |
| provisoire | Ling-flash-2.0 | Ant Group | 58,1 | de 49,9 à 66,3 | 8 % | 1 | inconnu |
| provisoire | Claude 3.5 Haiku | Anthropic | 57,1 | de 50,0 à 64,1 | 23 % | 3 | 0,70 € / 3,51 € |
| provisoire | Cohere Command A | Cohere | 57,1 | de 48,9 à 65,3 | 8 % | 1 | 2,17 € / 8,67 € |
| provisoire | Granite 4.2 30B | IBM | 57,1 | de 48,9 à 65,3 | 8 % | 1 | inconnu |
| provisoire | Devstral Small 2 | Mistral AI | 56,8 | de 48,6 à 65,0 | 8 % | 1 | inconnu |
| provisoire | Llama 4 Maverick | Meta AI | 56,8 | de 50,1 à 63,5 | 23 % | 3 | 0,13 € / 0,52 € |
| provisoire | Mistral Small 3.2 | Mistral AI | 56,8 | de 48,3 à 65,3 | 15 % | 2 | 0,07 € / 0,17 € |
| provisoire | Gemini 2.0 Flash (Feb 2025) | Google DeepMind | 56,3 | de 49,2 à 63,3 | 15 % | 2 | 0,09 € / 0,37 € |
| provisoire | Ring-flash-2.0 | Ant Group | 54,4 | de 46,3 à 62,6 | 8 % | 1 | inconnu |
| provisoire | Qwen Plus (Jan 2025) | Alibaba | 54,2 | de 46,0 à 62,4 | 8 % | 1 | 0,35 € / 1,05 € |
| provisoire | OLMo 3.1 32B Instruct | Allen Institute for AI | 53,9 | de 45,7 à 62,1 | 8 % | 1 | inconnu |
| provisoire | Gemini 1.5 Pro (Sept 2024) | Google DeepMind | 53,4 | de 46,2 à 60,6 | 15 % | 2 | inconnu |
| provisoire | GPT-4o (May 2024) | OpenAI | 53,4 | de 45,2 à 61,6 | 8 % | 1 | 4,39 € / 13 € |
| provisoire | Grok-2 (Dec 2024) | xAI | 53,4 | de 45,8 à 61,0 | 8 % | 1 | inconnu |
| provisoire | DeepSeek-V2.5 (Dec 2024) | DeepSeek | 53,1 | de 45,0 à 61,3 | 8 % | 1 | inconnu |
| provisoire | Magistral Medium 1.1 | Mistral AI | 53,1 | de 45,0 à 61,3 | 8 % | 1 | 1,73 € / 4,34 € |
| provisoire | Llama 3.1-405B | Meta AI | 52,9 | de 45,7 à 60,0 | 15 % | 2 | 2,38 € / 2,60 € |
| provisoire | Qwen3-8B | Alibaba | 52,9 | de 44,7 à 61,1 | 8 % | 1 | 0,04 € / 0,35 € |
| provisoire | Yi-Lightning | 01.AI | 52,9 | de 44,7 à 61,1 | 8 % | 1 | inconnu |
| provisoire | Grok-2 (Aug 2024) | xAI | 52,6 | de 44,4 à 60,8 | 8 % | 1 | inconnu |
| provisoire | Granite 4.1 30B | IBM | 52,4 | de 44,1 à 60,6 | 8 % | 1 | inconnu |
| provisoire | GPT-4.1 nano | OpenAI | 51,3 | de 44,4 à 58,2 | 23 % | 3 | 0,09 € / 0,35 € |
| provisoire | Granite 4.1 8B | IBM | 51,3 | de 43,1 à 59,5 | 8 % | 1 | 0,04 € / 0,09 € |
| provisoire | Mistral Small 3.1 | Mistral AI | 51,3 | de 43,3 à 59,3 | 15 % | 2 | 0,09 € / 0,26 € |
| provisoire | Nemotron 3 Nano 30B | NVIDIA | 51,3 | de 43,1 à 59,5 | 8 % | 1 | inconnu |
| provisoire | Gemini 1.5 Flash (Sep 2024) | Google DeepMind | 51,1 | de 41,8 à 60,3 | 15 % | 2 | inconnu |
| provisoire | Gemini 2.0 Flash-Lite | Google DeepMind | 50,8 | de 42,6 à 59,0 | 8 % | 1 | 0,07 € / 0,26 € |
| provisoire | GPT-4o (Aug 2024) | OpenAI | 50,8 | de 42,6 à 59,0 | 8 % | 1 | 2,19 € / 8,78 € |
| provisoire | GPT-4o (Nov 2024) | OpenAI | 50,8 | de 43,3 à 58,3 | 23 % | 3 | 2,19 € / 8,78 € |
| provisoire | Solar Pro 3 | Upstage | 50,8 | de 42,6 à 59,0 | 8 % | 1 | 0,13 € / 0,53 € |
| provisoire | Claude 3 Opus | Anthropic | 50,0 | de 42,6 à 57,4 | 15 % | 2 | 13 € / 66 € |
| provisoire | DeepSeek-V2.5 (Sep 2024) | DeepSeek | 50,0 | de 41,8 à 58,2 | 8 % | 1 | inconnu |
| provisoire | Gemma 3 27B | Google DeepMind | 50,0 | de 41,8 à 58,2 | 15 % | 2 | 0,07 € / 0,14 € |
| provisoire | Mistral Large 2 (Jul 2024) | Mistral AI | 50,0 | de 41,8 à 58,2 | 8 % | 1 | 1,76 € / 5,27 € |
| provisoire | Gemini 1.5 Pro (May 2024) | Google DeepMind | 49,2 | de 41,1 à 57,4 | 8 % | 1 | inconnu |
| provisoire | GPT-4 Turbo (Apr 2024) | OpenAI | 49,2 | de 41,8 à 56,7 | 15 % | 2 | inconnu |
| provisoire | Mistral Large 2 (Nov 2024) | Mistral AI | 49,2 | de 41,1 à 57,4 | 8 % | 1 | 1,76 € / 5,27 € |
| provisoire | Qwen2.5-72B | Alibaba | 48,4 | de 40,8 à 56,1 | 15 % | 2 | 2,46 € / 7,37 € |
| provisoire | GPT-4 Turbo (Nov 2023) | OpenAI | 48,2 | de 40,0 à 56,3 | 8 % | 1 | 8,78 € / 26 € |
| provisoire | Llama 3.3 70B | Meta AI | 48,2 | de 40,6 à 55,7 | 23 % | 3 | 0,09 € / 0,28 € |
| provisoire | Granite 4.2 8B | IBM | 47,7 | de 39,5 à 55,8 | 8 % | 1 | 0,05 € / 0,22 € |
| provisoire | OLMo 3 32B Think | Ai2 | 47,7 | de 39,5 à 55,8 | 8 % | 1 | 0,13 € / 0,43 € |
| provisoire | Llama 4 Scout | Meta AI | 47,1 | de 37,7 à 56,6 | 15 % | 2 | 0,09 € / 0,26 € |
| provisoire | Grok-2 mini | xAI | 46,6 | de 38,5 à 54,8 | 8 % | 1 | inconnu |
| provisoire | Llama-3.1-Nemotron-70B-Instruct | NVIDIA | 46,4 | de 38,2 à 54,5 | 8 % | 1 | 0,52 € / 0,52 € |
| provisoire | Gemma 3n E4B | Google DeepMind | 45,6 | de 37,4 à 53,7 | 8 % | 1 | 0,05 € / 0,10 € |
| provisoire | Amazon Nova Pro | Amazon | 44,5 | de 36,4 à 52,7 | 8 % | 1 | 0,70 € / 2,81 € |
| provisoire | GPT-4o mini | OpenAI | 44,5 | de 36,2 à 52,9 | 15 % | 2 | 0,13 € / 0,53 € |
| provisoire | Gemma 3 12B | Google DeepMind | 43,5 | de 35,3 à 51,7 | 15 % | 2 | 0,04 € / 0,13 € |
| provisoire | GPT-4 (Mar 2023) | OpenAI | 43,5 | de 35,4 à 51,6 | 8 % | 1 | 26 € / 53 € |
| provisoire | Llama 3.1-70B | Meta AI | 43,0 | de 34,4 à 51,6 | 15 % | 2 | 0,63 € / 0,63 € |
| provisoire | Mistral Small 3 | Mistral AI | 43,0 | de 34,8 à 51,1 | 8 % | 1 | 0,04 € / 0,07 € |
| provisoire | Phi-4 | Microsoft | 42,7 | de 34,6 à 50,8 | 8 % | 1 | 0,06 € / 0,12 € |
| provisoire | Qwen2.5-Coder-32B-Instruct | Alibaba | 42,4 | de 34,3 à 50,5 | 8 % | 1 | 0,25 € / 0,76 € |
| provisoire | GPT-4 (Jun 2023) | OpenAI | 41,9 | de 33,9 à 49,9 | 15 % | 2 | inconnu |
| provisoire | Gemini 1.5 Flash (May 2024) | Google DeepMind | 41,7 | de 33,6 à 49,8 | 8 % | 1 | inconnu |
| provisoire | Llama 3-70B | Meta AI | 41,7 | de 33,6 à 49,8 | 8 % | 1 | inconnu |
| provisoire | Gemma 2 27B | Google DeepMind | 41,1 | de 33,0 à 49,2 | 8 % | 1 | 0,57 € / 0,57 € |
| provisoire | Claude 3 Sonnet | Anthropic | 40,9 | de 32,7 à 49,0 | 15 % | 2 | inconnu |
| provisoire | GLM-4 (0520) | Z.ai (Zhipu AI) | 40,1 | de 32,0 à 48,2 | 8 % | 1 | inconnu |
| provisoire | Nemotron-4 340B | NVIDIA | 39,8 | de 31,8 à 47,9 | 8 % | 1 | inconnu |
| provisoire | Qwen2-72B | Alibaba | 39,3 | de 31,2 à 47,5 | 15 % | 2 | inconnu |
| provisoire | Mistral Large | Mistral AI | 38,0 | de 30,0 à 46,0 | 8 % | 1 | 0,44 € / 1,32 € |
| provisoire | Amazon Nova Lite | Amazon | 37,7 | de 29,7 à 45,8 | 8 % | 1 | 0,05 € / 0,21 € |
| provisoire | Claude 3 Haiku | Anthropic | 37,5 | de 29,3 à 45,7 | 15 % | 2 | 0,22 € / 1,10 € |
| provisoire | Gemma 3 4B | Google DeepMind | 37,0 | de 28,9 à 45,0 | 8 % | 1 | 0,04 € / 0,09 € |
| provisoire | Claude 2.1 | Anthropic | 35,4 | de 27,6 à 43,1 | 8 % | 1 | inconnu |
| provisoire | Gemini 1.5 Flash 8B | Google DeepMind | 35,4 | de 27,4 à 43,4 | 8 % | 1 | inconnu |
| provisoire | Gemma 2 9B | Google DeepMind | 34,9 | de 26,9 à 42,8 | 8 % | 1 | inconnu |
| provisoire | Amazon Nova Micro | Amazon | 34,6 | de 26,6 à 42,6 | 8 % | 1 | 0,03 € / 0,12 € |
| provisoire | Ministral 8B | Mistral AI | 32,5 | de 24,6 à 40,4 | 8 % | 1 | 0,09 € / 0,09 € |
| provisoire | Qwen1.5-110B | Alibaba | 32,3 | de 24,3 à 40,2 | 8 % | 1 | inconnu |
| provisoire | Mistral Medium | Mistral AI | 31,7 | de 23,8 à 39,6 | 8 % | 1 | 1,32 € / 6,58 € |
| provisoire | Mixtral 8x22B | Mistral AI | 31,5 | de 22,9 à 40,1 | 15 % | 2 | 1,76 € / 5,27 € |
| provisoire | Qwen1.5-72B | Alibaba | 31,5 | de 23,6 à 39,4 | 8 % | 1 | inconnu |
| provisoire | GPT-3.5 Turbo (Jan 2024) | OpenAI | 29,1 | de 20,6 à 37,7 | 15 % | 2 | 0,44 € / 1,32 € |
| provisoire | Yi-1.5-34B | 01.AI | 29,1 | de 21,3 à 36,9 | 8 % | 1 | inconnu |
| provisoire | Llama 3-8B | Meta AI | 27,8 | de 20,0 à 35,6 | 8 % | 1 | inconnu |
| provisoire | Llama 3.1-8B | Meta AI | 27,3 | de 18,8 à 35,8 | 23 % | 3 | 0,02 € / 0,03 € |
| provisoire | Mixtral 8x7B | Mistral AI | 27,0 | de 19,3 à 34,8 | 8 % | 1 | 0,61 € / 0,61 € |
| provisoire | GPT-3.5 Turbo (Nov 2023) | OpenAI | 26,5 | de 18,8 à 34,3 | 8 % | 1 | 0,88 € / 1,76 € |
| provisoire | Qwen1.5-32B | Alibaba | 26,3 | de 18,5 à 34,0 | 8 % | 1 | inconnu |
| provisoire | DBRX | Databricks | 25,5 | de 17,8 à 33,2 | 8 % | 1 | inconnu |
| provisoire | Qwen1.5-14B | Alibaba | 23,9 | de 16,3 à 31,5 | 8 % | 1 | inconnu |
| provisoire | DeepSeek LLM 67B | DeepSeek | 19,7 | de 12,3 à 27,2 | 8 % | 1 | inconnu |
| provisoire | phi-3-small 7.4B | Microsoft | 18,9 | de 11,5 à 26,4 | 8 % | 1 | inconnu |
| provisoire | Yi-34B | 01.AI | 18,9 | de 11,5 à 26,4 | 8 % | 1 | inconnu |
| provisoire | Llama 2-70B | Meta AI | 15,5 | de 8,3 à 22,8 | 8 % | 1 | inconnu |
| provisoire | Llama 3.2 3B | Meta AI | 14,8 | de 7,6 à 22,0 | 8 % | 1 | 0,04 € / 0,29 € |
| provisoire | QwQ-32B-Preview | Alibaba | 14,2 | de 7,1 à 21,4 | 8 % | 1 | inconnu |
| provisoire | Qwen1.5-7B | Alibaba | 13,7 | de 6,6 à 20,9 | 8 % | 1 | inconnu |
| provisoire | MPT-30B | MosaicML | 13,2 | de 6,1 à 20,3 | 8 % | 1 | inconnu |
| provisoire | Qwen-14B | Alibaba | 12,9 | de 5,9 à 20,0 | 8 % | 1 | inconnu |
| provisoire | phi-3-mini 3.8B | Microsoft | 11,1 | de 4,1 à 18,1 | 8 % | 1 | inconnu |
| provisoire | Mistral 7B v0.2 | Mistral AI | 10,9 | de 3,9 à 17,8 | 8 % | 1 | 0,14 € / 0,19 € |
| provisoire | Gemma 7B | Google DeepMind | 9,8 | de 2,9 à 16,7 | 8 % | 1 | inconnu |
| provisoire | Llama 2-13B | Meta AI | 8,2 | de 1,5 à 15,0 | 8 % | 1 | inconnu |
| provisoire | Llama 2-7B | Meta AI | 0,7 | de 0,0 à 6,9 | 8 % | 1 | inconnu |
| provisoire | chatglm2-6b | Z.ai (Zhipu AI) | 0,0 | de 0,0 à 0,0 | 8 % | 1 | inconnu |
| provisoire | Dolly 2.0-12b | Databricks | 0,0 | de 0,0 à 0,0 | 8 % | 1 | inconnu |
| provisoire | Gemma 2B | Google DeepMind | 0,0 | de 0,0 à 3,2 | 8 % | 1 | inconnu |
| provisoire | Llama 3.2 1B | Meta AI | 0,0 | de 0,0 à 3,8 | 8 % | 1 | 0,02 € / 0,18 € |
| provisoire | LLaMA-13B | Meta AI | 0,0 | de 0,0 à 0,0 | 8 % | 1 | inconnu |
| provisoire | MPT-7B | MosaicML | 0,0 | de 0,0 à 2,1 | 8 % | 1 | inconnu |
| provisoire | Phi-4 Mini | Microsoft | 0,0 | de 0,0 à 0,0 | 8 % | 1 | 0,07 € / 0,26 € |
| provisoire | stablelm-tuned-alpha-7b | Stability AI | 0,0 | de 0,0 à 0,0 | 8 % | 1 | inconnu |

## Ce qui compose le score

Le score Code agrège 13 benchmarks, chacun pesé ci-dessous. 2 benchmarks archivés ne comptent plus. La tâche pèse 15 % du score général.

- Arena, questions de code : 7,7 % du score de la tâche (actif)
- CursorBench : 7,7 % du score de la tâche (actif)
- DeepSWE : 7,7 % du score de la tâche (actif)
- FrontierCode : 7,7 % du score de la tâche (actif)
- FrontierSWE : 7,7 % du score de la tâche (actif)
- GBAEval : 7,7 % du score de la tâche (actif)
- GSO : 7,7 % du score de la tâche (actif)
- MirrorCode : 7,7 % du score de la tâche (actif)
- SciCode : 7,7 % du score de la tâche (actif)
- SWE-bench Verified : 7,7 % du score de la tâche (actif)
- Terminal-Bench 2.0 : 7,7 % du score de la tâche (actif)
- WeirdML (v2) : 7,7 % du score de la tâche (actif)
- WeirdML v3 : 7,7 % du score de la tâche (actif)

Source : Quelle IA, édition du 28 septembre 2026. https://quelleia.com
