# Classement Raisonnement des modèles de langage

> Dans l'édition du 28 septembre 2026, GPT-6 Astra (OpenAI) est premier en raisonnement avec un score Raisonnement de 103,5, ex æquo avec Claude Opus 5.5. La marge du premier va de 99,9 à 107,1 ; deux modèles dont les marges se recouvrent sont ex æquo. 100 modèles sont classés, 142 autres ont un score provisoire.

Page : https://quelleia.com/classement/raisonnement/
Édition : 2026-W40, 28 septembre 2026
Question : Quel modèle raisonne le mieux ?

## Comment lire ce classement

Le score Raisonnement résume les résultats d'un modèle sur les benchmarks de raisonnement où il a été mesuré. L'échelle est celle du score général : 100 correspond au meilleur modèle au lancement du site, 50 à GPT-4o de fin 2024. La barre indique la marge d'erreur : deux modèles dont les barres se chevauchent sont ex æquo.

## Modèles classés (100)

| Rang | Modèle | Éditeur | Score | Marge à 90 % | Couverture | Mesures | Prix entrée / sortie (€ par million de jetons) |
| --- | --- | --- | --- | --- | --- | --- | --- |
| 1 | GPT-6 Astra | OpenAI | 103,5 | de 99,9 à 107,1 | 67 % | 6 | 8,78 € / 44 € |
| 2 | Claude Opus 5.5 | Anthropic | 100,1 | de 95,9 à 104,4 | 56 % | 5 | 4 € / 20 € |
| 3 | GPT-5.6 Sol | OpenAI | 96,2 | de 93,8 à 98,6 | 89 % | 8 | 3,51 € / 18 € |
| 4 | GPT-5.5 Pro | OpenAI | 96,0 | de 91,5 à 100,4 | 67 % | 6 | 26 € / 158 € |
| 5 | Claude Fable 5.1 | Anthropic | 95,4 | de 92,4 à 98,5 | 67 % | 6 | 8,78 € / 44 € |
| 6 | Claude Opus 5 | Anthropic | 95,2 | de 92,1 à 98,3 | 78 % | 7 | 4,39 € / 22 € |
| 7 | Claude Fable 5 | Anthropic | 94,4 | de 91,6 à 97,2 | 89 % | 8 | 8,78 € / 44 € |
| 8 | GPT-5.5 | OpenAI | 94,1 | de 91,6 à 96,6 | 89 % | 8 | 4,34 € / 26 € |
| 9 | Gemini 3.8 Flash | Google DeepMind | 93,9 | de 90,2 à 97,5 | 44 % | 4 | 1,50 € / 7,50 € |
| 10 | GPT-5.4 Pro | OpenAI | 93,1 | de 89,7 à 96,5 | 56 % | 5 | 26 € / 158 € |
| 11 | Gemini 3.1 Pro | Google DeepMind | 91,8 | de 88,5 à 95,0 | 100 % | 9 | 2 € / 12 € |
| 12 | Gemini 3.7 Flash | Google DeepMind | 91,3 | de 88,9 à 93,6 | 67 % | 6 | 1,50 € / 7,50 € |
| 13 | GPT-5.6 Terra | OpenAI | 90,5 | de 86,8 à 94,1 | 78 % | 7 | 2,17 € / 13 € |
| 14 | Gemini 3.5 Flash | Google DeepMind | 89,7 | de 87,5 à 91,9 | 100 % | 9 | 1,30 € / 7,80 € |
| 15 | GPT-5.4 | OpenAI | 89,4 | de 87,6 à 91,3 | 89 % | 8 | 2,17 € / 13 € |
| 16 | Claude Opus 4.8 | Anthropic | 89,2 | de 87,3 à 91,0 | 100 % | 9 | 4,39 € / 22 € |
| 17 | DeepSeek V4 Pro 0813 | DeepSeek | 88,6 | de 85,8 à 91,5 | 67 % | 6 | 0,61 € / 1,82 € |
| 18 | Grok 4.6 | xAI | 88,6 | de 86,4 à 90,9 | 78 % | 7 | 1,76 € / 5,27 € |
| 19 | Claude Opus 4.7 | Anthropic | 88,4 | de 85,8 à 91,0 | 89 % | 8 | 4,39 € / 22 € |
| 20 | Claude Sonnet 5 | Anthropic | 87,6 | de 84,6 à 90,6 | 67 % | 6 | 1,73 € / 8,67 € |
| 21 | Muse Spark 1.3 | Meta AI | 87,6 | de 83,8 à 91,4 | 44 % | 4 | 1,25 € / 4,25 € |
| 22 | Qwen 3.8 Max | Alibaba | 87,6 | de 83,6 à 91,6 | 44 % | 4 | 1,76 € / 5,27 € |
| 23 | Gemini 3.6 Flash | Google DeepMind | 87,3 | de 85,3 à 89,4 | 67 % | 6 | 1,30 € / 6,50 € |
| 24 | Kimi K3 | Moonshot | 87,1 | de 85,2 à 89,0 | 89 % | 8 | 2,60 € / 13 € |
| 25 | Claude Opus 4.6 | Anthropic | 86,8 | de 83,7 à 89,9 | 100 % | 9 | 4,39 € / 22 € |
| 26 | DeepSeek V4 Flash 0731 | DeepSeek | 86,8 | de 84,8 à 88,8 | 78 % | 7 | 0,18 € / 0,35 € |
| 27 | Grok 4.20 | xAI | 86,3 | de 82,5 à 90,0 | 67 % | 6 | 1,08 € / 2,17 € |
| 28 | GLM-5.3 | Z.ai (Zhipu AI) | 86,0 | de 80,8 à 91,2 | 44 % | 4 | 1,40 € / 4,40 € |
| 29 | Grok 4.5 | xAI | 86,0 | de 83,8 à 88,3 | 67 % | 6 | 1,76 € / 5,27 € |
| 30 | GPT-5.6 Luna | OpenAI | 85,8 | de 83,0 à 88,5 | 78 % | 7 | 0,87 € / 5,20 € |
| 31 | Qwen3.7-Max | Alibaba | 85,5 | de 80,9 à 90,1 | 56 % | 5 | 1,08 € / 3,25 € |
| 32 | Claude Sonnet 4.6 | Anthropic | 85,0 | de 81,3 à 88,7 | 78 % | 7 | 2,63 € / 13 € |
| 33 | GPT-5.2 | OpenAI | 85,0 | de 81,9 à 88,0 | 100 % | 9 | 1,52 € / 12 € |
| 34 | Gemini 3 Flash | Google DeepMind | 83,2 | de 80,8 à 85,6 | 89 % | 8 | 0,43 € / 2,60 € |
| 35 | Gemini 3 Pro | Google DeepMind | 82,6 | de 78,6 à 86,7 | 67 % | 6 | 1,73 € / 10 € |
| 36 | Claude Opus 4.5 | Anthropic | 82,4 | de 80,3 à 84,5 | 100 % | 9 | 4,39 € / 22 € |
| 37 | Inkling-Small | Thinking Machines | 82,4 | de 78,4 à 86,3 | 44 % | 4 | 0,45 € / 1,20 € |
| 38 | Qwen 3.6 Max (Preview) | Alibaba | 81,6 | de 77,8 à 85,4 | 56 % | 5 | 1,14 € / 6,85 € |
| 39 | Inkling | Thinking Machines | 81,3 | de 78,8 à 83,8 | 67 % | 6 | 0,95 € / 4,05 € |
| 40 | Kimi K2.6 | Moonshot | 81,3 | de 77,4 à 85,3 | 44 % | 4 | 0,59 € / 2,96 € |
| 41 | Grok 4.3 Beta | xAI | 81,1 | de 76,4 à 85,8 | 44 % | 4 | 1,08 € / 2,17 € |
| 42 | GLM-5.2 | Z.ai (Zhipu AI) | 80,8 | de 78,5 à 83,1 | 78 % | 7 | 0,98 € / 3,08 € |
| 43 | DeepSeek-V4-Pro | DeepSeek | 80,6 | de 76,3 à 84,8 | 56 % | 5 | 0,38 € / 0,75 € |
| 44 | GPT-5.1 | OpenAI | 79,8 | de 77,3 à 82,2 | 100 % | 9 | 1,08 € / 8,67 € |
| 45 | GPT-5 Pro | OpenAI | 79,5 | de 76,3 à 82,7 | 44 % | 4 | 13 € / 105 € |
| 46 | GPT-5 | OpenAI | 79,0 | de 75,5 à 82,4 | 100 % | 9 | 1,08 € / 8,67 € |
| 47 | Grok 4 | xAI | 78,7 | de 75,6 à 81,9 | 56 % | 5 | 2,63 € / 13 € |
| 48 | Qwen3.7-Plus | Alibaba | 78,7 | de 74,5 à 82,9 | 44 % | 4 | 0,28 € / 1,11 € |
| 49 | Nemotron 3 Ultra | NVIDIA | 78,2 | de 72,4 à 84,0 | 44 % | 4 | inconnu |
| 50 | o3 | OpenAI | 77,9 | de 73,8 à 82,1 | 100 % | 9 | 1,76 € / 7,02 € |
| 51 | GPT-5.4 Mini | OpenAI | 77,7 | de 75,1 à 80,3 | 78 % | 7 | 0,65 € / 3,90 € |
| 52 | Qwen3.5 397B-A17B | Alibaba | 77,7 | de 72,4 à 83,0 | 44 % | 4 | 0,34 € / 2,03 € |
| 53 | Claude Sonnet 4.5 | Anthropic | 77,2 | de 75,0 à 79,3 | 100 % | 9 | 2,60 € / 13 € |
| 54 | Claude Opus 4.1 | Anthropic | 76,9 | de 71,2 à 82,6 | 78 % | 7 | 13 € / 66 € |
| 55 | Kimi K2.5 | Moonshot | 76,4 | de 73,2 à 79,5 | 56 % | 5 | 0,35 € / 1,65 € |
| 56 | Qwen 3.5 Plus (hosted 397B-A17B) | Alibaba | 76,4 | de 71,4 à 81,3 | 44 % | 4 | 0,35 € / 2,11 € |
| 57 | o3-pro | OpenAI | 76,1 | de 73,4 à 78,8 | 44 % | 4 | 18 € / 70 € |
| 58 | Gemini 3.5 Flash-Lite | Google DeepMind | 75,6 | de 72,9 à 78,2 | 67 % | 6 | 0,26 € / 2,17 € |
| 59 | GPT-5 mini | OpenAI | 75,1 | de 72,4 à 77,8 | 89 % | 8 | 0,22 € / 1,73 € |
| 60 | Qwen 3.5 Flash (hosted 35B-A3B) | Alibaba | 75,1 | de 69,7 à 80,5 | 44 % | 4 | 0,09 € / 0,35 € |
| 61 | DeepSeek-V3.2 | DeepSeek | 74,8 | de 72,1 à 77,5 | 56 % | 5 | 0,20 € / 0,30 € |
| 62 | GPT-5.4 Nano | OpenAI | 74,8 | de 71,8 à 77,8 | 78 % | 7 | 0,17 € / 1,08 € |
| 63 | Qwen 3.6 Plus | Alibaba | 74,8 | de 70,4 à 79,2 | 44 % | 4 | 0,28 € / 1,69 € |
| 64 | o4-mini | OpenAI | 74,3 | de 70,5 à 78,1 | 100 % | 9 | 0,95 € / 3,82 € |
| 65 | Gemini 2.5 Pro (Jun 2025) | Google DeepMind | 74,0 | de 70,1 à 77,9 | 89 % | 8 | 1,10 € / 8,78 € |
| 66 | Qwen3.6 27B | Alibaba | 74,0 | de 68,5 à 79,5 | 44 % | 4 | 0,53 € / 3,16 € |
| 67 | Grok 4 Fast | xAI | 73,5 | de 71,1 à 75,9 | 44 % | 4 | 0,17 € / 0,43 € |
| 68 | GLM-5 | Z.ai (Zhipu AI) | 73,2 | de 69,7 à 76,8 | 56 % | 5 | 0,52 € / 1,66 € |
| 69 | Gemini 3.1 Flash-Lite | Google DeepMind | 73,2 | de 66,5 à 80,0 | 56 % | 5 | 0,22 € / 1,30 € |
| 70 | MiniMax-M3 | MiniMax | 73,2 | de 69,3 à 77,2 | 67 % | 6 | 0,24 € / 0,97 € |
| 71 | Claude Opus 4 | Anthropic | 73,0 | de 68,7 à 77,3 | 78 % | 7 | 13 € / 66 € |
| 72 | Claude Haiku 4.5 | Anthropic | 72,2 | de 68,0 à 76,4 | 67 % | 6 | 0,88 € / 4,39 € |
| 73 | Qwen 3.6 35B-A3B | Alibaba | 71,9 | de 63,3 à 80,5 | 44 % | 4 | 0,22 € / 1,30 € |
| 74 | Claude Sonnet 4 | Anthropic | 71,4 | de 69,0 à 73,8 | 78 % | 7 | 2,60 € / 13 € |
| 75 | Qwen3-235B-A22B-Thinking (Jul 2025) | Alibaba | 71,4 | de 66,7 à 76,1 | 44 % | 4 | 0,26 € / 2,55 € |
| 76 | Gemini 2.5 Pro (Mar 2025) | Google DeepMind | 70,9 | de 65,9 à 75,9 | 44 % | 4 | 2,19 € / 8,78 € |
| 77 | Qwen3-Max | Alibaba | 70,9 | de 65,0 à 76,8 | 44 % | 4 | 0,68 € / 3,38 € |
| 78 | DeepSeek-V3.1 | DeepSeek | 70,6 | de 65,4 à 75,9 | 44 % | 4 | 0,18 € / 0,69 € |
| 79 | Qwen 3.6 Flash | Alibaba | 70,1 | de 64,6 à 75,6 | 56 % | 5 | 0,16 € / 0,99 € |
| 80 | Claude 3.7 Sonnet | Anthropic | 69,3 | de 65,5 à 73,1 | 56 % | 5 | 2,63 € / 13 € |
| 81 | Gemini 2.5 Flash (Jun 2025) | Google DeepMind | 69,3 | de 65,2 à 73,5 | 44 % | 4 | 0,26 € / 2,17 € |
| 82 | o1 | OpenAI | 68,5 | de 65,7 à 71,4 | 67 % | 6 | 13 € / 53 € |
| 83 | o3-mini | OpenAI | 66,2 | de 59,2 à 73,2 | 89 % | 8 | 0,97 € / 3,86 € |
| 84 | Qwen3-235B-A22B | Alibaba | 65,9 | de 60,9 à 71,0 | 44 % | 4 | 0,61 € / 2,46 € |
| 85 | Qwen3-235B-A22B-Instruct (Jul 2025) | Alibaba | 65,1 | de 60,0 à 70,3 | 44 % | 4 | 0,19 € / 0,77 € |
| 86 | gpt-oss-120b | OpenAI | 64,1 | de 55,6 à 72,6 | 56 % | 5 | 0,03 € / 0,16 € |
| 87 | DeepSeek-R1 | DeepSeek | 63,3 | de 58,5 à 68,2 | 44 % | 4 | inconnu |
| 88 | Claude 3.5 Sonnet (October 2024) | Anthropic | 62,8 | de 55,5 à 70,1 | 44 % | 4 | inconnu |
| 89 | GPT-4.5 | OpenAI | 62,5 | de 57,1 à 67,9 | 56 % | 5 | inconnu |
| 90 | GPT-4.1 | OpenAI | 60,5 | de 55,7 à 65,2 | 89 % | 8 | 1,76 € / 7,02 € |
| 91 | GPT-4.1 mini | OpenAI | 60,2 | de 55,3 à 65,0 | 67 % | 6 | 0,35 € / 1,39 € |
| 92 | GPT-5 nano | OpenAI | 59,7 | de 50,7 à 68,6 | 78 % | 7 | 0,04 € / 0,35 € |
| 93 | Llama 4 Maverick | Meta AI | 55,2 | de 50,3 à 60,2 | 78 % | 7 | 0,13 € / 0,52 € |
| 94 | GPT-4 (Jun 2023) | OpenAI | 54,2 | de 46,9 à 61,5 | 56 % | 5 | inconnu |
| 95 | Claude 3 Opus | Anthropic | 53,7 | de 47,9 à 59,4 | 67 % | 6 | 13 € / 66 € |
| 96 | Llama 3.3 70B | Meta AI | 51,8 | de 45,1 à 58,6 | 44 % | 4 | 0,09 € / 0,28 € |
| 97 | Llama 4 Scout | Meta AI | 50,3 | de 44,4 à 56,1 | 56 % | 5 | 0,09 € / 0,26 € |
| 98 | GPT-4o mini | OpenAI | 45,0 | de 38,0 à 52,1 | 67 % | 6 | 0,13 € / 0,53 € |
| 99 | GPT-4.1 nano | OpenAI | 44,5 | de 37,3 à 51,7 | 44 % | 4 | 0,09 € / 0,35 € |
| 100 | GPT-3.5 Turbo (Jan 2024) | OpenAI | 33,8 | de 23,9 à 43,8 | 56 % | 5 | 0,44 € / 1,32 € |

## Scores provisoires (142)

Ces modèles n'ont pas encore assez de mesures pour recevoir un rang. Ils sont listés du score le plus haut au plus bas.

| Rang | Modèle | Éditeur | Score | Marge à 90 % | Couverture | Mesures | Prix entrée / sortie (€ par million de jetons) |
| --- | --- | --- | --- | --- | --- | --- | --- |
| provisoire | Claude Sonnet 5.5 | Anthropic | 97,8 | de 94,9 à 100,7 | 11 % | 1 | 2 € / 10 € |
| provisoire | Gemini 3 Deep Think | Google DeepMind | 92,6 | de 89,0 à 96,1 | 22 % | 2 | inconnu |
| provisoire | Muse Spark 1.2 | Meta AI | 90,7 | de 85,2 à 96,3 | 33 % | 3 | 1,25 € / 4,25 € |
| provisoire | Qwen3.8 Max (0902) | Alibaba | 88,9 | de 84,4 à 93,5 | 11 % | 1 | 1,76 € / 5,27 € |
| provisoire | Muse Spark 1.1 | Meta AI | 88,6 | de 82,4 à 94,9 | 22 % | 2 | 1,10 € / 3,73 € |
| provisoire | DeepSeek V4.1 Flash | DeepSeek | 85,5 | de 80,0 à 91,1 | 22 % | 2 | 0,15 € / 0,60 € |
| provisoire | GPT-5.2 Pro | OpenAI | 85,5 | de 83,1 à 87,9 | 33 % | 3 | 18 € / 147 € |
| provisoire | Qwen 3.8 27B | Alibaba | 81,6 | de 76,3 à 86,9 | 22 % | 2 | 0,35 € / 2,75 € |
| provisoire | Kimi K2.7 Code | Moonshot | 80,6 | de 75,9 à 85,2 | 22 % | 2 | 0,83 € / 3,51 € |
| provisoire | Grok 4.1 Fast | xAI | 80,3 | de 75,3 à 85,3 | 33 % | 3 | 0,17 € / 0,43 € |
| provisoire | GLM-5.1 | Z.ai (Zhipu AI) | 79,0 | de 74,2 à 83,8 | 22 % | 2 | 0,85 € / 2,67 € |
| provisoire | Qwen3.7 Flash | Alibaba | 78,5 | de 72,6 à 84,3 | 22 % | 2 | 0,03 € / 0,11 € |
| provisoire | DeepSeek-V3.2-Speciale | DeepSeek | 77,9 | de 72,3 à 83,5 | 11 % | 1 | 0,51 € / 1,47 € |
| provisoire | DeepSeek-V4-Flash | DeepSeek | 76,6 | de 72,1 à 81,2 | 33 % | 3 | 0,09 € / 0,17 € |
| provisoire | Kimi K2 Thinking | Moonshot | 76,6 | de 69,6 à 83,6 | 11 % | 1 | 0,52 € / 2,17 € |
| provisoire | MiniMax-M2.5 | MiniMax | 76,1 | de 72,2 à 80,0 | 22 % | 2 | 0,13 € / 1 € |
| provisoire | Qwen3.5-122B-A10B | Alibaba | 75,9 | de 70,7 à 81,0 | 33 % | 3 | 0,35 € / 2,81 € |
| provisoire | DeepSeek-V3.2-Exp | DeepSeek | 75,6 | de 68,4 à 82,8 | 22 % | 2 | 0,25 € / 0,38 € |
| provisoire | MiMo-V2.5-Pro | Xiaomi | 75,1 | de 69,4 à 80,8 | 22 % | 2 | 0,38 € / 0,76 € |
| provisoire | Qwen3.5-27B | Alibaba | 74,8 | de 69,8 à 79,8 | 22 % | 2 | 0,26 € / 2,11 € |
| provisoire | GLM-5.3-Flash | Z.ai (Zhipu AI) | 74,5 | de 67,5 à 81,6 | 22 % | 2 | 0,15 € / 0,50 € |
| provisoire | Gemma 4 31B IT | Google DeepMind | 74,3 | de 67,0 à 81,6 | 33 % | 3 | 0,10 € / 0,31 € |
| provisoire | DeepSeek-V3.1-Terminus | DeepSeek | 72,2 | de 67,2 à 77,2 | 22 % | 2 | 0,24 € / 0,88 € |
| provisoire | GLM-4.7 | Z.ai (Zhipu AI) | 72,2 | de 64,5 à 79,9 | 22 % | 2 | 0,35 € / 1,52 € |
| provisoire | GPT-5.5 Instant | OpenAI | 71,9 | de 63,9 à 79,9 | 11 % | 1 | 4,39 € / 26 € |
| provisoire | tiny-recursion-model | inconnu | 71,7 | de 68,9 à 74,5 | 22 % | 2 | inconnu |
| provisoire | Kimi K2 (Sep 2025) | Moonshot | 71,2 | de 67,1 à 75,2 | 11 % | 1 | 0,55 € / 2,22 € |
| provisoire | Qwen3.5-35B-A3B | Alibaba | 70,9 | de 65,9 à 75,9 | 33 % | 3 | 0,12 € / 0,87 € |
| provisoire | Qwen Plus (Apr 2025) | Alibaba | 70,4 | de 64,3 à 76,4 | 22 % | 2 | inconnu |
| provisoire | Gemini 2.5 Flash (May 2025) | Google DeepMind | 69,8 | de 66,8 à 72,9 | 33 % | 3 | 0,12 € / 2,77 € |
| provisoire | Gemini 2.5 Flash (Apr 2025) | Google DeepMind | 69,6 | de 66,5 à 72,7 | 22 % | 2 | 0,13 € / 0,53 € |
| provisoire | seed-oss-36b-instruct | ByteDance | 68,8 | de 60,6 à 77,0 | 11 % | 1 | inconnu |
| provisoire | codex-mini-2025-05-16 | OpenAI | 68,3 | de 65,0 à 71,5 | 22 % | 2 | 1,32 € / 5,27 € |
| provisoire | Gemma 4 26B A4B | Google DeepMind | 68,3 | de 62,7 à 73,8 | 33 % | 3 | 0,05 € / 0,29 € |
| provisoire | Mistral Medium 3.5 | Mistral AI | 68,0 | de 63,1 à 72,9 | 22 % | 2 | 1,30 € / 6,50 € |
| provisoire | DeepSeek-R1 (May 2025) | DeepSeek | 67,0 | de 63,2 à 70,7 | 33 % | 3 | 0,43 € / 1,86 € |
| provisoire | o1-pro | OpenAI | 67,0 | de 62,9 à 71,1 | 22 % | 2 | 132 € / 527 € |
| provisoire | o1-preview | OpenAI | 65,9 | de 61,5 à 70,4 | 22 % | 2 | inconnu |
| provisoire | Qwen3.5-9B | Alibaba | 64,9 | de 59,6 à 70,2 | 33 % | 3 | 0,10 € / 0,15 € |
| provisoire | Grok-3 mini | xAI | 64,6 | de 60,2 à 69,0 | 22 % | 2 | 0,26 € / 0,43 € |
| provisoire | Gemini 2.5 Pro (May 2025) | Google DeepMind | 64,4 | de 59,0 à 69,7 | 11 % | 1 | 2,19 € / 8,78 € |
| provisoire | Mistral Small 4 | Mistral AI | 63,1 | de 58,2 à 68,0 | 22 % | 2 | 0,13 € / 0,52 € |
| provisoire | GLM-4.5-Air | Z.ai (Zhipu AI) | 62,5 | de 58,7 à 66,4 | 11 % | 1 | 0,18 € / 0,97 € |
| provisoire | Gemini 2.0 Pro | Google DeepMind | 62,3 | de 57,7 à 66,8 | 11 % | 1 | 1,75 € / 6,98 € |
| provisoire | Qwen3-30B-A3B-Thinking (Jul 2025) | Alibaba | 62,0 | de 57,1 à 66,9 | 33 % | 3 | 0,32 € / 1,14 € |
| provisoire | Grok 3 | xAI | 61,2 | de 54,7 à 67,8 | 33 % | 3 | 2,63 € / 13 € |
| provisoire | Qwen3-30B-A3B-Instruct (Jul 2025) | Alibaba | 61,0 | de 55,4 à 66,6 | 33 % | 3 | 0,26 € / 0,44 € |
| provisoire | Mistral Medium 3.1 | Mistral AI | 60,7 | de 55,6 à 65,8 | 22 % | 2 | 0,35 € / 1,73 € |
| provisoire | Gemini 2.0 Flash Thinking (Jan 2025) | Google DeepMind | 60,5 | de 52,9 à 68,0 | 22 % | 2 | inconnu |
| provisoire | DeepSeek-R1-Distill-Qwen-32B | DeepSeek | 60,2 | de 53,9 à 66,4 | 11 % | 1 | 0,25 € / 0,76 € |
| provisoire | Gemini 2.0 Flash (Dec 2024) | Google DeepMind | 60,2 | de 52,6 à 67,8 | 11 % | 1 | 1,10 € / 4,39 € |
| provisoire | glm-4.7-flash | Z.ai (Zhipu AI) | 59,9 | de 53,8 à 66,1 | 11 % | 1 | inconnu |
| provisoire | Qwen3-32B | Alibaba | 59,9 | de 54,9 à 64,9 | 33 % | 3 | 0,07 € / 0,24 € |
| provisoire | QwQ-32B | Alibaba | 59,7 | de 53,6 à 65,7 | 11 % | 1 | 0,13 € / 0,35 € |
| provisoire | Kimi K2 (Jul 2025) | Moonshot | 59,4 | de 47,8 à 71,0 | 22 % | 2 | 0,50 € / 2,02 € |
| provisoire | gpt-oss-20b | OpenAI | 59,1 | de 53,7 à 64,6 | 33 % | 3 | 0,03 € / 0,12 € |
| provisoire | Claude 3.5 Sonnet | Anthropic | 58,9 | de 53,3 à 64,4 | 33 % | 3 | 2,63 € / 13 € |
| provisoire | Mistral Large 3 | Mistral AI | 58,6 | de 53,4 à 63,9 | 22 % | 2 | 0,43 € / 1,30 € |
| provisoire | Qwen3-14B | Alibaba | 57,8 | de 52,2 à 63,4 | 33 % | 3 | 0,31 € / 1,23 € |
| provisoire | DeepSeek-V3 (Mar 2025) | DeepSeek | 57,3 | de 52,5 à 62,1 | 33 % | 3 | 0,17 € / 0,67 € |
| provisoire | Gemini 2.5 Flash-Lite (Jun 2025) | Google DeepMind | 57,1 | de 51,1 à 63,1 | 22 % | 2 | 0,09 € / 0,35 € |
| provisoire | GPT-4o (May 2024) | OpenAI | 56,8 | de 51,5 à 62,1 | 33 % | 3 | 4,39 € / 13 € |
| provisoire | Magistral Small 1.0 | Mistral AI | 56,8 | de 48,7 à 64,9 | 22 % | 2 | 0,43 € / 1,30 € |
| provisoire | qwen3-4b-instruct-2507 | Alibaba | 56,8 | de 51,8 à 61,8 | 11 % | 1 | 0,18 € / 0,18 € |
| provisoire | Gemini 2.0 Flash (Feb 2025) | Google DeepMind | 56,0 | de 49,9 à 62,1 | 33 % | 3 | 0,09 € / 0,37 € |
| provisoire | DeepSeek-R1-Distill-Qwen-14B | DeepSeek | 55,8 | de 51,1 à 60,4 | 11 % | 1 | 0,13 € / 0,38 € |
| provisoire | Grok-2 (Dec 2024) | xAI | 55,5 | de 48,2 à 62,8 | 22 % | 2 | inconnu |
| provisoire | Mistral Medium 3 | Mistral AI | 55,2 | de 49,4 à 61,0 | 11 % | 1 | 0,35 € / 1,76 € |
| provisoire | o1-mini | OpenAI | 55,0 | de 42,3 à 67,7 | 33 % | 3 | 0,97 € / 3,86 € |
| provisoire | Qwen2.5-72B | Alibaba | 54,4 | de 48,7 à 60,2 | 33 % | 3 | 2,46 € / 7,37 € |
| provisoire | Qwen3-30B-A3B | Alibaba | 54,4 | de 48,3 à 60,6 | 33 % | 3 | 0,10 € / 0,43 € |
| provisoire | Magistral Small 1.2 | Mistral AI | 53,7 | de 47,8 à 59,6 | 22 % | 2 | 0,44 € / 1,32 € |
| provisoire | Cohere Command A | Cohere | 53,4 | de 47,7 à 59,1 | 22 % | 2 | 2,17 € / 8,67 € |
| provisoire | Magistral Medium 1.1 | Mistral AI | 53,4 | de 45,0 à 61,8 | 22 % | 2 | 1,73 € / 4,34 € |
| provisoire | Qwen3-4B | Alibaba | 53,4 | de 49,6 à 57,2 | 11 % | 1 | 0,03 € / 0,03 € |
| provisoire | Llama 3.1-405B | Meta AI | 52,9 | de 46,8 à 58,9 | 33 % | 3 | 2,38 € / 2,60 € |
| provisoire | GPT-4 Turbo (Nov 2023) | OpenAI | 52,6 | de 46,2 à 59,1 | 22 % | 2 | 8,78 € / 26 € |
| provisoire | Mistral Large 2 (Nov 2024) | Mistral AI | 52,6 | de 46,1 à 59,1 | 22 % | 2 | 1,76 € / 5,27 € |
| provisoire | Mistral Small 3.2 | Mistral AI | 52,6 | de 46,4 à 58,8 | 22 % | 2 | 0,07 € / 0,17 € |
| provisoire | Gemini 1.5 Pro (Sept 2024) | Google DeepMind | 52,4 | de 46,2 à 58,5 | 33 % | 3 | inconnu |
| provisoire | Llama 3.1-70B | Meta AI | 52,4 | de 46,5 à 58,2 | 22 % | 2 | 0,63 € / 0,63 € |
| provisoire | Mistral Large 2 (Jul 2024) | Mistral AI | 52,1 | de 45,4 à 58,8 | 33 % | 3 | 1,76 € / 5,27 € |
| provisoire | Qwen3-8B | Alibaba | 52,1 | de 46,2 à 58,0 | 33 % | 3 | 0,04 € / 0,35 € |
| provisoire | GPT-4o (Nov 2024) | OpenAI | 51,8 | de 44,5 à 59,1 | 33 % | 3 | 2,19 € / 8,78 € |
| provisoire | glm-4.7-flash_none | Z.ai (Zhipu AI) | 51,6 | de 48,3 à 54,8 | 11 % | 1 | inconnu |
| provisoire | GPT-4 Turbo (Apr 2024) | OpenAI | 51,3 | de 43,0 à 59,6 | 33 % | 3 | inconnu |
| provisoire | Mistral Small 3.1 | Mistral AI | 50,5 | de 44,3 à 56,8 | 22 % | 2 | 0,09 € / 0,26 € |
| provisoire | Claude 3.5 Haiku | Anthropic | 48,7 | de 42,3 à 55,1 | 11 % | 1 | 0,70 € / 3,51 € |
| provisoire | DeepSeek-V3 | DeepSeek | 48,7 | de 38,8 à 58,6 | 22 % | 2 | inconnu |
| provisoire | Gemini 1.5 Pro (May 2024) | Google DeepMind | 48,7 | de 42,1 à 55,3 | 22 % | 2 | inconnu |
| provisoire | Qwen2.5-32B | Alibaba | 48,4 | de 46,0 à 50,9 | 11 % | 1 | 0,61 € / 2,46 € |
| provisoire | Gemma 3 27B | Google DeepMind | 46,6 | de 38,3 à 55,0 | 33 % | 3 | 0,07 € / 0,14 € |
| provisoire | GPT-4o (Aug 2024) | OpenAI | 46,4 | de 35,1 à 57,6 | 22 % | 2 | 2,19 € / 8,78 € |
| provisoire | Gemini 1.5 Flash (Sep 2024) | Google DeepMind | 45,8 | de 39,0 à 52,7 | 11 % | 1 | inconnu |
| provisoire | Llama 3.2 90B | Meta AI | 45,8 | de 44,8 à 46,8 | 11 % | 1 | 0,31 € / 0,35 € |
| provisoire | Mistral Large | Mistral AI | 45,8 | de 39,0 à 52,7 | 11 % | 1 | 0,44 € / 1,32 € |
| provisoire | Pixtral Large | Mistral AI | 45,8 | de 44,8 à 46,8 | 11 % | 1 | 1,76 € / 5,27 € |
| provisoire | Gemini 2.0 Flash-Lite | Google DeepMind | 45,6 | de 36,8 à 54,3 | 22 % | 2 | 0,07 € / 0,26 € |
| provisoire | Llama 3-70B | Meta AI | 45,0 | de 38,0 à 52,1 | 22 % | 2 | inconnu |
| provisoire | Phi-4 | Microsoft | 45,0 | de 43,3 à 46,8 | 11 % | 1 | 0,06 € / 0,12 € |
| provisoire | Mistral Small 3 | Mistral AI | 44,5 | de 42,8 à 46,2 | 11 % | 1 | 0,04 € / 0,07 € |
| provisoire | Claude 3 Sonnet | Anthropic | 44,3 | de 37,2 à 51,3 | 11 % | 1 | inconnu |
| provisoire | Command R+ | Cohere | 44,0 | de 36,2 à 51,8 | 33 % | 3 | 2,19 € / 8,78 € |
| provisoire | mistral-small-2402 | Mistral AI | 44,0 | de 36,9 à 51,1 | 11 % | 1 | 0,13 € / 0,53 € |
| provisoire | Mixtral 8x22B | Mistral AI | 43,5 | de 33,4 à 53,6 | 22 % | 2 | 1,76 € / 5,27 € |
| provisoire | Claude 2 | Anthropic | 41,7 | de 34,2 à 49,1 | 11 % | 1 | inconnu |
| provisoire | Gemini 1.5 Flash (May 2024) | Google DeepMind | 41,4 | de 33,8 à 49,0 | 22 % | 2 | inconnu |
| provisoire | Mistral Medium | Mistral AI | 41,1 | de 33,6 à 48,6 | 11 % | 1 | 1,32 € / 6,58 € |
| provisoire | Gemma 3 12B | Google DeepMind | 40,3 | de 32,1 à 48,6 | 33 % | 3 | 0,04 € / 0,13 € |
| provisoire | Gemma 3 4B | Google DeepMind | 39,6 | de 31,6 à 47,5 | 33 % | 3 | 0,04 € / 0,09 € |
| provisoire | Claude 2.1 | Anthropic | 39,3 | de 30,8 à 47,8 | 22 % | 2 | inconnu |
| provisoire | Ministral 3B | Mistral AI | 39,3 | de 31,0 à 47,6 | 22 % | 2 | 0,04 € / 0,04 € |
| provisoire | Claude 3 Haiku | Anthropic | 39,0 | de 30,8 à 47,3 | 33 % | 3 | 0,22 € / 1,10 € |
| provisoire | Gemini 1.5 Flash 8B | Google DeepMind | 38,8 | de 31,0 à 46,6 | 11 % | 1 | inconnu |
| provisoire | Mistral Small v24.09 | Mistral AI | 38,8 | de 31,0 à 46,6 | 11 % | 1 | inconnu |
| provisoire | Gemma 2 27B | Google DeepMind | 38,5 | de 30,2 à 46,9 | 22 % | 2 | 0,57 € / 0,57 € |
| provisoire | Llama 3.1-8B | Meta AI | 36,4 | de 26,9 à 46,0 | 33 % | 3 | 0,02 € / 0,03 € |
| provisoire | Mistral NeMo | Mistral AI | 36,4 | de 28,4 à 44,5 | 11 % | 1 | 0,13 € / 0,13 € |
| provisoire | Qwen2.5-7B | Alibaba | 36,2 | de 28,1 à 44,3 | 33 % | 3 | 0,15 € / 0,61 € |
| provisoire | c4ai-command-r-08-2024 | Cohere | 35,9 | de 26,2 à 45,6 | 22 % | 2 | inconnu |
| provisoire | Mixtral 8x7B | Mistral AI | 34,1 | de 24,6 à 43,6 | 22 % | 2 | 0,61 € / 0,61 € |
| provisoire | deepseek-r1-0528-qwen3-8b | DeepSeek | 33,6 | de 33,0 à 34,2 | 11 % | 1 | 0,05 € / 0,08 € |
| provisoire | granite-4.0-micro | IBM | 33,3 | de 32,7 à 33,9 | 11 % | 1 | 0,01 € / 0,10 € |
| provisoire | Qwen3-1.7B | Alibaba | 33,0 | de 32,5 à 33,6 | 11 % | 1 | inconnu |
| provisoire | Gemini 1.0 Pro | Google DeepMind | 32,8 | de 24,6 à 41,0 | 11 % | 1 | inconnu |
| provisoire | Qwen1.5-110B | Alibaba | 32,3 | de 29,2 à 35,3 | 11 % | 1 | inconnu |
| provisoire | Ministral 8B | Mistral AI | 31,5 | de 23,3 à 39,7 | 11 % | 1 | 0,09 € / 0,09 € |
| provisoire | Claude Instant | Anthropic | 31,2 | de 23,0 à 39,4 | 11 % | 1 | inconnu |
| provisoire | Llama 3-8B | Meta AI | 27,8 | de 19,4 à 36,2 | 33 % | 3 | inconnu |
| provisoire | Qwen3.5-2B | Alibaba | 24,9 | de 24,7 à 25,2 | 11 % | 1 | inconnu |
| provisoire | granite-4.0-1b | IBM | 21,8 | de 21,6 à 22,0 | 11 % | 1 | inconnu |
| provisoire | granite-4.0-350m | IBM | 21,8 | de 21,6 à 22,0 | 11 % | 1 | inconnu |
| provisoire | DeepSeek LLM 67B | DeepSeek | 19,7 | de 19,6 à 19,9 | 11 % | 1 | inconnu |
| provisoire | QwQ-32B-Preview | Alibaba | 16,9 | de 14,1 à 19,6 | 11 % | 1 | inconnu |
| provisoire | Llama 2-70B | Meta AI | 14,5 | de 8,9 à 20,1 | 22 % | 2 | inconnu |
| provisoire | Mistral 7B v0.3 | Mistral AI | 10,9 | de 6,8 à 14,9 | 22 % | 2 | 0,22 € / 0,22 € |
| provisoire | phi-3-mini 3.8B | Microsoft | 10,6 | de 10,5 à 10,7 | 11 % | 1 | inconnu |
| provisoire | Llama 2-13B | Meta AI | 8,8 | de 5,2 à 12,4 | 22 % | 2 | inconnu |
| provisoire | Llama 2-7B | Meta AI | 1,7 | de 1,7 à 1,7 | 11 % | 1 | inconnu |
| provisoire | DeepSeek-R1-Distill-Qwen-1.5B | DeepSeek | 0,0 | de 0,0 à 0,0 | 11 % | 1 | inconnu |
| provisoire | Gemma 3 1B | Google DeepMind | 0,0 | de 0,0 à 0,0 | 11 % | 1 | inconnu |
| provisoire | Llama 3.2 1B | Meta AI | 0,0 | de 0,0 à 0,0 | 11 % | 1 | 0,02 € / 0,18 € |

## Ce qui compose le score

Le score Raisonnement agrège 9 benchmarks, chacun pesé ci-dessous. 1 benchmark archivé ne compte plus. La tâche pèse 15 % du score général.

- ARC-AGI-1 : 11,1 % du score de la tâche (saturé)
- ARC-AGI-2 : 11,1 % du score de la tâche (saturé)
- Chess Puzzles : 11,1 % du score de la tâche (actif)
- DTBench : 11,1 % du score de la tâche (saturé)
- EnigmaEval : 11,1 % du score de la tâche (actif)
- ForecastBench : 11,1 % du score de la tâche (actif)
- LMCA : 11,1 % du score de la tâche (actif)
- Mystery Game Puzzles : 11,1 % du score de la tâche (actif)
- SimpleBench : 11,1 % du score de la tâche (actif)

Source : Quelle IA, édition du 28 septembre 2026. https://quelleia.com
