# Classement Raisonnement des modèles de langage, édition du 28 septembre 2026

100 modèles classés. Le score IA est une estimation, donnée avec sa marge à 90 % : deux modèles dont les marges se recouvrent sont ex æquo.

| Rang | Modèle | Éditeur | Score | Marge | Mesures |
| ---: | --- | --- | ---: | --- | ---: |
| 1 | [GPT-6 Astra](https://quelleia.com/modeles/gpt-6-astra/) | OpenAI | 103,5 | de 99,9 à 107,1 | 6 |
| 2 | [Claude Opus 5.5](https://quelleia.com/modeles/claude-opus-5-5/) | Anthropic | 100,1 | de 95,9 à 104,4 | 5 |
| 3 | [GPT-5.6 Sol](https://quelleia.com/modeles/gpt-5-6-sol/) | OpenAI | 96,2 | de 93,8 à 98,6 | 8 |
| 4 | [GPT-5.5 Pro](https://quelleia.com/modeles/gpt-5-5-pro/) | OpenAI | 96,0 | de 91,5 à 100,4 | 6 |
| 5 | [Claude Fable 5.1](https://quelleia.com/modeles/claude-fable-5-1/) | Anthropic | 95,4 | de 92,4 à 98,5 | 6 |
| 6 | [Claude Opus 5](https://quelleia.com/modeles/claude-opus-5/) | Anthropic | 95,2 | de 92,1 à 98,3 | 7 |
| 7 | [Claude Fable 5](https://quelleia.com/modeles/claude-fable-5/) | Anthropic | 94,4 | de 91,6 à 97,2 | 8 |
| 8 | [GPT-5.5](https://quelleia.com/modeles/gpt-5-5/) | OpenAI | 94,1 | de 91,6 à 96,6 | 8 |
| 9 | [Gemini 3.8 Flash](https://quelleia.com/modeles/gemini-3-8-flash/) | Google DeepMind | 93,9 | de 90,2 à 97,5 | 4 |
| 10 | [GPT-5.4 Pro](https://quelleia.com/modeles/gpt-5-4-pro/) | OpenAI | 93,1 | de 89,7 à 96,5 | 5 |
| 11 | [Gemini 3.1 Pro](https://quelleia.com/modeles/gemini-3-1-pro/) | Google DeepMind | 91,8 | de 88,5 à 95,0 | 9 |
| 12 | [Gemini 3.7 Flash](https://quelleia.com/modeles/gemini-3-7-flash/) | Google DeepMind | 91,3 | de 88,9 à 93,6 | 6 |
| 13 | [GPT-5.6 Terra](https://quelleia.com/modeles/gpt-5-6-terra/) | OpenAI | 90,5 | de 86,8 à 94,1 | 7 |
| 14 | [Gemini 3.5 Flash](https://quelleia.com/modeles/gemini-3-5-flash/) | Google DeepMind | 89,7 | de 87,5 à 91,9 | 9 |
| 15 | [GPT-5.4](https://quelleia.com/modeles/gpt-5-4/) | OpenAI | 89,4 | de 87,6 à 91,3 | 8 |
| 16 | [Claude Opus 4.8](https://quelleia.com/modeles/claude-opus-4-8/) | Anthropic | 89,2 | de 87,3 à 91,0 | 9 |
| 17 | [DeepSeek V4 Pro 0813](https://quelleia.com/modeles/deepseek-v4-pro-0813/) | DeepSeek | 88,6 | de 85,8 à 91,5 | 6 |
| 18 | [Grok 4.6](https://quelleia.com/modeles/grok-4-6/) | xAI | 88,6 | de 86,4 à 90,9 | 7 |
| 19 | [Claude Opus 4.7](https://quelleia.com/modeles/claude-opus-4-7/) | Anthropic | 88,4 | de 85,8 à 91,0 | 8 |
| 20 | [Claude Sonnet 5](https://quelleia.com/modeles/claude-sonnet-5/) | Anthropic | 87,6 | de 84,6 à 90,6 | 6 |
| 21 | [Muse Spark 1.3](https://quelleia.com/modeles/muse-spark-1-3/) | Meta AI | 87,6 | de 83,8 à 91,4 | 4 |
| 22 | [Qwen 3.8 Max](https://quelleia.com/modeles/qwen-3-8-max/) | Alibaba | 87,6 | de 83,6 à 91,6 | 4 |
| 23 | [Gemini 3.6 Flash](https://quelleia.com/modeles/gemini-3-6-flash/) | Google DeepMind | 87,3 | de 85,3 à 89,4 | 6 |
| 24 | [Kimi K3](https://quelleia.com/modeles/kimi-k3/) | Moonshot | 87,1 | de 85,2 à 89,0 | 8 |
| 25 | [Claude Opus 4.6](https://quelleia.com/modeles/claude-opus-4-6/) | Anthropic | 86,8 | de 83,7 à 89,9 | 9 |
| 26 | [DeepSeek V4 Flash 0731](https://quelleia.com/modeles/deepseek-v4-flash-0731/) | DeepSeek | 86,8 | de 84,8 à 88,8 | 7 |
| 27 | [Grok 4.20](https://quelleia.com/modeles/grok-4-20/) | xAI | 86,3 | de 82,5 à 90,0 | 6 |
| 28 | [GLM-5.3](https://quelleia.com/modeles/glm-5-3/) | Z.ai (Zhipu AI) | 86,0 | de 80,8 à 91,2 | 4 |
| 29 | [Grok 4.5](https://quelleia.com/modeles/grok-4-5/) | xAI | 86,0 | de 83,8 à 88,3 | 6 |
| 30 | [GPT-5.6 Luna](https://quelleia.com/modeles/gpt-5-6-luna/) | OpenAI | 85,8 | de 83,0 à 88,5 | 7 |
| 31 | [Qwen3.7-Max](https://quelleia.com/modeles/qwen3-7-max/) | Alibaba | 85,5 | de 80,9 à 90,1 | 5 |
| 32 | [Claude Sonnet 4.6](https://quelleia.com/modeles/claude-sonnet-4-6/) | Anthropic | 85,0 | de 81,3 à 88,7 | 7 |
| 33 | [GPT-5.2](https://quelleia.com/modeles/gpt-5-2/) | OpenAI | 85,0 | de 81,9 à 88,0 | 9 |
| 34 | [Gemini 3 Flash](https://quelleia.com/modeles/gemini-3-flash/) | Google DeepMind | 83,2 | de 80,8 à 85,6 | 8 |
| 35 | [Gemini 3 Pro](https://quelleia.com/modeles/gemini-3-pro/) | Google DeepMind | 82,6 | de 78,6 à 86,7 | 6 |
| 36 | [Claude Opus 4.5](https://quelleia.com/modeles/claude-opus-4-5/) | Anthropic | 82,4 | de 80,3 à 84,5 | 9 |
| 37 | [Inkling-Small](https://quelleia.com/modeles/inkling-small/) | Thinking Machines | 82,4 | de 78,4 à 86,3 | 4 |
| 38 | [Qwen 3.6 Max (Preview)](https://quelleia.com/modeles/qwen-3-6-max-preview/) | Alibaba | 81,6 | de 77,8 à 85,4 | 5 |
| 39 | [Inkling](https://quelleia.com/modeles/inkling/) | Thinking Machines | 81,3 | de 78,8 à 83,8 | 6 |
| 40 | [Kimi K2.6](https://quelleia.com/modeles/kimi-k2-6/) | Moonshot | 81,3 | de 77,4 à 85,3 | 4 |
| 41 | [Grok 4.3 Beta](https://quelleia.com/modeles/grok-4-3-beta/) | xAI | 81,1 | de 76,4 à 85,8 | 4 |
| 42 | [GLM-5.2](https://quelleia.com/modeles/glm-5-2/) | Z.ai (Zhipu AI) | 80,8 | de 78,5 à 83,1 | 7 |
| 43 | [DeepSeek-V4-Pro](https://quelleia.com/modeles/deepseek-v4-pro/) | DeepSeek | 80,6 | de 76,3 à 84,8 | 5 |
| 44 | [GPT-5.1](https://quelleia.com/modeles/gpt-5-1/) | OpenAI | 79,8 | de 77,3 à 82,2 | 9 |
| 45 | [GPT-5 Pro](https://quelleia.com/modeles/gpt-5-pro/) | OpenAI | 79,5 | de 76,3 à 82,7 | 4 |
| 46 | [GPT-5](https://quelleia.com/modeles/gpt-5/) | OpenAI | 79,0 | de 75,5 à 82,4 | 9 |
| 47 | [Grok 4](https://quelleia.com/modeles/grok-4/) | xAI | 78,7 | de 75,6 à 81,9 | 5 |
| 48 | [Qwen3.7-Plus](https://quelleia.com/modeles/qwen3-7-plus/) | Alibaba | 78,7 | de 74,5 à 82,9 | 4 |
| 49 | [Nemotron 3 Ultra](https://quelleia.com/modeles/nemotron-3-ultra/) | NVIDIA | 78,2 | de 72,4 à 84,0 | 4 |
| 50 | [o3](https://quelleia.com/modeles/o3/) | OpenAI | 77,9 | de 73,8 à 82,1 | 9 |
| 51 | [GPT-5.4 Mini](https://quelleia.com/modeles/gpt-5-4-mini/) | OpenAI | 77,7 | de 75,1 à 80,3 | 7 |
| 52 | [Qwen3.5 397B-A17B](https://quelleia.com/modeles/qwen3-5-397b-a17b/) | Alibaba | 77,7 | de 72,4 à 83,0 | 4 |
| 53 | [Claude Sonnet 4.5](https://quelleia.com/modeles/claude-sonnet-4-5/) | Anthropic | 77,2 | de 75,0 à 79,3 | 9 |
| 54 | [Claude Opus 4.1](https://quelleia.com/modeles/claude-opus-4-1/) | Anthropic | 76,9 | de 71,2 à 82,6 | 7 |
| 55 | [Kimi K2.5](https://quelleia.com/modeles/kimi-k2-5/) | Moonshot | 76,4 | de 73,2 à 79,5 | 5 |
| 56 | [Qwen 3.5 Plus (hosted 397B-A17B)](https://quelleia.com/modeles/qwen-3-5-plus-hosted-397b-a17b/) | Alibaba | 76,4 | de 71,4 à 81,3 | 4 |
| 57 | [o3-pro](https://quelleia.com/modeles/o3-pro/) | OpenAI | 76,1 | de 73,4 à 78,8 | 4 |
| 58 | [Gemini 3.5 Flash-Lite](https://quelleia.com/modeles/gemini-3-5-flash-lite/) | Google DeepMind | 75,6 | de 72,9 à 78,2 | 6 |
| 59 | [GPT-5 mini](https://quelleia.com/modeles/gpt-5-mini/) | OpenAI | 75,1 | de 72,4 à 77,8 | 8 |
| 60 | [Qwen 3.5 Flash (hosted 35B-A3B)](https://quelleia.com/modeles/qwen-3-5-flash-hosted-35b-a3b/) | Alibaba | 75,1 | de 69,7 à 80,5 | 4 |
| 61 | [DeepSeek-V3.2](https://quelleia.com/modeles/deepseek-v3-2/) | DeepSeek | 74,8 | de 72,1 à 77,5 | 5 |
| 62 | [GPT-5.4 Nano](https://quelleia.com/modeles/gpt-5-4-nano/) | OpenAI | 74,8 | de 71,8 à 77,8 | 7 |
| 63 | [Qwen 3.6 Plus](https://quelleia.com/modeles/qwen-3-6-plus/) | Alibaba | 74,8 | de 70,4 à 79,2 | 4 |
| 64 | [o4-mini](https://quelleia.com/modeles/o4-mini/) | OpenAI | 74,3 | de 70,5 à 78,1 | 9 |
| 65 | [Gemini 2.5 Pro (Jun 2025)](https://quelleia.com/modeles/gemini-2-5-pro-jun-2025/) | Google DeepMind | 74,0 | de 70,1 à 77,9 | 8 |
| 66 | [Qwen3.6 27B](https://quelleia.com/modeles/qwen3-6-27b/) | Alibaba | 74,0 | de 68,5 à 79,5 | 4 |
| 67 | [Grok 4 Fast](https://quelleia.com/modeles/grok-4-fast/) | xAI | 73,5 | de 71,1 à 75,9 | 4 |
| 68 | [GLM-5](https://quelleia.com/modeles/glm-5/) | Z.ai (Zhipu AI) | 73,2 | de 69,7 à 76,8 | 5 |
| 69 | [Gemini 3.1 Flash-Lite](https://quelleia.com/modeles/gemini-3-1-flash-lite/) | Google DeepMind | 73,2 | de 66,5 à 80,0 | 5 |
| 70 | [MiniMax-M3](https://quelleia.com/modeles/minimax-m3/) | MiniMax | 73,2 | de 69,3 à 77,2 | 6 |
| 71 | [Claude Opus 4](https://quelleia.com/modeles/claude-opus-4/) | Anthropic | 73,0 | de 68,7 à 77,3 | 7 |
| 72 | [Claude Haiku 4.5](https://quelleia.com/modeles/claude-haiku-4-5/) | Anthropic | 72,2 | de 68,0 à 76,4 | 6 |
| 73 | [Qwen 3.6 35B-A3B](https://quelleia.com/modeles/qwen-3-6-35b-a3b/) | Alibaba | 71,9 | de 63,3 à 80,5 | 4 |
| 74 | [Claude Sonnet 4](https://quelleia.com/modeles/claude-sonnet-4/) | Anthropic | 71,4 | de 69,0 à 73,8 | 7 |
| 75 | [Qwen3-235B-A22B-Thinking (Jul 2025)](https://quelleia.com/modeles/qwen3-235b-a22b-thinking-jul-2025/) | Alibaba | 71,4 | de 66,7 à 76,1 | 4 |
| 76 | [Gemini 2.5 Pro (Mar 2025)](https://quelleia.com/modeles/gemini-2-5-pro-mar-2025/) | Google DeepMind | 70,9 | de 65,9 à 75,9 | 4 |
| 77 | [Qwen3-Max](https://quelleia.com/modeles/qwen3-max/) | Alibaba | 70,9 | de 65,0 à 76,8 | 4 |
| 78 | [DeepSeek-V3.1](https://quelleia.com/modeles/deepseek-v3-1/) | DeepSeek | 70,6 | de 65,4 à 75,9 | 4 |
| 79 | [Qwen 3.6 Flash](https://quelleia.com/modeles/qwen-3-6-flash/) | Alibaba | 70,1 | de 64,6 à 75,6 | 5 |
| 80 | [Claude 3.7 Sonnet](https://quelleia.com/modeles/claude-3-7-sonnet/) | Anthropic | 69,3 | de 65,5 à 73,1 | 5 |
| 81 | [Gemini 2.5 Flash (Jun 2025)](https://quelleia.com/modeles/gemini-2-5-flash-jun-2025/) | Google DeepMind | 69,3 | de 65,2 à 73,5 | 4 |
| 82 | [o1](https://quelleia.com/modeles/o1/) | OpenAI | 68,5 | de 65,7 à 71,4 | 6 |
| 83 | [o3-mini](https://quelleia.com/modeles/o3-mini/) | OpenAI | 66,2 | de 59,2 à 73,2 | 8 |
| 84 | [Qwen3-235B-A22B](https://quelleia.com/modeles/qwen3-235b-a22b/) | Alibaba | 65,9 | de 60,9 à 71,0 | 4 |
| 85 | [Qwen3-235B-A22B-Instruct (Jul 2025)](https://quelleia.com/modeles/qwen3-235b-a22b-instruct-jul-2025/) | Alibaba | 65,1 | de 60,0 à 70,3 | 4 |
| 86 | [gpt-oss-120b](https://quelleia.com/modeles/gpt-oss-120b/) | OpenAI | 64,1 | de 55,6 à 72,6 | 5 |
| 87 | [DeepSeek-R1](https://quelleia.com/modeles/deepseek-r1/) | DeepSeek | 63,3 | de 58,5 à 68,2 | 4 |
| 88 | [Claude 3.5 Sonnet (October 2024)](https://quelleia.com/modeles/claude-3-5-sonnet-october-2024/) | Anthropic | 62,8 | de 55,5 à 70,1 | 4 |
| 89 | [GPT-4.5](https://quelleia.com/modeles/gpt-4-5/) | OpenAI | 62,5 | de 57,1 à 67,9 | 5 |
| 90 | [GPT-4.1](https://quelleia.com/modeles/gpt-4-1/) | OpenAI | 60,5 | de 55,7 à 65,2 | 8 |
| 91 | [GPT-4.1 mini](https://quelleia.com/modeles/gpt-4-1-mini/) | OpenAI | 60,2 | de 55,3 à 65,0 | 6 |
| 92 | [GPT-5 nano](https://quelleia.com/modeles/gpt-5-nano/) | OpenAI | 59,7 | de 50,7 à 68,6 | 7 |
| 93 | [Llama 4 Maverick](https://quelleia.com/modeles/llama-4-maverick/) | Meta AI | 55,2 | de 50,3 à 60,2 | 7 |
| 94 | [GPT-4 (Jun 2023)](https://quelleia.com/modeles/gpt-4-jun-2023/) | OpenAI | 54,2 | de 46,9 à 61,5 | 5 |
| 95 | [Claude 3 Opus](https://quelleia.com/modeles/claude-3-opus/) | Anthropic | 53,7 | de 47,9 à 59,4 | 6 |
| 96 | [Llama 3.3 70B](https://quelleia.com/modeles/llama-3-3-70b/) | Meta AI | 51,8 | de 45,1 à 58,6 | 4 |
| 97 | [Llama 4 Scout](https://quelleia.com/modeles/llama-4-scout/) | Meta AI | 50,3 | de 44,4 à 56,1 | 5 |
| 98 | [GPT-4o mini](https://quelleia.com/modeles/gpt-4o-mini/) | OpenAI | 45,0 | de 38,0 à 52,1 | 6 |
| 99 | [GPT-4.1 nano](https://quelleia.com/modeles/gpt-4-1-nano/) | OpenAI | 44,5 | de 37,3 à 51,7 | 4 |
| 100 | [GPT-3.5 Turbo (Jan 2024)](https://quelleia.com/modeles/gpt-3-5-turbo-jan-2024/) | OpenAI | 33,8 | de 23,9 à 43,8 | 5 |

Source : Quelle IA, édition du 28 septembre 2026, quelleia.com.
