# Classement Mathématiques des modèles de langage, édition du 28 septembre 2026

81 modèles classés. Le score IA est une estimation, donnée avec sa marge à 90 % : deux modèles dont les marges se recouvrent sont ex æquo.

| Rang | Modèle | Éditeur | Score | Marge | Mesures |
| ---: | --- | --- | ---: | --- | ---: |
| 1 | [GPT-6 Astra](https://quelleia.com/modeles/gpt-6-astra/) | OpenAI | 102,0 | de 96,0 à 108,0 | 6 |
| 2 | [Claude Opus 5.5](https://quelleia.com/modeles/claude-opus-5-5/) | Anthropic | 101,4 | de 96,0 à 106,9 | 5 |
| 3 | [Claude Fable 5.1](https://quelleia.com/modeles/claude-fable-5-1/) | Anthropic | 99,1 | de 95,2 à 103,0 | 6 |
| 4 | [Claude Fable 5](https://quelleia.com/modeles/claude-fable-5/) | Anthropic | 98,8 | de 94,9 à 102,7 | 6 |
| 5 | [Claude Sonnet 5.5](https://quelleia.com/modeles/claude-sonnet-5-5/) | Anthropic | 97,8 | de 93,6 à 101,9 | 4 |
| 6 | [Claude Opus 5](https://quelleia.com/modeles/claude-opus-5/) | Anthropic | 96,0 | de 92,2 à 99,7 | 5 |
| 7 | [GPT-5.6 Sol](https://quelleia.com/modeles/gpt-5-6-sol/) | OpenAI | 96,0 | de 93,1 à 98,8 | 6 |
| 8 | [GPT-5.5 Pro](https://quelleia.com/modeles/gpt-5-5-pro/) | OpenAI | 94,9 | de 92,7 à 97,1 | 5 |
| 9 | [GPT-5.6 Terra](https://quelleia.com/modeles/gpt-5-6-terra/) | OpenAI | 93,3 | de 91,2 à 95,5 | 5 |
| 10 | [GPT-5.4 Pro](https://quelleia.com/modeles/gpt-5-4-pro/) | OpenAI | 92,3 | de 90,7 à 93,9 | 4 |
| 11 | [GPT-5.5](https://quelleia.com/modeles/gpt-5-5/) | OpenAI | 91,5 | de 88,6 à 94,5 | 8 |
| 12 | [Claude Opus 4.8](https://quelleia.com/modeles/claude-opus-4-8/) | Anthropic | 91,0 | de 89,8 à 92,2 | 7 |
| 13 | [GPT-5.6 Luna](https://quelleia.com/modeles/gpt-5-6-luna/) | OpenAI | 91,0 | de 88,9 à 93,1 | 5 |
| 14 | [Kimi K3](https://quelleia.com/modeles/kimi-k3/) | Moonshot | 91,0 | de 87,4 à 94,6 | 5 |
| 15 | [Muse Spark 1.3](https://quelleia.com/modeles/muse-spark-1-3/) | Meta AI | 89,7 | de 87,8 à 91,6 | 4 |
| 16 | [Claude Sonnet 5](https://quelleia.com/modeles/claude-sonnet-5/) | Anthropic | 89,4 | de 85,9 à 92,9 | 5 |
| 17 | [GPT-5.4](https://quelleia.com/modeles/gpt-5-4/) | OpenAI | 89,4 | de 88,2 à 90,7 | 7 |
| 18 | [Qwen 3.8 Max](https://quelleia.com/modeles/qwen-3-8-max/) | Alibaba | 89,4 | de 88,1 à 90,7 | 4 |
| 19 | [Gemini 3.7 Flash](https://quelleia.com/modeles/gemini-3-7-flash/) | Google DeepMind | 88,6 | de 87,2 à 90,1 | 5 |
| 20 | [Claude Opus 4.7](https://quelleia.com/modeles/claude-opus-4-7/) | Anthropic | 87,9 | de 86,6 à 89,1 | 7 |
| 21 | [Grok 4.6](https://quelleia.com/modeles/grok-4-6/) | xAI | 87,6 | de 86,0 à 89,2 | 5 |
| 22 | [GLM-5.3](https://quelleia.com/modeles/glm-5-3/) | Z.ai (Zhipu AI) | 87,3 | de 85,9 à 88,8 | 5 |
| 23 | [Qwen3.8 Max (0902)](https://quelleia.com/modeles/qwen3-8-max-0902/) | Alibaba | 87,3 | de 85,1 à 89,6 | 4 |
| 24 | [Claude Opus 4.6](https://quelleia.com/modeles/claude-opus-4-6/) | Anthropic | 87,1 | de 85,7 à 88,4 | 7 |
| 25 | [DeepSeek V4 Flash 0731](https://quelleia.com/modeles/deepseek-v4-flash-0731/) | DeepSeek | 87,1 | de 84,4 à 89,8 | 4 |
| 26 | [DeepSeek V4 Pro 0813](https://quelleia.com/modeles/deepseek-v4-pro-0813/) | DeepSeek | 87,1 | de 85,5 à 88,7 | 4 |
| 27 | [Gemini 3.8 Flash](https://quelleia.com/modeles/gemini-3-8-flash/) | Google DeepMind | 86,8 | de 84,8 à 88,9 | 5 |
| 28 | [GLM-5.2](https://quelleia.com/modeles/glm-5-2/) | Z.ai (Zhipu AI) | 85,5 | de 83,1 à 87,9 | 5 |
| 29 | [Qwen3.7-Max](https://quelleia.com/modeles/qwen3-7-max/) | Alibaba | 85,5 | de 83,3 à 87,7 | 5 |
| 30 | [Gemini 3.6 Flash](https://quelleia.com/modeles/gemini-3-6-flash/) | Google DeepMind | 85,2 | de 83,7 à 86,8 | 5 |
| 31 | [Gemini 3.5 Flash](https://quelleia.com/modeles/gemini-3-5-flash/) | Google DeepMind | 85,0 | de 83,7 à 86,3 | 7 |
| 32 | [Grok 4.5](https://quelleia.com/modeles/grok-4-5/) | xAI | 85,0 | de 83,4 à 86,5 | 5 |
| 33 | [GPT-5.2](https://quelleia.com/modeles/gpt-5-2/) | OpenAI | 84,7 | de 82,4 à 87,1 | 7 |
| 34 | [Gemini 3.1 Pro](https://quelleia.com/modeles/gemini-3-1-pro/) | Google DeepMind | 84,7 | de 83,3 à 86,1 | 7 |
| 35 | [Claude Sonnet 4.6](https://quelleia.com/modeles/claude-sonnet-4-6/) | Anthropic | 84,5 | de 80,4 à 88,5 | 5 |
| 36 | [Gemini 3 Pro](https://quelleia.com/modeles/gemini-3-pro/) | Google DeepMind | 83,9 | de 81,8 à 86,1 | 5 |
| 37 | [Kimi K2.6](https://quelleia.com/modeles/kimi-k2-6/) | Moonshot | 83,7 | de 81,8 à 85,5 | 7 |
| 38 | [GLM-5.3-Flash](https://quelleia.com/modeles/glm-5-3-flash/) | Z.ai (Zhipu AI) | 83,2 | de 81,3 à 85,0 | 5 |
| 39 | [Muse Spark](https://quelleia.com/modeles/muse-spark/) | Meta AI | 83,2 | de 80,7 à 85,6 | 5 |
| 40 | [GPT-5](https://quelleia.com/modeles/gpt-5/) | OpenAI | 82,6 | de 81,0 à 84,3 | 7 |
| 41 | [Gemini 3 Flash](https://quelleia.com/modeles/gemini-3-flash/) | Google DeepMind | 81,9 | de 79,9 à 83,9 | 7 |
| 42 | [GLM-5.1](https://quelleia.com/modeles/glm-5-1/) | Z.ai (Zhipu AI) | 81,6 | de 79,0 à 84,2 | 6 |
| 43 | [GPT-5.1](https://quelleia.com/modeles/gpt-5-1/) | OpenAI | 81,6 | de 78,9 à 84,3 | 4 |
| 44 | [Grok 4.20](https://quelleia.com/modeles/grok-4-20/) | xAI | 81,1 | de 78,6 à 83,5 | 4 |
| 45 | [DeepSeek-V4-Pro](https://quelleia.com/modeles/deepseek-v4-pro/) | DeepSeek | 80,6 | de 77,8 à 83,3 | 5 |
| 46 | [GPT-5.4 Mini](https://quelleia.com/modeles/gpt-5-4-mini/) | OpenAI | 80,6 | de 78,4 à 82,7 | 7 |
| 47 | [Inkling-Small](https://quelleia.com/modeles/inkling-small/) | Thinking Machines | 80,3 | de 77,2 à 83,4 | 5 |
| 48 | [Grok 4.3 Beta](https://quelleia.com/modeles/grok-4-3-beta/) | xAI | 80,0 | de 77,3 à 82,7 | 5 |
| 49 | [GPT-5 mini](https://quelleia.com/modeles/gpt-5-mini/) | OpenAI | 79,5 | de 77,3 à 81,7 | 7 |
| 50 | [Kimi K2.5](https://quelleia.com/modeles/kimi-k2-5/) | Moonshot | 79,5 | de 76,7 à 82,3 | 4 |
| 51 | [GPT-5.4 Nano](https://quelleia.com/modeles/gpt-5-4-nano/) | OpenAI | 79,0 | de 76,9 à 81,0 | 7 |
| 52 | [Qwen 3.6 Plus](https://quelleia.com/modeles/qwen-3-6-plus/) | Alibaba | 79,0 | de 76,8 à 81,1 | 5 |
| 53 | [Claude Opus 4.5](https://quelleia.com/modeles/claude-opus-4-5/) | Anthropic | 78,5 | de 74,1 à 82,8 | 7 |
| 54 | [Qwen 3.6 Max (Preview)](https://quelleia.com/modeles/qwen-3-6-max-preview/) | Alibaba | 77,9 | de 75,1 à 80,7 | 4 |
| 55 | [o4-mini](https://quelleia.com/modeles/o4-mini/) | OpenAI | 77,7 | de 74,9 à 80,5 | 6 |
| 56 | [DeepSeek-V3.2](https://quelleia.com/modeles/deepseek-v3-2/) | DeepSeek | 77,2 | de 74,5 à 79,8 | 5 |
| 57 | [Inkling](https://quelleia.com/modeles/inkling/) | Thinking Machines | 76,6 | de 73,4 à 79,8 | 5 |
| 58 | [Kimi K2 Thinking](https://quelleia.com/modeles/kimi-k2-thinking/) | Moonshot | 76,1 | de 72,3 à 80,0 | 4 |
| 59 | [o3](https://quelleia.com/modeles/o3/) | OpenAI | 75,9 | de 73,5 à 78,2 | 5 |
| 60 | [Grok 4](https://quelleia.com/modeles/grok-4/) | xAI | 75,6 | de 72,5 à 78,7 | 4 |
| 61 | [Claude Sonnet 4.5](https://quelleia.com/modeles/claude-sonnet-4-5/) | Anthropic | 74,0 | de 70,3 à 77,7 | 7 |
| 62 | [GLM-5](https://quelleia.com/modeles/glm-5/) | Z.ai (Zhipu AI) | 74,0 | de 70,9 à 77,2 | 4 |
| 63 | [Gemini 2.5 Pro (Jun 2025)](https://quelleia.com/modeles/gemini-2-5-pro-jun-2025/) | Google DeepMind | 73,8 | de 71,3 à 76,2 | 6 |
| 64 | [Qwen 3.6 Flash](https://quelleia.com/modeles/qwen-3-6-flash/) | Alibaba | 72,2 | de 69,4 à 75,0 | 4 |
| 65 | [Gemini 3.5 Flash-Lite](https://quelleia.com/modeles/gemini-3-5-flash-lite/) | Google DeepMind | 71,7 | de 66,4 à 77,0 | 5 |
| 66 | [Qwen3-235B-A22B-Thinking (Jul 2025)](https://quelleia.com/modeles/qwen3-235b-a22b-thinking-jul-2025/) | Alibaba | 71,7 | de 67,6 à 75,7 | 4 |
| 67 | [o3-mini](https://quelleia.com/modeles/o3-mini/) | OpenAI | 71,4 | de 68,6 à 74,2 | 6 |
| 68 | [GPT-5 nano](https://quelleia.com/modeles/gpt-5-nano/) | OpenAI | 70,6 | de 66,6 à 74,7 | 7 |
| 69 | [GPT-5.5 Instant](https://quelleia.com/modeles/gpt-5-5-instant/) | OpenAI | 70,6 | de 65,1 à 76,2 | 4 |
| 70 | [Qwen 3.5 Flash (hosted 35B-A3B)](https://quelleia.com/modeles/qwen-3-5-flash-hosted-35b-a3b/) | Alibaba | 70,6 | de 67,1 à 74,1 | 5 |
| 71 | [GLM-4.7](https://quelleia.com/modeles/glm-4-7/) | Z.ai (Zhipu AI) | 70,1 | de 64,1 à 76,1 | 5 |
| 72 | [o1](https://quelleia.com/modeles/o1/) | OpenAI | 69,3 | de 66,5 à 72,2 | 4 |
| 73 | [Claude Opus 4.1](https://quelleia.com/modeles/claude-opus-4-1/) | Anthropic | 68,5 | de 65,4 à 71,7 | 6 |
| 74 | [Claude Sonnet 4](https://quelleia.com/modeles/claude-sonnet-4/) | Anthropic | 68,0 | de 64,6 à 71,4 | 4 |
| 75 | [Claude Haiku 4.5](https://quelleia.com/modeles/claude-haiku-4-5/) | Anthropic | 67,2 | de 64,0 à 70,5 | 4 |
| 76 | [Claude Opus 4](https://quelleia.com/modeles/claude-opus-4/) | Anthropic | 66,7 | de 62,5 à 71,0 | 4 |
| 77 | [Grok 3](https://quelleia.com/modeles/grok-3/) | xAI | 63,8 | de 60,9 à 66,7 | 4 |
| 78 | [GPT-4.1 mini](https://quelleia.com/modeles/gpt-4-1-mini/) | OpenAI | 61,2 | de 58,0 à 64,5 | 4 |
| 79 | [GPT-4.1](https://quelleia.com/modeles/gpt-4-1/) | OpenAI | 59,7 | de 55,0 à 64,3 | 5 |
| 80 | [Claude 3.5 Sonnet](https://quelleia.com/modeles/claude-3-5-sonnet/) | Anthropic | 48,7 | de 39,3 à 58,1 | 4 |
| 81 | [GPT-4o (Aug 2024)](https://quelleia.com/modeles/gpt-4o-aug-2024/) | OpenAI | 46,6 | de 39,1 à 54,1 | 4 |

Source : Quelle IA, édition du 28 septembre 2026, quelleia.com.
