Évolution · Raisonnement · depuis 2024
La course en raisonnement
L'écart entre fermés et ouverts, en raisonnement
Meilleur ferméMeilleur ouvertL'écartÉcart actuel : 14,9 points
Chaque marche est la sortie d'un modèle qui prend la tête de sa famille. Le score est celui d'aujourd'hui (édition du 28 septembre 2026), placé à la date de sortie : ce n'est pas un historique de mesures. Seuls les 100 modèles classés en raisonnement comptent. La ligne des modèles ouverts commence en décembre 2024, à la sortie du premier modèle ouvert classé en raisonnement.
Qui a pris la tête, et quand
Du plus récent au plus ancien · scores de l'édition duModèles fermés
18 relais · 75 modèles classés| Sortie | Modèle | Score | En tête |
|---|---|---|---|
| GPT-6 Astra · OpenAI | 103,5 | depuis 25 jours | |
| GPT-5.6 Sol · OpenAI | 96,2 | 56 jours | |
| GPT-5.5 Pro · OpenAI | 96,0 | 77 jours | |
| GPT-5.4 Pro · OpenAI | 93,1 | 49 jours | |
| Gemini 3.1 Pro · Google DeepMind | 91,8 | 14 jours | |
| Claude Opus 4.6 · Anthropic | 86,8 | 14 jours | |
| GPT-5.2 · OpenAI | 85,0 | 56 jours | |
| Gemini 3 Pro · Google DeepMind | 82,6 | 23 jours | |
| GPT-5.1 · OpenAI | 79,8 | 5 jours | |
| GPT-5 Pro · OpenAI | 79,5 | 37 jours | |
| GPT-5 · OpenAI | 79,0 | 61 jours | |
| Grok 4 · xAI | 78,7 | 29 jours | |
| o3 · OpenAI | 77,9 | 84 jours | |
| Gemini 2.5 Pro (Mar 2025) · Google DeepMind | 70,9 | 22 jours | |
| Claude 3.7 Sonnet · Anthropic | 69,3 | 29 jours | |
| o1 · OpenAI | 68,5 | 69 jours | |
| Claude 3.5 Sonnet (October 2024) · Anthropic | 62,8 | 56 jours | |
| GPT-4 (Jun 2023) · OpenAI | 54,2 | 497 jours |
Modèles ouverts
11 relais · 25 modèles classés| Sortie | Modèle | Score | En tête |
|---|---|---|---|
| DeepSeek V4 Pro 0813 · DeepSeek | 88,6 | depuis 46 jours | |
| Kimi K3 · Moonshot | 87,1 | 28 jours | |
| Inkling-Small · Thinking Machines | 82,4 | 1 jour | |
| Kimi K2.6 · Moonshot | 81,3 | 86 jours | |
| Qwen3.5 397B-A17B · Alibaba | 77,7 | 66 jours | |
| Kimi K2.5 · Moonshot | 76,4 | 17 jours | |
| DeepSeek-V3.2 · DeepSeek | 74,8 | 57 jours | |
| DeepSeek-V3.1 · DeepSeek | 70,6 | 102 jours | |
| Qwen3-235B-A22B · Alibaba | 65,9 | 115 jours | |
| DeepSeek-R1 · DeepSeek | 63,3 | 98 jours | |
| Llama 3.3 70B · Meta AI | 51,8 | 45 jours |
En bref
- Quel est l'écart entre les modèles fermés et les modèles ouverts en raisonnement ?
- Au 28 septembre 2026, le meilleur modèle fermé en raisonnement, GPT-6 Astra (OpenAI), obtient 103,5 et le meilleur modèle ouvert, DeepSeek V4 Pro 0813 (DeepSeek), 88,6 : l'écart est de 14,9 points en faveur des modèles fermés.
- Combien de temps les modèles ouverts mettent-ils à rattraper les modèles fermés ?
- Le niveau du meilleur modèle ouvert d'aujourd'hui, DeepSeek V4 Pro 0813 (88,6), sorti le 13 août 2026, avait été atteint par un modèle fermé dès le 19 février 2026, avec Gemini 3.1 Pro (91,8) : environ six mois d'écart. Chaque modèle est placé à sa date de sortie avec son score de l'édition du 28 septembre 2026 : la courbe ne rejoue pas les mesures de l'époque.
- L'écart entre fermés et ouverts se réduit-il ?
- Un an plus tôt, au 28 septembre 2025, le meilleur modèle fermé sorti était GPT-5 (79,0) et le meilleur modèle ouvert DeepSeek-V3.1 (70,6), soit 8,4 points d'écart. Il est de 14,9 points au 28 septembre 2026 : il s'est creusé de 6,5 points. Chaque modèle est placé à sa date de sortie avec son score de l'édition du 28 septembre 2026 : la courbe ne rejoue pas les mesures de l'époque.
- Quel est le meilleur modèle en raisonnement aujourd'hui ?
- GPT-6 Astra (OpenAI) avec un score de 103,5, dans l'édition du 28 septembre 2026. Il est sorti le 3 septembre 2026. Chez les modèles ouverts, DeepSeek V4 Pro 0813 (DeepSeek) mène avec 88,6.
- Quels éditeurs ont pris la tête depuis 2024 ?
- Depuis janvier 2024, la tête des modèles fermés en raisonnement a changé de main 17 fois : OpenAI dix fois, Anthropic trois fois, Google DeepMind trois fois et xAI une fois. Un changement est compté chaque fois qu'un modèle, à sa sortie, dépasse tous ceux sortis avant lui.
- Que montre ce graphique ?
- Le score en raisonnement que chaque modèle obtient aujourd'hui, placé à sa date de sortie. La ligne pleine suit le meilleur modèle fermé sorti à chaque date, la ligne pointillée le meilleur modèle ouvert. Ce n'est pas un historique de mesures : Quelle IA n'a qu'une édition, celle du 28 septembre 2026. Seuls les 100 modèles classés en raisonnement comptent, les scores provisoires sont écartés.