Évolution · Écriture · depuis 2024
La course en écriture
L'écart entre fermés et ouverts, en écriture
Meilleur ferméMeilleur ouvertL'écartÉcart actuel : 10,7 points
Chaque marche est la sortie d'un modèle qui prend la tête de sa famille. Le score est celui d'aujourd'hui (édition du 28 septembre 2026), placé à la date de sortie : ce n'est pas un historique de mesures. Seuls les 268 modèles classés en écriture comptent.
Qui a pris la tête, et quand
Du plus récent au plus ancien · scores de l'édition duModèles fermés
12 relais · 137 modèles classés| Sortie | Modèle | Score | En tête |
|---|---|---|---|
| Claude Opus 5.5 · Anthropic | 100,9 | depuis 6 jours | |
| Claude Fable 5 · Anthropic | 96,5 | 105 jours | |
| Claude Opus 4.6 · Anthropic | 92,6 | 124 jours | |
| Gemini 3 Pro · Google DeepMind | 88,6 | 79 jours | |
| Claude Sonnet 4.5 · Anthropic | 82,1 | 50 jours | |
| Claude Opus 4.1 · Anthropic | 80,0 | 55 jours | |
| ChatGPT-4o Latest · OpenAI | 79,5 | 356 jours | |
| Claude 3.5 Sonnet · Anthropic | 62,5 | 55 jours | |
| GPT-4o (May 2024) · OpenAI | 57,6 | 38 jours | |
| GPT-4 Turbo (Apr 2024) · OpenAI | 54,2 | 34 jours | |
| Claude 3 Opus · Anthropic | 50,5 | 40 jours | |
| GPT-4 Turbo (Nov 2023) · OpenAI | 50,0 | 115 jours |
Modèles ouverts
17 relais · 131 modèles classés| Sortie | Modèle | Score | En tête |
|---|---|---|---|
| Kimi K3 · Moonshot | 90,2 | depuis 74 jours | |
| GLM-5.2 · Z.ai (Zhipu AI) | 86,3 | 30 jours | |
| GLM-5.1 · Z.ai (Zhipu AI) | 84,2 | 70 jours | |
| GLM-5 · Z.ai (Zhipu AI) | 81,3 | 55 jours | |
| Kimi K2.5 · Moonshot | 79,8 | 15 jours | |
| DeepSeek-V3.2 · DeepSeek | 76,1 | 57 jours | |
| DeepSeek-V3.1-Terminus · DeepSeek | 75,1 | 70 jours | |
| DeepSeek-V3.1 · DeepSeek | 74,0 | 32 jours | |
| DeepSeek-R1 (May 2025) · DeepSeek | 71,2 | 85 jours | |
| DeepSeek-V3 (Mar 2025) · DeepSeek | 67,8 | 65 jours | |
| Gemma 3 27B · Google DeepMind | 59,1 | 13 jours | |
| QwQ-32B · Alibaba | 57,3 | 6 jours | |
| DeepSeek-V2.5 (Dec 2024) · DeepSeek | 54,2 | 85 jours | |
| Llama 3.1-405B · Meta AI | 53,7 | 140 jours | |
| Llama 3-70B · Meta AI | 43,5 | 96 jours | |
| Mistral Large · Mistral AI | 37,0 | 52 jours | |
| Mistral Medium · Mistral AI | 31,7 | 77 jours |
En bref
- Quel est l'écart entre les modèles fermés et les modèles ouverts en écriture ?
- Au 28 septembre 2026, le meilleur modèle fermé en écriture, Claude Opus 5.5 (Anthropic), obtient 100,9 et le meilleur modèle ouvert, Kimi K3 (Moonshot), 90,2 : l'écart est de 10,7 points en faveur des modèles fermés.
- Combien de temps les modèles ouverts mettent-ils à rattraper les modèles fermés ?
- Le niveau du meilleur modèle ouvert d'aujourd'hui, Kimi K3 (90,2), sorti le 16 juillet 2026, avait été atteint par un modèle fermé dès le 5 février 2026, avec Claude Opus 4.6 (92,6) : environ cinq mois d'écart. Chaque modèle est placé à sa date de sortie avec son score de l'édition du 28 septembre 2026 : la courbe ne rejoue pas les mesures de l'époque.
- L'écart entre fermés et ouverts se réduit-il ?
- Un an plus tôt, au 28 septembre 2025, le meilleur modèle fermé sorti était Claude Opus 4.1 (80,0) et le meilleur modèle ouvert DeepSeek-V3.1-Terminus (75,1), soit 4,9 points d'écart. Il est de 10,7 points au 28 septembre 2026 : il s'est creusé de 5,8 points. Chaque modèle est placé à sa date de sortie avec son score de l'édition du 28 septembre 2026 : la courbe ne rejoue pas les mesures de l'époque.
- Quel est le meilleur modèle en écriture aujourd'hui ?
- Claude Opus 5.5 (Anthropic) avec un score de 100,9, dans l'édition du 28 septembre 2026. Il est sorti le 22 septembre 2026. Chez les modèles ouverts, Kimi K3 (Moonshot) mène avec 90,2.
- Quels éditeurs ont pris la tête depuis 2024 ?
- Depuis janvier 2024, la tête des modèles fermés en écriture a changé de main 11 fois : Anthropic sept fois, OpenAI trois fois et Google DeepMind une fois. Un changement est compté chaque fois qu'un modèle, à sa sortie, dépasse tous ceux sortis avant lui.
- Que montre ce graphique ?
- Le score en écriture que chaque modèle obtient aujourd'hui, placé à sa date de sortie. La ligne pleine suit le meilleur modèle fermé sorti à chaque date, la ligne pointillée le meilleur modèle ouvert. Ce n'est pas un historique de mesures : Quelle IA n'a qu'une édition, celle du 28 septembre 2026. Seuls les 268 modèles classés en écriture comptent, les scores provisoires sont écartés.