Évolution · Usage · depuis 2024
La course en usage courant
L'écart entre fermés et ouverts, en usage courant
Meilleur ferméMeilleur ouvertL'écartÉcart actuel : 7,6 points
Chaque marche est la sortie d'un modèle qui prend la tête de sa famille. Le score est celui d'aujourd'hui (édition du 28 septembre 2026), placé à la date de sortie : ce n'est pas un historique de mesures. Seuls les 269 modèles classés en usage courant comptent.
Qui a pris la tête, et quand
Du plus récent au plus ancien · scores de l'édition duModèles fermés
16 relais · 137 modèles classés| Sortie | Modèle | Score | En tête |
|---|---|---|---|
| Gemini 4 Argon · Google DeepMind | 97,5 | depuis 0 jour | |
| Claude Opus 5.5 · Anthropic | 97,3 | 8 jours | |
| Claude Fable 5.1 · Anthropic | 95,4 | 21 jours | |
| Claude Fable 5 · Anthropic | 94,1 | 84 jours | |
| Claude Opus 4.7 · Anthropic | 90,5 | 54 jours | |
| Claude Opus 4.6 · Anthropic | 90,2 | 70 jours | |
| Gemini 3 Pro · Google DeepMind | 86,0 | 79 jours | |
| GPT-5.1 · OpenAI | 80,8 | 5 jours | |
| Claude Sonnet 4.5 · Anthropic | 79,5 | 45 jours | |
| GPT-5 · OpenAI | 78,7 | 53 jours | |
| ChatGPT-4o Latest · OpenAI | 78,5 | 358 jours | |
| Claude 3.5 Sonnet · Anthropic | 59,4 | 55 jours | |
| GPT-4o (May 2024) · OpenAI | 55,0 | 38 jours | |
| GPT-4 Turbo (Apr 2024) · OpenAI | 51,1 | 34 jours | |
| Claude 3 Opus · Anthropic | 50,5 | 40 jours | |
| GPT-4 Turbo (Nov 2023) · OpenAI | 49,5 | 115 jours |
Modèles ouverts
17 relais · 132 modèles classés| Sortie | Modèle | Score | En tête |
|---|---|---|---|
| Kimi K3 · Moonshot | 89,9 | depuis 74 jours | |
| GLM-5.2 · Z.ai (Zhipu AI) | 85,2 | 30 jours | |
| Kimi K2.6 · Moonshot | 83,2 | 57 jours | |
| GLM-5.1 · Z.ai (Zhipu AI) | 82,9 | 13 jours | |
| Kimi K2.5 · Moonshot | 79,2 | 70 jours | |
| GLM-4.7 · Z.ai (Zhipu AI) | 76,6 | 36 jours | |
| Kimi K2 Thinking · Moonshot | 75,3 | 46 jours | |
| DeepSeek-V3.1-Terminus · DeepSeek | 73,2 | 45 jours | |
| DeepSeek-V3.1 · DeepSeek | 72,5 | 32 jours | |
| DeepSeek-R1 (May 2025) · DeepSeek | 71,2 | 85 jours | |
| Qwen3-235B-A22B · Alibaba | 68,0 | 30 jours | |
| DeepSeek-V3 (Mar 2025) · DeepSeek | 64,9 | 35 jours | |
| QwQ-32B · Alibaba | 58,4 | 19 jours | |
| Llama 3.1-405B · Meta AI | 53,4 | 225 jours | |
| Llama 3-70B · Meta AI | 42,4 | 96 jours | |
| Mistral Large · Mistral AI | 36,7 | 52 jours | |
| Mistral Medium · Mistral AI | 31,2 | 77 jours |
En bref
- Quel est l'écart entre les modèles fermés et les modèles ouverts en usage courant ?
- Au 28 septembre 2026, le meilleur modèle fermé en usage courant, Gemini 4 Argon (Google DeepMind), obtient 97,5 et le meilleur modèle ouvert, Kimi K3 (Moonshot), 89,9 : l'écart est de 7,6 points en faveur des modèles fermés.
- Combien de temps les modèles ouverts mettent-ils à rattraper les modèles fermés ?
- Le niveau du meilleur modèle ouvert d'aujourd'hui, Kimi K3 (89,9), sorti le 16 juillet 2026, avait été atteint par un modèle fermé dès le 5 février 2026, avec Claude Opus 4.6 (90,2) : environ cinq mois d'écart. Chaque modèle est placé à sa date de sortie avec son score de l'édition du 28 septembre 2026 : la courbe ne rejoue pas les mesures de l'époque.
- L'écart entre fermés et ouverts se réduit-il ?
- Un an plus tôt, au 28 septembre 2025, le meilleur modèle fermé sorti était GPT-5 (78,7) et le meilleur modèle ouvert DeepSeek-V3.1-Terminus (73,2), soit 5,5 points d'écart. Il est de 7,6 points au 28 septembre 2026 : il s'est creusé de 2,1 points. Chaque modèle est placé à sa date de sortie avec son score de l'édition du 28 septembre 2026 : la courbe ne rejoue pas les mesures de l'époque.
- Quel est le meilleur modèle en usage courant aujourd'hui ?
- Gemini 4 Argon (Google DeepMind) avec un score de 97,5, dans l'édition du 28 septembre 2026. Il est sorti le 30 septembre 2026. Chez les modèles ouverts, Kimi K3 (Moonshot) mène avec 89,9.
- Quels éditeurs ont pris la tête depuis 2024 ?
- Depuis janvier 2024, la tête des modèles fermés en usage courant a changé de main 15 fois : Anthropic huit fois, OpenAI cinq fois et Google DeepMind deux fois. Un changement est compté chaque fois qu'un modèle, à sa sortie, dépasse tous ceux sortis avant lui.
- Que montre ce graphique ?
- Le score en usage courant que chaque modèle obtient aujourd'hui, placé à sa date de sortie. La ligne pleine suit le meilleur modèle fermé sorti à chaque date, la ligne pointillée le meilleur modèle ouvert. Ce n'est pas un historique de mesures : Quelle IA n'a qu'une édition, celle du 28 septembre 2026. Seuls les 269 modèles classés en usage courant comptent, les scores provisoires sont écartés.