Évolution · Sciences · depuis 2024
La course en sciences
L'écart entre fermés et ouverts, en sciences
Meilleur ferméMeilleur ouvertL'écartÉcart actuel : 2,1 points
Chaque marche est la sortie d'un modèle qui prend la tête de sa famille. Le score est celui d'aujourd'hui (édition du 28 septembre 2026), placé à la date de sortie : ce n'est pas un historique de mesures. Seuls les 95 modèles classés en sciences comptent. La ligne des modèles ouverts commence en juillet 2024, à la sortie du premier modèle ouvert classé en sciences.
Qui a pris la tête, et quand
Du plus récent au plus ancien · scores de l'édition duModèles fermés
14 relais · 62 modèles classés| Sortie | Modèle | Score | En tête |
|---|---|---|---|
| GPT-5.6 Sol · OpenAI | 97,0 | depuis 81 jours | |
| Claude Fable 5 · Anthropic | 96,0 | 30 jours | |
| GPT-5.5 · OpenAI | 94,6 | 47 jours | |
| GPT-5.4 Pro · OpenAI | 93,3 | 49 jours | |
| Gemini 3.1 Pro · Google DeepMind | 90,7 | 14 jours | |
| Claude Opus 4.6 · Anthropic | 87,1 | 14 jours | |
| Gemini 3 Pro · Google DeepMind | 86,0 | 79 jours | |
| GPT-5 · OpenAI | 80,6 | 103 jours | |
| Gemini 2.5 Pro (Jun 2025) · Google DeepMind | 76,9 | 63 jours | |
| o3 · OpenAI | 75,1 | 50 jours | |
| Claude 3.7 Sonnet · Anthropic | 70,4 | 51 jours | |
| o3-mini · OpenAI | 69,3 | 24 jours | |
| o1 · OpenAI | 68,8 | 45 jours | |
| Gemini 1.5 Pro (Sept 2024) · Google DeepMind | 57,1 | 84 jours |
Modèles ouverts
11 relais · 33 modèles classés| Sortie | Modèle | Score | En tête |
|---|---|---|---|
| Kimi K3 · Moonshot | 94,9 | depuis 74 jours | |
| GLM-5.2 · Z.ai (Zhipu AI) | 84,2 | 30 jours | |
| Kimi K2.6 · Moonshot | 83,2 | 57 jours | |
| GLM-5.1 · Z.ai (Zhipu AI) | 81,3 | 13 jours | |
| Kimi K2.5 · Moonshot | 79,5 | 70 jours | |
| GLM-4.7 · Z.ai (Zhipu AI) | 75,1 | 36 jours | |
| gpt-oss-120b · OpenAI | 69,3 | 139 jours | |
| DeepSeek-V3 (Mar 2025) · DeepSeek | 64,1 | 134 jours | |
| Gemma 3 27B · Google DeepMind | 51,8 | 13 jours | |
| Llama 3.3 70B · Meta AI | 50,3 | 95 jours | |
| Llama 3.1-8B · Meta AI | 26,8 | 136 jours |
En bref
- Quel est l'écart entre les modèles fermés et les modèles ouverts en sciences ?
- Au 28 septembre 2026, le meilleur modèle fermé en sciences, GPT-5.6 Sol (OpenAI), obtient 97,0 et le meilleur modèle ouvert, Kimi K3 (Moonshot), 94,9 : l'écart est de 2,1 points en faveur des modèles fermés.
- Combien de temps les modèles ouverts mettent-ils à rattraper les modèles fermés ?
- Le niveau du meilleur modèle ouvert d'aujourd'hui, Kimi K3 (94,9), sorti le 16 juillet 2026, avait été atteint par un modèle fermé dès le 9 juin 2026, avec Claude Fable 5 (96,0) : 37 jours d'écart. Chaque modèle est placé à sa date de sortie avec son score de l'édition du 28 septembre 2026 : la courbe ne rejoue pas les mesures de l'époque.
- L'écart entre fermés et ouverts se réduit-il ?
- Un an plus tôt, au 28 septembre 2025, le meilleur modèle fermé sorti était GPT-5 (80,6) et le meilleur modèle ouvert gpt-oss-120b (69,3), soit 11,3 points d'écart. Il est de 2,1 points au 28 septembre 2026 : il s'est réduit de 9,2 points. Chaque modèle est placé à sa date de sortie avec son score de l'édition du 28 septembre 2026 : la courbe ne rejoue pas les mesures de l'époque.
- Quel est le meilleur modèle en sciences aujourd'hui ?
- GPT-5.6 Sol (OpenAI) avec un score de 97,0, dans l'édition du 28 septembre 2026. Il est sorti le 9 juillet 2026. Chez les modèles ouverts, Kimi K3 (Moonshot) mène avec 94,9.
- Quels éditeurs ont pris la tête depuis 2024 ?
- Depuis janvier 2024, la tête des modèles fermés en sciences a changé de main 14 fois : OpenAI sept fois, Google DeepMind quatre fois et Anthropic trois fois. Un changement est compté chaque fois qu'un modèle, à sa sortie, dépasse tous ceux sortis avant lui.
- Que montre ce graphique ?
- Le score en sciences que chaque modèle obtient aujourd'hui, placé à sa date de sortie. La ligne pleine suit le meilleur modèle fermé sorti à chaque date, la ligne pointillée le meilleur modèle ouvert. Ce n'est pas un historique de mesures : Quelle IA n'a qu'une édition, celle du 28 septembre 2026. Seuls les 95 modèles classés en sciences comptent, les scores provisoires sont écartés.