La semaine · édition 2026-W40
Semaine du
Première édition : 246 modèles classés, 27 modèles sortis depuis moins de 30 jours, dont 8 en attente de mesures.
Entrants
8 des 27- Gemini 4 Argon · Google DeepMindProvisoire97,0
- GPT-6.1 Sol · OpenAIProvisoire100,7
- GPT-6.1 Sol Pro · OpenAIEn attente
- Claude Sonnet 5.5 · AnthropicNouveau98,0
- GLM 5.3 Prime · Z.ai (Zhipu AI)En attente
- Qwen 3.8 Max Prime · AlibabaEn attente
- Claude Opus 5.5 · AnthropicNouveau99,9
- GPT-6 Sol · OpenAINouveau94,9
Voir les 19 autres entrants
- GPT-6 Luna · OpenAINouveau87,6
- GPT-6 Luna Pro · OpenAIEn attente
- GPT-6 Sol Pro · OpenAIEn attente
- MiMo-V2.6-Pro · XiaomiNouveau90,5
- Grok 4.7 · xAINouveau87,3
- MiMo-V2.6-Flash · XiaomiNouveau80,6
- Step 5 Preview · StepFunProvisoire89,4
- GLM 5.3 FlashX · Z.ai (Zhipu AI)En attente
- Qwen3.8 Omni Flash · AlibabaEn attente
- SWE-2 · CognitionProvisoire94,4
- DeepSeek V4.1 Flash · DeepSeekNouveau87,3
- Mercury 2.5 · Inception LabsProvisoire73,0
- GPT-6 Astra · OpenAINouveau99,1
- Muse Spark 1.3 · Meta AINouveau90,2
- Gemini 3.8 Flash · Google DeepMindNouveau89,7
- Quasar 438B · Multiverse ComputingEn attente
- Claude Fable 5.1 · AnthropicNouveau97,3
- Qwen3.8 Max (0902) · AlibabaNouveau88,9
- Granite 4.2 8B · IBMProvisoire43,5
Progressions
Dès la W41Première édition : aucune variation à afficher. La semaine prochaine, les plus fortes hausses et baisses apparaîtront ici.
La course depuis 2024 →Benchmarks
57 actifs98 benchmarks recensés au lancement : 57 actifs, 8 saturés, 33 archivés.
Sources
7 à jourLes sept sources ont été relevées cette semaine : Epoch AI, Arena, compar:IA, EuroEval, models.dev, OpenRouter et Arena, images et vidéo. Aucune panne.
En bref
- Quel modèle est en tête cette semaine ?
- Claude Opus 5.5 (Anthropic) est premier du classement général de Quelle IA avec un score IA de 99,9, dans l'édition du 28 septembre 2026. Sa marge d'erreur recouvre celle de GPT-6 Astra et Claude Sonnet 5.5 : ils sont ex æquo.
- Quels modèles de langage viennent de sortir ?
- Au 28 septembre 2026, Quelle IA compte 27 modèles sortis depuis moins de 30 jours, dont 8 en attente de mesures. Les plus récents : Gemini 4 Argon (Google DeepMind, 30 septembre), GPT-6.1 Sol (OpenAI, 29 septembre), GPT-6.1 Sol Pro (OpenAI, 29 septembre) et Claude Sonnet 5.5 (Anthropic, 28 septembre). Le mieux classé d'entre eux est Claude Opus 5.5, rang 1 avec un score IA de 99,9.
- Quels scores ont le plus changé cette semaine ?
- Aucun : l'édition du 28 septembre 2026 est la première, il n'existe pas encore d'édition précédente à laquelle la comparer. Les hausses et les baisses apparaîtront avec l'édition 2026-W41.
- Les sources ont-elles toutes été relevées ?
- Les sept sources ont été relevées cette semaine : Epoch AI, Arena, compar:IA, EuroEval, models.dev, OpenRouter et Arena, images et vidéo. Aucune panne. Édition du 28 septembre 2026.
- Combien de benchmarks Quelle IA suit-il ?
- 98 benchmarks recensés au lancement : 57 actifs, 8 saturés, 33 archivés. Un benchmark saturé ne départage plus les meilleurs modèles ; un benchmark archivé n'est plus alimenté par des modèles récents.