# Classement Sciences des modèles de langage

> Dans l'édition du 28 septembre 2026, GPT-5.6 Sol (OpenAI) est premier en sciences avec un score Sciences de 97,0, ex æquo avec 19 autres modèles dont GPT-6 Astra et Claude Fable 5. La marge du premier va de 92,2 à 101,8 ; deux modèles dont les marges se recouvrent sont ex æquo. 95 modèles sont classés, 248 autres ont un score provisoire.

Page : https://quelleia.com/classement/sciences/
Édition : 2026-W40, 28 septembre 2026
Question : Quel modèle répond le mieux aux questions d'experts ?

## Comment lire ce classement

Le score Sciences résume les résultats d'un modèle sur les benchmarks de sciences et de savoir expert où il a été mesuré. L'échelle est celle du score général : 100 correspond au meilleur modèle au lancement du site, 50 à GPT-4o de fin 2024. La barre indique la marge d'erreur : deux modèles dont les barres se chevauchent sont ex æquo.

## Modèles classés (95)

| Rang | Modèle | Éditeur | Score | Marge à 90 % | Couverture | Mesures | Prix entrée / sortie (€ par million de jetons) |
| --- | --- | --- | --- | --- | --- | --- | --- |
| 1 | GPT-5.6 Sol | OpenAI | 97,0 | de 92,2 à 101,8 | 80 % | 4 | 3,51 € / 18 € |
| 2 | GPT-6 Astra | OpenAI | 96,2 | de 92,5 à 99,9 | 80 % | 4 | 8,78 € / 44 € |
| 3 | Claude Fable 5 | Anthropic | 96,0 | de 88,6 à 103,3 | 80 % | 4 | 8,78 € / 44 € |
| 4 | Claude Opus 5.5 | Anthropic | 95,7 | de 89,5 à 101,9 | 60 % | 3 | 4 € / 20 € |
| 5 | Kimi K3 | Moonshot | 94,9 | de 88,5 à 101,3 | 80 % | 4 | 2,60 € / 13 € |
| 6 | Claude Opus 5 | Anthropic | 94,6 | de 89,8 à 99,5 | 60 % | 3 | 4,39 € / 22 € |
| 7 | GPT-5.5 | OpenAI | 94,6 | de 89,9 à 99,4 | 80 % | 4 | 4,34 € / 26 € |
| 8 | GPT-5.6 Terra | OpenAI | 94,4 | de 89,9 à 98,9 | 80 % | 4 | 2,17 € / 13 € |
| 9 | Claude Fable 5.1 | Anthropic | 94,1 | de 90,2 à 98,0 | 60 % | 3 | 8,78 € / 44 € |
| 10 | GPT-5.4 Pro | OpenAI | 93,3 | de 89,3 à 97,4 | 60 % | 3 | 26 € / 158 € |
| 11 | Claude Opus 4.8 | Anthropic | 92,8 | de 87,8 à 97,8 | 80 % | 4 | 4,39 € / 22 € |
| 12 | Gemini 3.8 Flash | Google DeepMind | 91,0 | de 87,9 à 94,1 | 100 % | 5 | 1,50 € / 7,50 € |
| 13 | Gemini 3.1 Pro | Google DeepMind | 90,7 | de 86,5 à 95,0 | 80 % | 4 | 2 € / 12 € |
| 14 | GPT-5.4 | OpenAI | 89,4 | de 85,0 à 93,9 | 80 % | 4 | 2,17 € / 13 € |
| 15 | Grok 4.6 | xAI | 89,2 | de 83,3 à 95,0 | 60 % | 3 | 1,76 € / 5,27 € |
| 16 | GLM-5.3 | Z.ai (Zhipu AI) | 88,9 | de 83,1 à 94,7 | 60 % | 3 | 1,40 € / 4,40 € |
| 17 | Grok 4.5 | xAI | 88,6 | de 84,7 à 92,6 | 80 % | 4 | 1,76 € / 5,27 € |
| 18 | Qwen3.8 Max (0902) | Alibaba | 88,4 | de 82,8 à 94,0 | 60 % | 3 | 1,76 € / 5,27 € |
| 19 | Gemini 3.7 Flash | Google DeepMind | 87,9 | de 82,1 à 93,6 | 60 % | 3 | 1,50 € / 7,50 € |
| 20 | Claude Opus 4.6 | Anthropic | 87,1 | de 81,7 à 92,4 | 60 % | 3 | 4,39 € / 22 € |
| 21 | Claude Opus 4.7 | Anthropic | 87,1 | de 82,8 à 91,4 | 80 % | 4 | 4,39 € / 22 € |
| 22 | Muse Spark | Meta AI | 87,1 | de 81,8 à 92,3 | 80 % | 4 | inconnu |
| 23 | GPT-5.6 Luna | OpenAI | 86,0 | de 81,7 à 90,4 | 80 % | 4 | 0,87 € / 5,20 € |
| 24 | Gemini 3 Pro | Google DeepMind | 86,0 | de 80,9 à 91,1 | 80 % | 4 | 1,73 € / 10 € |
| 25 | Gemini 3.6 Flash | Google DeepMind | 85,5 | de 79,4 à 91,7 | 60 % | 3 | 1,30 € / 6,50 € |
| 26 | Qwen3.7-Max | Alibaba | 85,5 | de 79,6 à 91,4 | 60 % | 3 | 1,08 € / 3,25 € |
| 27 | Claude Sonnet 5 | Anthropic | 85,2 | de 81,1 à 89,4 | 80 % | 4 | 1,73 € / 8,67 € |
| 28 | GLM-5.2 | Z.ai (Zhipu AI) | 84,2 | de 79,0 à 89,4 | 80 % | 4 | 0,98 € / 3,08 € |
| 29 | Gemini 3.5 Flash | Google DeepMind | 84,2 | de 80,6 à 87,9 | 80 % | 4 | 1,30 € / 7,80 € |
| 30 | GPT-5.2 | OpenAI | 83,2 | de 78,1 à 88,2 | 60 % | 3 | 1,52 € / 12 € |
| 31 | Kimi K2.6 | Moonshot | 83,2 | de 76,9 à 89,4 | 60 % | 3 | 0,59 € / 2,96 € |
| 32 | GLM-5.3-Flash | Z.ai (Zhipu AI) | 82,6 | de 78,2 à 87,1 | 80 % | 4 | 0,15 € / 0,50 € |
| 33 | Muse Spark 1.1 | Meta AI | 82,6 | de 77,7 à 87,6 | 60 % | 3 | 1,10 € / 3,73 € |
| 34 | MiniMax-M3 | MiniMax | 81,9 | de 78,1 à 85,6 | 80 % | 4 | 0,24 € / 0,97 € |
| 35 | GLM-5.1 | Z.ai (Zhipu AI) | 81,3 | de 74,8 à 87,9 | 60 % | 3 | 0,85 € / 2,67 € |
| 36 | Claude Opus 4.5 | Anthropic | 80,8 | de 75,2 à 86,4 | 60 % | 3 | 4,39 € / 22 € |
| 37 | DeepSeek V4.1 Flash | DeepSeek | 80,8 | de 74,8 à 86,9 | 60 % | 3 | 0,15 € / 0,60 € |
| 38 | Qwen3.7-Plus | Alibaba | 80,8 | de 74,7 à 86,9 | 60 % | 3 | 0,28 € / 1,11 € |
| 39 | Claude Sonnet 4.6 | Anthropic | 80,6 | de 73,7 à 87,4 | 60 % | 3 | 2,63 € / 13 € |
| 40 | GPT-5 | OpenAI | 80,6 | de 75,4 à 85,7 | 80 % | 4 | 1,08 € / 8,67 € |
| 41 | Kimi K2.7 Code | Moonshot | 80,6 | de 77,0 à 84,1 | 60 % | 3 | 0,83 € / 3,51 € |
| 42 | GPT-5.4 Mini | OpenAI | 80,3 | de 74,0 à 86,6 | 60 % | 3 | 0,65 € / 3,90 € |
| 43 | GPT-5.1 | OpenAI | 79,8 | de 74,9 à 84,7 | 80 % | 4 | 1,08 € / 8,67 € |
| 44 | Grok 4.3 Beta | xAI | 79,8 | de 73,4 à 86,1 | 60 % | 3 | 1,08 € / 2,17 € |
| 45 | Inkling | Thinking Machines | 79,8 | de 73,6 à 85,9 | 60 % | 3 | 0,95 € / 4,05 € |
| 46 | Inkling-Small | Thinking Machines | 79,5 | de 73,1 à 85,9 | 60 % | 3 | 0,45 € / 1,20 € |
| 47 | Kimi K2.5 | Moonshot | 79,5 | de 74,4 à 84,6 | 80 % | 4 | 0,35 € / 1,65 € |
| 48 | Qwen 3.6 Plus | Alibaba | 79,2 | de 72,8 à 85,7 | 60 % | 3 | 0,28 € / 1,69 € |
| 49 | Qwen 3.8 27B | Alibaba | 79,2 | de 75,6 à 82,9 | 60 % | 3 | 0,35 € / 2,75 € |
| 50 | DeepSeek-V4-Pro | DeepSeek | 79,0 | de 73,5 à 84,4 | 80 % | 4 | 0,38 € / 0,75 € |
| 51 | Qwen 3.6 35B-A3B | Alibaba | 77,9 | de 73,7 à 82,2 | 60 % | 3 | 0,22 € / 1,30 € |
| 52 | Gemini 2.5 Pro (Jun 2025) | Google DeepMind | 76,9 | de 71,8 à 82,0 | 80 % | 4 | 1,10 € / 8,78 € |
| 53 | Nemotron 3 Ultra | NVIDIA | 76,9 | de 70,9 à 82,9 | 60 % | 3 | inconnu |
| 54 | Gemini 3.5 Flash-Lite | Google DeepMind | 75,6 | de 69,6 à 81,5 | 60 % | 3 | 0,26 € / 2,17 € |
| 55 | GPT-5.5 Instant | OpenAI | 75,3 | de 69,2 à 81,5 | 60 % | 3 | 4,39 € / 26 € |
| 56 | GLM-4.7 | Z.ai (Zhipu AI) | 75,1 | de 69,3 à 80,8 | 60 % | 3 | 0,35 € / 1,52 € |
| 57 | o3 | OpenAI | 75,1 | de 69,9 à 80,3 | 80 % | 4 | 1,76 € / 7,02 € |
| 58 | Claude Sonnet 4.5 | Anthropic | 74,8 | de 68,9 à 80,8 | 80 % | 4 | 2,60 € / 13 € |
| 59 | Qwen3.5-35B-A3B | Alibaba | 73,5 | de 66,8 à 80,2 | 60 % | 3 | 0,12 € / 0,87 € |
| 60 | Gemma 4 31B IT | Google DeepMind | 73,0 | de 68,3 à 77,7 | 80 % | 4 | 0,10 € / 0,31 € |
| 61 | Qwen3-235B-A22B-Thinking (Jul 2025) | Alibaba | 73,0 | de 66,8 à 79,2 | 60 % | 3 | 0,26 € / 2,55 € |
| 62 | GPT-5.4 Nano | OpenAI | 72,7 | de 66,2 à 79,2 | 60 % | 3 | 0,17 € / 1,08 € |
| 63 | o4-mini | OpenAI | 72,5 | de 67,2 à 77,7 | 80 % | 4 | 0,95 € / 3,82 € |
| 64 | Gemini 3.1 Flash-Lite | Google DeepMind | 72,2 | de 66,1 à 78,3 | 80 % | 4 | 0,22 € / 1,30 € |
| 65 | Claude Opus 4.1 | Anthropic | 71,9 | de 65,7 à 78,2 | 60 % | 3 | 13 € / 66 € |
| 66 | Mistral Medium 3.5 | Mistral AI | 71,9 | de 67,4 à 76,4 | 60 % | 3 | 1,30 € / 6,50 € |
| 67 | Claude Sonnet 4 | Anthropic | 70,6 | de 65,0 à 76,3 | 80 % | 4 | 2,60 € / 13 € |
| 68 | Claude 3.7 Sonnet | Anthropic | 70,4 | de 64,0 à 76,8 | 60 % | 3 | 2,63 € / 13 € |
| 69 | Claude Opus 4 | Anthropic | 70,1 | de 65,0 à 75,3 | 80 % | 4 | 13 € / 66 € |
| 70 | GPT-5 mini | OpenAI | 70,1 | de 64,4 à 75,8 | 80 % | 4 | 0,22 € / 1,73 € |
| 71 | Gemma 4 26B A4B | Google DeepMind | 69,6 | de 62,2 à 76,9 | 60 % | 3 | 0,05 € / 0,29 € |
| 72 | gpt-oss-120b | OpenAI | 69,3 | de 64,0 à 74,6 | 80 % | 4 | 0,03 € / 0,16 € |
| 73 | o3-mini | OpenAI | 69,3 | de 63,7 à 75,0 | 60 % | 3 | 0,97 € / 3,86 € |
| 74 | o1 | OpenAI | 68,8 | de 63,2 à 74,4 | 60 % | 3 | 13 € / 53 € |
| 75 | Claude Haiku 4.5 | Anthropic | 67,8 | de 61,3 à 74,2 | 60 % | 3 | 0,88 € / 4,39 € |
| 76 | Trinity Large Thinking | Arcee AI | 66,2 | de 60,5 à 71,9 | 60 % | 3 | 0,19 € / 0,74 € |
| 77 | GPT-4.5 | OpenAI | 64,9 | de 59,3 à 70,5 | 60 % | 3 | inconnu |
| 78 | DeepSeek-V3 (Mar 2025) | DeepSeek | 64,1 | de 59,3 à 68,9 | 60 % | 3 | 0,17 € / 0,67 € |
| 79 | GPT-4.1 | OpenAI | 63,6 | de 58,7 à 68,5 | 60 % | 3 | 1,76 € / 7,02 € |
| 80 | Qwen3-32B | Alibaba | 63,1 | de 58,3 à 67,8 | 60 % | 3 | 0,07 € / 0,24 € |
| 81 | GPT-4.1 mini | OpenAI | 62,8 | de 58,2 à 67,4 | 60 % | 3 | 0,35 € / 1,39 € |
| 82 | Llama 4 Maverick | Meta AI | 61,5 | de 53,5 à 69,5 | 80 % | 4 | 0,13 € / 0,52 € |
| 83 | Mistral Medium 3 | Mistral AI | 59,1 | de 54,4 à 63,9 | 60 % | 3 | 0,35 € / 1,76 € |
| 84 | gpt-oss-20b | OpenAI | 58,9 | de 52,7 à 65,1 | 60 % | 3 | 0,03 € / 0,12 € |
| 85 | Gemini 1.5 Pro (Sept 2024) | Google DeepMind | 57,1 | de 52,0 à 62,1 | 60 % | 3 | inconnu |
| 86 | Llama 4 Scout | Meta AI | 53,1 | de 47,6 à 58,7 | 60 % | 3 | 0,09 € / 0,26 € |
| 87 | Mistral Small 3.2 | Mistral AI | 52,6 | de 47,3 à 57,9 | 60 % | 3 | 0,07 € / 0,17 € |
| 88 | Gemma 3 27B | Google DeepMind | 51,8 | de 46,4 à 57,3 | 60 % | 3 | 0,07 € / 0,14 € |
| 89 | GPT-4.1 nano | OpenAI | 51,6 | de 46,4 à 56,8 | 60 % | 3 | 0,09 € / 0,35 € |
| 90 | GPT-4o (Nov 2024) | OpenAI | 51,1 | de 45,5 à 56,6 | 60 % | 3 | 2,19 € / 8,78 € |
| 91 | Llama 3.3 70B | Meta AI | 50,3 | de 44,7 à 55,9 | 60 % | 3 | 0,09 € / 0,28 € |
| 92 | Mistral Small 3.1 | Mistral AI | 50,3 | de 44,7 à 55,8 | 60 % | 3 | 0,09 € / 0,26 € |
| 93 | Claude 3.5 Haiku | Anthropic | 44,8 | de 37,4 à 52,1 | 60 % | 3 | 0,70 € / 3,51 € |
| 94 | Gemma 3 12B | Google DeepMind | 44,5 | de 38,2 à 50,9 | 60 % | 3 | 0,04 € / 0,13 € |
| 95 | Llama 3.1-8B | Meta AI | 26,8 | de 18,4 à 35,2 | 60 % | 3 | 0,02 € / 0,03 € |

## Scores provisoires (248)

Ces modèles n'ont pas encore assez de mesures pour recevoir un rang. Ils sont listés du score le plus haut au plus bas.

| Rang | Modèle | Éditeur | Score | Marge à 90 % | Couverture | Mesures | Prix entrée / sortie (€ par million de jetons) |
| --- | --- | --- | --- | --- | --- | --- | --- |
| provisoire | Claude Sonnet 5.5 | Anthropic | 96,0 | de 91,6 à 100,3 | 40 % | 2 | 2 € / 10 € |
| provisoire | GPT-5.5 Pro | OpenAI | 95,4 | de 90,4 à 100,4 | 40 % | 2 | 26 € / 158 € |
| provisoire | Gemini 4 Argon | Google DeepMind | 94,9 | de 86,7 à 103,1 | 20 % | 1 | inconnu |
| provisoire | Gemini 3 Deep Think | Google DeepMind | 93,3 | de 88,5 à 98,2 | 20 % | 1 | inconnu |
| provisoire | Muse Spark 1.3 | Meta AI | 92,6 | de 87,4 à 97,7 | 40 % | 2 | 1,25 € / 4,25 € |
| provisoire | MiMo-V2.6-Pro | Xiaomi | 91,0 | de 82,8 à 99,2 | 20 % | 1 | 0,44 € / 0,87 € |
| provisoire | Step 5 Preview | StepFun | 90,7 | de 85,2 à 96,2 | 20 % | 1 | 0,95 € / 2,71 € |
| provisoire | GPT-6 Sol | OpenAI | 89,9 | de 81,7 à 98,2 | 20 % | 1 | 2 € / 10 € |
| provisoire | Qwen 3.8 Max | Alibaba | 89,9 | de 84,2 à 95,7 | 40 % | 2 | 1,76 € / 5,27 € |
| provisoire | DeepSeek V4 Pro 0813 | DeepSeek | 88,4 | de 82,2 à 94,5 | 40 % | 2 | 0,61 € / 1,82 € |
| provisoire | Muse Spark 1.2 | Meta AI | 88,1 | de 82,0 à 94,2 | 40 % | 2 | 1,25 € / 4,25 € |
| provisoire | DeepSeek V4 Flash 0731 | DeepSeek | 87,3 | de 81,0 à 93,7 | 40 % | 2 | 0,18 € / 0,35 € |
| provisoire | Grok 4.7 | xAI | 86,8 | de 78,5 à 95,1 | 40 % | 2 | 1,76 € / 5,27 € |
| provisoire | GPT-6 Luna | OpenAI | 86,3 | de 78,1 à 94,5 | 20 % | 1 | 0,10 € / 0,50 € |
| provisoire | GPT-5 Pro | OpenAI | 84,7 | de 79,2 à 90,2 | 20 % | 1 | 13 € / 105 € |
| provisoire | Qwen3.5 Max Preview | Alibaba | 84,7 | de 76,5 à 92,9 | 20 % | 1 | inconnu |
| provisoire | MiMo-V2.6-Flash | Xiaomi | 84,5 | de 76,3 à 92,7 | 20 % | 1 | 0,14 € / 0,28 € |
| provisoire | ERNIE 5.1 | Baidu | 84,2 | de 76,0 à 92,4 | 20 % | 1 | 0,66 € / 2,63 € |
| provisoire | GPT-5.2 Chat | OpenAI | 84,2 | de 76,0 à 92,4 | 20 % | 1 | 1,54 € / 12 € |
| provisoire | Hy3 | Tencent | 83,7 | de 75,5 à 91,9 | 20 % | 1 | 0,15 € / 0,50 € |
| provisoire | Grok 4.20 Beta 1 | xAI | 83,2 | de 75,0 à 91,4 | 20 % | 1 | inconnu |
| provisoire | Grok 4.20 Multi Agent Beta | xAI | 82,9 | de 74,7 à 91,1 | 20 % | 1 | 1,10 € / 2,19 € |
| provisoire | Gemini 3 Flash | Google DeepMind | 82,6 | de 75,6 à 89,7 | 40 % | 2 | 0,43 € / 2,60 € |
| provisoire | Grok 4.20 | xAI | 82,4 | de 74,7 à 90,0 | 20 % | 1 | 1,08 € / 2,17 € |
| provisoire | MiMo-V2-Pro | Xiaomi | 82,1 | de 73,9 à 90,3 | 20 % | 1 | 0,38 € / 0,76 € |
| provisoire | Grok Build 0.1 | xAI | 81,3 | de 73,3 à 89,4 | 20 % | 1 | 0,88 € / 1,76 € |
| provisoire | MiMo-V2.5-Pro | Xiaomi | 81,1 | de 72,7 à 89,5 | 40 % | 2 | 0,38 € / 0,76 € |
| provisoire | Qwen 3.6 Max (Preview) | Alibaba | 81,1 | de 73,9 à 88,2 | 40 % | 2 | 1,14 € / 6,85 € |
| provisoire | Seed 2.0 Pro | ByteDance | 81,1 | de 72,9 à 89,3 | 20 % | 1 | 0,44 € / 2,63 € |
| provisoire | DeepSeek-V4-Flash | DeepSeek | 80,3 | de 72,8 à 87,8 | 40 % | 2 | 0,09 € / 0,17 € |
| provisoire | GPT-5.3 Chat | OpenAI | 80,3 | de 72,1 à 88,5 | 20 % | 1 | 1,52 € / 12 € |
| provisoire | GLM-5 | Z.ai (Zhipu AI) | 79,8 | de 73,2 à 86,3 | 40 % | 2 | 0,52 € / 1,66 € |
| provisoire | Grok 4.20 Beta (0309) | xAI | 79,8 | de 71,6 à 88,0 | 20 % | 1 | 1,76 € / 5,27 € |
| provisoire | Qwen3.5 397B-A17B | Alibaba | 78,7 | de 72,3 à 85,1 | 40 % | 2 | 0,34 € / 2,03 € |
| provisoire | MiMo-V2.5 | Xiaomi | 77,9 | de 70,0 à 85,9 | 40 % | 2 | 0,12 € / 0,25 € |
| provisoire | GLM-5V-Turbo | Z.ai (Zhipu AI) | 77,7 | de 69,5 à 85,9 | 20 % | 1 | 1,05 € / 3,51 € |
| provisoire | ERNIE 5.0 | Baidu | 77,4 | de 69,2 à 85,6 | 20 % | 1 | 0,74 € / 2,96 € |
| provisoire | Grok 4 | xAI | 77,2 | de 70,2 à 84,1 | 40 % | 2 | 2,63 € / 13 € |
| provisoire | MiMo V2 Omni | Xiaomi | 77,2 | de 69,0 à 85,4 | 20 % | 1 | 0,12 € / 0,25 € |
| provisoire | Qwen 3.5 Plus (hosted 397B-A17B) | Alibaba | 76,6 | de 70,1 à 83,2 | 20 % | 1 | 0,35 € / 2,11 € |
| provisoire | Qwen3.6 27B | Alibaba | 76,6 | de 69,6 à 83,7 | 40 % | 2 | 0,53 € / 3,16 € |
| provisoire | Kimi K2 Thinking | Moonshot | 76,4 | de 70,4 à 82,3 | 40 % | 2 | 0,52 € / 2,17 € |
| provisoire | Kimi K2.5 Instant | Moonshot | 76,4 | de 68,2 à 84,6 | 20 % | 1 | inconnu |
| provisoire | DeepSeek-V3.2 | DeepSeek | 75,6 | de 69,7 à 81,4 | 40 % | 2 | 0,20 € / 0,30 € |
| provisoire | Gemini 2.5 Pro (Mar 2025) | Google DeepMind | 75,3 | de 69,9 à 80,7 | 40 % | 2 | 2,19 € / 8,78 € |
| provisoire | Grok 4.1 | xAI | 75,3 | de 67,1 à 83,5 | 20 % | 1 | 1,76 € / 8,78 € |
| provisoire | Qwen 3.6 Flash | Alibaba | 74,8 | de 68,6 à 81,0 | 20 % | 1 | 0,16 € / 0,99 € |
| provisoire | ChatGPT-4o Latest | OpenAI | 74,5 | de 66,4 à 82,7 | 20 % | 1 | 4,39 € / 18 € |
| provisoire | Qwen3.7 Flash | Alibaba | 74,5 | de 68,4 à 80,7 | 20 % | 1 | 0,03 € / 0,11 € |
| provisoire | Hunyuan Hy3 Preview | Tencent | 74,3 | de 66,1 à 82,5 | 20 % | 1 | inconnu |
| provisoire | MiniMax-M2.7 | MiniMax | 74,3 | de 65,9 à 82,7 | 40 % | 2 | 0,24 € / 1,04 € |
| provisoire | Muse Glimmer 30B | Meta AI | 74,0 | de 65,8 à 82,2 | 20 % | 1 | 0,30 € / 1,10 € |
| provisoire | Qwen3.5-27B | Alibaba | 73,8 | de 65,6 à 82,0 | 20 % | 1 | 0,26 € / 2,11 € |
| provisoire | DeepSeek-V3.2-Exp | DeepSeek | 73,5 | de 65,3 à 81,7 | 40 % | 2 | 0,25 € / 0,38 € |
| provisoire | Grok 4.1 Fast | xAI | 73,2 | de 65,1 à 81,4 | 20 % | 1 | 0,17 € / 0,43 € |
| provisoire | Qwen 3.5 Flash (hosted 35B-A3B) | Alibaba | 73,2 | de 67,1 à 79,3 | 40 % | 2 | 0,09 € / 0,35 € |
| provisoire | Ring-2.6-1T | Ant Group | 73,2 | de 66,2 à 80,3 | 20 % | 1 | 0,26 € / 2,19 € |
| provisoire | Qwen3.5-122B-A10B | Alibaba | 73,0 | de 64,7 à 81,2 | 40 % | 2 | 0,35 € / 2,81 € |
| provisoire | MiniMax-M2.5 | MiniMax | 72,7 | de 64,5 à 80,9 | 20 % | 1 | 0,13 € / 1 € |
| provisoire | Qwen3 VL 235B A22B Instruct | Alibaba | 72,7 | de 64,5 à 80,9 | 20 % | 1 | 0,47 € / 2,34 € |
| provisoire | Solar Pro 4 | Upstage | 72,2 | de 64,0 à 80,4 | 20 % | 1 | 0,26 € / 1,05 € |
| provisoire | DeepSeek-V3.1 | DeepSeek | 71,9 | de 63,7 à 80,1 | 20 % | 1 | 0,18 € / 0,69 € |
| provisoire | DeepSeek-V3.1-Terminus | DeepSeek | 71,9 | de 65,4 à 78,4 | 20 % | 1 | 0,24 € / 0,88 € |
| provisoire | GLM-4.6 | Z.ai (Zhipu AI) | 71,9 | de 63,6 à 80,2 | 40 % | 2 | 0,37 € / 1,51 € |
| provisoire | Qwen3-235B-A22B-Instruct (Jul 2025) | Alibaba | 71,7 | de 63,5 à 79,9 | 20 % | 1 | 0,19 € / 0,77 € |
| provisoire | MiniMax-M2.1 | MiniMax | 71,4 | de 63,2 à 79,6 | 20 % | 1 | 0,26 € / 1,05 € |
| provisoire | Gemini 2.5 Flash (Sep 2025) | Google DeepMind | 70,9 | de 62,7 à 79,1 | 20 % | 1 | 0,26 € / 2,19 € |
| provisoire | Grok 4 Fast Chat | xAI | 70,9 | de 62,7 à 79,1 | 20 % | 1 | inconnu |
| provisoire | Qwen3 VL 235B A22B Thinking | Alibaba | 70,9 | de 62,7 à 79,1 | 20 % | 1 | 0,61 € / 2,46 € |
| provisoire | Qwen3.5-9B | Alibaba | 70,9 | de 63,8 à 78,0 | 40 % | 2 | 0,10 € / 0,15 € |
| provisoire | Grok 4 Fast | xAI | 70,4 | de 62,2 à 78,6 | 20 % | 1 | 0,17 € / 0,43 € |
| provisoire | Nova 2.0 Pro Preview | Amazon | 70,4 | de 64,5 à 76,2 | 20 % | 1 | inconnu |
| provisoire | Kimi K2 (Sep 2025) | Moonshot | 70,1 | de 61,9 à 78,3 | 20 % | 1 | 0,55 € / 2,22 € |
| provisoire | LongCat Flash Chat | Meituan | 70,1 | de 61,9 à 78,3 | 20 % | 1 | inconnu |
| provisoire | Step 3.7 Flash | StepFun | 70,1 | de 64,4 à 75,8 | 20 % | 1 | 0,19 € / 1,16 € |
| provisoire | Gemini 2.5 Flash (Jun 2025) | Google DeepMind | 69,8 | de 61,7 à 78,0 | 40 % | 2 | 0,26 € / 2,17 € |
| provisoire | Step 3.5 Flash | StepFun | 69,8 | de 61,7 à 78,0 | 20 % | 1 | 0,08 € / 0,26 € |
| provisoire | DeepSeek-R1 (May 2025) | DeepSeek | 69,6 | de 64,5 à 74,6 | 40 % | 2 | 0,43 € / 1,86 € |
| provisoire | GLM-4.5 | Z.ai (Zhipu AI) | 69,3 | de 60,4 à 78,3 | 40 % | 2 | 0,52 € / 1,91 € |
| provisoire | Grok-3 mini | xAI | 69,3 | de 64,1 à 74,6 | 40 % | 2 | 0,26 € / 0,43 € |
| provisoire | MiMo-V2-Flash | Xiaomi | 69,3 | de 61,2 à 77,5 | 40 % | 2 | 0,12 € / 0,25 € |
| provisoire | Cogito v2.1 | Deep Cogito | 69,1 | de 63,8 à 74,4 | 20 % | 1 | inconnu |
| provisoire | Kimi K2 (Jul 2025) | Moonshot | 69,1 | de 60,9 à 77,3 | 20 % | 1 | 0,50 € / 2,02 € |
| provisoire | Qwen3-Max | Alibaba | 69,1 | de 61,6 à 76,5 | 40 % | 2 | 0,68 € / 3,38 € |
| provisoire | Grok 3 | xAI | 68,8 | de 63,6 à 74,0 | 40 % | 2 | 2,63 € / 13 € |
| provisoire | Gemini 2.5 Flash (Apr 2025) | Google DeepMind | 68,5 | de 60,3 à 76,8 | 20 % | 1 | 0,13 € / 0,53 € |
| provisoire | Mistral Large 3 | Mistral AI | 68,5 | de 59,9 à 77,2 | 40 % | 2 | 0,43 € / 1,30 € |
| provisoire | Gemini 2.5 Flash (May 2025) | Google DeepMind | 67,8 | de 59,6 à 76,0 | 20 % | 1 | 0,12 € / 2,77 € |
| provisoire | Magistral Medium 1.2 | Mistral AI | 67,8 | de 63,0 à 72,5 | 20 % | 1 | inconnu |
| provisoire | Hunyuan-T1 | Tencent | 67,5 | de 59,3 à 75,7 | 20 % | 1 | inconnu |
| provisoire | Laguna M.1 | Poolside | 67,0 | de 61,1 à 72,9 | 20 % | 1 | inconnu |
| provisoire | Mistral Medium 3.1 | Mistral AI | 67,0 | de 58,7 à 75,3 | 40 % | 2 | 0,35 € / 1,73 € |
| provisoire | Nemotron 3 Super | NVIDIA | 67,0 | de 62,5 à 71,4 | 20 % | 1 | 0,01 € / 0,53 € |
| provisoire | Command A+ | Cohere | 66,7 | de 62,4 à 71,0 | 20 % | 1 | 2,19 € / 8,78 € |
| provisoire | seed-oss-36b-instruct | ByteDance | 66,7 | de 61,7 à 71,8 | 20 % | 1 | inconnu |
| provisoire | DeepSeek-R1 | DeepSeek | 66,5 | de 61,2 à 71,7 | 40 % | 2 | inconnu |
| provisoire | chutes/Qwen3-Next-80B-A3B-Instruct | Alibaba | 66,2 | de 58,0 à 74,4 | 20 % | 1 | 0,44 € / 1,76 € |
| provisoire | Qwen3-235B-A22B | Alibaba | 65,9 | de 61,2 à 70,7 | 40 % | 2 | 0,61 € / 2,46 € |
| provisoire | Qwen3-30B-A3B-Thinking (Jul 2025) | Alibaba | 65,7 | de 60,7 à 70,7 | 40 % | 2 | 0,32 € / 1,14 € |
| provisoire | Qwen3-Coder-480B-A35B | Alibaba | 65,1 | de 57,0 à 73,3 | 20 % | 1 | 0,19 € / 1,56 € |
| provisoire | qwen3-coder-next | Alibaba | 65,1 | de 61,4 à 68,9 | 20 % | 1 | 0,10 € / 0,69 € |
| provisoire | GLM-4.6V | Z.ai (Zhipu AI) | 64,9 | de 56,7 à 73,1 | 20 % | 1 | inconnu |
| provisoire | Gemini 2.5 Pro (May 2025) | Google DeepMind | 64,4 | de 56,5 à 72,2 | 40 % | 2 | 2,19 € / 8,78 € |
| provisoire | GPT-5 nano | OpenAI | 64,4 | de 58,4 à 70,4 | 40 % | 2 | 0,04 € / 0,35 € |
| provisoire | o1-pro | OpenAI | 64,4 | de 56,6 à 72,1 | 20 % | 1 | 132 € / 527 € |
| provisoire | Gemini 2.5 Flash-Lite (Sep 2025) | Google DeepMind | 64,1 | de 55,9 à 72,3 | 20 % | 1 | 0,09 € / 0,35 € |
| provisoire | Qwen3-Next-80B-A3B Thinking | Alibaba | 63,6 | de 55,4 à 71,8 | 20 % | 1 | inconnu |
| provisoire | Gemini 2.0 Pro | Google DeepMind | 62,8 | de 58,0 à 67,6 | 20 % | 1 | 1,75 € / 6,98 € |
| provisoire | GLM-4.5-Air | Z.ai (Zhipu AI) | 62,8 | de 54,6 à 71,0 | 40 % | 2 | 0,18 € / 0,97 € |
| provisoire | GLM-4.5V | Z.ai (Zhipu AI) | 62,8 | de 54,6 à 71,0 | 20 % | 1 | inconnu |
| provisoire | Nemotron 3 Super 120B | NVIDIA | 62,5 | de 54,3 à 70,7 | 20 % | 1 | 0,08 € / 0,39 € |
| provisoire | QWQ-Plus | Alibaba | 62,5 | de 57,7 à 67,4 | 20 % | 1 | 0,70 € / 2,11 € |
| provisoire | QwQ-32B | Alibaba | 62,0 | de 57,0 à 67,1 | 40 % | 2 | 0,13 € / 0,35 € |
| provisoire | DeepSeek-R1-Distill-Qwen-32B | DeepSeek | 61,8 | de 56,9 à 66,6 | 20 % | 1 | 0,25 € / 0,76 € |
| provisoire | Qwen3-14B | Alibaba | 61,8 | de 56,9 à 66,6 | 40 % | 2 | 0,31 € / 1,23 € |
| provisoire | Gemini 2.0 Flash (Feb 2025) | Google DeepMind | 61,2 | de 56,1 à 66,4 | 40 % | 2 | 0,09 € / 0,37 € |
| provisoire | Gemini 2.5 Flash-Lite (Jun 2025) | Google DeepMind | 61,2 | de 53,0 à 69,4 | 20 % | 1 | 0,09 € / 0,35 € |
| provisoire | Granite 4.2 30B | IBM | 60,7 | de 52,5 à 68,9 | 20 % | 1 | inconnu |
| provisoire | Nemotron 3.5 Lightning | NVIDIA | 60,7 | de 52,5 à 68,9 | 20 % | 1 | 0,08 € / 0,20 € |
| provisoire | MiniMax-M2 | MiniMax | 60,5 | de 52,2 à 68,7 | 20 % | 1 | 0,22 € / 0,87 € |
| provisoire | glm-4.7-flash | Z.ai (Zhipu AI) | 60,2 | de 55,1 à 65,2 | 40 % | 2 | inconnu |
| provisoire | MiniMax-M1-80k | MiniMax | 60,2 | de 52,0 à 68,4 | 20 % | 1 | 0,12 € / 1,10 € |
| provisoire | o1-mini | OpenAI | 60,2 | de 55,2 à 65,2 | 40 % | 2 | 0,97 € / 3,86 € |
| provisoire | Hunyuan-TurboS | Tencent | 59,9 | de 51,7 à 68,1 | 20 % | 1 | inconnu |
| provisoire | Qwen3-30B-A3B | Alibaba | 59,7 | de 54,6 à 64,8 | 40 % | 2 | 0,10 € / 0,43 € |
| provisoire | Llama 3.3 Nemotron Super 49B v1.5 | NVIDIA | 59,1 | de 50,9 à 67,4 | 20 % | 1 | inconnu |
| provisoire | Step 3 | StepFun | 58,9 | de 50,7 à 67,1 | 20 % | 1 | inconnu |
| provisoire | INTELLECT-3 | Prime Intellect | 58,1 | de 49,9 à 66,3 | 20 % | 1 | inconnu |
| provisoire | Mercury 2 | Inception Labs | 58,1 | de 49,7 à 66,5 | 40 % | 2 | 0,22 € / 0,66 € |
| provisoire | Gemini 2.0 Flash Thinking (Jan 2025) | Google DeepMind | 57,8 | de 52,9 à 62,8 | 40 % | 2 | inconnu |
| provisoire | Qwen3-30B-A3B-Instruct (Jul 2025) | Alibaba | 57,8 | de 51,3 à 64,4 | 40 % | 2 | 0,26 € / 0,44 € |
| provisoire | Qwen3-8B | Alibaba | 57,3 | de 52,4 à 62,2 | 40 % | 2 | 0,04 € / 0,35 € |
| provisoire | Ling-flash-2.0 | Ant Group | 57,1 | de 48,8 à 65,3 | 20 % | 1 | inconnu |
| provisoire | Qwen2.5-Max | Alibaba | 57,1 | de 52,2 à 61,9 | 40 % | 2 | 1,40 € / 5,62 € |
| provisoire | DeepSeek-R1-Distill-Llama-70B | DeepSeek | 56,8 | de 51,9 à 61,7 | 20 % | 1 | 0,61 € / 0,69 € |
| provisoire | DeepSeek-V3 | DeepSeek | 56,8 | de 51,6 à 62,0 | 40 % | 2 | inconnu |
| provisoire | Devstral Small 2 | Mistral AI | 56,8 | de 55,2 à 58,4 | 20 % | 1 | inconnu |
| provisoire | Magistral Small 1.0 | Mistral AI | 56,8 | de 51,9 à 61,7 | 20 % | 1 | 0,43 € / 1,30 € |
| provisoire | Claude 3.5 Sonnet | Anthropic | 56,0 | de 50,7 à 61,4 | 40 % | 2 | 2,63 € / 13 € |
| provisoire | Claude 3.5 Sonnet (October 2024) | Anthropic | 56,0 | de 51,0 à 61,1 | 40 % | 2 | inconnu |
| provisoire | Cohere Command A | Cohere | 56,0 | de 47,8 à 64,2 | 20 % | 1 | 2,17 € / 8,67 € |
| provisoire | Ring-flash-2.0 | Ant Group | 56,0 | de 47,8 à 64,2 | 20 % | 1 | inconnu |
| provisoire | Grok-2 (Dec 2024) | xAI | 55,0 | de 49,9 à 60,0 | 20 % | 1 | inconnu |
| provisoire | o1-preview | OpenAI | 54,7 | de 47,6 à 61,8 | 40 % | 2 | inconnu |
| provisoire | Phi-4 | Microsoft | 54,2 | de 44,0 à 64,4 | 40 % | 2 | 0,06 € / 0,12 € |
| provisoire | Qwen3-4B | Alibaba | 54,2 | de 49,1 à 59,3 | 20 % | 1 | 0,03 € / 0,03 € |
| provisoire | Gemini 2.0 Flash-Lite | Google DeepMind | 53,7 | de 45,4 à 61,9 | 20 % | 1 | 0,07 € / 0,26 € |
| provisoire | Granite 4.1 8B | IBM | 53,7 | de 45,4 à 61,9 | 20 % | 1 | 0,04 € / 0,09 € |
| provisoire | Llama 3.1-405B | Meta AI | 53,1 | de 48,1 à 58,2 | 40 % | 2 | 2,38 € / 2,60 € |
| provisoire | Yi-Lightning | 01.AI | 52,9 | de 44,7 à 61,1 | 20 % | 1 | inconnu |
| provisoire | Granite 4.1 30B | IBM | 52,6 | de 51,6 à 53,6 | 20 % | 1 | inconnu |
| provisoire | Qwen Plus (Jan 2025) | Alibaba | 52,6 | de 45,9 à 59,3 | 40 % | 2 | 0,35 € / 1,05 € |
| provisoire | Granite 4.2 8B | IBM | 52,1 | de 43,9 à 60,3 | 20 % | 1 | 0,05 € / 0,22 € |
| provisoire | Grok-2 (Aug 2024) | xAI | 52,1 | de 43,9 à 60,3 | 20 % | 1 | inconnu |
| provisoire | Mistral Large 2 (Nov 2024) | Mistral AI | 52,1 | de 44,7 à 59,5 | 40 % | 2 | 1,76 € / 5,27 € |
| provisoire | Nemotron 3 Nano 30B | NVIDIA | 52,1 | de 43,9 à 60,3 | 20 % | 1 | inconnu |
| provisoire | OLMo 3.1 32B Instruct | Allen Institute for AI | 52,1 | de 43,9 à 60,3 | 20 % | 1 | inconnu |
| provisoire | GPT-4o (May 2024) | OpenAI | 51,8 | de 46,7 à 57,0 | 40 % | 2 | 4,39 € / 13 € |
| provisoire | GPT-4o (Aug 2024) | OpenAI | 51,6 | de 46,3 à 56,9 | 40 % | 2 | 2,19 € / 8,78 € |
| provisoire | Magistral Small 1.2 | Mistral AI | 51,3 | de 45,4 à 57,2 | 40 % | 2 | 0,44 € / 1,32 € |
| provisoire | Mistral Large 2 (Jul 2024) | Mistral AI | 51,3 | de 45,7 à 56,9 | 40 % | 2 | 1,76 € / 5,27 € |
| provisoire | Qwen2.5-72B | Alibaba | 51,3 | de 45,4 à 57,2 | 40 % | 2 | 2,46 € / 7,37 € |
| provisoire | Solar Pro 3 | Upstage | 51,1 | de 50,2 à 51,9 | 20 % | 1 | 0,13 € / 0,53 € |
| provisoire | qwen3-4b-instruct-2507 | Alibaba | 50,8 | de 45,3 à 56,3 | 20 % | 1 | 0,18 € / 0,18 € |
| provisoire | Claude 3 Opus | Anthropic | 50,5 | de 45,3 à 55,8 | 40 % | 2 | 13 € / 66 € |
| provisoire | DeepSeek-V2.5 (Dec 2024) | DeepSeek | 50,3 | de 42,0 à 58,5 | 20 % | 1 | inconnu |
| provisoire | DeepSeek-R1-Distill-Qwen-14B | DeepSeek | 49,7 | de 44,1 à 55,4 | 20 % | 1 | 0,13 € / 0,38 € |
| provisoire | Gemini 1.5 Flash (Sep 2024) | Google DeepMind | 49,7 | de 43,6 à 55,9 | 40 % | 2 | inconnu |
| provisoire | Gemini 1.5 Pro (May 2024) | Google DeepMind | 49,7 | de 44,4 à 55,1 | 40 % | 2 | inconnu |
| provisoire | GPT-4 Turbo (Apr 2024) | OpenAI | 49,7 | de 44,2 à 55,3 | 40 % | 2 | inconnu |
| provisoire | Tulu 3 (Tülu 3) 70B | Allen Institute for AI | 49,7 | de 44,1 à 55,4 | 20 % | 1 | inconnu |
| provisoire | glm-4.7-flash_none | Z.ai (Zhipu AI) | 49,5 | de 43,8 à 55,2 | 20 % | 1 | inconnu |
| provisoire | Qwen2.5-32B | Alibaba | 49,5 | de 43,8 à 55,2 | 20 % | 1 | 0,61 € / 2,46 € |
| provisoire | Mistral Small 3 | Mistral AI | 48,7 | de 40,9 à 56,5 | 40 % | 2 | 0,04 € / 0,07 € |
| provisoire | Magistral Medium 1.1 | Mistral AI | 47,9 | de 39,7 à 56,1 | 20 % | 1 | 1,73 € / 4,34 € |
| provisoire | WizardLM-2 8x22B | Microsoft | 47,7 | de 41,6 à 53,7 | 20 % | 1 | 0,54 € / 0,54 € |
| provisoire | Llama 3.1-70B | Meta AI | 47,4 | de 41,3 à 53,5 | 40 % | 2 | 0,63 € / 0,63 € |
| provisoire | Llama-3.1-Nemotron-70B-Instruct | NVIDIA | 47,4 | de 39,2 à 55,6 | 20 % | 1 | 0,52 € / 0,52 € |
| provisoire | DeepSeek-V2.5 (Sep 2024) | DeepSeek | 47,1 | de 38,9 à 55,4 | 20 % | 1 | inconnu |
| provisoire | Gemma 3n E4B | Google DeepMind | 46,9 | de 38,7 à 55,1 | 20 % | 1 | 0,05 € / 0,10 € |
| provisoire | GPT-4 Turbo (Nov 2023) | OpenAI | 46,9 | de 41,1 à 52,7 | 40 % | 2 | 8,78 € / 26 € |
| provisoire | Grok-2 mini | xAI | 46,9 | de 38,7 à 55,1 | 20 % | 1 | inconnu |
| provisoire | OLMo 3 32B Think | Ai2 | 46,4 | de 38,1 à 54,6 | 20 % | 1 | 0,13 € / 0,43 € |
| provisoire | Qwen-Turbo | Alibaba | 46,1 | de 39,8 à 52,4 | 20 % | 1 | 0,04 € / 0,18 € |
| provisoire | Llama 3.2 90B | Meta AI | 45,6 | de 39,2 à 52,0 | 20 % | 1 | 0,31 € / 0,35 € |
| provisoire | Claude 3 Sonnet | Anthropic | 44,3 | de 37,8 à 50,7 | 40 % | 2 | inconnu |
| provisoire | Gemini 1.5 Flash (May 2024) | Google DeepMind | 44,0 | de 37,5 à 50,5 | 40 % | 2 | inconnu |
| provisoire | Llama 3-70B | Meta AI | 43,5 | de 36,2 à 50,7 | 40 % | 2 | inconnu |
| provisoire | Qwen2-72B | Alibaba | 43,5 | de 36,5 à 50,5 | 40 % | 2 | inconnu |
| provisoire | GPT-4o mini | OpenAI | 43,2 | de 36,6 à 49,8 | 40 % | 2 | 0,13 € / 0,53 € |
| provisoire | Amazon Nova Pro | Amazon | 42,2 | de 34,0 à 50,4 | 40 % | 2 | 0,70 € / 2,81 € |
| provisoire | Hermes 2 Theta Llama-3 70B | Nous Research | 41,9 | de 34,8 à 49,1 | 20 % | 1 | inconnu |
| provisoire | Gemma 2 27B | Google DeepMind | 40,9 | de 34,0 à 47,7 | 40 % | 2 | 0,57 € / 0,57 € |
| provisoire | Qwen2.5-Coder-32B-Instruct | Alibaba | 40,9 | de 32,7 à 49,1 | 20 % | 1 | 0,25 € / 0,76 € |
| provisoire | GPT-4 (Mar 2023) | OpenAI | 40,6 | de 33,7 à 47,6 | 40 % | 2 | 26 € / 53 € |
| provisoire | Mistral Large | Mistral AI | 40,6 | de 32,6 à 48,6 | 40 % | 2 | 0,44 € / 1,32 € |
| provisoire | Nemotron-4 340B | NVIDIA | 39,8 | de 31,7 à 48,0 | 20 % | 1 | inconnu |
| provisoire | Qwen3-1.7B | Alibaba | 39,8 | de 32,3 à 47,4 | 20 % | 1 | inconnu |
| provisoire | Claude 3 Haiku | Anthropic | 39,3 | de 32,1 à 46,5 | 40 % | 2 | 0,22 € / 1,10 € |
| provisoire | GLM-4 (0520) | Z.ai (Zhipu AI) | 39,3 | de 31,1 à 47,5 | 20 % | 1 | inconnu |
| provisoire | Claude 2 | Anthropic | 39,0 | de 31,4 à 46,7 | 20 % | 1 | inconnu |
| provisoire | Qwen2.5-7B | Alibaba | 38,5 | de 30,8 à 46,3 | 20 % | 1 | 0,15 € / 0,61 € |
| provisoire | Amazon Nova Lite | Amazon | 38,3 | de 30,0 à 46,5 | 40 % | 2 | 0,05 € / 0,21 € |
| provisoire | Eurus-2-7B-PRIME | Tsinghua University | 37,5 | de 29,6 à 45,4 | 20 % | 1 | inconnu |
| provisoire | GPT-4 (Jun 2023) | OpenAI | 36,7 | de 28,6 à 44,8 | 40 % | 2 | inconnu |
| provisoire | Claude 2.1 | Anthropic | 36,4 | de 28,4 à 44,5 | 20 % | 1 | inconnu |
| provisoire | Gemini 1.0 Pro | Google DeepMind | 36,4 | de 28,4 à 44,5 | 20 % | 1 | inconnu |
| provisoire | Gemini 1.5 Flash 8B | Google DeepMind | 36,4 | de 28,8 à 44,0 | 40 % | 2 | inconnu |
| provisoire | Amazon Nova Micro | Amazon | 35,1 | de 27,0 à 43,2 | 20 % | 1 | 0,03 € / 0,12 € |
| provisoire | Mixtral 8x22B | Mistral AI | 35,1 | de 27,0 à 43,2 | 40 % | 2 | 1,76 € / 5,27 € |
| provisoire | Gemma 3 4B | Google DeepMind | 33,0 | de 22,6 à 43,5 | 40 % | 2 | 0,04 € / 0,09 € |
| provisoire | Mistral Medium | Mistral AI | 33,0 | de 25,0 à 41,1 | 20 % | 1 | 1,32 € / 6,58 € |
| provisoire | Mistral NeMo | Mistral AI | 33,0 | de 24,8 à 41,3 | 20 % | 1 | 0,13 € / 0,13 € |
| provisoire | Gemma 2 9B | Google DeepMind | 32,3 | de 23,4 à 41,1 | 40 % | 2 | inconnu |
| provisoire | Qwen1.5-110B | Alibaba | 32,3 | de 24,2 à 40,3 | 20 % | 1 | inconnu |
| provisoire | Yi-1.5-34B | 01.AI | 32,3 | de 24,1 à 40,4 | 40 % | 2 | inconnu |
| provisoire | Qwen1.5-72B | Alibaba | 31,0 | de 22,4 à 39,5 | 40 % | 2 | inconnu |
| provisoire | granite-4.0-micro | IBM | 30,4 | de 22,4 à 38,5 | 20 % | 1 | 0,01 € / 0,10 € |
| provisoire | Ministral 8B | Mistral AI | 30,4 | de 21,5 à 39,4 | 40 % | 2 | 0,09 € / 0,09 € |
| provisoire | Mixtral 8x7B | Mistral AI | 28,9 | de 20,6 à 37,2 | 40 % | 2 | 0,61 € / 0,61 € |
| provisoire | Qwen1.5-32B | Alibaba | 28,6 | de 20,4 à 36,8 | 40 % | 2 | inconnu |
| provisoire | DBRX | Databricks | 28,3 | de 19,4 à 37,3 | 40 % | 2 | inconnu |
| provisoire | deepseek-r1-0528-qwen3-8b | DeepSeek | 28,3 | de 20,6 à 36,0 | 20 % | 1 | 0,05 € / 0,08 € |
| provisoire | Ministral 3B | Mistral AI | 28,3 | de 20,6 à 36,0 | 20 % | 1 | 0,04 € / 0,04 € |
| provisoire | GPT-3.5 Turbo (Jan 2024) | OpenAI | 27,3 | de 19,0 à 35,6 | 40 % | 2 | 0,44 € / 1,32 € |
| provisoire | Llama 3-8B | Meta AI | 26,8 | de 18,0 à 35,5 | 40 % | 2 | inconnu |
| provisoire | GPT-3.5 Turbo (Nov 2023) | OpenAI | 26,5 | de 18,0 à 35,0 | 40 % | 2 | 0,88 € / 1,76 € |
| provisoire | phi-3-medium 14B | Microsoft | 26,0 | de 18,9 à 33,1 | 20 % | 1 | inconnu |
| provisoire | Qwen1.5-14B | Alibaba | 24,7 | de 16,9 à 32,4 | 20 % | 1 | inconnu |
| provisoire | granite-4.0-1b | IBM | 20,5 | de 15,1 à 25,9 | 20 % | 1 | inconnu |
| provisoire | granite-4.0-350m | IBM | 20,5 | de 15,1 à 25,9 | 20 % | 1 | inconnu |
| provisoire | phi-3-small 7.4B | Microsoft | 20,2 | de 12,7 à 27,8 | 20 % | 1 | inconnu |
| provisoire | DeepSeek LLM 67B | DeepSeek | 18,7 | de 13,9 à 23,5 | 20 % | 1 | inconnu |
| provisoire | Yi-34B | 01.AI | 18,7 | de 10,8 à 26,5 | 40 % | 2 | inconnu |
| provisoire | Llama 3.2 3B | Meta AI | 18,4 | de 11,0 à 25,8 | 20 % | 1 | 0,04 € / 0,29 € |
| provisoire | Llama 2-70B | Meta AI | 16,6 | de 9,0 à 24,2 | 40 % | 2 | inconnu |
| provisoire | QwQ-32B-Preview | Alibaba | 16,6 | de 9,3 à 23,9 | 20 % | 1 | inconnu |
| provisoire | Qwen1.5-7B | Alibaba | 13,7 | de 6,7 à 20,8 | 20 % | 1 | inconnu |
| provisoire | phi-3-mini 3.8B | Microsoft | 12,2 | de 5,2 à 19,1 | 20 % | 1 | inconnu |
| provisoire | Mistral 7B v0.2 | Mistral AI | 11,9 | de 5,0 à 18,8 | 20 % | 1 | 0,14 € / 0,19 € |
| provisoire | Gemma 7B | Google DeepMind | 10,9 | de 4,0 à 17,7 | 20 % | 1 | inconnu |
| provisoire | Mistral 7B v0.3 | Mistral AI | 10,1 | de 7,5 à 12,6 | 20 % | 1 | 0,22 € / 0,22 € |
| provisoire | Llama 2-13B | Meta AI | 9,8 | de 3,1 à 16,6 | 20 % | 1 | inconnu |
| provisoire | Llama 2-7B | Meta AI | 4,3 | de 0,0 à 10,6 | 20 % | 1 | inconnu |
| provisoire | DeepSeek-R1-Distill-Qwen-1.5B | DeepSeek | 0,0 | de 0,0 à 0,0 | 20 % | 1 | inconnu |
| provisoire | Gemma 3 1B | Google DeepMind | 0,0 | de 0,0 à 0,0 | 20 % | 1 | inconnu |
| provisoire | Llama 3.2 1B | Meta AI | 0,0 | de 0,0 à 3,6 | 40 % | 2 | 0,02 € / 0,18 € |
| provisoire | Phi-4 Mini | Microsoft | 0,0 | de 0,0 à 0,0 | 20 % | 1 | 0,07 € / 0,26 € |

## Ce qui compose le score

Le score Sciences agrège 5 benchmarks, chacun pesé ci-dessous. La tâche pèse 10 % du score général.

- Arena, questions d'experts : 20 % du score de la tâche (actif)
- CritPt : 20 % du score de la tâche (actif)
- GPQA Diamond : 20 % du score de la tâche (actif)
- Humanity's Last Exam : 20 % du score de la tâche (actif)
- Surface Evolver Bench : 20 % du score de la tâche (saturé)

Source : Quelle IA, édition du 28 septembre 2026. https://quelleia.com
