# Classement Français des modèles de langage

> Dans l'édition du 28 septembre 2026, Gemini 3.7 Flash (Google DeepMind) est premier en français avec un score Français de 98,8, ex æquo avec 32 autres modèles dont GPT-6 Astra et Gemini 3.6 Flash. La marge du premier va de 88,3 à 109,4 ; deux modèles dont les marges se recouvrent sont ex æquo. 183 modèles sont classés, 122 autres ont un score provisoire.

Page : https://quelleia.com/classement/francais/
Édition : 2026-W40, 28 septembre 2026
Question : Quel modèle maîtrise le mieux le français ?

## Comment lire ce classement

Le score Français résume les résultats d'un modèle sur les benchmarks de français où il a été mesuré. L'échelle est celle du score général : 100 correspond au meilleur modèle au lancement du site, 50 à GPT-4o de fin 2024. La barre indique la marge d'erreur : deux modèles dont les barres se chevauchent sont ex æquo.

## Modèles classés (183)

| Rang | Modèle | Éditeur | Score | Marge à 90 % | Couverture | Mesures | Prix entrée / sortie (€ par million de jetons) |
| --- | --- | --- | --- | --- | --- | --- | --- |
| 1 | Gemini 3.7 Flash | Google DeepMind | 98,8 | de 88,3 à 109,4 | 100 % | 10 | 1,50 € / 7,50 € |
| 2 | GPT-6 Astra | OpenAI | 98,3 | de 85,2 à 111,4 | 75 % | 9 | 8,78 € / 44 € |
| 3 | Gemini 3.6 Flash | Google DeepMind | 97,8 | de 87,1 à 108,4 | 100 % | 10 | 1,30 € / 6,50 € |
| 4 | Gemini 3 Flash | Google DeepMind | 96,2 | de 84,8 à 107,6 | 100 % | 10 | 0,43 € / 2,60 € |
| 5 | Muse Spark 1.3 | Meta AI | 96,0 | de 86,4 à 105,5 | 50 % | 2 | 1,25 € / 4,25 € |
| 6 | GPT-5.6 Sol | OpenAI | 94,1 | de 83,0 à 105,2 | 75 % | 9 | 3,51 € / 18 € |
| 7 | GPT-5.5 | OpenAI | 91,5 | de 82,0 à 101,0 | 50 % | 2 | 4,34 € / 26 € |
| 8 | Gemini 3.8 Flash | Google DeepMind | 90,5 | de 81,9 à 99,0 | 50 % | 2 | 1,50 € / 7,50 € |
| 9 | GPT-6 Sol | OpenAI | 89,9 | de 81,0 à 98,9 | 50 % | 2 | 2 € / 10 € |
| 10 | GPT-5.6 Terra | OpenAI | 89,4 | de 81,2 à 97,7 | 100 % | 10 | 2,17 € / 13 € |
| 11 | Gemini 3 Pro | Google DeepMind | 88,6 | de 77,8 à 99,5 | 88 % | 8 | 1,73 € / 10 € |
| 12 | GPT-5.6 Luna | OpenAI | 87,9 | de 79,5 à 96,3 | 100 % | 10 | 0,87 € / 5,20 € |
| 13 | Kimi K3 | Moonshot | 87,6 | de 79,0 à 96,2 | 50 % | 2 | 2,60 € / 13 € |
| 14 | Gemini 3.1 Pro | Google DeepMind | 87,1 | de 78,8 à 95,3 | 50 % | 2 | 2 € / 12 € |
| 15 | Claude Sonnet 5 | Anthropic | 86,8 | de 78,3 à 95,3 | 50 % | 2 | 1,73 € / 8,67 € |
| 16 | GLM-5.3 | Z.ai (Zhipu AI) | 86,6 | de 76,7 à 96,4 | 50 % | 2 | 1,40 € / 4,40 € |
| 17 | GLM-5.3-Flash | Z.ai (Zhipu AI) | 86,3 | de 76,7 à 95,9 | 100 % | 10 | 0,15 € / 0,50 € |
| 18 | Gemini 3.5 Flash | Google DeepMind | 86,0 | de 77,7 à 94,4 | 50 % | 2 | 1,30 € / 7,80 € |
| 19 | GPT-5.3 Chat | OpenAI | 85,0 | de 74,0 à 96,0 | 50 % | 2 | 1,52 € / 12 € |
| 20 | GPT-5.4 Mini | OpenAI | 85,0 | de 77,1 à 92,8 | 100 % | 10 | 0,65 € / 3,90 € |
| 21 | GPT-5.4 | OpenAI | 83,7 | de 73,9 à 93,5 | 100 % | 10 | 2,17 € / 13 € |
| 22 | DeepSeek-V4-Pro | DeepSeek | 82,9 | de 74,7 à 91,1 | 50 % | 2 | 0,38 € / 0,75 € |
| 23 | GLM-5.2 | Z.ai (Zhipu AI) | 81,9 | de 72,5 à 91,2 | 50 % | 2 | 0,98 € / 3,08 € |
| 24 | GPT-5.1 | OpenAI | 81,9 | de 73,0 à 90,7 | 50 % | 2 | 1,08 € / 8,67 € |
| 25 | Gemini 3.1 Flash-Lite | Google DeepMind | 81,6 | de 71,9 à 91,3 | 100 % | 10 | 0,22 € / 1,30 € |
| 26 | Kimi K2.6 | Moonshot | 81,6 | de 73,3 à 89,9 | 50 % | 2 | 0,59 € / 2,96 € |
| 27 | Claude Sonnet 4.6 | Anthropic | 81,3 | de 72,1 à 90,6 | 75 % | 9 | 2,63 € / 13 € |
| 28 | Claude Sonnet 4.5 | Anthropic | 81,1 | de 73,3 à 88,9 | 100 % | 10 | 2,60 € / 13 € |
| 29 | GPT-6 Luna | OpenAI | 81,1 | de 71,8 à 90,3 | 50 % | 2 | 0,10 € / 0,50 € |
| 30 | MiniMax-M3 | MiniMax | 81,1 | de 71,7 à 90,5 | 50 % | 2 | 0,24 € / 0,97 € |
| 31 | DeepSeek-V4-Flash | DeepSeek | 80,6 | de 72,1 à 89,0 | 50 % | 2 | 0,09 € / 0,17 € |
| 32 | Gemma 4 31B IT | Google DeepMind | 78,7 | de 68,2 à 89,3 | 100 % | 10 | 0,10 € / 0,31 € |
| 33 | GLM-5.1 | Z.ai (Zhipu AI) | 78,5 | de 66,7 à 90,3 | 50 % | 2 | 0,85 € / 2,67 € |
| 34 | DeepSeek V4.1 Flash | DeepSeek | 77,9 | de 69,2 à 86,7 | 50 % | 2 | 0,15 € / 0,60 € |
| 35 | Inkling | Thinking Machines | 77,2 | de 68,9 à 85,5 | 50 % | 2 | 0,95 € / 4,05 € |
| 36 | Kimi K2.5 | Moonshot | 77,2 | de 68,6 à 85,7 | 50 % | 2 | 0,35 € / 1,65 € |
| 37 | Qwen3-Max | Alibaba | 76,9 | de 67,8 à 86,0 | 50 % | 2 | 0,68 € / 3,38 € |
| 38 | GPT-5.2 | OpenAI | 76,6 | de 66,0 à 87,3 | 100 % | 10 | 1,52 € / 12 € |
| 39 | Gemma 4 26B A4B | Google DeepMind | 76,6 | de 67,1 à 86,2 | 100 % | 10 | 0,05 € / 0,29 € |
| 40 | Qwen 3.6 Plus | Alibaba | 76,6 | de 67,4 à 85,9 | 50 % | 2 | 0,28 € / 1,69 € |
| 41 | Qwen3.7-Plus | Alibaba | 76,6 | de 65,6 à 87,6 | 50 % | 2 | 0,28 € / 1,11 € |
| 42 | Kimi K2 Thinking | Moonshot | 76,4 | de 67,6 à 85,1 | 50 % | 2 | 0,52 € / 2,17 € |
| 43 | Grok 4.1 Fast | xAI | 76,1 | de 67,8 à 84,4 | 75 % | 9 | 0,17 € / 0,43 € |
| 44 | DeepSeek-V3.2 | DeepSeek | 75,9 | de 67,2 à 84,5 | 50 % | 2 | 0,20 € / 0,30 € |
| 45 | Gemini 2.5 Pro (Jun 2025) | Google DeepMind | 75,6 | de 63,4 à 87,7 | 56 % | 6 | 1,10 € / 8,78 € |
| 46 | Gemini 3.5 Flash-Lite | Google DeepMind | 75,6 | de 64,7 à 86,5 | 100 % | 10 | 0,26 € / 2,17 € |
| 47 | DeepSeek-V3.1 | DeepSeek | 74,8 | de 66,5 à 83,1 | 50 % | 2 | 0,18 € / 0,69 € |
| 48 | GPT-5 | OpenAI | 74,8 | de 65,1 à 84,5 | 81 % | 7 | 1,08 € / 8,67 € |
| 49 | Qwen3-235B-A22B-Instruct (Jul 2025) | Alibaba | 74,5 | de 63,2 à 85,9 | 56 % | 6 | 0,19 € / 0,77 € |
| 50 | Qwen3.5 397B-A17B | Alibaba | 74,3 | de 62,8 à 85,8 | 50 % | 2 | 0,34 € / 2,03 € |
| 51 | GLM-5 | Z.ai (Zhipu AI) | 74,0 | de 61,6 à 86,5 | 50 % | 2 | 0,52 € / 1,66 € |
| 52 | Mistral Medium 3.5 | Mistral AI | 73,8 | de 65,2 à 82,4 | 50 % | 2 | 1,30 € / 6,50 € |
| 53 | Qwen 3.8 27B | Alibaba | 73,8 | de 63,0 à 84,5 | 100 % | 10 | 0,35 € / 2,75 € |
| 54 | Qwen3.6 27B | Alibaba | 73,8 | de 61,7 à 85,8 | 50 % | 8 | 0,53 € / 3,16 € |
| 55 | Claude Sonnet 4 | Anthropic | 73,0 | de 64,1 à 81,9 | 50 % | 2 | 2,60 € / 13 € |
| 56 | Gemini 2.5 Flash (Jun 2025) | Google DeepMind | 72,7 | de 61,3 à 84,2 | 81 % | 7 | 0,26 € / 2,17 € |
| 57 | o3 | OpenAI | 72,7 | de 59,4 à 86,1 | 56 % | 6 | 1,76 € / 7,02 € |
| 58 | GLM-4.6 | Z.ai (Zhipu AI) | 72,2 | de 63,6 à 80,8 | 50 % | 2 | 0,37 € / 1,51 € |
| 59 | GPT-5 mini | OpenAI | 72,2 | de 63,1 à 81,3 | 100 % | 10 | 0,22 € / 1,73 € |
| 60 | Inkling-Small | Thinking Machines | 71,9 | de 63,3 à 80,6 | 50 % | 2 | 0,45 € / 1,20 € |
| 61 | GPT-4.1 | OpenAI | 71,4 | de 62,4 à 80,5 | 75 % | 9 | 1,76 € / 7,02 € |
| 62 | MiniMax-M2.7 | MiniMax | 71,2 | de 61,9 à 80,4 | 50 % | 2 | 0,24 € / 1,04 € |
| 63 | Mistral Medium 3.1 | Mistral AI | 71,2 | de 62,8 à 79,5 | 50 % | 2 | 0,35 € / 1,73 € |
| 64 | Qwen3-Coder-480B-A35B | Alibaba | 71,2 | de 62,8 à 79,6 | 50 % | 2 | 0,19 € / 1,56 € |
| 65 | Mistral Large 3 | Mistral AI | 70,4 | de 62,2 à 78,6 | 50 % | 2 | 0,43 € / 1,30 € |
| 66 | GLM-4.7 | Z.ai (Zhipu AI) | 70,1 | de 58,0 à 82,2 | 50 % | 2 | 0,35 € / 1,52 € |
| 67 | Trinity Large Thinking | Arcee AI | 69,8 | de 61,5 à 78,2 | 50 % | 2 | 0,19 € / 0,74 € |
| 68 | GLM-4.5 | Z.ai (Zhipu AI) | 69,6 | de 61,2 à 78,0 | 50 % | 2 | 0,52 € / 1,91 € |
| 69 | Grok 3 | xAI | 69,6 | de 57,0 à 82,2 | 56 % | 6 | 2,63 € / 13 € |
| 70 | Qwen3-235B-A22B-Thinking (Jul 2025) | Alibaba | 69,6 | de 52,6 à 86,6 | 31 % | 5 | 0,26 € / 2,55 € |
| 71 | MiniMax-M2.5 | MiniMax | 69,1 | de 60,8 à 77,3 | 50 % | 2 | 0,13 € / 1 € |
| 72 | Voxtral Small | Mistral AI | 69,1 | de 57,8 à 80,4 | 38 % | 6 | inconnu |
| 73 | DeepSeek-V3 (Mar 2025) | DeepSeek | 68,8 | de 59,7 à 77,9 | 50 % | 2 | 0,17 € / 0,67 € |
| 74 | DeepSeek-R1 (May 2025) | DeepSeek | 68,0 | de 59,7 à 76,3 | 50 % | 2 | 0,43 € / 1,86 € |
| 75 | GPT-5.4 Nano | OpenAI | 67,8 | de 57,9 à 77,6 | 100 % | 10 | 0,17 € / 1,08 € |
| 76 | chutes/Qwen3-Next-80B-A3B-Instruct | Alibaba | 67,5 | de 56,8 à 78,2 | 56 % | 6 | 0,44 € / 1,76 € |
| 77 | o4-mini | OpenAI | 67,2 | de 56,6 à 77,9 | 81 % | 7 | 0,95 € / 3,82 € |
| 78 | Qwen3.5-35B-A3B | Alibaba | 67,0 | de 57,3 à 76,6 | 100 % | 10 | 0,12 € / 0,87 € |
| 79 | Gemini 2.5 Flash-Lite (Jun 2025) | Google DeepMind | 64,9 | de 55,5 à 74,3 | 75 % | 9 | 0,09 € / 0,35 € |
| 80 | Ministral 3 14B | Mistral AI | 64,6 | de 51,5 à 77,8 | 50 % | 8 | inconnu |
| 81 | Mistral Small 3.2 | Mistral AI | 64,6 | de 56,2 à 73,0 | 100 % | 10 | 0,07 € / 0,17 € |
| 82 | GPT-4.1 mini | OpenAI | 64,4 | de 52,5 à 76,3 | 81 % | 7 | 0,35 € / 1,39 € |
| 83 | Claude 3.7 Sonnet | Anthropic | 63,8 | de 53,7 à 74,0 | 56 % | 6 | 2,63 € / 13 € |
| 84 | Claude Haiku 4.5 | Anthropic | 63,8 | de 54,5 à 73,2 | 75 % | 9 | 0,88 € / 4,39 € |
| 85 | Magistral Small 1.2 | Mistral AI | 63,8 | de 53,6 à 74,1 | 31 % | 5 | 0,44 € / 1,32 € |
| 86 | Qwen3-235B-A22B | Alibaba | 62,5 | de 51,8 à 73,3 | 56 % | 6 | 0,61 € / 2,46 € |
| 87 | Gemma 3 27B | Google DeepMind | 61,5 | de 53,0 à 70,0 | 100 % | 10 | 0,07 € / 0,14 € |
| 88 | Cohere Command A | Cohere | 61,2 | de 52,7 à 69,8 | 50 % | 2 | 2,17 € / 8,67 € |
| 89 | Ministral 3 8B | Mistral AI | 61,2 | de 49,2 à 73,3 | 50 % | 8 | inconnu |
| 90 | GLM-4.5-Air | Z.ai (Zhipu AI) | 60,2 | de 48,6 à 71,8 | 56 % | 6 | 0,18 € / 0,97 € |
| 91 | MiniMax-M2 | MiniMax | 59,4 | de 50,5 à 68,3 | 50 % | 2 | 0,22 € / 0,87 € |
| 92 | Qwen3.5-9B | Alibaba | 59,4 | de 50,3 à 68,5 | 50 % | 8 | 0,10 € / 0,15 € |
| 93 | Magistral Small 1.0 | Mistral AI | 58,9 | de 48,9 à 68,9 | 56 % | 6 | 0,43 € / 1,30 € |
| 94 | Nemotron 3 Nano 30B | NVIDIA | 58,9 | de 49,9 à 67,9 | 75 % | 9 | inconnu |
| 95 | Qwen3-Next-80B-A3B Thinking | Alibaba | 58,9 | de 46,0 à 71,7 | 56 % | 6 | inconnu |
| 96 | gpt-oss-120b | OpenAI | 58,9 | de 50,8 à 67,0 | 100 % | 10 | 0,03 € / 0,16 € |
| 97 | Mistral Small 3.1 | Mistral AI | 58,6 | de 46,3 à 70,9 | 75 % | 9 | 0,09 € / 0,26 € |
| 98 | Nemotron 3 Super 120B | NVIDIA | 58,6 | de 48,6 à 68,7 | 50 % | 2 | 0,08 € / 0,39 € |
| 99 | Qwen3-14B | Alibaba | 58,6 | de 51,4 à 65,9 | 50 % | 8 | 0,31 € / 1,23 € |
| 100 | Aya Expanse 32B | Cohere | 58,1 | de 47,1 à 69,1 | 56 % | 6 | 0,69 € / 0,69 € |
| 101 | Qwen2.5-72B | Alibaba | 58,1 | de 47,9 à 68,3 | 75 % | 9 | 2,46 € / 7,37 € |
| 102 | Llama 3.3 70B | Meta AI | 57,3 | de 48,3 à 66,4 | 100 % | 10 | 0,09 € / 0,28 € |
| 103 | Qwen3-32B | Alibaba | 57,3 | de 48,6 à 66,1 | 75 % | 9 | 0,07 € / 0,24 € |
| 104 | o3-mini | OpenAI | 57,3 | de 46,2 à 68,4 | 56 % | 6 | 0,97 € / 3,86 € |
| 105 | Llama 3.1-405B | Meta AI | 57,1 | de 45,5 à 68,7 | 81 % | 7 | 2,38 € / 2,60 € |
| 106 | glm-4.7-flash | Z.ai (Zhipu AI) | 56,8 | de 47,8 à 65,8 | 75 % | 9 | inconnu |
| 107 | Nemotron 3.5 Lightning | NVIDIA | 56,5 | de 43,6 à 69,5 | 50 % | 2 | 0,08 € / 0,20 € |
| 108 | Llama-3.1-Nemotron-70B-Instruct | NVIDIA | 56,0 | de 45,0 à 67,1 | 56 % | 6 | 0,52 € / 0,52 € |
| 109 | Gemma 3 12B | Google DeepMind | 55,2 | de 46,7 à 63,7 | 75 % | 9 | 0,04 € / 0,13 € |
| 110 | GPT-5 nano | OpenAI | 55,0 | de 46,0 à 64,0 | 75 % | 9 | 0,04 € / 0,35 € |
| 111 | Llama 4 Scout | Meta AI | 55,0 | de 44,0 à 65,9 | 81 % | 7 | 0,09 € / 0,26 € |
| 112 | Grok-3 mini | xAI | 54,7 | de 44,1 à 65,3 | 56 % | 6 | 0,26 € / 0,43 € |
| 113 | Magistral Medium 1.1 | Mistral AI | 54,7 | de 43,0 à 66,4 | 50 % | 2 | 1,73 € / 4,34 € |
| 114 | Gemma 3n E4B | Google DeepMind | 54,4 | de 44,5 à 64,4 | 88 % | 8 | 0,05 € / 0,10 € |
| 115 | Llama 3.1-70B | Meta AI | 53,9 | de 42,4 à 65,4 | 75 % | 9 | 0,63 € / 0,63 € |
| 116 | Qwen3.5-4B | Alibaba | 53,9 | de 43,2 à 64,6 | 50 % | 8 | 0,04 € / 0,06 € |
| 117 | Qwen3-30B-A3B | Alibaba | 53,4 | de 41,9 à 64,9 | 81 % | 7 | 0,10 € / 0,43 € |
| 118 | Llama 4 Maverick | Meta AI | 53,1 | de 41,7 à 64,6 | 50 % | 2 | 0,13 € / 0,52 € |
| 119 | Qwen3-4B | Alibaba | 52,4 | de 44,4 à 60,3 | 50 % | 8 | 0,03 € / 0,03 € |
| 120 | EuroLLM 22B Instruct | EuroLLM | 51,3 | de 42,0 à 60,7 | 75 % | 9 | 0,17 € / 0,35 € |
| 121 | QwQ-32B | Alibaba | 51,1 | de 37,0 à 65,1 | 81 % | 7 | 0,13 € / 0,35 € |
| 122 | OLMo 3.1 32B Instruct | Allen Institute for AI | 50,8 | de 38,7 à 62,9 | 62 % | 7 | inconnu |
| 123 | Grok-2 (Dec 2024) | xAI | 50,0 | de 38,0 à 62,0 | 31 % | 5 | inconnu |
| 124 | Apertus v1.5 70B | Swiss AI (EPFL, ETH Zurich) | 49,7 | de 37,9 à 61,6 | 75 % | 9 | 0,82 € / 2,92 € |
| 125 | gpt-oss-20b | OpenAI | 49,0 | de 38,8 à 59,2 | 75 % | 9 | 0,03 € / 0,12 € |
| 126 | qwen3-4b-instruct-2507 | Alibaba | 48,4 | de 39,5 à 57,3 | 31 % | 5 | 0,18 € / 0,18 € |
| 127 | Gemma 2 27B | Google DeepMind | 47,1 | de 35,7 à 58,6 | 56 % | 6 | 0,57 € / 0,57 € |
| 128 | Llama 3-70B | Meta AI | 47,1 | de 36,1 à 58,2 | 56 % | 6 | inconnu |
| 129 | Mistral Small 3 | Mistral AI | 47,1 | de 29,4 à 64,9 | 56 % | 6 | 0,04 € / 0,07 € |
| 130 | Reka Flash 3 | Reka AI | 46,6 | de 34,3 à 58,9 | 31 % | 5 | 0,09 € / 0,18 € |
| 131 | Ministral 3 3B | Mistral AI | 45,6 | de 34,5 à 56,6 | 50 % | 8 | inconnu |
| 132 | DeepSeek-R1-Distill-Qwen-32B | DeepSeek | 45,3 | de 34,9 à 55,7 | 31 % | 5 | 0,25 € / 0,76 € |
| 133 | DeepSeek-R1-Distill-Llama-70B | DeepSeek | 44,5 | de 33,7 à 55,4 | 56 % | 6 | 0,61 € / 0,69 € |
| 134 | Qwen3-8B | Alibaba | 43,5 | de 31,7 à 55,3 | 75 % | 9 | 0,04 € / 0,35 € |
| 135 | Apertus 70B Instruct | Swiss AI (EPFL, ETH Zurich) | 43,2 | de 32,9 à 53,6 | 56 % | 6 | 0,52 € / 0,69 € |
| 136 | c4ai-command-r-08-2024 | Cohere | 41,9 | de 32,2 à 51,7 | 31 % | 5 | inconnu |
| 137 | Phi-4 | Microsoft | 41,4 | de 30,2 à 52,6 | 81 % | 7 | 0,06 € / 0,12 € |
| 138 | Yi-1.5-34B | 01.AI | 39,3 | de 22,4 à 56,2 | 56 % | 6 | inconnu |
| 139 | Mistral NeMo | Mistral AI | 39,0 | de 30,6 à 47,5 | 31 % | 5 | 0,13 € / 0,13 € |
| 140 | granite-4.0-micro | IBM | 39,0 | de 24,9 à 53,2 | 38 % | 6 | 0,01 € / 0,10 € |
| 141 | Gemma 2 9B | Google DeepMind | 38,5 | de 26,1 à 51,0 | 56 % | 6 | inconnu |
| 142 | Luciole 23B Instruct 1.1 | OpenLLM-France | 38,0 | de 26,4 à 49,6 | 50 % | 8 | inconnu |
| 143 | OLMo 3 32B Think | Ai2 | 36,7 | de 21,9 à 51,5 | 50 % | 2 | 0,13 € / 0,43 € |
| 144 | DeepSeek-R1-Distill-Qwen-14B | DeepSeek | 36,4 | de 27,1 à 45,8 | 31 % | 5 | 0,13 € / 0,38 € |
| 145 | Ministral 8B | Mistral AI | 35,4 | de 15,4 à 55,4 | 31 % | 5 | 0,09 € / 0,09 € |
| 146 | Gemma 3 4B | Google DeepMind | 35,1 | de 20,7 à 49,5 | 75 % | 9 | 0,04 € / 0,09 € |
| 147 | EuroLLM 9B Instruct (2512) | EuroLLM | 34,9 | de 24,2 à 45,5 | 50 % | 8 | inconnu |
| 148 | Mixtral 8x7B | Mistral AI | 34,1 | de 23,8 à 44,4 | 56 % | 6 | 0,61 € / 0,61 € |
| 149 | deepseek-r1-0528-qwen3-8b | DeepSeek | 33,3 | de 22,9 à 43,7 | 31 % | 5 | 0,05 € / 0,08 € |
| 150 | nvidia-nemotron-nano-9b-v2 | NVIDIA | 31,2 | de 21,4 à 41,0 | 31 % | 5 | 0,05 € / 0,20 € |
| 151 | Llama 3.1-8B | Meta AI | 30,2 | de 20,6 à 39,7 | 100 % | 10 | 0,02 € / 0,03 € |
| 152 | Qwen1.5-14B | Alibaba | 28,3 | de 16,9 à 39,7 | 56 % | 6 | inconnu |
| 153 | Llama 3-8B | Meta AI | 26,8 | de 16,8 à 36,8 | 56 % | 6 | inconnu |
| 154 | Qwen3.5-2B | Alibaba | 24,2 | de 10,5 à 37,8 | 50 % | 8 | inconnu |
| 155 | OLMo 2 Furious 13B | Allen Institute for AI | 22,1 | de 13,5 à 30,6 | 31 % | 5 | inconnu |
| 156 | Apertus 8B Instruct | Swiss AI (EPFL | 21,8 | de 11,7 à 31,9 | 31 % | 5 | inconnu |
| 157 | Qwen3-1.7B | Alibaba | 21,3 | de 7,7 à 34,8 | 50 % | 8 | inconnu |
| 158 | Llama 2-70B | Meta AI | 21,0 | de 9,7 à 32,4 | 56 % | 6 | inconnu |
| 159 | EuroLLM 9B Instruct | EuroLLM | 20,5 | de 8,9 à 32,1 | 50 % | 8 | inconnu |
| 160 | Luciole 8B Instruct 1.1 | OpenLLM-France | 16,1 | de 5,6 à 26,6 | 50 % | 8 | inconnu |
| 161 | Falcon 2 11B | Technology Innovation Institute | 11,9 | de 1,7 à 22,1 | 31 % | 5 | inconnu |
| 162 | Gemma 7B | Google DeepMind | 8,8 | de 0,0 à 19,1 | 56 % | 6 | inconnu |
| 163 | Llama 3.2 3B | Meta AI | 8,2 | de 0,0 à 17,9 | 50 % | 8 | 0,04 € / 0,29 € |
| 164 | Mistral 7B v0.3 | Mistral AI | 8,2 | de 0,0 à 21,2 | 31 % | 5 | 0,22 € / 0,22 € |
| 165 | Qwen2.5-1.5B | Alibaba | 7,7 | de 0,0 à 18,5 | 31 % | 5 | inconnu |
| 166 | Mistral 7B v0.1 | Mistral AI | 6,7 | de 0,0 à 20,2 | 31 % | 5 | inconnu |
| 167 | ALIA-40b | Barcelona Supercomputing Center | 6,2 | de 0,0 à 21,4 | 31 % | 5 | inconnu |
| 168 | Mistral 7B v0.2 | Mistral AI | 4,6 | de 0,0 à 14,7 | 56 % | 6 | 0,14 € / 0,19 € |
| 169 | Llama 2-13B | Meta AI | 3,0 | de 0,0 à 15,8 | 56 % | 6 | inconnu |
| 170 | DeepSeek-R1-Distill-Llama-8B | DeepSeek | 0,0 | de 0,0 à 0,0 | 31 % | 5 | inconnu |
| 171 | DeepSeek-R1-Distill-Qwen-1.5B | DeepSeek | 0,0 | de 0,0 à 0,0 | 31 % | 5 | inconnu |
| 172 | DeepSeek-R1-Distill-Qwen-7B | DeepSeek | 0,0 | de 0,0 à 0,0 | 31 % | 5 | 0,06 € / 0,13 € |
| 173 | Gemma 2B | Google DeepMind | 0,0 | de 0,0 à 0,0 | 31 % | 5 | inconnu |
| 174 | Gemma 3 1B | Google DeepMind | 0,0 | de 0,0 à 0,0 | 50 % | 8 | inconnu |
| 175 | Gemma 3 270M | Google DeepMind | 0,0 | de 0,0 à 0,0 | 50 % | 8 | inconnu |
| 176 | Llama 2-7B | Meta AI | 0,0 | de 0,0 à 4,6 | 50 % | 5 | inconnu |
| 177 | Llama 3.2 1B | Meta AI | 0,0 | de 0,0 à 0,0 | 50 % | 8 | 0,02 € / 0,18 € |
| 178 | Phi-2 | Microsoft | 0,0 | de 0,0 à 0,0 | 31 % | 5 | inconnu |
| 179 | Phi-4 Mini | Microsoft | 0,0 | de 0,0 à 0,0 | 31 % | 5 | 0,07 € / 0,26 € |
| 180 | Phi-4 Reasoning | Microsoft | 0,0 | de 0,0 à 0,0 | 31 % | 5 | 0,11 € / 0,44 € |
| 181 | Qwen3-0.6B | Alibaba | 0,0 | de 0,0 à 0,0 | 50 % | 8 | inconnu |
| 182 | Qwen3.5-0.8B | Alibaba | 0,0 | de 0,0 à 0,0 | 50 % | 8 | inconnu |
| 183 | Salamandra 7B Instruct | Barcelona Supercomputing Center | 0,0 | de 0,0 à 0,0 | 50 % | 8 | inconnu |

## Scores provisoires (122)

Ces modèles n'ont pas encore assez de mesures pour recevoir un rang. Ils sont listés du score le plus haut au plus bas.

| Rang | Modèle | Éditeur | Score | Marge à 90 % | Couverture | Mesures | Prix entrée / sortie (€ par million de jetons) |
| --- | --- | --- | --- | --- | --- | --- | --- |
| provisoire | Claude Opus 5.5 | Anthropic | 108,5 | de 102,3 à 114,7 | 25 % | 1 | 4 € / 20 € |
| provisoire | Muse Spark 1.2 | Meta AI | 96,2 | de 89,9 à 102,5 | 25 % | 1 | 1,25 € / 4,25 € |
| provisoire | Claude Fable 5.1 | Anthropic | 94,6 | de 86,5 à 102,8 | 25 % | 1 | 8,78 € / 44 € |
| provisoire | Claude Fable 5 | Anthropic | 93,3 | de 85,2 à 101,5 | 25 % | 1 | 8,78 € / 44 € |
| provisoire | Claude Opus 5 | Anthropic | 92,3 | de 84,1 à 100,5 | 25 % | 1 | 4,39 € / 22 € |
| provisoire | MiMo-V2.6-Pro | Xiaomi | 92,3 | de 85,9 à 98,7 | 25 % | 1 | 0,44 € / 0,87 € |
| provisoire | Claude Opus 4.7 | Anthropic | 89,7 | de 81,5 à 97,9 | 25 % | 1 | 4,39 € / 22 € |
| provisoire | Claude Opus 4.8 | Anthropic | 89,7 | de 81,5 à 97,9 | 25 % | 1 | 4,39 € / 22 € |
| provisoire | Qwen3.8 Max (0902) | Alibaba | 88,4 | de 80,2 à 96,6 | 25 % | 1 | 1,76 € / 5,27 € |
| provisoire | Claude Opus 4.6 | Anthropic | 88,1 | de 79,9 à 96,3 | 25 % | 1 | 4,39 € / 22 € |
| provisoire | Muse Spark | Meta AI | 87,6 | de 79,4 à 95,8 | 25 % | 1 | inconnu |
| provisoire | Muse Spark 1.1 | Meta AI | 87,6 | de 79,4 à 95,8 | 25 % | 1 | 1,10 € / 3,73 € |
| provisoire | Grok 4.6 | xAI | 86,8 | de 78,6 à 95,0 | 25 % | 1 | 1,76 € / 5,27 € |
| provisoire | Grok 4.20 Beta 1 | xAI | 85,8 | de 77,6 à 94,0 | 25 % | 1 | inconnu |
| provisoire | Grok 4.5 | xAI | 85,0 | de 76,8 à 93,2 | 25 % | 1 | 1,76 € / 5,27 € |
| provisoire | Grok 4.20 Multi Agent Beta | xAI | 84,7 | de 76,5 à 92,9 | 25 % | 1 | 1,10 € / 2,19 € |
| provisoire | ERNIE 5.1 | Baidu | 83,9 | de 75,7 à 92,2 | 25 % | 1 | 0,66 € / 2,63 € |
| provisoire | GPT-5.2 Chat | OpenAI | 83,9 | de 75,7 à 92,2 | 25 % | 1 | 1,54 € / 12 € |
| provisoire | Qwen3.5 Max Preview | Alibaba | 83,7 | de 75,5 à 91,9 | 25 % | 1 | inconnu |
| provisoire | Claude Opus 4.5 | Anthropic | 83,4 | de 75,2 à 91,6 | 25 % | 1 | 4,39 € / 22 € |
| provisoire | Hy3 | Tencent | 83,4 | de 75,2 à 91,6 | 25 % | 1 | 0,15 € / 0,50 € |
| provisoire | MiMo-V2.5-Pro | Xiaomi | 83,4 | de 75,2 à 91,6 | 25 % | 1 | 0,38 € / 0,76 € |
| provisoire | Grok 4.20 Beta (0309) | xAI | 82,6 | de 74,4 à 90,9 | 25 % | 1 | 1,76 € / 5,27 € |
| provisoire | Seed 2.0 Pro | ByteDance | 82,6 | de 74,4 à 90,9 | 25 % | 1 | 0,44 € / 2,63 € |
| provisoire | MiMo-V2-Pro | Xiaomi | 81,3 | de 73,1 à 89,6 | 25 % | 1 | 0,38 € / 0,76 € |
| provisoire | ERNIE 5.0 | Baidu | 81,1 | de 72,9 à 89,3 | 25 % | 1 | 0,74 € / 2,96 € |
| provisoire | GPT-5.5 Instant | OpenAI | 80,8 | de 72,6 à 89,0 | 25 % | 1 | 4,39 € / 26 € |
| provisoire | Qwen 3.6 Max (Preview) | Alibaba | 80,0 | de 71,8 à 88,2 | 25 % | 1 | 1,14 € / 6,85 € |
| provisoire | MiMo-V2.6-Flash | Xiaomi | 79,2 | de 72,8 à 85,7 | 25 % | 1 | 0,14 € / 0,28 € |
| provisoire | ChatGPT-4o Latest | OpenAI | 78,7 | de 70,5 à 86,9 | 25 % | 1 | 4,39 € / 18 € |
| provisoire | Grok 4.3 Beta | xAI | 78,5 | de 70,2 à 86,7 | 25 % | 1 | 1,08 € / 2,17 € |
| provisoire | MiMo-V2.5 | Xiaomi | 78,2 | de 70,0 à 86,4 | 25 % | 1 | 0,12 € / 0,25 € |
| provisoire | Claude Opus 4.1 | Anthropic | 77,4 | de 69,2 à 85,6 | 25 % | 1 | 13 € / 66 € |
| provisoire | Grok 4.1 | xAI | 77,2 | de 68,9 à 85,4 | 25 % | 1 | 1,76 € / 8,78 € |
| provisoire | Qwen3.7-Max | Alibaba | 76,9 | de 70,5 à 83,3 | 25 % | 1 | 1,08 € / 3,25 € |
| provisoire | MiMo V2 Omni | Xiaomi | 76,4 | de 68,2 à 84,6 | 25 % | 1 | 0,12 € / 0,25 € |
| provisoire | GLM-5V-Turbo | Z.ai (Zhipu AI) | 75,9 | de 67,6 à 84,1 | 25 % | 1 | 1,05 € / 3,51 € |
| provisoire | Nemotron 3 Ultra | NVIDIA | 75,9 | de 67,6 à 84,1 | 25 % | 1 | inconnu |
| provisoire | Qwen3.5-122B-A10B | Alibaba | 74,8 | de 66,6 à 83,0 | 25 % | 1 | 0,35 € / 2,81 € |
| provisoire | DeepSeek-V3.2-Exp | DeepSeek | 73,8 | de 65,5 à 82,0 | 25 % | 1 | 0,25 € / 0,38 € |
| provisoire | Grok 4 | xAI | 73,5 | de 65,3 à 81,7 | 25 % | 1 | 2,63 € / 13 € |
| provisoire | Hunyuan Hy3 Preview | Tencent | 73,5 | de 65,3 à 81,7 | 25 % | 1 | inconnu |
| provisoire | Kimi K2.5 Instant | Moonshot | 73,2 | de 65,0 à 81,5 | 25 % | 1 | inconnu |
| provisoire | Qwen3 VL 235B A22B Instruct | Alibaba | 73,0 | de 64,8 à 81,2 | 25 % | 1 | 0,47 € / 2,34 € |
| provisoire | Grok 4 Fast | xAI | 72,2 | de 64,0 à 80,4 | 25 % | 1 | 0,17 € / 0,43 € |
| provisoire | Claude Opus 4 | Anthropic | 71,7 | de 63,5 à 79,9 | 25 % | 1 | 13 € / 66 € |
| provisoire | Qwen3.5-27B | Alibaba | 71,2 | de 62,9 à 79,4 | 25 % | 1 | 0,26 € / 2,11 € |
| provisoire | Gemini 2.5 Flash (Sep 2025) | Google DeepMind | 70,9 | de 62,7 à 79,1 | 25 % | 1 | 0,26 € / 2,19 € |
| provisoire | Kimi K2 (Sep 2025) | Moonshot | 70,6 | de 62,4 à 78,9 | 25 % | 1 | 0,55 € / 2,22 € |
| provisoire | MiMo-V2-Flash | Xiaomi | 70,6 | de 62,4 à 78,9 | 25 % | 1 | 0,12 € / 0,25 € |
| provisoire | LongCat Flash Chat | Meituan | 70,1 | de 61,9 à 78,3 | 25 % | 1 | inconnu |
| provisoire | qwen3-coder-next | Alibaba | 70,1 | de 63,7 à 76,5 | 25 % | 1 | 0,10 € / 0,69 € |
| provisoire | Kimi K2 (Jul 2025) | Moonshot | 69,8 | de 61,6 à 78,1 | 25 % | 1 | 0,50 € / 2,02 € |
| provisoire | MiniMax-M2.1 | MiniMax | 69,8 | de 61,6 à 78,1 | 25 % | 1 | 0,26 € / 1,05 € |
| provisoire | Qwen 3.5 Flash (hosted 35B-A3B) | Alibaba | 69,8 | de 61,6 à 78,1 | 25 % | 1 | 0,09 € / 0,35 € |
| provisoire | GPT-4.5 | OpenAI | 69,6 | de 61,4 à 77,8 | 25 % | 1 | inconnu |
| provisoire | Solar Pro 4 | Upstage | 69,1 | de 60,8 à 77,3 | 25 % | 1 | 0,26 € / 1,05 € |
| provisoire | Muse Glimmer 30B | Meta AI | 68,5 | de 62,1 à 75,0 | 25 % | 1 | 0,30 € / 1,10 € |
| provisoire | Step 3.5 Flash | StepFun | 68,0 | de 59,8 à 76,2 | 25 % | 1 | 0,08 € / 0,26 € |
| provisoire | o1 | OpenAI | 65,7 | de 57,4 à 73,9 | 25 % | 1 | 13 € / 53 € |
| provisoire | Qwen3-30B-A3B-Instruct (Jul 2025) | Alibaba | 65,7 | de 57,4 à 73,9 | 25 % | 1 | 0,26 € / 0,44 € |
| provisoire | Mistral Small 4 | Mistral AI | 65,1 | de 58,7 à 71,6 | 25 % | 1 | 0,13 € / 0,52 € |
| provisoire | Hunyuan-TurboS | Tencent | 64,6 | de 56,4 à 72,8 | 25 % | 1 | inconnu |
| provisoire | Gemini 2.5 Flash-Lite (Sep 2025) | Google DeepMind | 64,1 | de 55,9 à 72,3 | 25 % | 1 | 0,09 € / 0,35 € |
| provisoire | LFM 2 8B A1B | Liquid AI | 62,8 | de 56,4 à 69,2 | 25 % | 1 | 0,09 € / 0,17 € |
| provisoire | MiniMax-M1-80k | MiniMax | 62,5 | de 54,3 à 70,8 | 25 % | 1 | 0,12 € / 1,10 € |
| provisoire | Gemini 2.0 Flash (Feb 2025) | Google DeepMind | 62,3 | de 54,1 à 70,5 | 25 % | 1 | 0,09 € / 0,37 € |
| provisoire | Qwen2.5-Max | Alibaba | 62,3 | de 54,1 à 70,5 | 25 % | 1 | 1,40 € / 5,62 € |
| provisoire | Claude 3.5 Sonnet | Anthropic | 61,5 | de 52,3 à 70,7 | 31 % | 2 | 2,63 € / 13 € |
| provisoire | o1-preview | OpenAI | 61,5 | de 53,3 à 69,7 | 25 % | 1 | inconnu |
| provisoire | Mistral Medium 3 | Mistral AI | 61,0 | de 52,8 à 69,2 | 25 % | 1 | 0,35 € / 1,76 € |
| provisoire | Gemini 2.5 Flash (Apr 2025) | Google DeepMind | 60,7 | de 50,7 à 70,8 | 12 % | 2 | 0,13 € / 0,53 € |
| provisoire | Qwen3.8 2.4T A95B | Alibaba | 59,4 | de 53,0 à 65,8 | 25 % | 1 | 2 € / 6 € |
| provisoire | Hermes 4 70B | Nous Research | 57,6 | de 51,2 à 64,0 | 25 % | 1 | 0,11 € / 0,35 € |
| provisoire | Mistral Saba | Mistral AI | 57,6 | de 51,2 à 64,0 | 25 % | 1 | 0,17 € / 0,52 € |
| provisoire | Gemini 2.0 Flash-Lite | Google DeepMind | 57,1 | de 48,8 à 65,3 | 25 % | 1 | 0,07 € / 0,26 € |
| provisoire | GPT-4o (May 2024) | OpenAI | 55,0 | de 46,8 à 63,2 | 25 % | 1 | 4,39 € / 13 € |
| provisoire | Mistral Large 2 (Nov 2024) | Mistral AI | 54,7 | de 46,5 à 62,9 | 25 % | 1 | 1,76 € / 5,27 € |
| provisoire | Gemini 1.5 Pro (Sept 2024) | Google DeepMind | 54,4 | de 46,2 à 62,7 | 25 % | 1 | inconnu |
| provisoire | Grok-2 (Aug 2024) | xAI | 54,4 | de 46,2 à 62,7 | 25 % | 1 | inconnu |
| provisoire | o1-mini | OpenAI | 54,4 | de 46,2 à 62,7 | 25 % | 1 | 0,97 € / 3,86 € |
| provisoire | GPT-4.1 nano | OpenAI | 52,9 | de 46,5 à 59,2 | 25 % | 1 | 0,09 € / 0,35 € |
| provisoire | Yi-Lightning | 01.AI | 52,6 | de 44,4 à 60,8 | 25 % | 1 | inconnu |
| provisoire | LFM2 24B A2B | Liquid AI | 51,3 | de 45,0 à 57,7 | 25 % | 1 | 0,03 € / 0,10 € |
| provisoire | Claude 3 Opus | Anthropic | 51,1 | de 42,9 à 59,2 | 25 % | 1 | 13 € / 66 € |
| provisoire | GPT-4 Turbo (Apr 2024) | OpenAI | 50,8 | de 42,6 à 59,0 | 25 % | 1 | inconnu |
| provisoire | GPT-4 Turbo (Nov 2023) | OpenAI | 50,8 | de 42,6 à 59,0 | 25 % | 1 | 8,78 € / 26 € |
| provisoire | Granite 4.1 8B | IBM | 50,8 | de 44,5 à 57,1 | 25 % | 1 | 0,04 € / 0,09 € |
| provisoire | Gemini 1.5 Pro (May 2024) | Google DeepMind | 50,3 | de 42,1 à 58,5 | 25 % | 1 | inconnu |
| provisoire | GPT-4o (Aug 2024) | OpenAI | 50,3 | de 42,1 à 58,5 | 25 % | 1 | 2,19 € / 8,78 € |
| provisoire | Mistral Large 2 (Jul 2024) | Mistral AI | 50,0 | de 41,8 à 58,2 | 25 % | 1 | 1,76 € / 5,27 € |
| provisoire | Claude 3.5 Haiku | Anthropic | 48,7 | de 38,3 à 59,1 | 31 % | 2 | 0,70 € / 3,51 € |
| provisoire | GPT-4o mini | OpenAI | 48,7 | de 40,5 à 56,9 | 25 % | 1 | 0,13 € / 0,53 € |
| provisoire | DeepSeek-V2.5 (Sep 2024) | DeepSeek | 48,4 | de 40,3 à 56,6 | 25 % | 1 | inconnu |
| provisoire | Grok-2 mini | xAI | 47,9 | de 39,7 à 56,1 | 25 % | 1 | inconnu |
| provisoire | Amazon Nova Pro | Amazon | 44,3 | de 36,1 à 52,4 | 25 % | 1 | 0,70 € / 2,81 € |
| provisoire | Gemini 1.5 Flash (Sep 2024) | Google DeepMind | 44,3 | de 34,1 à 54,4 | 31 % | 2 | inconnu |
| provisoire | GPT-4 (Mar 2023) | OpenAI | 44,0 | de 35,9 à 52,1 | 25 % | 1 | 26 € / 53 € |
| provisoire | Claude 3 Sonnet | Anthropic | 43,2 | de 35,1 à 51,3 | 25 % | 1 | inconnu |
| provisoire | Gemini 1.5 Flash (May 2024) | Google DeepMind | 43,0 | de 34,8 à 51,1 | 25 % | 1 | inconnu |
| provisoire | Qwen3.8 Flash | Alibaba | 43,0 | de 36,7 à 49,2 | 25 % | 1 | 0,15 € / 0,47 € |
| provisoire | GPT-4 (Jun 2023) | OpenAI | 40,6 | de 32,5 à 48,7 | 25 % | 1 | inconnu |
| provisoire | Mistral Large | Mistral AI | 39,6 | de 31,5 à 47,6 | 25 % | 1 | 0,44 € / 1,32 € |
| provisoire | Nemotron-4 340B | NVIDIA | 38,3 | de 30,2 à 46,3 | 25 % | 1 | inconnu |
| provisoire | Claude 3 Haiku | Anthropic | 38,0 | de 30,0 à 46,0 | 25 % | 1 | 0,22 € / 1,10 € |
| provisoire | Gemini 1.5 Flash 8B | Google DeepMind | 38,0 | de 30,0 à 46,0 | 25 % | 1 | inconnu |
| provisoire | Apertus 1.5 8B | Swiss AI (EPFL, ETH Zurich) | 37,5 | de 31,3 à 43,7 | 25 % | 1 | 0,09 € / 0,17 € |
| provisoire | Qwen2-72B | Alibaba | 37,5 | de 29,4 à 45,5 | 25 % | 1 | inconnu |
| provisoire | Amazon Nova Lite | Amazon | 37,2 | de 29,2 à 45,2 | 25 % | 1 | 0,05 € / 0,21 € |
| provisoire | Amazon Nova Micro | Amazon | 35,9 | de 27,9 à 43,9 | 25 % | 1 | 0,03 € / 0,12 € |
| provisoire | Mixtral 8x22B | Mistral AI | 33,8 | de 25,9 à 41,8 | 25 % | 1 | 1,76 € / 5,27 € |
| provisoire | Mistral Medium | Mistral AI | 32,5 | de 24,6 à 40,4 | 25 % | 1 | 1,32 € / 6,58 € |
| provisoire | Qwen1.5-72B | Alibaba | 30,7 | de 22,8 à 38,6 | 25 % | 1 | inconnu |
| provisoire | Qwen1.5-110B | Alibaba | 30,2 | de 22,3 à 38,0 | 25 % | 1 | inconnu |
| provisoire | GPT-3.5 Turbo (Jan 2024) | OpenAI | 29,4 | de 21,6 à 37,2 | 25 % | 1 | 0,44 € / 1,32 € |
| provisoire | GPT-3.5 Turbo (Nov 2023) | OpenAI | 23,4 | de 15,8 à 31,0 | 25 % | 1 | 0,88 € / 1,76 € |
| provisoire | DBRX | Databricks | 23,1 | de 15,5 à 30,7 | 25 % | 1 | inconnu |
| provisoire | Qwen1.5-32B | Alibaba | 22,3 | de 14,8 à 29,9 | 25 % | 1 | inconnu |
| provisoire | phi-3-small 7.4B | Microsoft | 21,0 | de 13,5 à 28,5 | 25 % | 1 | inconnu |
| provisoire | Yi-34B | 01.AI | 17,6 | de 10,3 à 24,9 | 25 % | 1 | inconnu |
| provisoire | phi-3-mini 3.8B | Microsoft | 10,6 | de 3,7 à 17,5 | 25 % | 1 | inconnu |
| provisoire | Phi-4-Reasoning-plus | Microsoft | 0,0 | de 0,0 à 0,0 | 19 % | 3 | 0,11 € / 0,44 € |

## Ce qui compose le score

Le score Français agrège 10 benchmarks, chacun pesé ci-dessous. La tâche pèse 10 % du score général.

- Arena, questions en français : 25,1 % du score de la tâche (actif)
- compar:IA : 25,1 % du score de la tâche (actif)
- EuroEval, Allociné (sentiment) : 6,2 % du score de la tâche (saturé)
- EuroEval, ELTeC (noms propres) : 6,2 % du score de la tâche (actif)
- EuroEval, FQuAD (compréhension) : 6,2 % du score de la tâche (actif)
- EuroEval, HellaSwag (bon sens) : 6,2 % du score de la tâche (actif)
- EuroEval, INCLUDE (connaissances) : 6,2 % du score de la tâche (actif)
- EuroEval, MultiLoKo (connaissances locales) : 6,2 % du score de la tâche (actif)
- EuroEval, OrangeSum (résumé) : 6,2 % du score de la tâche (actif)
- EuroEval, ScaLA (grammaire) : 6,2 % du score de la tâche (actif)

Source : Quelle IA, édition du 28 septembre 2026. https://quelleia.com
