Aller au contenu
EN 4 QUESTIONSTrouver mon modèle

FrançaisFiche benchmark · Ministère de la Culture, beta.gouv.fr · comparia.beta.gouv.fr

compar:IA

L'arène publique du ministère de la Culture : deux modèles anonymes répondent, l'internaute vote, presque toujours en français.

À quoi il sert

Sur Quelle IA, compar:IA sert à noter la tâche Français : c'est l'un de ses 10 benchmarks. Il départage surtout les modèles dont le score IA approche 74.

Comment c'est noté

Un score Elo calculé sur les duels, avec sa marge. Environ neuf questions sur dix sont en français.

Pour le calcul, un Elo devient une probabilité de victoire face à un niveau de référence, ici 1 025 Elo. Un écart de 100 points donne environ 64 % de chances de l'emporter.

Ce qu'il ne dit pas

Moins de duels par modèle que sur Arena, donc des marges larges. Peu de modèles très récents.

Comment lire le score

114 modèles mesurés · 117 mesures

En tête : Claude Opus 5.5, 1 210,0 Elo

Chaque trait est un modèle, placé à son meilleur score. Un modèle qui obtient 1 025 Elo a un score IA d'environ 74. Le meilleur, Claude Opus 5.5, atteint 1 210,0 Elo.

Ce que ce benchmark attend à chaque niveau

Score IA 51niveau de GPT-4o (Nov 2024)
974 Elo
Score IA 76niveau de Claude Sonnet 4.5
1 032 Elo
Score IA 100niveau de Claude Opus 5.5
1 086 Elo

Valeurs lues sur la courbe d'étalonnage du benchmark, qui relie le score publié au score IA. La démarche

Son poids chez nous

2,5 %du score général. compar:IA porte 25 % de la tâche Français (10 % du score général), que se partagent 10 benchmarks.

En couleur, la tâche Français dans le score général. En noir, la part de compar:IA.

Le classement du benchmark

Scores relevés sur arene.comparia.beta.gouv.fr · édition du
RangModèleRéflexionScore publiéSuggèreSource
1Claude Opus 5.5AnthropicNon précisée1 210,0 Elo154,2
2Muse Spark 1.2Meta AINon précisée1 180,0 Elo141,1
3Muse Spark 1.3Meta AINon précisée1 150,0 Elo128,0
4GPT-5.3 ChatOpenAINon précisée1 135,0 Elo121,5
5Gemini 3 FlashGoogle DeepMindNon précisée1 125,0 Elo117,1
6GPT-5.5OpenAINon précisée1 110,0 Elo110,6
6Gemini 3.6 FlashGoogle DeepMindNon précisée1 110,0 Elo110,6
8Gemini 3.1 Flash-LiteGoogle DeepMindNon précisée1 109,0 Elo110,2
9GPT-5.6 TerraOpenAINon précisée1 105,0 Elo108,4
10GPT-5.4OpenAINon précisée1 099,0 Elo105,8
114 modèles mesurés, chacun à sa meilleure configuration. « Suggère » : le score IA que cette seule mesure indique.Voir les 114 →Replier le classement ↑
11Gemma 4 31B ITGoogle DeepMind · poids ouvertsNon précisée1 098,0 Elo105,4
12GPT-5.6 LunaOpenAINon précisée1 095,0 Elo104,0
13Qwen3-MaxAlibabaMaximale1 094,0 Elo103,6
14Gemini 3.5 Flash-LiteGoogle DeepMindNon précisée1 091,0 Elo102,3
15MiMo-V2.6-ProXiaomi · poids ouvertsNon précisée1 088,0 Elo101,0
16GPT-5.2OpenAINon précisée1 087,0 Elo100,6
17Gemini 3.8 FlashGoogle DeepMindNon précisée1 086,0 Elo100,1
17MiniMax-M3MiniMax · poids ouvertsNon précisée1 086,0 Elo100,1
19Gemini 3.7 FlashGoogle DeepMindNon précisée1 085,0 Elo99,7
20Gemini 2.5 Flash (Jun 2025)Google DeepMindNon précisée1 084,0 Elo99,2
21GPT-5.1OpenAINon précisée1 082,0 Elo98,4
21GPT-5.4 MiniOpenAINon précisée1 082,0 Elo98,4
21DeepSeek-V3 (Mar 2025)DeepSeek · poids ouvertsNon précisée1 082,0 Elo98,4
24Gemma 4 26B A4BGoogle DeepMind · poids ouvertsNon précisée1 081,0 Elo97,9
25Claude Sonnet 4.5AnthropicNon précisée1 078,0 Elo96,6
26Magistral Medium 1.1Mistral AIMoyenne1 072,0 Elo94,0
27GPT-6 SolOpenAINon précisée1 066,0 Elo91,4
27Gemini 3.1 ProGoogle DeepMindNon précisée1 066,0 Elo91,4
27Gemini 3.5 FlashGoogle DeepMindNon précisée1 066,0 Elo91,4
27Kimi K2 ThinkingMoonshot · poids ouverts · 2 configurationsNon précisée1 066,0 Elo91,4
31qwen3-coder-nextAlibaba · poids ouvertsNon précisée1 065,0 Elo91,0
32Claude Sonnet 5AnthropicNon précisée1 063,0 Elo90,1
32Claude Sonnet 4AnthropicNon précisée1 063,0 Elo90,1
34Mistral Medium 3.5Mistral AI · poids ouvertsNon précisée1 062,0 Elo89,6
35Gemma 3 27BGoogle DeepMind · poids ouvertsNon précisée1 061,0 Elo89,2
36Mistral Medium 3.1Mistral AIMoyenne1 057,0 Elo87,5
36GPT-4.1 miniOpenAINon précisée1 057,0 Elo87,5
38DeepSeek-V3.2DeepSeek · poids ouvertsNon précisée1 055,0 Elo86,6
39Gemini 3 ProGoogle DeepMindNon précisée1 052,0 Elo85,3
39GPT-5.4 NanoOpenAINon précisée1 052,0 Elo85,3
39DeepSeek-V3.1DeepSeek · poids ouvertsNon précisée1 052,0 Elo85,3
42DeepSeek-V4-ProDeepSeek · poids ouvertsNon précisée1 048,0 Elo83,5
42Trinity Large ThinkingArcee AI · poids ouverts · 2 configurationsNon précisée1 048,0 Elo83,5
44Qwen3-Coder-480B-A35BAlibaba · poids ouvertsNon précisée1 047,0 Elo83,1
45DeepSeek-V4-FlashDeepSeek · poids ouvertsNon précisée1 046,0 Elo82,7
46Mistral Large 3Mistral AI · poids ouvertsNon précisée1 044,0 Elo81,8
47GPT-5 miniOpenAINon précisée1 041,0 Elo80,5
48o4-miniOpenAINon précisée1 039,0 Elo79,6
49Cohere Command ACohere · poids ouvertsNon précisée1 038,0 Elo79,2
50Mistral Small 3.2Mistral AI · poids ouvertsNon précisée1 032,0 Elo76,6
50Gemma 3 12BGoogle DeepMind · poids ouvertsNon précisée1 032,0 Elo76,6
52GPT-5OpenAINon précisée1 030,0 Elo75,7
52Llama 4 MaverickMeta AI · poids ouvertsNon précisée1 030,0 Elo75,7
54GLM-4.5Z.ai (Zhipu AI) · poids ouvertsNon précisée1 028,0 Elo74,8
55Kimi K3Moonshot · poids ouvertsNon précisée1 026,0 Elo73,9
55Kimi K2.6Moonshot · poids ouvertsNon précisée1 026,0 Elo73,9
57Mistral Small 4Mistral AI · poids ouvertsNon précisée1 025,0 Elo73,5
58MiMo-V2.6-FlashXiaomi · poids ouvertsNon précisée1 024,0 Elo73,1
59InklingThinking Machines · poids ouvertsNon précisée1 014,0 Elo68,7
60Kimi K2.5Moonshot · poids ouvertsNon précisée1 010,0 Elo66,9
60Magistral Small 1.0Mistral AI · poids ouvertsNon précisée1 010,0 Elo66,9
62Llama 4 ScoutMeta AI · poids ouvertsNon précisée1 007,0 Elo65,6
63GLM-4.6Z.ai (Zhipu AI) · poids ouvertsNon précisée1 006,0 Elo65,2
64GLM-5.3Z.ai (Zhipu AI) · poids ouvertsNon précisée1 004,0 Elo64,3
64Gemma 3 4BGoogle DeepMind · poids ouvertsNon précisée1 004,0 Elo64,3
66LFM 2 8B A1BLiquid AI · poids ouvertsNon précisée1 003,0 Elo63,9
67DeepSeek-R1 (May 2025)DeepSeek · poids ouverts · 2 configurationsNon précisée999,0 Elo62,1
68Gemma 3n E4BGoogle DeepMind · poids ouvertsNon précisée998,0 Elo61,7
69GLM-5.2Z.ai (Zhipu AI) · poids ouvertsNon précisée997,0 Elo61,3
70Qwen3.8 2.4T A95BAlibaba · poids ouvertsNon précisée994,0 Elo60,0
70GPT-4.1 nanoOpenAINon précisée994,0 Elo60,0
72MiniMax-M2.5MiniMax · poids ouvertsNon précisée993,0 Elo59,5
72Llama-3.1-Nemotron-70B-InstructNVIDIA · poids ouvertsNon précisée993,0 Elo59,5
74MiniMax-M2MiniMax · poids ouvertsNon précisée991,0 Elo58,7
75Hermes 4 70BNous Research · poids ouvertsNon précisée989,0 Elo57,8
75Mistral SabaMistral AINon précisée989,0 Elo57,8
77Qwen 3.6 PlusAlibabaNon précisée984,0 Elo55,6
77Llama 3.3 70BMeta AI · poids ouvertsNon précisée984,0 Elo55,6
79Aya Expanse 32BCohere · poids ouvertsNon précisée981,0 Elo54,3
80Apertus v1.5 70BSwiss AI (EPFL, ETH Zurich) · poids ouvertsNon précisée979,0 Elo53,4
81GLM-5.3-FlashZ.ai (Zhipu AI) · poids ouvertsNon précisée977,0 Elo52,5
81Apertus 70B InstructSwiss AI (EPFL, ETH Zurich) · poids ouvertsNon précisée977,0 Elo52,5
83Qwen3-32BAlibaba · poids ouvertsNon précisée976,0 Elo52,1
84GPT-6 LunaOpenAINon précisée974,0 Elo51,2
85LFM2 24B A2BLiquid AI · poids ouvertsNon précisée971,0 Elo49,9
86EuroLLM 22B InstructEuroLLM · poids ouvertsNon précisée967,0 Elo48,2
87Qwen3.7-PlusAlibabaNon précisée965,0 Elo47,3
87MiniMax-M2.7MiniMax · poids ouvertsNon précisée965,0 Elo47,3
89DeepSeek V4.1 FlashDeepSeek · poids ouvertsNon précisée964,0 Elo46,9
90Muse Glimmer 30BMeta AI · poids ouvertsNon précisée962,0 Elo46,0
91Qwen 3.8 27BAlibaba · poids ouvertsNon précisée961,0 Elo45,6
91Inkling-SmallThinking Machines · poids ouvertsNon précisée961,0 Elo45,6
93gpt-oss-120bOpenAI · poids ouvertsNon précisée960,0 Elo45,1
94Llama 3.1-405BMeta AI · poids ouvertsNon précisée957,0 Elo43,8
95Qwen3.7-MaxAlibabaMaximale955,0 Elo42,9
96Granite 4.1 8BIBM · poids ouvertsNon précisée951,0 Elo41,2
97GLM-5.1Z.ai (Zhipu AI) · poids ouvertsNon précisée950,0 Elo40,8
98Qwen3.8 FlashAlibaba · poids ouvertsNon précisée948,0 Elo39,9
99GPT-5 nanoOpenAINon précisée947,0 Elo39,5
100Qwen3.5 397B-A17BAlibaba · poids ouvertsNon précisée945,0 Elo38,6
101GLM-5Z.ai (Zhipu AI) · poids ouvertsNon précisée937,0 Elo35,1
101Nemotron 3 Super 120BNVIDIA · poids ouvertsNon précisée937,0 Elo35,1
103Apertus 1.5 8BSwiss AI (EPFL, ETH Zurich) · poids ouvertsNon précisée932,0 Elo32,9
104Phi-4Microsoft · poids ouvertsNon précisée930,0 Elo32,0
105GLM-4.7Z.ai (Zhipu AI) · poids ouvertsNon précisée917,0 Elo26,4
106DeepSeek-R1-Distill-Llama-70BDeepSeek · poids ouvertsNon précisée914,0 Elo25,1
107gpt-oss-20bOpenAI · poids ouvertsNon précisée910,0 Elo23,3
107Qwen3-30B-A3BAlibaba · poids ouvertsNon précisée910,0 Elo23,3
109Llama 3.1-8BMeta AI · poids ouvertsNon précisée908,0 Elo22,4
110Nemotron 3.5 LightningNVIDIA · poids ouvertsNon précisée904,0 Elo20,7
111Qwen3.5-35B-A3BAlibaba · poids ouvertsNon précisée902,0 Elo19,8
112Qwen3-8BAlibaba · poids ouvertsNon précisée864,0 Elo3,2
113QwQ-32BAlibaba · poids ouvertsNon précisée857,0 Elo0,2
114OLMo 3 32B ThinkAi2 · poids ouvertsNon précisée755,0 Elo-44,3

En bref

Que mesure compar:IA ?
L'arène publique du ministère de la Culture : deux modèles anonymes répondent, l'internaute vote, presque toujours en français. Sur Quelle IA, il est rangé dans la tâche Français.
Comment compar:IA est-il noté ?
Un score Elo calculé sur les duels, avec sa marge. Environ neuf questions sur dix sont en français. Un modèle qui obtient 1 025 Elo a un score IA d'environ 74.
Qui est en tête sur compar:IA ?
Claude Opus 5.5 (Anthropic) est en tête de compar:IA avec 1 210,0 Elo, dans l'édition du 28 septembre 2026. Suivent Muse Spark 1.2 (1 180,0 Elo) et Muse Spark 1.3 (1 150,0 Elo). 114 modèles y sont mesurés.
Quelles sont les limites de compar:IA ?
Moins de duels par modèle que sur Arena, donc des marges larges. Peu de modèles très récents. Au 28 septembre 2026, le benchmark est actif.
Combien pèse compar:IA dans le score IA ?
compar:IA compte pour 2,5 % du score général, dans l'édition du 28 septembre 2026. Il porte 25 % de la tâche Français (10 % du score général), que se partagent 10 benchmarks.
Qui maintient compar:IA ?
Ministère de la Culture, beta.gouv.fr. Sa page de référence : comparia.beta.gouv.fr.

Les autres benchmarks de la tâche Français

Tous les benchmarks →Comment le score IA est calculé →