Aller au contenu
EN 4 QUESTIONSTrouver mon modèle

FrançaisFiche benchmark · EuroEval · euroeval.com

EuroEval, ELTeC (noms propres)

Le modèle repère les personnes, les lieux et les organisations dans un texte en français.

À quoi il sert

Sur Quelle IA, EuroEval, ELTeC (noms propres) sert à noter la tâche Français : c'est l'un de ses 10 benchmarks. Il départage surtout les modèles dont le score IA approche 13.

Comment c'est noté

Un score de 0 à 100 qui combine les entités trouvées et les entités manquées.

Ce qu'il ne dit pas

Tâche d'extraction, éloignée de l'usage courant d'un assistant.

Comment lire le score

134 modèles mesurés · 190 mesures

En tête : Qwen3.6 27B, 83,9 %

Chaque trait est un modèle, placé à son meilleur score. Un modèle qui obtient 50 % a un score IA d'environ 13. Le meilleur, Qwen3.6 27B, atteint 83,9 %. Le benchmark sera dit saturé quand un modèle atteindra 95 %.

Ce que ce benchmark attend à chaque niveau

Score IA 51niveau de GPT-4o (Nov 2024)
62 %
Score IA 76niveau de Claude Sonnet 4.5
69 %
Score IA 100niveau de Claude Opus 5.5
75 %

Valeurs lues sur la courbe d'étalonnage du benchmark, qui relie le score publié au score IA. La démarche

Son poids chez nous

0,62 %du score général. EuroEval, ELTeC (noms propres) porte 6 % de la tâche Français (10 % du score général), que se partagent 10 benchmarks.

En couleur, la tâche Français dans le score général. En noir, la part d'EuroEval, ELTeC (noms propres).

Le classement du benchmark

Scores relevés sur euroeval.com · édition du
RangModèleRéflexionScore publiéSuggèreSource
1Qwen3.6 27BAlibaba · poids ouvertsNon précisée83,9 %142,2
2Gemini 3.7 FlashGoogle DeepMindNon précisée83,1 %137,6
3GPT-6 AstraOpenAINon précisée82,5 %134,3
4Gemini 3.6 FlashGoogle DeepMindNon précisée82,5 %134,2
5Claude Sonnet 4.5Anthropic · 2 configurationsSans80,7 %124,7
6Qwen 3.8 27BAlibaba · poids ouvertsNon précisée80,5 %123,8
7GPT-5.6 SolOpenAINon précisée80,4 %123,3
8GPT-5.6 LunaOpenAINon précisée80 %121,2
9GPT-5.6 TerraOpenAINon précisée78,8 %115,6
10GLM-5.3-FlashZ.ai (Zhipu AI) · poids ouvertsNon précisée78,4 %113,9
134 modèles mesurés, chacun à sa meilleure configuration. « Suggère » : le score IA que cette seule mesure indique.Voir les 134 →Replier le classement ↑
11Gemma 4 31B ITGoogle DeepMind · poids ouverts · 2 configurationsNon précisée77,9 %111,6
12GPT-5.4 MiniOpenAI · 4 configurationsÉlevée77 %107,4
13Gemini 3 ProGoogle DeepMindNon précisée76,7 %106,1
14Qwen3-235B-A22B-Thinking (Jul 2025)AlibabaNon précisée75,4 %100,7
15Qwen3-Next-80B-A3B ThinkingAlibaba · poids ouvertsÉlevée75,3 %100,3
16GPT-5.4OpenAISans74,6 %97,3
17gpt-oss-120bOpenAI · poids ouvertsNon précisée73,7 %93,5
18Qwen3-4BAlibaba · poids ouverts · 3 configurationsÉlevée73,4 %92,4
19Nemotron 3 Nano 30BNVIDIA · poids ouverts · 3 configurationsNon précisée73,3 %92,1
20Grok 4.1 FastxAIÉlevée73,2 %91,5
21Claude Sonnet 4.6AnthropicNon précisée73,1 %91,4
22GPT-5 nanoOpenAI · 3 configurationsNon précisée72,8 %90,1
23Gemma 4 26B A4BGoogle DeepMind · poids ouverts · 2 configurationsNon précisée72,5 %89,0
24Reka Flash 3Reka AINon précisée71,3 %84,2
25QwQ-32BAlibaba · poids ouvertsNon précisée71,2 %84,0
26GPT-5OpenAI · 3 configurationsNon précisée71 %83,3
27Voxtral SmallMistral AI · poids ouvertsNon précisée71 %83,2
28Mistral Small 3.2Mistral AI · poids ouvertsNon précisée70,5 %81,1
29o3OpenAINon précisée70,2 %80,2
30Mistral Small 3Mistral AINon précisée70,2 %80,2
31Gemini 3 FlashGoogle DeepMind · 2 configurationsÉlevée70 %79,2
32Gemini 3.1 Flash-LiteGoogle DeepMindNon précisée69,9 %78,9
33Llama 3.1-70BMeta AI · poids ouverts · 2 configurationsNon précisée69,7 %78,2
34c4ai-command-r-08-2024Cohere · poids ouvertsNon précisée69,6 %77,8
35chutes/Qwen3-Next-80B-A3B-InstructAlibaba · poids ouvertsNon précisée69,3 %76,8
36Qwen3-14BAlibaba · poids ouverts · 2 configurationsNon précisée69,2 %76,5
37Magistral Small 1.0Mistral AI · poids ouvertsNon précisée69 %75,9
38o3-miniOpenAINon précisée68,9 %75,5
39Qwen3.5-35B-A3BAlibaba · poids ouvertsNon précisée68,8 %74,9
40Llama 3-70BMeta AI · poids ouverts · 2 configurationsNon précisée68,7 %74,5
41Claude Haiku 4.5AnthropicNon précisée68,5 %73,9
42Claude 3.7 SonnetAnthropic · 2 configurationsÉlevée68,4 %73,4
43Llama 3.3 70BMeta AI · poids ouvertsNon précisée68,2 %72,7
44o4-miniOpenAINon précisée67,9 %71,8
45Qwen3-235B-A22BAlibaba · poids ouvertsNon précisée67,8 %71,4
45Llama 3.1-405BMeta AI · poids ouverts · 3 configurationsNon précisée67,8 %71,4
47Gemini 2.5 Flash (Jun 2025)Google DeepMind · 2 configurationsSans67,5 %70,4
48GLM-4.5-AirZ.ai (Zhipu AI) · poids ouverts · 2 configurationsÉlevée67,5 %70,2
49gpt-oss-20bOpenAI · poids ouverts · 3 configurationsFaible66,6 %67,2
50Mistral Small 3.1Mistral AINon précisée66,6 %67,0
51Magistral Small 1.2Mistral AI · poids ouvertsNon précisée66,4 %66,5
52Grok 3xAINon précisée66,4 %66,4
53glm-4.7-flashZ.ai (Zhipu AI) · poids ouverts · 2 configurationsNon précisée65,7 %64,0
54deepseek-r1-0528-qwen3-8bDeepSeek · poids ouvertsNon précisée65,7 %64,0
55Gemma 3n E4BGoogle DeepMind · poids ouverts · 2 configurationsNon précisée65,3 %62,6
56Qwen3-235B-A22B-Instruct (Jul 2025)Alibaba · poids ouvertsNon précisée65,2 %62,4
57Gemma 3 12BGoogle DeepMind · poids ouvertsNon précisée65,1 %62,1
58Gemini 2.5 Flash-Lite (Jun 2025)Google DeepMind · 4 configurationsÉlevée64,8 %60,9
59Ministral 3 14BMistral AI · poids ouverts · 2 configurationsÉlevée64,6 %60,3
60Gemini 2.5 Pro (Jun 2025)Google DeepMindNon précisée64,6 %60,1
61GPT-5.2OpenAINon précisée63,9 %58,0
62Ministral 3 8BMistral AI · poids ouverts · 2 configurationsÉlevée63,9 %57,7
63nvidia-nemotron-nano-9b-v2NVIDIA · poids ouverts · 2 configurationsNon précisée63,7 %57,1
64DeepSeek-R1-Distill-Qwen-32BDeepSeekNon précisée63 %54,8
65Llama 4 ScoutMeta AI · poids ouvertsNon précisée63 %54,7
66Gemma 3 27BGoogle DeepMind · poids ouvertsNon précisée62,8 %54,2
67Qwen2.5-72BAlibaba · poids ouvertsNon précisée62,8 %54,1
68Phi-4Microsoft · poids ouvertsNon précisée61,6 %50,0
69Mistral NeMoMistral AI · poids ouvertsNon précisée60,8 %47,6
70Gemini 3.5 Flash-LiteGoogle DeepMindNon précisée60,5 %46,5
71GPT-5 miniOpenAI · 3 configurationsÉlevée60,4 %46,3
72Qwen3-30B-A3BAlibaba · poids ouvertsSans60,1 %45,4
72Aya Expanse 32BCohere · poids ouvertsNon précisée60,1 %45,4
74DeepSeek-R1-Distill-Llama-70BDeepSeek · poids ouvertsNon précisée60,1 %45,3
75GPT-4.1OpenAINon précisée59,2 %42,3
76Ministral 8BMistral AI · poids ouvertsNon précisée59,1 %41,9
77Llama 2-70BMeta AI · poids ouverts · 2 configurationsNon précisée58,9 %41,4
78Qwen3.5-9BAlibaba · poids ouvertsNon précisée58,9 %41,2
79Grok-3 minixAIÉlevée58,7 %40,8
80ALIA-40bBarcelona Supercomputing Center · poids ouvertsNon précisée58,4 %39,7
81Mixtral 8x7BMistral AI · poids ouverts · 2 configurationsNon précisée58 %38,3
82GPT-5.4 NanoOpenAI · 4 configurationsÉlevée57,9 %38,2
83Yi-1.5-34B01.AI · poids ouvertsNon précisée57,7 %37,6
84Llama 3.1-8BMeta AI · poids ouverts · 2 configurationsNon précisée57,6 %37,2
85Qwen3-8BAlibaba · poids ouverts · 2 configurationsSans56,1 %32,4
86Qwen1.5-14BAlibaba · poids ouverts · 2 configurationsNon précisée54,9 %28,7
87OLMo 3.1 32B InstructAllen Institute for AI · poids ouvertsNon précisée54,1 %26,3
88GPT-4.1 miniOpenAINon précisée53,8 %25,1
89Llama-3.1-Nemotron-70B-InstructNVIDIA · poids ouvertsNon précisée53,7 %24,8
90Qwen3-32BAlibaba · poids ouvertsSans53,6 %24,6
91Apertus v1.5 70BSwiss AI (EPFL, ETH Zurich) · poids ouvertsNon précisée53,1 %23,2
92Gemma 3 4BGoogle DeepMind · poids ouvertsNon précisée53,1 %22,9
93Grok-2 (Dec 2024)xAINon précisée52,8 %22,1
94Llama 3-8BMeta AI · poids ouverts · 2 configurationsNon précisée52,2 %20,2
95Mistral 7B v0.3Mistral AI · poids ouvertsNon précisée51 %16,6
96qwen3-4b-instruct-2507AlibabaNon précisée50,6 %15,3
97Llama 2-13BMeta AI · poids ouverts · 2 configurationsNon précisée50,5 %14,8
98Mistral 7B v0.1Mistral AI · poids ouverts · 2 configurationsNon précisée50,3 %14,2
99Falcon 2 11BTechnology Innovation Institute · poids ouvertsNon précisée50,3 %14,1
100EuroLLM 22B InstructEuroLLM · poids ouverts · 2 configurationsNon précisée49,7 %12,5
101Qwen3.5-2BAlibaba · poids ouvertsNon précisée49,6 %12,2
102granite-4.0-microIBM · poids ouvertsNon précisée49,6 %12,0
103EuroLLM 9B Instruct (2512)EuroLLM · poids ouvertsNon précisée49,6 %12,0
104DeepSeek-R1-Distill-Qwen-14BDeepSeekNon précisée49,2 %11,0
105OLMo 2 Furious 13BAllen Institute for AI · poids ouvertsNon précisée48,7 %9,1
106Gemma 7BGoogle DeepMind · poids ouverts · 2 configurationsNon précisée46,9 %3,7
107Qwen3.5-4BAlibaba · poids ouvertsNon précisée46,9 %3,7
107Apertus 70B InstructSwiss AI (EPFL, ETH Zurich) · poids ouvertsNon précisée46,9 %3,7
109Qwen2.5-1.5BAlibaba · poids ouvertsNon précisée44,4 %-4,1
110EuroLLM 9B InstructEuroLLM · poids ouvertsNon précisée44,3 %-4,5
111Llama 3.2 3BMeta AI · poids ouvertsNon précisée44,2 %-5,0
112Luciole 23B Instruct 1.1OpenLLM-France · poids ouvertsNon précisée43,4 %-7,2
113Qwen3.5-0.8BAlibaba · poids ouvertsNon précisée42,4 %-10,6
114Apertus 8B InstructSwiss AI (EPFL · poids ouvertsNon précisée42,1 %-11,4
115Ministral 3 3BMistral AI · poids ouverts · 2 configurationsÉlevée42 %-11,9
116Llama 3.2 1BMeta AI · poids ouverts · 2 configurationsNon précisée41,9 %-12,1
117Gemma 2 27BGoogle DeepMind · 2 configurationsNon précisée41,7 %-12,6
118Qwen3-1.7BAlibaba · 2 configurationsSans41,5 %-13,3
119Luciole 8B Instruct 1.1OpenLLM-France · poids ouvertsNon précisée40,8 %-15,7
120Mistral 7B v0.2Mistral AINon précisée40,1 %-18,0
121Phi-2Microsoft · poids ouvertsNon précisée39,8 %-18,8
122Phi-4 MiniMicrosoft · poids ouvertsÉlevée39,7 %-19,3
123Gemma 2 9BGoogle DeepMind · poids ouverts · 2 configurationsNon précisée38,3 %-23,7
124Llama 2-7BMeta AI · poids ouvertsNon précisée37,8 %-25,4
125DeepSeek-R1-Distill-Qwen-7BDeepSeekNon précisée37,4 %-26,8
126Qwen3-0.6BAlibaba · 2 configurationsSans36,4 %-30,0
127DeepSeek-R1-Distill-Llama-8BDeepSeekNon précisée36,3 %-30,4
128Gemma 3 270MGoogle DeepMind · poids ouverts · 2 configurationsNon précisée35 %-35,1
129Salamandra 7B InstructBarcelona Supercomputing Center · poids ouvertsNon précisée34,4 %-37,0
130Gemma 2BGoogle DeepMind · poids ouverts · 2 configurationsNon précisée33,9 %-38,7
131Gemma 3 1BGoogle DeepMind · poids ouvertsNon précisée29,9 %-52,9
132Phi-4 ReasoningMicrosoft · poids ouvertsÉlevée26,3 %-67,0
133DeepSeek-R1-Distill-Qwen-1.5BDeepSeekNon précisée20,5 %-92,5
134Phi-4-Reasoning-plusMicrosoft · poids ouvertsNon précisée2,9 %-260,3

En bref

Que mesure EuroEval, ELTeC (noms propres) ?
Le modèle repère les personnes, les lieux et les organisations dans un texte en français. Sur Quelle IA, il est rangé dans la tâche Français.
Comment EuroEval, ELTeC (noms propres) est-il noté ?
Un score de 0 à 100 qui combine les entités trouvées et les entités manquées. Un modèle qui obtient 50 % a un score IA d'environ 13.
Qui est en tête sur EuroEval, ELTeC (noms propres) ?
Qwen3.6 27B (Alibaba) est en tête d'EuroEval, ELTeC (noms propres) avec 83,9 %, dans l'édition du 28 septembre 2026. Suivent Gemini 3.7 Flash (83,1 %) et GPT-6 Astra (82,5 %). 134 modèles y sont mesurés.
Quelles sont les limites d'EuroEval, ELTeC (noms propres) ?
Tâche d'extraction, éloignée de l'usage courant d'un assistant. Au 28 septembre 2026, le benchmark est actif.
Combien pèse EuroEval, ELTeC (noms propres) dans le score IA ?
EuroEval, ELTeC (noms propres) compte pour 0,62 % du score général, dans l'édition du 28 septembre 2026. Il porte 6 % de la tâche Français (10 % du score général), que se partagent 10 benchmarks.
Qui maintient EuroEval, ELTeC (noms propres) ?
EuroEval. Sa page de référence : euroeval.com/leaderboards/Monolingual/french.

Les autres benchmarks de la tâche Français

Tous les benchmarks →Comment le score IA est calculé →