À quoi il sert
Sur Quelle IA, EuroEval, ELTeC (noms propres) sert à noter la tâche Français : c'est l'un de ses 10 benchmarks. Il départage surtout les modèles dont le score IA approche 13.
FrançaisFiche benchmark · EuroEval · euroeval.com
Le modèle repère les personnes, les lieux et les organisations dans un texte en français.
Sur Quelle IA, EuroEval, ELTeC (noms propres) sert à noter la tâche Français : c'est l'un de ses 10 benchmarks. Il départage surtout les modèles dont le score IA approche 13.
Un score de 0 à 100 qui combine les entités trouvées et les entités manquées.
Tâche d'extraction, éloignée de l'usage courant d'un assistant.
EuroEval.
euroeval.com/leaderboards/Monolingual/french · tâche Français · 134 modèles mesurés
Description à confirmer : elle n'a pas encore été vérifiée sur la page de la source.
En tête : Qwen3.6 27B, 83,9 %
Chaque trait est un modèle, placé à son meilleur score. Un modèle qui obtient 50 % a un score IA d'environ 13. Le meilleur, Qwen3.6 27B, atteint 83,9 %. Le benchmark sera dit saturé quand un modèle atteindra 95 %.
Valeurs lues sur la courbe d'étalonnage du benchmark, qui relie le score publié au score IA. La démarche
0,62 %du score général. EuroEval, ELTeC (noms propres) porte 6 % de la tâche Français (10 % du score général), que se partagent 10 benchmarks.
En couleur, la tâche Français dans le score général. En noir, la part d'EuroEval, ELTeC (noms propres).