Aller au contenu
EN 4 QUESTIONSTrouver mon modèle

Classement · édition du

Classement des générateurs d'images, Portraits

Quel modèle réussit le mieux les portraits ?

Comment lire ce tableauComment lire ?

Le score vient des votes à l'aveugle d'Arena : des internautes comparent deux images faites pour la même consigne et choisissent la meilleure. 100 correspond au meilleur modèle au lancement de ce classement, 50 au repère DALL·E 3. La barre indique la marge d'erreur : deux modèles dont les barres se chevauchent sont ex æquo. Tout le détail, et les limites.

Poids
Poids
Éditeur
Éditeur
Densité du tableau

Dans l'édition du 28 septembre 2026, GPT Image 2 (OpenAI) est premier en portraits avec un score de 96,5. 2 modèles encore provisoires obtiennent un score plus haut, dont GPT Image 2.5 Sunburst (100,0).

Classement des générateurs d'images, portraits, édition du 28 septembre 2026
RangEmpreinteModèleÉtiquettesScore et marge (50 à 110)VotesSortieEssayer
Sans rangGPT Image 2.5 SunburstPROVISOIREOpenAI100,098,6 à 101,41 729 votes
Sans rangGPT Image 2.5 FlarePROVISOIREOpenAI98,597,1 à 99,81 598 votes
RANG 1Seul en tête : sa marge ne recouvre celle d'aucun autre modèle.
1GPT Image 2OpenAI96,595,9 à 97,116 950 votes
2MAI-Image-2.6Microsoft AI89,588,6 à 90,33 506 votes
Sans rangGrok Imagine Image 2.0PROVISOIRExAI88,887,5 à 90,11 401 votesEssayer Grok Imagine Image 2.0
Sans rangReve 2.1PROVISOIREReve86,385,2 à 87,51 663 votesEssayer Reve 2.1
EX ÆQUORangs 3 à 5 : leurs marges se recouvrent.
3Muse ImageMeta84,884,1 à 85,56 655 votes
4Seedream 5.0 ProByteDance84,183,6 à 84,717 128 votesEssayer Seedream 5.0 Pro
5Qwen-Image-3.0-ProAlibaba83,182,1 à 84,12 376 votesEssayer Qwen-Image-3.0-Pro
6Reve 2.0Reve83,082,1 à 83,93 258 votesEssayer Reve 2.0
EX ÆQUORangs 7 à 10 : leurs marges se recouvrent.
7Nano Banana 2Google81,380,7 à 81,810 649 votesEssayer Nano Banana 2
8GPT Image 1.5OpenAI81,080,6 à 81,532 378 votes
9Nano Banana ProGoogle80,880,3 à 81,238 014 votesEssayer Nano Banana Pro
10MAI-Image-2.5Microsoft AI80,680,0 à 81,111 838 votes
Sans rangQwen-Image-2.1PROVISOIREAlibaba79,878,3 à 81,3916 votes
11Nano Banana 2 LiteGoogle79,678,8 à 80,43 734 votesEssayer Nano Banana 2 Lite
EX ÆQUORangs 12 à 13 : leurs marges se recouvrent.
12Qwen-Image-2.0-ProAlibaba76,976,1 à 77,82 590 votes
13MAI-Image-2Microsoft AI76,175,5 à 76,711 497 votes
14Ideogram 4.0Ideogram75,374,8 à 75,911 063 votesEssayer Ideogram 4.0
EX ÆQUORangs 15 à 17 : leurs marges se recouvrent.
15Grok Imagine ImagexAI74,173,7 à 74,459 280 votesEssayer Grok Imagine Image
16Cosmos3-Super-Text2ImageNVIDIA74,073,1 à 74,92 671 votes
17Uni-1.1Luma AI73,172,5 à 73,78 254 votes
EX ÆQUORangs 18 à 22 : leurs marges se recouvrent.
18Grok Imagine Image ProxAI72,972,4 à 73,422 501 votes
Sans rangRecraft V4.1 Utility ProPROVISOIRERecraft72,470,5 à 74,3519 votesEssayer Recraft V4.1 Utility Pro
19Seedream 4.5ByteDance72,372,0 à 72,763 891 votesEssayer Seedream 4.5
20Imagen 4 UltraGoogle72,371,8 à 72,8111 752 votes
21Nano BananaGoogle72,372,0 à 72,6237 959 votesEssayer Nano Banana
22Uni-1.1 MaxLuma AI72,071,2 à 72,83 119 votes
EX ÆQUORangs 23 à 26 : leurs marges se recouvrent.
23FLUX.2 [max]Black Forest Labs71,470,9 à 71,928 183 votesEssayer FLUX.2 [max]
24Seedream 5.0 LiteByteDance71,170,7 à 71,626 519 votesEssayer Seedream 5.0 Lite
25Reve v1.5Reve70,870,2 à 71,47 850 votesEssayer Reve v1.5
26Krea 2 MediumKrea70,670,0 à 71,29 643 votesEssayer Krea 2 Medium
Sans rangRecraft V4.1 ProPROVISOIRERecraft70,468,6 à 72,2611 votesEssayer Recraft V4.1 Pro
EX ÆQUORangs 27 à 34 : leurs marges se recouvrent.
27Imagen 4Google70,369,9 à 70,6146 810 votes
28FLUX.2 [flex]Black Forest Labs70,369,8 à 70,735 653 votesEssayer FLUX.2 [flex]
29HunyuanImage 3.0Tencent70,269,8 à 70,744 823 votesEssayer HunyuanImage 3.0
30FLUX.2 [pro]Black Forest Labs70,169,8 à 70,545 961 votesEssayer FLUX.2 [pro]
31Qwen-Image-2512Alibaba70,069,6 à 70,521 683 votes
32Z-Image-TurboAlibaba70,069,3 à 70,75 635 votes
33Seedream 4.0ByteDance69,969,1 à 70,83 655 votesEssayer Seedream 4.0
34Krea 2 TurboKrea69,969,3 à 70,58 938 votesEssayer Krea 2 Turbo
Sans rangRecraft V4.1 FlashPROVISOIRERecraft69,768,0 à 71,5599 votesEssayer Recraft V4.1 Flash
EX ÆQUORangs 35 à 40 : leurs marges se recouvrent.
35FLUX.2 [dev]Black Forest Labs69,268,7 à 69,717 467 votes
36Wan 2.7 Image ProAlibaba68,868,2 à 69,47 189 votes
37Wan 2.7 ImageAlibaba68,567,9 à 69,27 297 votes
38Recraft V4Recraft68,367,9 à 68,828 644 votesEssayer Recraft V4
39Wan 2.6 T2IAlibaba68,367,9 à 68,749 719 votes
40Krea 2 LargeKrea68,167,5 à 68,79 567 votesEssayer Krea 2 Large
EX ÆQUORangs 41 à 43 : leurs marges se recouvrent.
41GPT Image 1OpenAI67,667,1 à 68,066 029 votes
42GPT Image 1 MiniOpenAI67,266,8 à 67,635 972 votes
43HiDream-O1-ImageHiDream.ai66,666,1 à 67,112 548 votes
EX ÆQUORangs 44 à 48 : leurs marges se recouvrent.
44Seedream 3.0ByteDance66,265,6 à 66,910 451 votes
45P-ImagePruna AI65,965,5 à 66,425 215 votesEssayer P-Image
46MAI-Image-1Microsoft AI65,665,1 à 66,120 387 votes
47FLUX.2 [klein] 9BBlack Forest Labs65,465,0 à 65,934 779 votes
48Wan 2.5 Preview ImageAlibaba65,465,0 à 65,761 513 votes
EX ÆQUORangs 49 à 51 : leurs marges se recouvrent.
49FLUX.1 Kontext [max]Black Forest Labs64,864,3 à 65,219 689 votesEssayer FLUX.1 Kontext [max]
50Imagen 3Google64,063,6 à 64,588 801 votes
51Qwen-ImageAlibaba64,063,6 à 64,328 685 votes
52FLUX.1 Kontext [pro]Black Forest Labs62,962,5 à 63,396 453 votesEssayer FLUX.1 Kontext [pro]
EX ÆQUORangs 53 à 56 : leurs marges se recouvrent.
53FLUX.2 [klein] 4BBlack Forest Labs61,861,4 à 62,334 890 votes
54Qwen-Image avec extension du promptAlibaba61,761,3 à 62,0201 862 votes
55Ideogram 3.0Ideogram61,561,0 à 62,029 298 votesEssayer Ideogram 3.0
56FLUX1.1 [pro]Black Forest Labs60,960,3 à 61,414 171 votes
EX ÆQUORangs 57 à 58 : leurs marges se recouvrent.
57Lucid OriginLeonardo.Ai60,860,3 à 61,374 166 votes
58Recraft V3Recraft60,560,0 à 61,044 305 votesEssayer Recraft V3
EX ÆQUORangs 59 à 61 : leurs marges se recouvrent.
59PhotonLuma AI59,158,6 à 59,632 382 votes
60Runway Gen-4 ImageRunway58,858,2 à 59,413 070 votesEssayer Runway Gen-4 Image
61Ideogram 2.0Ideogram58,758,2 à 59,314 547 votes
Sans rangGLM-ImagePROVISOIREZ.ai56,955,6 à 58,21 093 votes
62FLUX.1 [dev]Black Forest Labs56,856,2 à 57,410 614 votes
63Gemini 2.0 Flash Preview Image GenerationGoogle53,352,9 à 53,875 753 votes
EX ÆQUORangs 64 à 65 : leurs marges se recouvrent.
64FLUX.1 Kontext [dev]Black Forest Labs51,751,3 à 52,264 291 votes
65Stable Diffusion 3.5 LargeStability AI51,550,8 à 52,25 704 votes
EX ÆQUORangs 66 à 67 : leurs marges se recouvrent.
66BAGELByteDance50,149,3 à 50,93 499 votes
67DALL·E 3OpenAI50,049,5 à 50,560 356 votes

67 modèles classés et 9 provisoires. Votes d'Arena publiés le 24 septembre 2026.

Comment lire ce classement

Une seule source, Arena
Des internautes y écrivent une consigne, reçoivent deux images faites par deux modèles anonymes et votent pour la meilleure. Ce classement vient de ces votes à l'aveugle, publiés sous licence CC BY 4.0 dans le jeu de données d'Arena, à jour au . Chaque modèle classé compte de 2 376 à 237 959 votes.
L'échelle
100 correspond au meilleur modèle au lancement de ce classement, GPT Image 2.5 Sunburst, dans l'édition du 28 septembre 2026. 50 correspond au repère DALL·E 3. Entre les deux, le score suit l'EloEloUn score issu de duels, comme aux échecs. Battre un modèle fort rapporte plus que battre un modèle faible. d'Arena en ligne droite : dix points de score valent 109 points d'Elo.
La marge et les ex æquo
La barre bleue couvre la marge d'erreurMarge d'erreurL'intervalle où le vrai niveau du modèle a neuf chances sur dix de se trouver. à 90 %, tirée de l'intervalle d'Arena. Deux modèles dont les marges se recouvrent sont ex æquoEx æquoDeux modèles sont ex æquo quand leurs marges d'erreur se recouvrent. L'écart entre eux est trop petit pour les départager. : ils partagent un groupe, où l'ordre ne départage personne.
Provisoire
Sous 2 000 votes, un score reste provisoire : il n'a pas de rang, son cadre est en pointillé et sa marge hachurée. 9 modèles sont dans ce cas ici.

Plus fragile que le classement des modèles de langage. Celui-ci croise 98 benchmarks ; ici, tout repose sur les préférences des votants d'une seule arène. Un biais dans le choix des consignes ou dans le goût des votants passe tel quel dans le score, sans autre source pour le corriger.