Aller au contenu
EN 4 QUESTIONSTrouver mon modèle

Classement · édition du

Classement des générateurs d'images, Art et illustration

Quel modèle illustre le mieux ?

Comment lire ce tableauComment lire ?

Le score vient des votes à l'aveugle d'Arena : des internautes comparent deux images faites pour la même consigne et choisissent la meilleure. 100 correspond au meilleur modèle au lancement de ce classement, 50 au repère DALL·E 3. La barre indique la marge d'erreur : deux modèles dont les barres se chevauchent sont ex æquo. Tout le détail, et les limites.

Poids
Poids
Éditeur
Éditeur
Densité du tableau

Dans l'édition du 28 septembre 2026, GPT Image 2 (OpenAI) est premier en art et illustration avec un score de 96,9. 2 modèles encore provisoires obtiennent un score plus haut, dont GPT Image 2.5 Sunburst (100,0).

Classement des générateurs d'images, art et illustration, édition du 28 septembre 2026
RangEmpreinteModèleÉtiquettesScore et marge (50 à 110)VotesSortieEssayer
Sans rangGPT Image 2.5 SunburstPROVISOIREOpenAI100,098,2 à 101,81 544 votes
Sans rangGPT Image 2.5 FlarePROVISOIREOpenAI97,295,5 à 99,01 547 votes
RANG 1Seul en tête : sa marge ne recouvre celle d'aucun autre modèle.
1GPT Image 2OpenAI96,996,1 à 97,811 641 votes
2MAI-Image-2.6Microsoft AI93,091,6 à 94,32 777 votes
Sans rangReve 2.1PROVISOIREReve87,085,2 à 88,81 213 votesEssayer Reve 2.1
Sans rangGrok Imagine Image 2.0PROVISOIRExAI86,684,6 à 88,51 048 votesEssayer Grok Imagine Image 2.0
EX ÆQUORangs 3 à 4 : leurs marges se recouvrent.
3MAI-Image-2.5Microsoft AI85,184,2 à 85,99 166 votes
4Seedream 5.0 ProByteDance83,782,8 à 84,512 283 votesEssayer Seedream 5.0 Pro
EX ÆQUORangs 5 à 7 : leurs marges se recouvrent.
5Muse ImageMeta83,182,1 à 84,15 122 votes
6Reve 2.0Reve82,581,1 à 83,92 163 votesEssayer Reve 2.0
7Nano Banana 2 LiteGoogle82,280,9 à 83,52 538 votesEssayer Nano Banana 2 Lite
Sans rangQwen-Image-3.0-ProPROVISOIREAlibaba82,280,7 à 83,71 685 votesEssayer Qwen-Image-3.0-Pro
8Nano Banana 2Google80,279,4 à 81,17 913 votesEssayer Nano Banana 2
Sans rangQwen-Image-2.1PROVISOIREAlibaba79,677,1 à 82,2608 votes
EX ÆQUORangs 9 à 10 : leurs marges se recouvrent.
9GPT Image 1.5OpenAI78,277,5 à 78,823 541 votes
10Nano Banana ProGoogle78,177,4 à 78,724 149 votesEssayer Nano Banana Pro
EX ÆQUORangs 11 à 12 : leurs marges se recouvrent.
11Ideogram 4.0Ideogram75,374,5 à 76,27 826 votesEssayer Ideogram 4.0
12Uni-1.1 MaxLuma AI74,072,7 à 75,42 023 votes
Sans rangCosmos3-Super-Text2ImagePROVISOIRENVIDIA73,972,4 à 75,41 669 votes
EX ÆQUORangs 13 à 15 : leurs marges se recouvrent.
13Uni-1.1Luma AI73,472,4 à 74,36 066 votes
Sans rangRecraft V4.1 Utility ProPROVISOIRERecraft72,169,1 à 75,0402 votesEssayer Recraft V4.1 Utility Pro
14Grok Imagine ImagexAI72,071,4 à 72,634 849 votesEssayer Grok Imagine Image
Sans rangQwen-Image-2.0-ProPROVISOIREAlibaba72,070,6 à 73,41 921 votes
15MAI-Image-2Microsoft AI71,971,0 à 72,86 412 votes
EX ÆQUORangs 16 à 18 : leurs marges se recouvrent.
16FLUX.2 [max]Black Forest Labs70,970,2 à 71,617 560 votesEssayer FLUX.2 [max]
17Grok Imagine Image ProxAI70,369,6 à 71,113 718 votes
Sans rangSeedream 4.0PROVISOIREByteDance70,268,4 à 72,01 675 votesEssayer Seedream 4.0
18FLUX.2 [pro]Black Forest Labs69,869,2 à 70,429 493 votesEssayer FLUX.2 [pro]
Sans rangRecraft V4.1 ProPROVISOIRERecraft69,867,1 à 72,6430 votesEssayer Recraft V4.1 Pro
EX ÆQUORangs 19 à 24 : leurs marges se recouvrent.
19Wan 2.6 T2IAlibaba69,568,9 à 70,129 273 votes
20Seedream 4.5ByteDance69,368,7 à 69,839 252 votesEssayer Seedream 4.5
21FLUX.2 [flex]Black Forest Labs69,068,3 à 69,722 977 votesEssayer FLUX.2 [flex]
22Krea 2 MediumKrea68,968,1 à 69,87 391 votesEssayer Krea 2 Medium
23HunyuanImage 3.0Tencent68,768,0 à 69,426 862 votesEssayer HunyuanImage 3.0
24FLUX.2 [dev]Black Forest Labs68,367,6 à 69,111 670 votes
EX ÆQUORangs 25 à 28 : leurs marges se recouvrent.
25Nano BananaGoogle67,967,4 à 68,4116 667 votesEssayer Nano Banana
26Reve v1.5Reve67,566,6 à 68,45 989 votesEssayer Reve v1.5
27Seedream 5.0 LiteByteDance66,966,3 à 67,616 875 votesEssayer Seedream 5.0 Lite
28Krea 2 TurboKrea66,565,6 à 67,56 073 votesEssayer Krea 2 Turbo
EX ÆQUORangs 29 à 31 : leurs marges se recouvrent.
29Qwen-Image-2512Alibaba65,965,3 à 66,614 838 votes
30Imagen 4 UltraGoogle65,464,6 à 66,246 502 votes
Sans rangRecraft V4.1 FlashPROVISOIRERecraft65,262,6 à 67,7546 votesEssayer Recraft V4.1 Flash
31Recraft V4Recraft65,164,4 à 65,717 453 votesEssayer Recraft V4
EX ÆQUORangs 32 à 36 : leurs marges se recouvrent.
32Wan 2.5 Preview ImageAlibaba64,363,8 à 64,938 886 votes
33Krea 2 LargeKrea64,163,2 à 65,07 395 votesEssayer Krea 2 Large
34HiDream-O1-ImageHiDream.ai64,063,2 à 64,88 466 votes
35GPT Image 1OpenAI63,963,2 à 64,534 456 votes
36GPT Image 1 MiniOpenAI63,462,8 à 64,123 849 votes
EX ÆQUORangs 37 à 38 : leurs marges se recouvrent.
37Imagen 4Google63,162,5 à 63,667 300 votes
38MAI-Image-1Microsoft AI62,461,7 à 63,215 135 votes
EX ÆQUORangs 39 à 43 : leurs marges se recouvrent.
39Seedream 3.0ByteDance60,759,5 à 61,94 758 votes
40FLUX.1 Kontext [max]Black Forest Labs59,258,3 à 60,27 204 votesEssayer FLUX.1 Kontext [max]
41FLUX.2 [klein] 9BBlack Forest Labs59,058,3 à 59,720 287 votes
42Wan 2.7 Image ProAlibaba59,057,8 à 60,13 136 votes
43Wan 2.7 ImageAlibaba58,857,7 à 59,93 194 votes
EX ÆQUORangs 44 à 46 : leurs marges se recouvrent.
44Z-Image-TurboAlibaba58,257,1 à 59,33 471 votes
45FLUX.1 Kontext [pro]Black Forest Labs57,456,7 à 58,139 743 votesEssayer FLUX.1 Kontext [pro]
46Imagen 3Google56,455,6 à 57,159 553 votes
EX ÆQUORangs 47 à 49 : leurs marges se recouvrent.
47Qwen-Image avec extension du promptAlibaba56,055,5 à 56,688 519 votes
48Qwen-ImageAlibaba55,955,1 à 56,78 604 votes
49PhotonLuma AI54,954,1 à 55,621 177 votes
EX ÆQUORangs 50 à 52 : leurs marges se recouvrent.
50FLUX1.1 [pro]Black Forest Labs54,553,7 à 55,318 271 votes
51P-ImagePruna AI54,053,2 à 54,714 348 votesEssayer P-Image
52Ideogram 3.0Ideogram53,852,9 à 54,617 420 votesEssayer Ideogram 3.0
EX ÆQUORangs 53 à 54 : leurs marges se recouvrent.
53Lucid OriginLeonardo.Ai52,752,0 à 53,534 440 votes
54FLUX.2 [klein] 4BBlack Forest Labs52,351,6 à 53,020 614 votes
Sans rangGLM-ImagePROVISOIREZ.ai51,048,9 à 53,2761 votes
EX ÆQUORangs 55 à 57 : leurs marges se recouvrent.
55Runway Gen-4 ImageRunway50,950,0 à 51,97 006 votesEssayer Runway Gen-4 Image
56Ideogram 2.0Ideogram50,950,1 à 51,718 774 votes
57DALL·E 3OpenAI50,049,2 à 50,838 798 votes
EX ÆQUORangs 58 à 59 : leurs marges se recouvrent.
58Stable Diffusion 3.5 LargeStability AI48,447,4 à 49,45 340 votes
59Recraft V3Recraft47,546,7 à 48,235 616 votesEssayer Recraft V3
60FLUX.1 [dev]Black Forest Labs45,744,9 à 46,612 769 votes
61Gemini 2.0 Flash Preview Image GenerationGoogle44,043,2 à 44,830 594 votes
62FLUX.1 Kontext [dev]Black Forest Labs39,038,2 à 39,926 006 votes
Sans rangBAGELPROVISOIREByteDance36,935,1 à 38,61 394 votes

62 modèles classés et 14 provisoires. Votes d'Arena publiés le 24 septembre 2026.

Comment lire ce classement

Une seule source, Arena
Des internautes y écrivent une consigne, reçoivent deux images faites par deux modèles anonymes et votent pour la meilleure. Ce classement vient de ces votes à l'aveugle, publiés sous licence CC BY 4.0 dans le jeu de données d'Arena, à jour au . Chaque modèle classé compte de 2 023 à 116 667 votes.
L'échelle
100 correspond au meilleur modèle au lancement de ce classement, GPT Image 2.5 Sunburst, dans l'édition du 28 septembre 2026. 50 correspond au repère DALL·E 3. Entre les deux, le score suit l'EloEloUn score issu de duels, comme aux échecs. Battre un modèle fort rapporte plus que battre un modèle faible. d'Arena en ligne droite : dix points de score valent 76 points d'Elo.
La marge et les ex æquo
La barre bleue couvre la marge d'erreurMarge d'erreurL'intervalle où le vrai niveau du modèle a neuf chances sur dix de se trouver. à 90 %, tirée de l'intervalle d'Arena. Deux modèles dont les marges se recouvrent sont ex æquoEx æquoDeux modèles sont ex æquo quand leurs marges d'erreur se recouvrent. L'écart entre eux est trop petit pour les départager. : ils partagent un groupe, où l'ordre ne départage personne.
Provisoire
Sous 2 000 votes, un score reste provisoire : il n'a pas de rang, son cadre est en pointillé et sa marge hachurée. 14 modèles sont dans ce cas ici.

Plus fragile que le classement des modèles de langage. Celui-ci croise 98 benchmarks ; ici, tout repose sur les préférences des votants d'une seule arène. Un biais dans le choix des consignes ou dans le goût des votants passe tel quel dans le score, sans autre source pour le corriger.