Aller au contenu
EN 4 QUESTIONSTrouver mon modèle

Classement · édition du

Classement des générateurs d'images, Graphisme et produit

Quel modèle crée les meilleurs visuels de produit et de marque ?

Comment lire ce tableauComment lire ?

Le score vient des votes à l'aveugle d'Arena : des internautes comparent deux images faites pour la même consigne et choisissent la meilleure. 100 correspond au meilleur modèle au lancement de ce classement, 50 au repère DALL·E 3. La barre indique la marge d'erreur : deux modèles dont les barres se chevauchent sont ex æquo. Tout le détail, et les limites.

Poids
Poids
Éditeur
Éditeur
Densité du tableau

Dans l'édition du 28 septembre 2026, GPT Image 2.5 Sunburst (OpenAI) est premier en graphisme et visuels de produit avec un score de 100,0.

Classement des générateurs d'images, graphisme et produit, édition du 28 septembre 2026
RangEmpreinteModèleÉtiquettesScore et marge (50 à 110)VotesSortieEssayer
RANG 1Seul en tête : sa marge ne recouvre celle d'aucun autre modèle.
1GPT Image 2.5 SunburstOpenAI100,098,9 à 101,13 669 votes
EX ÆQUORangs 2 à 3 : leurs marges se recouvrent.
2GPT Image 2.5 FlareOpenAI97,696,5 à 98,73 299 votes
3GPT Image 2OpenAI96,896,2 à 97,433 677 votes
4MAI-Image-2.6Microsoft AI91,490,5 à 92,35 759 votes
EX ÆQUORangs 5 à 6 : leurs marges se recouvrent.
5Reve 2.1Reve88,587,4 à 89,62 965 votesEssayer Reve 2.1
6Grok Imagine Image 2.0xAI86,285,0 à 87,42 369 votesEssayer Grok Imagine Image 2.0
EX ÆQUORangs 7 à 9 : leurs marges se recouvrent.
7Reve 2.0Reve84,083,2 à 84,96 039 votesEssayer Reve 2.0
8Nano Banana 2Google83,082,4 à 83,618 068 votesEssayer Nano Banana 2
9Muse ImageMeta82,581,8 à 83,211 647 votes
EX ÆQUORangs 10 à 12 : leurs marges se recouvrent.
10MAI-Image-2.5Microsoft AI81,981,3 à 82,422 313 votes
11Qwen-Image-3.0-ProAlibaba81,480,4 à 82,43 653 votesEssayer Qwen-Image-3.0-Pro
12Nano Banana 2 LiteGoogle80,579,7 à 81,46 352 votesEssayer Nano Banana 2 Lite
EX ÆQUORangs 13 à 15 : leurs marges se recouvrent.
13Nano Banana ProGoogle80,379,8 à 80,759 273 votesEssayer Nano Banana Pro
14GPT Image 1.5OpenAI79,479,0 à 79,963 825 votes
15Seedream 5.0 ProByteDance79,378,7 à 79,827 591 votesEssayer Seedream 5.0 Pro
Sans rangQwen-Image-2.1PROVISOIREAlibaba78,977,4 à 80,31 397 votes
16Ideogram 4.0Ideogram77,576,9 à 78,118 022 votesEssayer Ideogram 4.0
EX ÆQUORangs 17 à 18 : leurs marges se recouvrent.
17Uni-1.1 MaxLuma AI74,673,8 à 75,45 432 votes
18Qwen-Image-2.0-ProAlibaba73,572,6 à 74,34 861 votes
EX ÆQUORangs 19 à 22 : leurs marges se recouvrent.
19Reve v1.5Reve72,972,3 à 73,515 473 votesEssayer Reve v1.5
20Uni-1.1Luma AI72,872,2 à 73,414 808 votes
21MAI-Image-2Microsoft AI72,271,6 à 72,819 945 votes
22Grok Imagine ImagexAI71,971,5 à 72,396 049 votesEssayer Grok Imagine Image
EX ÆQUORangs 23 à 25 : leurs marges se recouvrent.
23FLUX.2 [flex]Black Forest Labs71,771,2 à 72,257 811 votesEssayer FLUX.2 [flex]
24Grok Imagine Image ProxAI71,270,6 à 71,736 668 votes
Sans rangRecraft V4.1 Utility ProPROVISOIRERecraft71,069,4 à 72,61 106 votesEssayer Recraft V4.1 Utility Pro
25FLUX.2 [max]Black Forest Labs70,770,2 à 71,246 331 votesEssayer FLUX.2 [max]
EX ÆQUORangs 26 à 31 : leurs marges se recouvrent.
26FLUX.2 [pro]Black Forest Labs69,869,4 à 70,274 199 votesEssayer FLUX.2 [pro]
27FLUX.2 [dev]Black Forest Labs69,569,0 à 70,026 647 votes
28Cosmos3-Super-Text2ImageNVIDIA69,568,4 à 70,52 902 votes
29Nano BananaGoogle69,369,0 à 69,6265 966 votesEssayer Nano Banana
30HunyuanImage 3.0Tencent69,368,8 à 69,857 766 votesEssayer HunyuanImage 3.0
31Imagen 4 UltraGoogle69,268,7 à 69,8107 945 votes
EX ÆQUORangs 32 à 33 : leurs marges se recouvrent.
32Wan 2.6 T2IAlibaba68,868,4 à 69,282 564 votes
33Seedream 4.5ByteDance68,167,8 à 68,5102 413 votesEssayer Seedream 4.5
Sans rangRecraft V4.1 ProPROVISOIRERecraft68,066,5 à 69,51 177 votesEssayer Recraft V4.1 Pro
EX ÆQUORangs 34 à 36 : leurs marges se recouvrent.
34Wan 2.5 Preview ImageAlibaba67,667,2 à 68,094 772 votes
35Seedream 4.0ByteDance67,166,1 à 68,23 475 votesEssayer Seedream 4.0
36Seedream 5.0 LiteByteDance66,866,4 à 67,346 206 votesEssayer Seedream 5.0 Lite
EX ÆQUORangs 37 à 40 : leurs marges se recouvrent.
37Imagen 4Google66,766,3 à 67,1162 289 votes
38HiDream-O1-ImageHiDream.ai66,666,0 à 67,120 206 votes
39Qwen-Image-2512Alibaba66,666,1 à 67,034 876 votes
40Recraft V4Recraft66,566,0 à 67,046 344 votesEssayer Recraft V4
EX ÆQUORangs 41 à 45 : leurs marges se recouvrent.
41Krea 2 MediumKrea65,665,0 à 66,217 376 votesEssayer Krea 2 Medium
42Wan 2.7 Image ProAlibaba65,264,5 à 65,812 256 votes
43GPT Image 1OpenAI64,964,4 à 65,382 342 votes
44Krea 2 TurboKrea64,664,0 à 65,313 412 votesEssayer Krea 2 Turbo
45Wan 2.7 ImageAlibaba64,663,9 à 65,212 331 votes
EX ÆQUORangs 46 à 47 : leurs marges se recouvrent.
46GPT Image 1 MiniOpenAI64,363,9 à 64,863 650 votes
47Krea 2 LargeKrea63,963,3 à 64,516 918 votesEssayer Krea 2 Large
Sans rangRecraft V4.1 FlashPROVISOIRERecraft63,562,0 à 65,01 223 votesEssayer Recraft V4.1 Flash
EX ÆQUORangs 48 à 51 : leurs marges se recouvrent.
48Qwen-Image avec extension du promptAlibaba61,761,3 à 62,0213 014 votes
49MAI-Image-1Microsoft AI61,561,0 à 62,035 909 votes
50FLUX.1 Kontext [max]Black Forest Labs61,260,6 à 61,716 506 votesEssayer FLUX.1 Kontext [max]
51Ideogram 3.0Ideogram61,160,6 à 61,737 799 votesEssayer Ideogram 3.0
EX ÆQUORangs 52 à 56 : leurs marges se recouvrent.
52FLUX.2 [klein] 9BBlack Forest Labs59,759,3 à 60,258 147 votes
53Seedream 3.0ByteDance59,759,0 à 60,510 362 votes
54Qwen-ImageAlibaba59,559,1 à 60,017 871 votes
55FLUX.1 Kontext [pro]Black Forest Labs59,459,0 à 59,991 692 votesEssayer FLUX.1 Kontext [pro]
56Z-Image-TurboAlibaba59,058,3 à 59,78 069 votes
EX ÆQUORangs 57 à 59 : leurs marges se recouvrent.
57Imagen 3Google58,257,7 à 58,687 660 votes
58Ideogram 2.0Ideogram57,857,0 à 58,610 338 votes
59PhotonLuma AI57,757,2 à 58,237 945 votes
Sans rangGLM-ImagePROVISOIREZ.ai56,054,7 à 57,31 712 votes
EX ÆQUORangs 60 à 63 : leurs marges se recouvrent.
60P-ImagePruna AI55,154,6 à 55,640 502 votesEssayer P-Image
61Recraft V3Recraft54,654,1 à 55,147 792 votesEssayer Recraft V3
62FLUX.2 [klein] 4BBlack Forest Labs54,654,2 à 55,158 992 votes
63Runway Gen-4 ImageRunway54,654,0 à 55,121 280 votesEssayer Runway Gen-4 Image
EX ÆQUORangs 64 à 66 : leurs marges se recouvrent.
64Lucid OriginLeonardo.Ai53,953,4 à 54,383 190 votes
65Gemini 2.0 Flash Preview Image GenerationGoogle53,753,1 à 54,267 942 votes
66FLUX1.1 [pro]Black Forest Labs53,052,2 à 53,810 135 votes
EX ÆQUORangs 67 à 68 : leurs marges se recouvrent.
67FLUX.1 [dev]Black Forest Labs50,549,7 à 51,46 410 votes
68DALL·E 3OpenAI50,049,5 à 50,556 020 votes
69FLUX.1 Kontext [dev]Black Forest Labs47,547,0 à 48,058 488 votes
70Stable Diffusion 3.5 LargeStability AI44,243,1 à 45,33 051 votes
71BAGELByteDance38,337,3 à 39,33 281 votes

71 modèles classés et 5 provisoires. Votes d'Arena publiés le 24 septembre 2026.

Comment lire ce classement

Une seule source, Arena
Des internautes y écrivent une consigne, reçoivent deux images faites par deux modèles anonymes et votent pour la meilleure. Ce classement vient de ces votes à l'aveugle, publiés sous licence CC BY 4.0 dans le jeu de données d'Arena, à jour au . Chaque modèle classé compte de 2 369 à 265 966 votes.
L'échelle
100 correspond au meilleur modèle au lancement de ce classement, GPT Image 2.5 Sunburst, dans l'édition du 28 septembre 2026. 50 correspond au repère DALL·E 3. Entre les deux, le score suit l'EloEloUn score issu de duels, comme aux échecs. Battre un modèle fort rapporte plus que battre un modèle faible. d'Arena en ligne droite : dix points de score valent 86 points d'Elo.
La marge et les ex æquo
La barre bleue couvre la marge d'erreurMarge d'erreurL'intervalle où le vrai niveau du modèle a neuf chances sur dix de se trouver. à 90 %, tirée de l'intervalle d'Arena. Deux modèles dont les marges se recouvrent sont ex æquoEx æquoDeux modèles sont ex æquo quand leurs marges d'erreur se recouvrent. L'écart entre eux est trop petit pour les départager. : ils partagent un groupe, où l'ordre ne départage personne.
Provisoire
Sous 2 000 votes, un score reste provisoire : il n'a pas de rang, son cadre est en pointillé et sa marge hachurée. 5 modèles sont dans ce cas ici.

Plus fragile que le classement des modèles de langage. Celui-ci croise 98 benchmarks ; ici, tout repose sur les préférences des votants d'une seule arène. Un biais dans le choix des consignes ou dans le goût des votants passe tel quel dans le score, sans autre source pour le corriger.