Aller au contenu
EN 4 QUESTIONSTrouver mon modèle

Classement · édition du

Classement des générateurs d'images, Photoréalisme

Quel modèle crée les images les plus réalistes ?

Comment lire ce tableauComment lire ?

Le score vient des votes à l'aveugle d'Arena : des internautes comparent deux images faites pour la même consigne et choisissent la meilleure. 100 correspond au meilleur modèle au lancement de ce classement, 50 au repère DALL·E 3. La barre indique la marge d'erreur : deux modèles dont les barres se chevauchent sont ex æquo. Tout le détail, et les limites.

Poids
Poids
Éditeur
Éditeur
Densité du tableau

Dans l'édition du 28 septembre 2026, GPT Image 2.5 Sunburst (OpenAI) est premier en photoréalisme avec un score de 100,0, ex æquo avec GPT Image 2.5 Flare.

Classement des générateurs d'images, photoréalisme, édition du 28 septembre 2026
RangEmpreinteModèleÉtiquettesScore et marge (50 à 110)VotesSortieEssayer
EX ÆQUO · RANG 1L'écart entre ces modèles est plus petit que la marge d'erreur.
1GPT Image 2.5 SunburstOpenAI100,099,0 à 101,03 918 votes
2GPT Image 2.5 FlareOpenAI98,797,7 à 99,83 469 votes
3GPT Image 2OpenAI94,994,3 à 95,433 847 votes
4MAI-Image-2.6Microsoft AI89,789,0 à 90,46 713 votes
EX ÆQUORangs 5 à 6 : leurs marges se recouvrent.
5Grok Imagine Image 2.0xAI87,686,6 à 88,62 716 votesEssayer Grok Imagine Image 2.0
6Reve 2.1Reve87,086,1 à 88,03 348 votesEssayer Reve 2.1
EX ÆQUORangs 7 à 9 : leurs marges se recouvrent.
7Muse ImageMeta85,284,6 à 85,813 269 votes
8Seedream 5.0 ProByteDance84,584,0 à 85,033 043 votesEssayer Seedream 5.0 Pro
9Reve 2.0Reve84,483,7 à 85,16 565 votesEssayer Reve 2.0
EX ÆQUORangs 10 à 13 : leurs marges se recouvrent.
10Nano Banana 2Google83,382,7 à 83,821 007 votesEssayer Nano Banana 2
11Qwen-Image-3.0-ProAlibaba82,882,0 à 83,64 435 votesEssayer Qwen-Image-3.0-Pro
12Nano Banana ProGoogle82,682,3 à 83,071 487 votesEssayer Nano Banana Pro
13Nano Banana 2 LiteGoogle82,581,8 à 83,27 464 votesEssayer Nano Banana 2 Lite
EX ÆQUORangs 14 à 15 : leurs marges se recouvrent.
14MAI-Image-2.5Microsoft AI81,781,2 à 82,223 780 votes
15GPT Image 1.5OpenAI81,481,0 à 81,866 320 votes
Sans rangQwen-Image-2.1PROVISOIREAlibaba79,978,7 à 81,21 653 votes
EX ÆQUORangs 16 à 18 : leurs marges se recouvrent.
16Qwen-Image-2.0-ProAlibaba77,376,6 à 78,05 335 votes
17Ideogram 4.0Ideogram76,876,3 à 77,320 936 votesEssayer Ideogram 4.0
18MAI-Image-2Microsoft AI76,876,3 à 77,420 925 votes
EX ÆQUORangs 19 à 21 : leurs marges se recouvrent.
19Uni-1.1 MaxLuma AI75,274,5 à 75,95 932 votes
20Uni-1.1Luma AI74,774,2 à 75,216 499 votes
Sans rangRecraft V4.1 Utility ProPROVISOIRERecraft74,372,9 à 75,81 015 votesEssayer Recraft V4.1 Utility Pro
21Grok Imagine ImagexAI74,273,8 à 74,5107 871 votesEssayer Grok Imagine Image
EX ÆQUORangs 22 à 24 : leurs marges se recouvrent.
22Grok Imagine Image ProxAI73,573,1 à 73,941 415 votes
23Cosmos3-Super-Text2ImageNVIDIA73,072,2 à 73,94 209 votes
24Seedream 4.5ByteDance72,972,6 à 73,3118 843 votesEssayer Seedream 4.5
EX ÆQUORangs 25 à 28 : leurs marges se recouvrent.
25FLUX.2 [max]Black Forest Labs72,572,1 à 72,953 328 votesEssayer FLUX.2 [max]
26Nano BananaGoogle72,071,7 à 72,3409 224 votesEssayer Nano Banana
27Seedream 5.0 LiteByteDance72,071,6 à 72,450 590 votesEssayer Seedream 5.0 Lite
28Imagen 4 UltraGoogle71,971,4 à 72,3187 099 votes
EX ÆQUORangs 29 à 33 : leurs marges se recouvrent.
29FLUX.2 [pro]Black Forest Labs71,571,2 à 71,987 103 votesEssayer FLUX.2 [pro]
30Seedream 4.0ByteDance71,470,7 à 72,25 930 votesEssayer Seedream 4.0
31HunyuanImage 3.0Tencent71,471,0 à 71,880 874 votesEssayer HunyuanImage 3.0
32Reve v1.5Reve71,270,7 à 71,716 226 votesEssayer Reve v1.5
Sans rangRecraft V4.1 ProPROVISOIRERecraft71,069,6 à 72,41 144 votesEssayer Recraft V4.1 Pro
33FLUX.2 [flex]Black Forest Labs70,970,5 à 71,367 318 votesEssayer FLUX.2 [flex]
EX ÆQUORangs 34 à 36 : leurs marges se recouvrent.
34FLUX.2 [dev]Black Forest Labs70,670,2 à 71,133 046 votes
35Imagen 4Google69,969,5 à 70,2251 359 votes
36Qwen-Image-2512Alibaba69,869,4 à 70,242 042 votes
EX ÆQUORangs 37 à 41 : leurs marges se recouvrent.
37Krea 2 MediumKrea69,569,0 à 70,119 586 votesEssayer Krea 2 Medium
38Wan 2.6 T2IAlibaba69,268,9 à 69,691 144 votes
39Krea 2 LargeKrea68,868,3 à 69,419 240 votesEssayer Krea 2 Large
40Wan 2.7 Image ProAlibaba68,668,0 à 69,211 959 votes
41Krea 2 TurboKrea68,467,9 à 69,017 126 votesEssayer Krea 2 Turbo
EX ÆQUORangs 42 à 46 : leurs marges se recouvrent.
42Recraft V4Recraft68,367,9 à 68,652 903 votesEssayer Recraft V4
43Z-Image-TurboAlibaba68,167,5 à 68,710 376 votes
44Wan 2.7 ImageAlibaba68,067,5 à 68,612 447 votes
45GPT Image 1OpenAI67,867,4 à 68,2119 287 votes
46GPT Image 1 MiniOpenAI67,867,4 à 68,271 399 votes
Sans rangRecraft V4.1 FlashPROVISOIRERecraft67,766,4 à 69,11 292 votesEssayer Recraft V4.1 Flash
EX ÆQUORangs 47 à 49 : leurs marges se recouvrent.
47HiDream-O1-ImageHiDream.ai67,266,8 à 67,723 805 votes
48MAI-Image-1Microsoft AI66,666,2 à 67,141 415 votes
49Seedream 3.0ByteDance66,465,8 à 67,017 470 votes
50Wan 2.5 Preview ImageAlibaba66,265,9 à 66,6114 566 votes
51FLUX.2 [klein] 9BBlack Forest Labs65,465,0 à 65,864 015 votes
EX ÆQUORangs 52 à 53 : leurs marges se recouvrent.
52FLUX.1 Kontext [max]Black Forest Labs64,564,1 à 64,930 274 votesEssayer FLUX.1 Kontext [max]
53Imagen 3Google63,663,2 à 64,1159 667 votes
EX ÆQUORangs 54 à 55 : leurs marges se recouvrent.
54P-ImagePruna AI63,563,0 à 63,946 040 votesEssayer P-Image
55FLUX.1 Kontext [pro]Black Forest Labs62,762,3 à 63,1160 122 votesEssayer FLUX.1 Kontext [pro]
56Qwen-ImageAlibaba62,462,1 à 62,842 908 votes
EX ÆQUORangs 57 à 60 : leurs marges se recouvrent.
57Recraft V3Recraft61,661,1 à 62,081 940 votesEssayer Recraft V3
58Ideogram 3.0Ideogram61,260,8 à 61,653 120 votesEssayer Ideogram 3.0
59Qwen-Image avec extension du promptAlibaba60,960,5 à 61,2339 921 votes
60FLUX.2 [klein] 4BBlack Forest Labs60,860,4 à 61,264 719 votes
EX ÆQUORangs 61 à 64 : leurs marges se recouvrent.
61FLUX1.1 [pro]Black Forest Labs60,560,0 à 61,026 892 votes
62Runway Gen-4 ImageRunway60,259,7 à 60,823 939 votesEssayer Runway Gen-4 Image
63PhotonLuma AI59,759,2 à 60,157 437 votes
64Lucid OriginLeonardo.Ai59,659,2 à 60,0133 257 votes
65Ideogram 2.0Ideogram58,057,6 à 58,527 531 votes
EX ÆQUORangs 66 à 67 : leurs marges se recouvrent.
66GLM-ImageZ.ai56,154,9 à 57,22 087 votes
67FLUX.1 [dev]Black Forest Labs55,154,6 à 55,619 407 votes
68Gemini 2.0 Flash Preview Image GenerationGoogle52,351,8 à 52,7123 199 votes
EX ÆQUORangs 69 à 70 : leurs marges se recouvrent.
69DALL·E 3OpenAI50,049,5 à 50,5104 410 votes
70FLUX.1 Kontext [dev]Black Forest Labs49,549,1 à 49,9105 511 votes
EX ÆQUORangs 71 à 72 : leurs marges se recouvrent.
71Stable Diffusion 3.5 LargeStability AI48,848,2 à 49,49 405 votes
72BAGELByteDance48,247,5 à 48,95 479 votes

72 modèles classés et 4 provisoires. Votes d'Arena publiés le 24 septembre 2026.

Comment lire ce classement

Une seule source, Arena
Des internautes y écrivent une consigne, reçoivent deux images faites par deux modèles anonymes et votent pour la meilleure. Ce classement vient de ces votes à l'aveugle, publiés sous licence CC BY 4.0 dans le jeu de données d'Arena, à jour au . Chaque modèle classé compte de 2 087 à 409 224 votes.
L'échelle
100 correspond au meilleur modèle au lancement de ce classement, GPT Image 2.5 Sunburst, dans l'édition du 28 septembre 2026. 50 correspond au repère DALL·E 3. Entre les deux, le score suit l'EloEloUn score issu de duels, comme aux échecs. Battre un modèle fort rapporte plus que battre un modèle faible. d'Arena en ligne droite : dix points de score valent 98 points d'Elo.
La marge et les ex æquo
La barre bleue couvre la marge d'erreurMarge d'erreurL'intervalle où le vrai niveau du modèle a neuf chances sur dix de se trouver. à 90 %, tirée de l'intervalle d'Arena. Deux modèles dont les marges se recouvrent sont ex æquoEx æquoDeux modèles sont ex æquo quand leurs marges d'erreur se recouvrent. L'écart entre eux est trop petit pour les départager. : ils partagent un groupe, où l'ordre ne départage personne.
Provisoire
Sous 2 000 votes, un score reste provisoire : il n'a pas de rang, son cadre est en pointillé et sa marge hachurée. 4 modèles sont dans ce cas ici.

Plus fragile que le classement des modèles de langage. Celui-ci croise 98 benchmarks ; ici, tout repose sur les préférences des votants d'une seule arène. Un biais dans le choix des consignes ou dans le goût des votants passe tel quel dans le score, sans autre source pour le corriger.