Aller au contenu
EN 4 QUESTIONSTrouver mon modèle

Classement · édition du

Classement des générateurs d'images, Texte vers image

Quel modèle crée les meilleures images à partir d'un texte ?

Comment lire ce tableauComment lire ?

Le score vient des votes à l'aveugle d'Arena : des internautes comparent deux images faites pour la même consigne et choisissent la meilleure. 100 correspond au meilleur modèle au lancement de ce classement, 50 au repère DALL·E 3. La barre indique la marge d'erreur : deux modèles dont les barres se chevauchent sont ex æquo. Tout le détail, et les limites.

Poids
Poids
Éditeur
Éditeur
Densité du tableau

Dans l'édition du 28 septembre 2026, GPT Image 2.5 Sunburst (OpenAI) est premier en génération d'images à partir d'un texte avec un score de 100,0.

Classement des générateurs d'images, texte vers image, édition du 28 septembre 2026
RangEmpreinteModèleÉtiquettesScore et marge (50 à 110)VotesSortieEssayer
RANG 1Seul en tête : sa marge ne recouvre celle d'aucun autre modèle.
1GPT Image 2.5 SunburstOpenAI100,099,3 à 100,710 884 votes
2GPT Image 2.5 FlareOpenAI97,596,8 à 98,210 058 votes
3GPT Image 2OpenAI95,595,2 à 95,988 744 votes
4MAI-Image-2.6Microsoft AI90,389,8 à 90,818 625 votes
EX ÆQUORangs 5 à 6 : leurs marges se recouvrent.
5Reve 2.1Reve86,786,0 à 87,48 305 votesEssayer Reve 2.1
6Grok Imagine Image 2.0xAI86,585,8 à 87,27 257 votesEssayer Grok Imagine Image 2.0
EX ÆQUORangs 7 à 8 : leurs marges se recouvrent.
7Muse ImageMeta83,883,3 à 84,335 422 votes
8Reve 2.0Reve83,082,5 à 83,615 802 votesEssayer Reve 2.0
EX ÆQUORangs 9 à 12 : leurs marges se recouvrent.
9Nano Banana 2Google82,281,8 à 82,653 228 votesEssayer Nano Banana 2
10Seedream 5.0 ProByteDance81,681,3 à 82,085 690 votesEssayer Seedream 5.0 Pro
11Qwen-Image-3.0-ProAlibaba81,681,0 à 82,211 520 votesEssayer Qwen-Image-3.0-Pro
12MAI-Image-2.5Microsoft AI81,481,0 à 81,861 448 votes
EX ÆQUORangs 13 à 14 : leurs marges se recouvrent.
13Nano Banana 2 LiteGoogle81,080,4 à 81,517 851 votesEssayer Nano Banana 2 Lite
14Nano Banana ProGoogle80,780,4 à 81,0168 447 votesEssayer Nano Banana Pro
15GPT Image 1.5OpenAI79,779,4 à 80,0165 437 votes
16Qwen-Image-2.1Alibaba78,577,7 à 79,34 445 votes
17Ideogram 4.0Ideogram76,075,6 à 76,453 371 votesEssayer Ideogram 4.0
EX ÆQUORangs 18 à 21 : leurs marges se recouvrent.
18Qwen-Image-2.0-ProAlibaba74,674,0 à 75,113 123 votes
19Uni-1.1 MaxLuma AI74,373,7 à 74,814 083 votes
20MAI-Image-2Microsoft AI73,773,3 à 74,151 477 votes
21Uni-1.1Luma AI73,773,3 à 74,141 412 votes
EX ÆQUORangs 22 à 24 : leurs marges se recouvrent.
22Grok Imagine ImagexAI72,272,0 à 72,5262 132 votesEssayer Grok Imagine Image
23Recraft V4.1 Utility ProRecraft72,171,1 à 73,12 618 votesEssayer Recraft V4.1 Utility Pro
24Cosmos3-Super-Text2ImageNVIDIA71,671,0 à 72,210 856 votes
EX ÆQUORangs 25 à 28 : leurs marges se recouvrent.
25Grok Imagine Image ProxAI71,371,0 à 71,799 444 votes
26FLUX.2 [max]Black Forest Labs71,371,0 à 71,6123 187 votesEssayer FLUX.2 [max]
27FLUX.2 [flex]Black Forest Labs70,770,4 à 71,0156 912 votesEssayer FLUX.2 [flex]
28Reve v1.5Reve70,670,2 à 71,039 755 votesEssayer Reve v1.5
EX ÆQUORangs 29 à 31 : leurs marges se recouvrent.
29FLUX.2 [pro]Black Forest Labs70,470,2 à 70,7205 540 votesEssayer FLUX.2 [pro]
30Nano BananaGoogle70,069,8 à 70,2878 451 votesEssayer Nano Banana
31HunyuanImage 3.0Tencent69,969,6 à 70,2180 550 votesEssayer HunyuanImage 3.0
EX ÆQUORangs 32 à 35 : leurs marges se recouvrent.
32Imagen 4 UltraGoogle69,769,3 à 70,1388 772 votes
33Seedream 4.5ByteDance69,769,5 à 69,9287 128 votesEssayer Seedream 4.5
34FLUX.2 [dev]Black Forest Labs69,569,1 à 69,978 080 votes
35Seedream 4.0ByteDance68,968,3 à 69,512 566 votesEssayer Seedream 4.0
EX ÆQUORangs 36 à 38 : leurs marges se recouvrent.
36Seedream 5.0 LiteByteDance68,768,4 à 69,0123 178 votesEssayer Seedream 5.0 Lite
37Wan 2.6 T2IAlibaba68,568,3 à 68,8223 535 votes
38Recraft V4.1 ProRecraft68,167,1 à 69,02 795 votesEssayer Recraft V4.1 Pro
EX ÆQUORangs 39 à 41 : leurs marges se recouvrent.
39Imagen 4Google67,767,4 à 67,9539 788 votes
40Qwen-Image-2512Alibaba67,367,0 à 67,698 363 votes
41Krea 2 MediumKrea67,066,7 à 67,450 800 votesEssayer Krea 2 Medium
EX ÆQUORangs 42 à 47 : leurs marges se recouvrent.
42Wan 2.5 Preview ImageAlibaba66,366,0 à 66,5271 922 votes
43HiDream-O1-ImageHiDream.ai66,265,9 à 66,659 511 votes
44GPT Image 1OpenAI66,265,9 à 66,5268 466 votes
45Recraft V4Recraft66,165,8 à 66,4129 674 votesEssayer Recraft V4
46Krea 2 TurboKrea65,965,5 à 66,343 913 votesEssayer Krea 2 Turbo
47Krea 2 LargeKrea65,665,2 à 66,049 906 votesEssayer Krea 2 Large
EX ÆQUORangs 48 à 49 : leurs marges se recouvrent.
48GPT Image 1 MiniOpenAI65,665,3 à 65,9171 058 votes
49Wan 2.7 Image ProAlibaba64,964,4 à 65,330 229 votes
EX ÆQUORangs 50 à 51 : leurs marges se recouvrent.
50Wan 2.7 ImageAlibaba64,664,2 à 65,130 621 votes
51Recraft V4.1 FlashRecraft64,563,7 à 65,43 533 votesEssayer Recraft V4.1 Flash
52MAI-Image-1Microsoft AI63,763,4 à 64,098 414 votes
EX ÆQUORangs 53 à 54 : leurs marges se recouvrent.
53Z-Image-TurboAlibaba62,762,2 à 63,224 291 votes
54Seedream 3.0ByteDance62,562,0 à 62,936 890 votes
EX ÆQUORangs 55 à 56 : leurs marges se recouvrent.
55FLUX.1 Kontext [max]Black Forest Labs61,761,4 à 62,065 517 votesEssayer FLUX.1 Kontext [max]
56FLUX.2 [klein] 9BBlack Forest Labs61,260,9 à 61,5150 780 votes
EX ÆQUORangs 57 à 60 : leurs marges se recouvrent.
57Qwen-Image avec extension du promptAlibaba60,159,9 à 60,4716 829 votes
58FLUX.1 Kontext [pro]Black Forest Labs60,059,7 à 60,3332 376 votesEssayer FLUX.1 Kontext [pro]
59Imagen 3Google59,959,6 à 60,2359 786 votes
60Qwen-ImageAlibaba59,859,5 à 60,084 555 votes
61Ideogram 3.0Ideogram58,858,5 à 59,2118 542 votesEssayer Ideogram 3.0
EX ÆQUORangs 62 à 64 : leurs marges se recouvrent.
62PhotonLuma AI57,457,1 à 57,8130 158 votes
63P-ImagePruna AI57,256,8 à 57,5109 782 votesEssayer P-Image
64FLUX.2 [klein] 4BBlack Forest Labs56,856,5 à 57,1152 358 votes
EX ÆQUORangs 65 à 66 : leurs marges se recouvrent.
65Runway Gen-4 ImageRunway56,255,8 à 56,654 376 votesEssayer Runway Gen-4 Image
66Recraft V3Recraft55,855,5 à 56,1195 623 votesEssayer Recraft V3
EX ÆQUORangs 67 à 70 : leurs marges se recouvrent.
67FLUX1.1 [pro]Black Forest Labs55,254,9 à 55,670 460 votes
68Ideogram 2.0Ideogram55,054,7 à 55,372 090 votes
69Lucid OriginLeonardo.Ai55,054,6 à 55,3287 345 votes
70GLM-ImageZ.ai54,854,0 à 55,74 852 votes
EX ÆQUORangs 71 à 72 : leurs marges se recouvrent.
71Gemini 2.0 Flash Preview Image GenerationGoogle50,850,5 à 51,1257 241 votes
72FLUX.1 [dev]Black Forest Labs50,249,8 à 50,549 221 votes
73DALL·E 3OpenAI50,049,7 à 50,3238 749 votes
EX ÆQUORangs 74 à 75 : leurs marges se recouvrent.
74FLUX.1 Kontext [dev]Black Forest Labs47,146,7 à 47,4216 238 votes
75Stable Diffusion 3.5 LargeStability AI46,846,3 à 47,223 396 votes
76BAGELByteDance42,341,8 à 42,812 363 votes

76 modèles classés. Votes d'Arena publiés le 24 septembre 2026.

Comment lire ce classement

Une seule source, Arena
Des internautes y écrivent une consigne, reçoivent deux images faites par deux modèles anonymes et votent pour la meilleure. Ce classement vient de ces votes à l'aveugle, publiés sous licence CC BY 4.0 dans le jeu de données d'Arena, à jour au . Chaque modèle classé compte de 2 618 à 878 451 votes.
L'échelle
100 correspond au meilleur modèle au lancement de ce classement, GPT Image 2.5 Sunburst, dans l'édition du 28 septembre 2026. 50 correspond au repère DALL·E 3. Entre les deux, le score suit l'EloEloUn score issu de duels, comme aux échecs. Battre un modèle fort rapporte plus que battre un modèle faible. d'Arena en ligne droite : dix points de score valent 91 points d'Elo.
La marge et les ex æquo
La barre bleue couvre la marge d'erreurMarge d'erreurL'intervalle où le vrai niveau du modèle a neuf chances sur dix de se trouver. à 90 %, tirée de l'intervalle d'Arena. Deux modèles dont les marges se recouvrent sont ex æquoEx æquoDeux modèles sont ex æquo quand leurs marges d'erreur se recouvrent. L'écart entre eux est trop petit pour les départager. : ils partagent un groupe, où l'ordre ne départage personne.
Provisoire
Sous 2 000 votes, un score reste provisoire : il n'a pas de rang, son cadre est en pointillé et sa marge hachurée. Aucun modèle n'est dans ce cas ici.

Plus fragile que le classement des modèles de langage. Celui-ci croise 98 benchmarks ; ici, tout repose sur les préférences des votants d'une seule arène. Un biais dans le choix des consignes ou dans le goût des votants passe tel quel dans le score, sans autre source pour le corriger.