Aller au contenu
EN 4 QUESTIONSTrouver mon modèle

Classement · édition du

Classement des générateurs d'images, Texte dans l'image

Quel modèle écrit le mieux du texte dans une image ?

Comment lire ce tableauComment lire ?

Le score vient des votes à l'aveugle d'Arena : des internautes comparent deux images faites pour la même consigne et choisissent la meilleure. 100 correspond au meilleur modèle au lancement de ce classement, 50 au repère DALL·E 3. La barre indique la marge d'erreur : deux modèles dont les barres se chevauchent sont ex æquo. Tout le détail, et les limites.

Poids
Poids
Éditeur
Éditeur
Densité du tableau

Dans l'édition du 28 septembre 2026, GPT Image 2.5 Sunburst (OpenAI) est premier pour le texte dans l'image avec un score de 100,0.

Classement des générateurs d'images, texte dans l'image, édition du 28 septembre 2026
RangEmpreinteModèleÉtiquettesScore et marge (50 à 110)VotesSortieEssayer
RANG 1Seul en tête : sa marge ne recouvre celle d'aucun autre modèle.
1GPT Image 2.5 SunburstOpenAI100,099,0 à 101,03 699 votes
EX ÆQUORangs 2 à 3 : leurs marges se recouvrent.
2GPT Image 2.5 FlareOpenAI96,895,8 à 97,83 360 votes
3GPT Image 2OpenAI95,895,2 à 96,332 795 votes
4MAI-Image-2.6Microsoft AI90,489,6 à 91,26 053 votes
EX ÆQUORangs 5 à 6 : leurs marges se recouvrent.
5Grok Imagine Image 2.0xAI87,486,3 à 88,52 354 votesEssayer Grok Imagine Image 2.0
6Reve 2.1Reve87,386,3 à 88,22 756 votesEssayer Reve 2.1
EX ÆQUORangs 7 à 9 : leurs marges se recouvrent.
7Muse ImageMeta83,282,5 à 83,811 345 votes
8Reve 2.0Reve83,182,4 à 83,95 468 votesEssayer Reve 2.0
9Nano Banana 2Google82,782,2 à 83,317 342 votesEssayer Nano Banana 2
EX ÆQUORangs 10 à 13 : leurs marges se recouvrent.
10Qwen-Image-3.0-ProAlibaba81,580,7 à 82,43 643 votesEssayer Qwen-Image-3.0-Pro
11MAI-Image-2.5Microsoft AI81,480,8 à 81,920 912 votes
12Nano Banana 2 LiteGoogle80,679,9 à 81,45 826 votesEssayer Nano Banana 2 Lite
13Nano Banana ProGoogle80,379,9 à 80,755 545 votesEssayer Nano Banana Pro
Sans rangQwen-Image-2.1PROVISOIREAlibaba79,578,2 à 80,71 361 votes
EX ÆQUORangs 14 à 15 : leurs marges se recouvrent.
14Seedream 5.0 ProByteDance78,878,3 à 79,327 232 votesEssayer Seedream 5.0 Pro
15GPT Image 1.5OpenAI78,578,1 à 78,959 309 votes
16Ideogram 4.0Ideogram77,076,5 à 77,617 299 votesEssayer Ideogram 4.0
EX ÆQUORangs 17 à 18 : leurs marges se recouvrent.
17Uni-1.1 MaxLuma AI75,174,3 à 75,94 796 votes
18Uni-1.1Luma AI74,073,4 à 74,513 698 votes
19Qwen-Image-2.0-ProAlibaba73,472,7 à 74,24 374 votes
EX ÆQUORangs 20 à 23 : leurs marges se recouvrent.
20Reve v1.5Reve71,971,4 à 72,513 637 votesEssayer Reve v1.5
21Grok Imagine ImagexAI71,771,3 à 72,093 401 votesEssayer Grok Imagine Image
22Grok Imagine Image ProxAI71,471,0 à 71,935 037 votes
23MAI-Image-2Microsoft AI70,970,3 à 71,419 396 votes
EX ÆQUORangs 24 à 25 : leurs marges se recouvrent.
24FLUX.2 [flex]Black Forest Labs70,470,0 à 70,852 342 votesEssayer FLUX.2 [flex]
25FLUX.2 [max]Black Forest Labs69,869,3 à 70,242 386 votesEssayer FLUX.2 [max]
Sans rangRecraft V4.1 Utility ProPROVISOIRERecraft69,467,9 à 70,9956 votesEssayer Recraft V4.1 Utility Pro
EX ÆQUORangs 26 à 29 : leurs marges se recouvrent.
26FLUX.2 [dev]Black Forest Labs69,068,6 à 69,524 410 votes
Sans rangRecraft V4.1 ProPROVISOIRERecraft68,867,4 à 70,3956 votesEssayer Recraft V4.1 Pro
27FLUX.2 [pro]Black Forest Labs68,768,4 à 69,169 022 votesEssayer FLUX.2 [pro]
28Nano BananaGoogle68,668,3 à 68,9234 500 votesEssayer Nano Banana
29HunyuanImage 3.0Tencent68,167,7 à 68,652 522 votesEssayer HunyuanImage 3.0
EX ÆQUORangs 30 à 35 : leurs marges se recouvrent.
30Wan 2.6 T2IAlibaba68,167,7 à 68,479 115 votes
31Imagen 4 UltraGoogle68,067,6 à 68,590 345 votes
32Cosmos3-Super-Text2ImageNVIDIA67,766,8 à 68,72 436 votes
33Seedream 4.5ByteDance67,567,2 à 67,897 172 votesEssayer Seedream 4.5
34Seedream 4.0ByteDance67,566,5 à 68,43 099 votesEssayer Seedream 4.0
35Wan 2.5 Preview ImageAlibaba67,467,0 à 67,788 333 votes
EX ÆQUORangs 36 à 38 : leurs marges se recouvrent.
36Recraft V4Recraft67,166,7 à 67,545 141 votesEssayer Recraft V4
37Seedream 5.0 LiteByteDance66,866,4 à 67,143 258 votesEssayer Seedream 5.0 Lite
38HiDream-O1-ImageHiDream.ai66,666,2 à 67,118 944 votes
EX ÆQUORangs 39 à 42 : leurs marges se recouvrent.
39Krea 2 MediumKrea65,965,4 à 66,516 666 votesEssayer Krea 2 Medium
40Qwen-Image-2512Alibaba65,565,1 à 66,030 851 votes
41Imagen 4Google65,565,2 à 65,9141 558 votes
42Wan 2.7 Image ProAlibaba65,364,7 à 65,812 680 votes
EX ÆQUORangs 43 à 45 : leurs marges se recouvrent.
43Wan 2.7 ImageAlibaba64,864,2 à 65,312 705 votes
44GPT Image 1OpenAI64,764,3 à 65,072 150 votes
45Krea 2 LargeKrea64,564,0 à 65,016 133 votesEssayer Krea 2 Large
Sans rangRecraft V4.1 FlashPROVISOIRERecraft64,362,9 à 65,61 149 votesEssayer Recraft V4.1 Flash
EX ÆQUORangs 46 à 47 : leurs marges se recouvrent.
46GPT Image 1 MiniOpenAI63,763,3 à 64,158 202 votes
47Krea 2 TurboKrea63,462,8 à 63,913 553 votesEssayer Krea 2 Turbo
48Qwen-Image avec extension du promptAlibaba61,461,1 à 61,7187 346 votes
EX ÆQUORangs 49 à 52 : leurs marges se recouvrent.
49FLUX.1 Kontext [max]Black Forest Labs60,459,9 à 60,815 684 votesEssayer FLUX.1 Kontext [max]
50Ideogram 3.0Ideogram60,359,8 à 60,833 482 votesEssayer Ideogram 3.0
51MAI-Image-1Microsoft AI60,159,7 à 60,631 640 votes
52Z-Image-TurboAlibaba59,358,7 à 59,97 466 votes
EX ÆQUORangs 53 à 55 : leurs marges se recouvrent.
53FLUX.2 [klein] 9BBlack Forest Labs59,058,6 à 59,454 481 votes
54FLUX.1 Kontext [pro]Black Forest Labs58,558,1 à 58,978 686 votesEssayer FLUX.1 Kontext [pro]
55Seedream 3.0ByteDance58,357,7 à 59,09 069 votes
EX ÆQUORangs 56 à 59 : leurs marges se recouvrent.
56Qwen-ImageAlibaba57,957,5 à 58,415 521 votes
57Ideogram 2.0Ideogram57,857,1 à 58,510 893 votes
58Imagen 3Google57,757,3 à 58,276 519 votes
59PhotonLuma AI57,356,8 à 57,833 843 votes
Sans rangGLM-ImagePROVISOIREZ.ai56,655,4 à 57,81 487 votes
EX ÆQUORangs 60 à 62 : leurs marges se recouvrent.
60P-ImagePruna AI55,354,9 à 55,738 702 votesEssayer P-Image
61Runway Gen-4 ImageRunway55,054,4 à 55,519 842 votesEssayer Runway Gen-4 Image
62FLUX.2 [klein] 4BBlack Forest Labs54,754,3 à 55,155 213 votes
EX ÆQUORangs 63 à 65 : leurs marges se recouvrent.
63Gemini 2.0 Flash Preview Image GenerationGoogle53,853,4 à 54,358 814 votes
64Lucid OriginLeonardo.Ai53,753,3 à 54,268 172 votes
65Recraft V3Recraft53,753,2 à 54,143 490 votesEssayer Recraft V3
66FLUX1.1 [pro]Black Forest Labs52,752,0 à 53,310 769 votes
EX ÆQUORangs 67 à 68 : leurs marges se recouvrent.
67DALL·E 3OpenAI50,049,5 à 50,549 694 votes
68FLUX.1 [dev]Black Forest Labs49,548,7 à 50,26 736 votes
69FLUX.1 Kontext [dev]Black Forest Labs48,548,0 à 49,050 306 votes
70Stable Diffusion 3.5 LargeStability AI45,344,4 à 46,23 222 votes
71BAGELByteDance40,639,7 à 41,53 133 votes

71 modèles classés et 5 provisoires. Votes d'Arena publiés le 24 septembre 2026.

Comment lire ce classement

Une seule source, Arena
Des internautes y écrivent une consigne, reçoivent deux images faites par deux modèles anonymes et votent pour la meilleure. Ce classement vient de ces votes à l'aveugle, publiés sous licence CC BY 4.0 dans le jeu de données d'Arena, à jour au . Chaque modèle classé compte de 2 354 à 234 500 votes.
L'échelle
100 correspond au meilleur modèle au lancement de ce classement, GPT Image 2.5 Sunburst, dans l'édition du 28 septembre 2026. 50 correspond au repère DALL·E 3. Entre les deux, le score suit l'EloEloUn score issu de duels, comme aux échecs. Battre un modèle fort rapporte plus que battre un modèle faible. d'Arena en ligne droite : dix points de score valent 100 points d'Elo.
La marge et les ex æquo
La barre bleue couvre la marge d'erreurMarge d'erreurL'intervalle où le vrai niveau du modèle a neuf chances sur dix de se trouver. à 90 %, tirée de l'intervalle d'Arena. Deux modèles dont les marges se recouvrent sont ex æquoEx æquoDeux modèles sont ex æquo quand leurs marges d'erreur se recouvrent. L'écart entre eux est trop petit pour les départager. : ils partagent un groupe, où l'ordre ne départage personne.
Provisoire
Sous 2 000 votes, un score reste provisoire : il n'a pas de rang, son cadre est en pointillé et sa marge hachurée. 5 modèles sont dans ce cas ici.

Plus fragile que le classement des modèles de langage. Celui-ci croise 98 benchmarks ; ici, tout repose sur les préférences des votants d'une seule arène. Un biais dans le choix des consignes ou dans le goût des votants passe tel quel dans le score, sans autre source pour le corriger.