Aller au contenu
EN 4 QUESTIONSTrouver mon modèle

Classement · édition du

Classement des générateurs d'images, Édition à plusieurs images

Quel modèle compose le mieux une image à partir de plusieurs ?

Comment lire ce tableauComment lire ?

Le score vient des votes à l'aveugle d'Arena : des internautes comparent deux images faites pour la même consigne et choisissent la meilleure. 100 correspond au meilleur modèle au lancement de ce classement, 50 au repère FLUX.1 Kontext [pro]. La barre indique la marge d'erreur : deux modèles dont les barres se chevauchent sont ex æquo. Tout le détail, et les limites.

Poids
Poids
Éditeur
Éditeur
Densité du tableau

Dans l'édition du 28 septembre 2026, GPT Image 2.5 Sunburst (OpenAI) est premier en édition à plusieurs images avec un score de 100,0.

Classement des générateurs d'images, édition à plusieurs images, édition du 28 septembre 2026
RangEmpreinteModèleÉtiquettesScore et marge (50 à 110)VotesSortieEssayer
RANG 1Seul en tête : sa marge ne recouvre celle d'aucun autre modèle.
1GPT Image 2.5 SunburstOpenAI100,099,4 à 100,614 999 votes
2GPT Image 2.5 FlareOpenAI94,894,2 à 95,315 443 votes
3GPT Image 2OpenAI92,191,7 à 92,4110 462 votes
4Seedream 5.0 ProByteDance87,987,5 à 88,355 549 votesEssayer Seedream 5.0 Pro
5Muse ImageMeta86,786,3 à 87,179 826 votes
EX ÆQUORangs 6 à 7 : leurs marges se recouvrent.
6Nano Banana 2Google83,182,7 à 83,479 551 votesEssayer Nano Banana 2
7Nano Banana ProGoogle82,982,6 à 83,3285 282 votesEssayer Nano Banana Pro
EX ÆQUORangs 8 à 9 : leurs marges se recouvrent.
8chatgpt-image-latestOpenAI81,381,0 à 81,6219 635 votes
9Reve 2.0Reve80,379,6 à 81,09 335 votesEssayer Reve 2.0
10GPT Image 1.5OpenAI80,279,9 à 80,6201 226 votes
11Uni-1.1 MaxLuma AI76,676,1 à 77,120 613 votes
EX ÆQUORangs 12 à 15 : leurs marges se recouvrent.
12Seedream 4.5ByteDance74,674,4 à 74,9516 700 votesEssayer Seedream 4.5
13Nano Banana 2 LiteGoogle74,574,1 à 75,026 345 votesEssayer Nano Banana 2 Lite
14Wan 2.7 Image ProAlibaba74,574,0 à 75,016 948 votes
15Uni-1.1Luma AI74,173,8 à 74,566 126 votes
16Wan 2.7 ImageAlibaba73,573,0 à 74,018 204 votes
17Seedream 5.0 LiteByteDance72,372,0 à 72,5296 906 votesEssayer Seedream 5.0 Lite
18Reve v1.1Reve71,671,2 à 71,9253 598 votesEssayer Reve v1.1
EX ÆQUORangs 19 à 20 : leurs marges se recouvrent.
19Kling Image O1Kuaishou70,570,1 à 71,045 427 votesEssayer Kling Image O1
20FLUX.2 [max]Black Forest Labs70,369,9 à 70,7136 189 votesEssayer FLUX.2 [max]
21FLUX.2 [pro]Black Forest Labs69,369,0 à 69,6216 531 votesEssayer FLUX.2 [pro]
EX ÆQUORangs 22 à 23 : leurs marges se recouvrent.
22Nano BananaGoogle68,668,4 à 68,94 598 539 votesEssayer Nano Banana
23FLUX.2 [flex]Black Forest Labs68,668,2 à 69,0125 543 votesEssayer FLUX.2 [flex]
EX ÆQUORangs 24 à 26 : leurs marges se recouvrent.
24Reve v1Reve67,366,6 à 68,1531 372 votesEssayer Reve v1
25Wan 2.6 ImageAlibaba66,966,6 à 67,2197 624 votes
26FLUX.2 [klein] 9BBlack Forest Labs66,365,9 à 66,6148 086 votes
27Seedream 4.0ByteDance65,965,6 à 66,31 013 496 votesEssayer Seedream 4.0
28FLUX.2 [dev]Black Forest Labs65,164,7 à 65,5113 625 votes
29Qwen-Image-Edit-2511Alibaba62,161,8 à 62,4218 621 votes
EX ÆQUORangs 30 à 31 : leurs marges se recouvrent.
30FLUX.2 [klein] 4BBlack Forest Labs61,461,0 à 61,7147 448 votes
31Wan 2.5 Preview ImageAlibaba61,060,7 à 61,4114 455 votes
32P-Image-EditPruna AI59,258,8 à 59,5126 846 votesEssayer P-Image-Edit
33GPT Image 1OpenAI57,056,7 à 57,31 822 434 votes
34GPT Image 1 MiniOpenAI55,455,0 à 55,7615 200 votes
EX ÆQUORangs 35 à 38 : leurs marges se recouvrent.
35FLUX.1 Kontext [pro]Black Forest Labs50,048,9 à 51,1140 924 votesEssayer FLUX.1 Kontext [pro]
36FLUX.1 Kontext [max]Black Forest Labs49,849,1 à 50,651 984 votesEssayer FLUX.1 Kontext [max]
37Gemini 2.0 Flash Preview Image GenerationGoogle49,749,1 à 50,23 160 719 votes
38SeedEdit 3.0ByteDance48,046,7 à 49,486 880 votes
39FLUX.1 Kontext [dev]Black Forest Labs47,246,3 à 48,0129 243 votes

39 modèles classés. Votes d'Arena publiés le 22 septembre 2026.

Comment lire ce classement

Une seule source, Arena
Des internautes y écrivent une consigne, reçoivent deux images faites par deux modèles anonymes et votent pour la meilleure. Ce classement vient de ces votes à l'aveugle, publiés sous licence CC BY 4.0 dans le jeu de données d'Arena, à jour au . Chaque modèle classé compte de 9 335 à 4 598 539 votes.
L'échelle
100 correspond au meilleur modèle au lancement de ce classement, GPT Image 2.5 Sunburst, dans l'édition du 28 septembre 2026. 50 correspond au repère FLUX.1 Kontext [pro]. Entre les deux, le score suit l'EloEloUn score issu de duels, comme aux échecs. Battre un modèle fort rapporte plus que battre un modèle faible. d'Arena en ligne droite : dix points de score valent 93 points d'Elo.
La marge et les ex æquo
La barre bleue couvre la marge d'erreurMarge d'erreurL'intervalle où le vrai niveau du modèle a neuf chances sur dix de se trouver. à 90 %, tirée de l'intervalle d'Arena. Deux modèles dont les marges se recouvrent sont ex æquoEx æquoDeux modèles sont ex æquo quand leurs marges d'erreur se recouvrent. L'écart entre eux est trop petit pour les départager. : ils partagent un groupe, où l'ordre ne départage personne.
Provisoire
Sous 2 000 votes, un score reste provisoire : il n'a pas de rang, son cadre est en pointillé et sa marge hachurée. Aucun modèle n'est dans ce cas ici.

Plus fragile que le classement des modèles de langage. Celui-ci croise 98 benchmarks ; ici, tout repose sur les préférences des votants d'une seule arène. Un biais dans le choix des consignes ou dans le goût des votants passe tel quel dans le score, sans autre source pour le corriger.