Classement · édition du
Classement des générateurs d'images, Édition à plusieurs images
Quel modèle compose le mieux une image à partir de plusieurs ?
Comment lire ce tableauComment lire ?
Le score vient des votes à l'aveugle d'Arena : des internautes comparent deux images faites pour la même consigne et choisissent la meilleure. 100 correspond au meilleur modèle au lancement de ce classement, 50 au repère FLUX.1 Kontext [pro]. La barre indique la marge d'erreur : deux modèles dont les barres se chevauchent sont ex æquo. Tout le détail, et les limites.
Dans l'édition du 28 septembre 2026, GPT Image 2.5 Sunburst (OpenAI) est premier en édition à plusieurs images avec un score de 100,0.
| Rang | Empreinte | Modèle | Étiquettes | Score et marge (50 à 110) | Votes | Sortie | Essayer |
|---|---|---|---|---|---|---|---|
| RANG 1Seul en tête : sa marge ne recouvre celle d'aucun autre modèle. | |||||||
| 1 | GPT Image 2.5 SunburstOpenAI | 100,099,4 à 100,6 | 14 999 votes | ||||
| 2 | GPT Image 2.5 FlareOpenAI | 94,894,2 à 95,3 | 15 443 votes | ||||
| 3 | GPT Image 2OpenAI | 92,191,7 à 92,4 | 110 462 votes | ||||
| 4 | Seedream 5.0 ProByteDance | 87,987,5 à 88,3 | 55 549 votes | Essayer Seedream 5.0 Pro | |||
| 5 | Muse ImageMeta | 86,786,3 à 87,1 | 79 826 votes | ||||
| EX ÆQUORangs 6 à 7 : leurs marges se recouvrent. | |||||||
| 6 | Nano Banana 2Google | 83,182,7 à 83,4 | 79 551 votes | Essayer Nano Banana 2 | |||
| 7 | Nano Banana ProGoogle | 82,982,6 à 83,3 | 285 282 votes | Essayer Nano Banana Pro | |||
| EX ÆQUORangs 8 à 9 : leurs marges se recouvrent. | |||||||
| 8 | chatgpt-image-latestOpenAI | 81,381,0 à 81,6 | 219 635 votes | ||||
| 9 | Reve 2.0Reve | 80,379,6 à 81,0 | 9 335 votes | Essayer Reve 2.0 | |||
| 10 | GPT Image 1.5OpenAI | 80,279,9 à 80,6 | 201 226 votes | ||||
| 11 | Uni-1.1 MaxLuma AI | 76,676,1 à 77,1 | 20 613 votes | ||||
| EX ÆQUORangs 12 à 15 : leurs marges se recouvrent. | |||||||
| 12 | Seedream 4.5ByteDance | 74,674,4 à 74,9 | 516 700 votes | Essayer Seedream 4.5 | |||
| 13 | Nano Banana 2 LiteGoogle | 74,574,1 à 75,0 | 26 345 votes | Essayer Nano Banana 2 Lite | |||
| 14 | Wan 2.7 Image ProAlibaba | 74,574,0 à 75,0 | 16 948 votes | ||||
| 15 | Uni-1.1Luma AI | 74,173,8 à 74,5 | 66 126 votes | ||||
| 16 | Wan 2.7 ImageAlibaba | 73,573,0 à 74,0 | 18 204 votes | ||||
| 17 | Seedream 5.0 LiteByteDance | 72,372,0 à 72,5 | 296 906 votes | Essayer Seedream 5.0 Lite | |||
| 18 | Reve v1.1Reve | 71,671,2 à 71,9 | 253 598 votes | Essayer Reve v1.1 | |||
| EX ÆQUORangs 19 à 20 : leurs marges se recouvrent. | |||||||
| 19 | Kling Image O1Kuaishou | 70,570,1 à 71,0 | 45 427 votes | Essayer Kling Image O1 | |||
| 20 | FLUX.2 [max]Black Forest Labs | 70,369,9 à 70,7 | 136 189 votes | Essayer FLUX.2 [max] | |||
| 21 | FLUX.2 [pro]Black Forest Labs | 69,369,0 à 69,6 | 216 531 votes | Essayer FLUX.2 [pro] | |||
| EX ÆQUORangs 22 à 23 : leurs marges se recouvrent. | |||||||
| 22 | Nano BananaGoogle | 68,668,4 à 68,9 | 4 598 539 votes | Essayer Nano Banana | |||
| 23 | FLUX.2 [flex]Black Forest Labs | 68,668,2 à 69,0 | 125 543 votes | Essayer FLUX.2 [flex] | |||
| EX ÆQUORangs 24 à 26 : leurs marges se recouvrent. | |||||||
| 24 | Reve v1Reve | 67,366,6 à 68,1 | 531 372 votes | Essayer Reve v1 | |||
| 25 | Wan 2.6 ImageAlibaba | 66,966,6 à 67,2 | 197 624 votes | ||||
| 26 | FLUX.2 [klein] 9BBlack Forest Labs | 66,365,9 à 66,6 | 148 086 votes | ||||
| 27 | Seedream 4.0ByteDance | 65,965,6 à 66,3 | 1 013 496 votes | Essayer Seedream 4.0 | |||
| 28 | FLUX.2 [dev]Black Forest Labs | 65,164,7 à 65,5 | 113 625 votes | ||||
| 29 | Qwen-Image-Edit-2511Alibaba | 62,161,8 à 62,4 | 218 621 votes | ||||
| EX ÆQUORangs 30 à 31 : leurs marges se recouvrent. | |||||||
| 30 | FLUX.2 [klein] 4BBlack Forest Labs | 61,461,0 à 61,7 | 147 448 votes | ||||
| 31 | Wan 2.5 Preview ImageAlibaba | 61,060,7 à 61,4 | 114 455 votes | ||||
| 32 | P-Image-EditPruna AI | 59,258,8 à 59,5 | 126 846 votes | Essayer P-Image-Edit | |||
| 33 | GPT Image 1OpenAI | 57,056,7 à 57,3 | 1 822 434 votes | ||||
| 34 | GPT Image 1 MiniOpenAI | 55,455,0 à 55,7 | 615 200 votes | ||||
| EX ÆQUORangs 35 à 38 : leurs marges se recouvrent. | |||||||
| 35 | FLUX.1 Kontext [pro]Black Forest Labs | 50,048,9 à 51,1 | 140 924 votes | Essayer FLUX.1 Kontext [pro] | |||
| 36 | FLUX.1 Kontext [max]Black Forest Labs | 49,849,1 à 50,6 | 51 984 votes | Essayer FLUX.1 Kontext [max] | |||
| 37 | Gemini 2.0 Flash Preview Image GenerationGoogle | 49,749,1 à 50,2 | 3 160 719 votes | ||||
| 38 | SeedEdit 3.0ByteDance | 48,046,7 à 49,4 | 86 880 votes | ||||
| 39 | FLUX.1 Kontext [dev]Black Forest Labs | 47,246,3 à 48,0 | 129 243 votes | ||||
Aucun modèle ne correspond à ces filtres.
39 modèles classés. Votes d'Arena publiés le 22 septembre 2026.
Comment lire ce classement
- Une seule source, Arena
- Des internautes y écrivent une consigne, reçoivent deux images faites par deux modèles anonymes et votent pour la meilleure. Ce classement vient de ces votes à l'aveugle, publiés sous licence CC BY 4.0 dans le jeu de données d'Arena, à jour au . Chaque modèle classé compte de 9 335 à 4 598 539 votes.
- L'échelle
- 100 correspond au meilleur modèle au lancement de ce classement, GPT Image 2.5 Sunburst, dans l'édition du 28 septembre 2026. 50 correspond au repère FLUX.1 Kontext [pro]. Entre les deux, le score suit l'EloEloUn score issu de duels, comme aux échecs. Battre un modèle fort rapporte plus que battre un modèle faible. d'Arena en ligne droite : dix points de score valent 93 points d'Elo.
- La marge et les ex æquo
- La barre bleue couvre la marge d'erreurMarge d'erreurL'intervalle où le vrai niveau du modèle a neuf chances sur dix de se trouver. à 90 %, tirée de l'intervalle d'Arena. Deux modèles dont les marges se recouvrent sont ex æquoEx æquoDeux modèles sont ex æquo quand leurs marges d'erreur se recouvrent. L'écart entre eux est trop petit pour les départager. : ils partagent un groupe, où l'ordre ne départage personne.
- Provisoire
- Sous 2 000 votes, un score reste provisoire : il n'a pas de rang, son cadre est en pointillé et sa marge hachurée. Aucun modèle n'est dans ce cas ici.
Plus fragile que le classement des modèles de langage. Celui-ci croise 98 benchmarks ; ici, tout repose sur les préférences des votants d'une seule arène. Un biais dans le choix des consignes ou dans le goût des votants passe tel quel dans le score, sans autre source pour le corriger.
Les autres classements d'images
- Texte vers image100,0GPT Image 2.5 Sunburst
- Texte100,0GPT Image 2.5 Sunburst
- Photo100,0GPT Image 2.5 Sunburst
- Portraits96,5GPT Image 2
- Art96,9GPT Image 2
- Dessin animé100,0GPT Image 2.5 Sunburst
- Graphisme100,0GPT Image 2.5 Sunburst
- 3D93,7GPT Image 2
- Retouche99,5GPT Image 2.5 Sunburst
Voir aussi : le classement des modèles de langage et le classement de la vidéo.