Aller au contenu
EN 4 QUESTIONSTrouver mon modèle

Classement · édition du

Classement des générateurs d'images, Édition d'image

Quel modèle retouche le mieux une image sur consigne ?

Comment lire ce tableauComment lire ?

Le score vient des votes à l'aveugle d'Arena : des internautes comparent deux images faites pour la même consigne et choisissent la meilleure. 100 correspond au meilleur modèle au lancement de ce classement, 50 au repère FLUX.1 Kontext [pro]. La barre indique la marge d'erreur : deux modèles dont les barres se chevauchent sont ex æquo. Tout le détail, et les limites.

Poids
Poids
Éditeur
Éditeur
Densité du tableau

Dans l'édition du 28 septembre 2026, GPT Image 2.5 Sunburst (OpenAI) est premier en retouche d'image avec un score de 99,5.

Classement des générateurs d'images, édition d'image, édition du 28 septembre 2026
RangEmpreinteModèleÉtiquettesScore et marge (50 à 110)VotesSortieEssayer
RANG 1Seul en tête : sa marge ne recouvre celle d'aucun autre modèle.
1GPT Image 2.5 SunburstOpenAI99,598,8 à 100,147 289 votes
2GPT Image 2.5 FlareOpenAI93,292,6 à 93,944 792 votes
3GPT Image 2OpenAI90,790,4 à 91,1293 819 votes
EX ÆQUORangs 4 à 5 : leurs marges se recouvrent.
4Grok Imagine Image 2.0xAI85,885,2 à 86,536 022 votesEssayer Grok Imagine Image 2.0
5MAI-Image-2.6Microsoft AI85,885,2 à 86,441 512 votes
EX ÆQUORangs 6 à 7 : leurs marges se recouvrent.
6Muse ImageMeta82,582,0 à 83,0130 653 votes
7MAI-Image-2.5Microsoft AI82,181,7 à 82,5190 356 votes
EX ÆQUORangs 8 à 11 : leurs marges se recouvrent.
8Seedream 5.0 ProByteDance81,180,7 à 81,5270 020 votesEssayer Seedream 5.0 Pro
9Grok Imagine Image QualityxAI80,780,1 à 81,438 256 votesEssayer Grok Imagine Image Quality
10Nano Banana ProGoogle80,680,3 à 80,9638 610 votesEssayer Nano Banana Pro
11chatgpt-image-latestOpenAI80,480,1 à 80,7617 941 votes
12Nano Banana 2Google80,279,8 à 80,6216 640 votesEssayer Nano Banana 2
EX ÆQUORangs 13 à 15 : leurs marges se recouvrent.
13Reve 2.1Reve78,377,6 à 79,020 823 votesEssayer Reve 2.1
14GPT Image 1.5OpenAI77,677,3 à 78,0642 272 votes
15Qwen-Image-2.1Alibaba77,276,5 à 77,914 617 votes
EX ÆQUORangs 16 à 17 : leurs marges se recouvrent.
16Reve 2.0Reve76,175,3 à 76,819 291 votesEssayer Reve 2.0
17Ideogram 4.5Ideogram75,074,1 à 76,05 441 votes
EX ÆQUORangs 18 à 19 : leurs marges se recouvrent.
18Uni-1.1 MaxLuma AI72,672,0 à 73,243 451 votes
19Grok Imagine ImagexAI71,971,6 à 72,2737 207 votesEssayer Grok Imagine Image
EX ÆQUORangs 20 à 21 : leurs marges se recouvrent.
20Uni-1.1Luma AI69,869,4 à 70,2177 667 votes
21Nano Banana 2 LiteGoogle69,669,1 à 70,265 764 votesEssayer Nano Banana 2 Lite
EX ÆQUORangs 22 à 26 : leurs marges se recouvrent.
22Qwen-Image-2.0-ProAlibaba68,267,6 à 68,756 781 votes
23HunyuanImage 3.0-InstructTencent68,167,7 à 68,5331 592 votes
24Wan 2.7 Image ProAlibaba68,167,6 à 68,543 992 votes
25Seedream 4.5ByteDance67,967,7 à 68,21 266 531 votesEssayer Seedream 4.5
26Wan 2.7 ImageAlibaba67,967,4 à 68,344 814 votes
EX ÆQUORangs 27 à 28 : leurs marges se recouvrent.
27Seedream 5.0 LiteByteDance66,866,5 à 67,1446 300 votesEssayer Seedream 5.0 Lite
28Nano BananaGoogle66,766,5 à 66,911 355 727 votesEssayer Nano Banana
29Seedream 4.0ByteDance63,462,6 à 64,2210 076 votesEssayer Seedream 4.0
EX ÆQUORangs 30 à 31 : leurs marges se recouvrent.
30Reve v1.1Reve62,261,9 à 62,5672 675 votesEssayer Reve v1.1
31FLUX.2 [max]Black Forest Labs62,261,8 à 62,6375 959 votesEssayer FLUX.2 [max]
32Kling Image O1Kuaishou60,760,3 à 61,1143 692 votesEssayer Kling Image O1
EX ÆQUORangs 33 à 34 : leurs marges se recouvrent.
33FLUX.2 [pro]Black Forest Labs59,959,6 à 60,2624 352 votesEssayer FLUX.2 [pro]
34Qwen-Image-EditAlibaba59,359,0 à 59,62 022 077 votes
EX ÆQUORangs 35 à 37 : leurs marges se recouvrent.
35Reve v1Reve58,357,7 à 58,9395 314 votesEssayer Reve v1
36Qwen-Image-Edit-2511Alibaba58,257,9 à 58,6485 308 votes
37Wan 2.6 ImageAlibaba57,857,5 à 58,1664 189 votes
EX ÆQUORangs 38 à 40 : leurs marges se recouvrent.
38FLUX.2 [flex]Black Forest Labs56,956,6 à 57,3443 953 votesEssayer FLUX.2 [flex]
39FLUX.2 [klein] 9BBlack Forest Labs56,956,6 à 57,3540 833 votes
40FLUX.2 [dev]Black Forest Labs56,956,4 à 57,4254 450 votes
EX ÆQUORangs 41 à 42 : leurs marges se recouvrent.
41P-Image-EditPruna AI54,954,5 à 55,3359 965 votesEssayer P-Image-Edit
42Reve v1.1 FastReve54,454,1 à 54,8553 361 votesEssayer Reve v1.1 Fast
43Reve Edit FastReve53,152,6 à 53,6230 289 votesEssayer Reve Edit Fast
44FLUX.2 [klein] 4BBlack Forest Labs51,651,3 à 51,9541 422 votes
EX ÆQUORangs 45 à 47 : leurs marges se recouvrent.
45FLUX.1 Kontext [max]Black Forest Labs50,650,3 à 50,9390 877 votesEssayer FLUX.1 Kontext [max]
46Wan 2.5 Preview ImageAlibaba50,650,3 à 50,9715 740 votes
47FLUX.1 Kontext [pro]Black Forest Labs50,049,7 à 50,36 404 790 votesEssayer FLUX.1 Kontext [pro]
48FLUX.1 Kontext [dev]Black Forest Labs46,145,7 à 46,53 639 915 votes
EX ÆQUORangs 49 à 50 : leurs marges se recouvrent.
49SeedEdit 3.0ByteDance44,744,3 à 45,04 918 196 votes
50GPT Image 1OpenAI44,644,3 à 44,92 870 020 votes
51GPT Image 1 MiniOpenAI42,642,2 à 42,9682 950 votes
52Gemini 2.0 Flash Preview Image GenerationGoogle36,336,1 à 36,64 943 024 votes
53BAGELByteDance28,627,9 à 29,313 488 votes
54Step1X-EditStepFun24,524,0 à 25,1155 417 votes

54 modèles classés. Votes d'Arena publiés le 30 septembre 2026.

Comment lire ce classement

Une seule source, Arena
Des internautes y écrivent une consigne, reçoivent deux images faites par deux modèles anonymes et votent pour la meilleure. Ce classement vient de ces votes à l'aveugle, publiés sous licence CC BY 4.0 dans le jeu de données d'Arena, à jour au . Chaque modèle classé compte de 5 441 à 11 355 727 votes.
L'échelle
100 correspond au meilleur modèle au lancement de ce classement, GPT Image 2.5 Sunburst, dans l'édition du 28 septembre 2026. 50 correspond au repère FLUX.1 Kontext [pro]. Entre les deux, le score suit l'EloEloUn score issu de duels, comme aux échecs. Battre un modèle fort rapporte plus que battre un modèle faible. d'Arena en ligne droite : dix points de score valent 70 points d'Elo.
La marge et les ex æquo
La barre bleue couvre la marge d'erreurMarge d'erreurL'intervalle où le vrai niveau du modèle a neuf chances sur dix de se trouver. à 90 %, tirée de l'intervalle d'Arena. Deux modèles dont les marges se recouvrent sont ex æquoEx æquoDeux modèles sont ex æquo quand leurs marges d'erreur se recouvrent. L'écart entre eux est trop petit pour les départager. : ils partagent un groupe, où l'ordre ne départage personne.
Provisoire
Sous 2 000 votes, un score reste provisoire : il n'a pas de rang, son cadre est en pointillé et sa marge hachurée. Aucun modèle n'est dans ce cas ici.

Plus fragile que le classement des modèles de langage. Celui-ci croise 98 benchmarks ; ici, tout repose sur les préférences des votants d'une seule arène. Un biais dans le choix des consignes ou dans le goût des votants passe tel quel dans le score, sans autre source pour le corriger.