# Code Arena, WebDev

> Fiche du benchmark Code Arena, WebDev sur Quelle IA, édition du 28 septembre 2026. Deux modèles construisent le même site ou la même application web, l'internaute vote pour le meilleur résultat. En tête au 28 septembre 2026 : Claude Opus 5.5 (1 817,8 Elo). Notation, limites et classement des 114 modèles mesurés.

Page : https://quelleia.com/benchmarks/arena_webdev/
Source du benchmark : https://arena.ai/leaderboard/code/webdev
Mainteneur : Arena (ex LMArena)
Tâche : Web et interfaces
État : actif

## À quoi il sert

Sur Quelle IA, Code Arena, WebDev sert à noter la tâche Web et interfaces : c'est son seul benchmark. Il départage surtout les modèles dont le score IA approche 80.

## Comment c'est noté

Un score Elo calculé sur des duels où le résultat s'affiche et s'utilise.

Pour le calcul, un Elo devient une probabilité de victoire face à un niveau de référence, ici 1 440 Elo. Un écart de 100 points donne environ 64 % de chances de l'emporter.

## Ce qu'il ne dit pas

Juge le rendu et l'usage immédiat. La qualité du code et sa maintenance ne sont pas évaluées.

## Qui le tient

Arena (ex LMArena).

## Comment lire le score

Chaque trait est un modèle, placé à son meilleur score. Un modèle qui obtient 1 440 Elo a un score IA d'environ 80. Le meilleur, Claude Opus 5.5, atteint 1 817,8 Elo.

Ce que le benchmark attend à chaque niveau, d'après sa courbe d'étalonnage :

- Score IA 51 (niveau de GPT-4o (Nov 2024)) : 1 018 Elo
- Score IA 76 (niveau de Claude Sonnet 4.5) : 1 388 Elo
- Score IA 100 (niveau de Claude Opus 5.5) : 1 733 Elo

## Son poids dans le score IA

5 % du score général. Code Arena, WebDev est le seul benchmark de la tâche Web et interfaces (5 % du score général) : il en porte tout le poids.

## Classement (114 modèles mesurés · 135 mesures, édition du 28 septembre 2026)

Un modèle par ligne, à sa meilleure configuration. « Suggère » : le score IA que cette seule mesure indique.

| Rang | Modèle | Éditeur | Réflexion | Score publié | Suggère | Source |
| --- | --- | --- | --- | --- | --- | --- |
| 1 | [Claude Opus 5.5](https://quelleia.com/modeles/claude-opus-5-5.md) | Anthropic | Maximale | 1 817,8 Elo | 105,7 | https://arena.ai/leaderboard |
| 2 | [GPT-6 Astra](https://quelleia.com/modeles/gpt-6-astra.md) | OpenAI | Maximale | 1 789,1 Elo | 103,8 | https://arena.ai/leaderboard |
| 3 | [GPT-6.1 Sol](https://quelleia.com/modeles/gpt-6-1-sol.md) | OpenAI | Maximale | 1 758,7 Elo | 101,7 | https://arena.ai/leaderboard |
| 4 | [Claude Fable 5.1](https://quelleia.com/modeles/claude-fable-5-1.md) | Anthropic | Maximale | 1 750,7 Elo | 101,1 | https://arena.ai/leaderboard |
| 5 | [Claude Sonnet 5.5](https://quelleia.com/modeles/claude-sonnet-5-5.md) | Anthropic | Élevée | 1 708,7 Elo | 98,3 | https://arena.ai/leaderboard |
| 6 | [Claude Opus 5](https://quelleia.com/modeles/claude-opus-5.md) | Anthropic | Maximale | 1 693,7 Elo | 97,3 | https://arena.ai/leaderboard |
| 7 | [GPT-6 Sol](https://quelleia.com/modeles/gpt-6-sol.md) | OpenAI | Maximale | 1 689,3 Elo | 97,0 | https://arena.ai/leaderboard |
| 8 | [Gemini 4 Argon](https://quelleia.com/modeles/gemini-4-argon.md) | Google DeepMind | Élevée | 1 679,0 Elo | 96,3 | https://arena.ai/leaderboard |
| 9 | [Qwen3.8 Max (0902)](https://quelleia.com/modeles/qwen3-8-max-0902.md) | Alibaba | Maximale | 1 671,2 Elo | 95,7 | https://arena.ai/leaderboard |
| 10 | [Kimi K3](https://quelleia.com/modeles/kimi-k3.md) | Moonshot | Maximale | 1 657,8 Elo | 94,8 | https://arena.ai/leaderboard |
| 11 | [Muse Spark 1.3](https://quelleia.com/modeles/muse-spark-1-3.md) | Meta AI | Maximale | 1 655,4 Elo | 94,6 | https://arena.ai/leaderboard |
| 12 | [Qwen3.8 Flash Next](https://quelleia.com/modeles/qwen3-8-flash-next.md) | Alibaba | non précisée | 1 637,8 Elo | 93,4 | https://arena.ai/leaderboard |
| 13 | [Grok 4.7](https://quelleia.com/modeles/grok-4-7.md) | xAI | Maximale | 1 636,3 Elo | 93,3 | https://arena.ai/leaderboard |
| 14 | [Tencent Hy4 preview](https://quelleia.com/modeles/tencent-hy4-preview.md) | Tencent | non précisée | 1 633,2 Elo | 93,1 | https://arena.ai/leaderboard |
| 15 | [Claude Fable 5](https://quelleia.com/modeles/claude-fable-5.md) | Anthropic | Élevée | 1 625,6 Elo | 92,6 | https://arena.ai/leaderboard |
| 16 | [GLM-5.3](https://quelleia.com/modeles/glm-5-3.md) | Z.ai (Zhipu AI) | Maximale | 1 622,0 Elo | 92,4 | https://arena.ai/leaderboard |
| 17 | [Grok 4.6](https://quelleia.com/modeles/grok-4-6.md) | xAI | Élevée | 1 620,1 Elo | 92,2 | https://arena.ai/leaderboard |
| 18 | [DeepSeek V4.1 Flash](https://quelleia.com/modeles/deepseek-v4-1-flash.md) | DeepSeek | Maximale | 1 620,0 Elo | 92,2 | https://arena.ai/leaderboard |
| 19 | [GPT-5.6 Sol](https://quelleia.com/modeles/gpt-5-6-sol.md) | OpenAI | Maximale | 1 619,3 Elo | 92,2 | https://arena.ai/leaderboard |
| 20 | [MiMo-V2.6-Pro](https://quelleia.com/modeles/mimo-v2-6-pro.md) | Xiaomi | non précisée | 1 618,5 Elo | 92,1 | https://arena.ai/leaderboard |
| 21 | [GLM-5.3-Flash](https://quelleia.com/modeles/glm-5-3-flash.md) | Z.ai (Zhipu AI) | non précisée | 1 614,8 Elo | 91,9 | https://arena.ai/leaderboard |
| 22 | [GLM-5.2](https://quelleia.com/modeles/glm-5-2.md) | Z.ai (Zhipu AI) | Maximale | 1 604,6 Elo | 91,2 | https://arena.ai/leaderboard |
| 23 | [Gemini 3.7 Flash](https://quelleia.com/modeles/gemini-3-7-flash.md) | Google DeepMind | Élevée | 1 592,2 Elo | 90,3 | https://arena.ai/leaderboard |
| 24 | [Qwen 3.8 27B](https://quelleia.com/modeles/qwen-3-8-27b.md) | Alibaba | non précisée | 1 590,4 Elo | 90,2 | https://arena.ai/leaderboard |
| 25 | [Gemini 3.8 Flash](https://quelleia.com/modeles/gemini-3-8-flash.md) | Google DeepMind | Élevée | 1 582,7 Elo | 89,7 | https://arena.ai/leaderboard |
| 26 | [DeepSeek-V4-Pro](https://quelleia.com/modeles/deepseek-v4-pro.md) | DeepSeek | Élevée | 1 582,3 Elo | 89,7 | https://arena.ai/leaderboard |
| 27 | [GPT-6 Luna](https://quelleia.com/modeles/gpt-6-luna.md) | OpenAI | Maximale | 1 581,9 Elo | 89,6 | https://arena.ai/leaderboard |
| 28 | [DeepSeek-V4-Flash](https://quelleia.com/modeles/deepseek-v4-flash.md) | DeepSeek | Élevée | 1 581,0 Elo | 89,6 | https://arena.ai/leaderboard |
| 29 | [Step 5 Preview](https://quelleia.com/modeles/step-5-preview.md) | StepFun | Élevée | 1 569,6 Elo | 88,8 | https://arena.ai/leaderboard |
| 30 | [Claude Opus 4.7](https://quelleia.com/modeles/claude-opus-4-7.md) | Anthropic | Élevée | 1 557,2 Elo | 88,0 | https://arena.ai/leaderboard |
| 31 | [Claude Opus 4.8](https://quelleia.com/modeles/claude-opus-4-8.md) | Anthropic | Élevée | 1 556,0 Elo | 87,9 | https://arena.ai/leaderboard |
| 32 | [Grok 4.5](https://quelleia.com/modeles/grok-4-5.md) | xAI | non précisée | 1 552,0 Elo | 87,6 | https://arena.ai/leaderboard |
| 33 | [Claude Opus 4.6](https://quelleia.com/modeles/claude-opus-4-6.md) | Anthropic | Élevée | 1 546,1 Elo | 87,2 | https://arena.ai/leaderboard |
| 34 | [Muse Spark 1.1](https://quelleia.com/modeles/muse-spark-1-1.md) | Meta AI | non précisée | 1 541,9 Elo | 86,9 | https://arena.ai/leaderboard |
| 35 | [Claude Sonnet 5](https://quelleia.com/modeles/claude-sonnet-5.md) | Anthropic | Élevée | 1 539,5 Elo | 86,7 | https://arena.ai/leaderboard |
| 36 | [Gemini 3.6 Flash](https://quelleia.com/modeles/gemini-3-6-flash.md) | Google DeepMind | Élevée | 1 536,3 Elo | 86,5 | https://arena.ai/leaderboard |
| 37 | [Muse Spark 1.2](https://quelleia.com/modeles/muse-spark-1-2.md) | Meta AI | non précisée | 1 531,8 Elo | 86,2 | https://arena.ai/leaderboard |
| 38 | [Claude Sonnet 4.6](https://quelleia.com/modeles/claude-sonnet-4-6.md) | Anthropic | non précisée | 1 521,6 Elo | 85,5 | https://arena.ai/leaderboard |
| 39 | [GPT-5.6 Terra](https://quelleia.com/modeles/gpt-5-6-terra.md) | OpenAI | Maximale | 1 519,5 Elo | 85,4 | https://arena.ai/leaderboard |
| 40 | [GPT-5.6 Luna](https://quelleia.com/modeles/gpt-5-6-luna.md) | OpenAI | Maximale | 1 517,9 Elo | 85,3 | https://arena.ai/leaderboard |
| 41 | [Qwen3.7-Max](https://quelleia.com/modeles/qwen3-7-max.md) | Alibaba | Maximale | 1 514,9 Elo | 85,1 | https://arena.ai/leaderboard |
| 42 | [GPT-5.5](https://quelleia.com/modeles/gpt-5-5.md) | OpenAI | Maximale | 1 512,1 Elo | 84,9 | https://arena.ai/leaderboard |
| 43 | [Kimi K2.6](https://quelleia.com/modeles/kimi-k2-6.md) | Moonshot | non précisée | 1 508,7 Elo | 84,6 | https://arena.ai/leaderboard |
| 44 | [GLM-5.1](https://quelleia.com/modeles/glm-5-1.md) | Z.ai (Zhipu AI) | non précisée | 1 508,5 Elo | 84,6 | https://arena.ai/leaderboard |
| 45 | [Hy3](https://quelleia.com/modeles/hy3.md) | Tencent | non précisée | 1 508,1 Elo | 84,6 | https://arena.ai/leaderboard |
| 46 | [Gemini 3.5 Flash](https://quelleia.com/modeles/gemini-3-5-flash.md) | Google DeepMind | Élevée | 1 499,1 Elo | 84,0 | https://arena.ai/leaderboard |
| 47 | [Claude Opus 4.5](https://quelleia.com/modeles/claude-opus-4-5.md) | Anthropic | Élevée | 1 493,4 Elo | 83,6 | https://arena.ai/leaderboard |
| 48 | [MiniMax-M3](https://quelleia.com/modeles/minimax-m3.md) | MiniMax | non précisée | 1 482,4 Elo | 82,8 | https://arena.ai/leaderboard |
| 49 | [Qwen 3.6 Max (Preview)](https://quelleia.com/modeles/qwen-3-6-max-preview.md) | Alibaba | Maximale | 1 481,8 Elo | 82,8 | https://arena.ai/leaderboard |
| 50 | [MiMo-V2.5-Pro](https://quelleia.com/modeles/mimo-v2-5-pro.md) | Xiaomi | non précisée | 1 476,9 Elo | 82,5 | https://arena.ai/leaderboard |
| 51 | [Kimi K2.7 Code](https://quelleia.com/modeles/kimi-k2-7-code.md) | Moonshot | non précisée | 1 472,9 Elo | 82,2 | https://arena.ai/leaderboard |
| 52 | [GPT-5.4](https://quelleia.com/modeles/gpt-5-4.md) | OpenAI | Élevée | 1 465,3 Elo | 81,7 | https://arena.ai/leaderboard |
| 53 | [Qwen 3.6 Plus](https://quelleia.com/modeles/qwen-3-6-plus.md) | Alibaba | non précisée | 1 460,6 Elo | 81,4 | https://arena.ai/leaderboard |
| 54 | [Gemini 3.1 Pro](https://quelleia.com/modeles/gemini-3-1-pro.md) | Google DeepMind | non précisée | 1 446,2 Elo | 80,4 | https://arena.ai/leaderboard |
| 55 | [Gemini 3.5 Flash-Lite](https://quelleia.com/modeles/gemini-3-5-flash-lite.md) | Google DeepMind | non précisée | 1 439,7 Elo | 79,9 | https://arena.ai/leaderboard |
| 56 | [Gemini 3 Pro](https://quelleia.com/modeles/gemini-3-pro.md) | Google DeepMind | non précisée | 1 438,9 Elo | 79,9 | https://arena.ai/leaderboard |
| 57 | [Gemini 3 Flash](https://quelleia.com/modeles/gemini-3-flash.md) | Google DeepMind | non précisée | 1 438,7 Elo | 79,9 | https://arena.ai/leaderboard |
| 58 | [MiMo-V2.5](https://quelleia.com/modeles/mimo-v2-5.md) | Xiaomi | non précisée | 1 437,7 Elo | 79,8 | https://arena.ai/leaderboard |
| 59 | [Kimi K2.5](https://quelleia.com/modeles/kimi-k2-5.md) | Moonshot | Élevée | 1 435,8 Elo | 79,7 | https://arena.ai/leaderboard |
| 60 | [GLM-4.7](https://quelleia.com/modeles/glm-4-7.md) | Z.ai (Zhipu AI) | non précisée | 1 434,5 Elo | 79,6 | https://arena.ai/leaderboard |
| 61 | [GLM-5](https://quelleia.com/modeles/glm-5.md) | Z.ai (Zhipu AI) | non précisée | 1 434,0 Elo | 79,5 | https://arena.ai/leaderboard |
| 62 | [MiMo-V2-Pro](https://quelleia.com/modeles/mimo-v2-pro.md) | Xiaomi | non précisée | 1 432,9 Elo | 79,5 | https://arena.ai/leaderboard |
| 63 | [GPT-5](https://quelleia.com/modeles/gpt-5.md) | OpenAI | Moyenne | 1 417,1 Elo | 78,4 | https://arena.ai/leaderboard |
| 64 | [GPT-5.2](https://quelleia.com/modeles/gpt-5-2.md) | OpenAI | non précisée | 1 415,5 Elo | 78,3 | https://arena.ai/leaderboard |
| 65 | [Inkling](https://quelleia.com/modeles/inkling.md) | Thinking Machines | non précisée | 1 412,0 Elo | 78,0 | https://arena.ai/leaderboard |
| 66 | [Inkling-Small](https://quelleia.com/modeles/inkling-small.md) | Thinking Machines | non précisée | 1 408,3 Elo | 77,8 | https://arena.ai/leaderboard |
| 67 | [GPT-5.3 Codex](https://quelleia.com/modeles/gpt-5-3-codex.md) | OpenAI | non précisée | 1 408,1 Elo | 77,8 | https://arena.ai/leaderboard |
| 68 | [Kimi K2.5 Instant](https://quelleia.com/modeles/kimi-k2-5-instant.md) | Moonshot | non précisée | 1 403,6 Elo | 77,5 | https://arena.ai/leaderboard |
| 69 | [GLM-5V-Turbo](https://quelleia.com/modeles/glm-5v-turbo.md) | Z.ai (Zhipu AI) | non précisée | 1 399,8 Elo | 77,2 | https://arena.ai/leaderboard |
| 70 | [Qwen3.5 397B-A17B](https://quelleia.com/modeles/qwen3-5-397b-a17b.md) | Alibaba | non précisée | 1 399,6 Elo | 77,2 | https://arena.ai/leaderboard |
| 71 | [MiniMax-M2.7](https://quelleia.com/modeles/minimax-m2-7.md) | MiniMax | non précisée | 1 397,1 Elo | 77,0 | https://arena.ai/leaderboard |
| 72 | [GPT-5.4 Mini](https://quelleia.com/modeles/gpt-5-4-mini.md) | OpenAI | Élevée | 1 396,9 Elo | 77,0 | https://arena.ai/leaderboard |
| 73 | [GPT-5.1](https://quelleia.com/modeles/gpt-5-1.md) | OpenAI | Moyenne | 1 394,7 Elo | 76,9 | https://arena.ai/leaderboard |
| 74 | [Claude Sonnet 4.5](https://quelleia.com/modeles/claude-sonnet-4-5.md) | Anthropic | Élevée | 1 393,1 Elo | 76,8 | https://arena.ai/leaderboard |
| 75 | [Claude Opus 4.1](https://quelleia.com/modeles/claude-opus-4-1.md) | Anthropic | non précisée | 1 389,7 Elo | 76,5 | https://arena.ai/leaderboard |
| 76 | [MiniMax-M2.5](https://quelleia.com/modeles/minimax-m2-5.md) | MiniMax | non précisée | 1 386,3 Elo | 76,3 | https://arena.ai/leaderboard |
| 77 | [MiniMax-M2.1](https://quelleia.com/modeles/minimax-m2-1.md) | MiniMax | non précisée | 1 384,0 Elo | 76,1 | https://arena.ai/leaderboard |
| 78 | [Grok 4.20 Beta (0309)](https://quelleia.com/modeles/grok-4-20-beta-0309.md) | xAI | Élevée | 1 374,1 Elo | 75,5 | https://arena.ai/leaderboard |
| 79 | [Solar Pro 4](https://quelleia.com/modeles/solar-pro-4.md) | Upstage | non précisée | 1 370,3 Elo | 75,2 | https://arena.ai/leaderboard |
| 80 | [Gemma 4 31B IT](https://quelleia.com/modeles/gemma-4-31b-it.md) | Google DeepMind | non précisée | 1 364,7 Elo | 74,8 | https://arena.ai/leaderboard |
| 81 | [DeepSeek-V3.2](https://quelleia.com/modeles/deepseek-v3-2.md) | DeepSeek | Élevée | 1 361,6 Elo | 74,6 | https://arena.ai/leaderboard |
| 82 | [Qwen3.5-122B-A10B](https://quelleia.com/modeles/qwen3-5-122b-a10b.md) | Alibaba | non précisée | 1 359,8 Elo | 74,5 | https://arena.ai/leaderboard |
| 83 | [Gemma 4 26B A4B](https://quelleia.com/modeles/gemma-4-26b-a4b.md) | Google DeepMind | non précisée | 1 358,5 Elo | 74,4 | https://arena.ai/leaderboard |
| 84 | [Qwen3.5-27B](https://quelleia.com/modeles/qwen3-5-27b.md) | Alibaba | non précisée | 1 357,4 Elo | 74,3 | https://arena.ai/leaderboard |
| 85 | [Grok 4.3 Beta](https://quelleia.com/modeles/grok-4-3-beta.md) | xAI | non précisée | 1 356,6 Elo | 74,3 | https://arena.ai/leaderboard |
| 86 | [Hunyuan Hy3 Preview](https://quelleia.com/modeles/hunyuan-hy3-preview.md) | Tencent | non précisée | 1 355,8 Elo | 74,2 | https://arena.ai/leaderboard |
| 87 | [Muse Glimmer 30B](https://quelleia.com/modeles/muse-glimmer-30b.md) | Meta AI | non précisée | 1 354,8 Elo | 74,1 | https://arena.ai/leaderboard |
| 88 | [Laguna M.1](https://quelleia.com/modeles/laguna-m-1.md) | Poolside | non précisée | 1 347,9 Elo | 73,7 | https://arena.ai/leaderboard |
| 89 | [GLM-4.6](https://quelleia.com/modeles/glm-4-6.md) | Z.ai (Zhipu AI) | non précisée | 1 339,5 Elo | 73,1 | https://arena.ai/leaderboard |
| 90 | [GPT-5.2 Codex](https://quelleia.com/modeles/gpt-5-2-codex.md) | OpenAI | non précisée | 1 339,1 Elo | 73,1 | https://arena.ai/leaderboard |
| 91 | [GPT-5.1-Codex](https://quelleia.com/modeles/gpt-5-1-codex.md) | OpenAI | non précisée | 1 336,7 Elo | 72,9 | https://arena.ai/leaderboard |
| 92 | [MiMo-V2-Flash](https://quelleia.com/modeles/mimo-v2-flash.md) | Xiaomi | non précisée | 1 329,6 Elo | 72,4 | https://arena.ai/leaderboard |
| 93 | [Claude Haiku 4.5](https://quelleia.com/modeles/claude-haiku-4-5.md) | Anthropic | non précisée | 1 329,4 Elo | 72,4 | https://arena.ai/leaderboard |
| 94 | [Kimi K2 Thinking](https://quelleia.com/modeles/kimi-k2-thinking.md) | Moonshot | non précisée | 1 321,4 Elo | 71,9 | https://arena.ai/leaderboard |
| 95 | [Laguna XS.2](https://quelleia.com/modeles/laguna-xs-2.md) | Poolside | non précisée | 1 301,8 Elo | 70,5 | https://arena.ai/leaderboard |
| 96 | [MiniMax-M2](https://quelleia.com/modeles/minimax-m2.md) | MiniMax | non précisée | 1 296,7 Elo | 70,2 | https://arena.ai/leaderboard |
| 97 | [Qwen3-Coder-480B-A35B](https://quelleia.com/modeles/qwen3-coder-480b-a35b.md) | Alibaba | non précisée | 1 274,3 Elo | 68,7 | https://arena.ai/leaderboard |
| 98 | [DeepSeek-V3.2-Exp](https://quelleia.com/modeles/deepseek-v3-2-exp.md) | DeepSeek | non précisée | 1 271,9 Elo | 68,5 | https://arena.ai/leaderboard |
| 99 | [Mistral Medium 3.5](https://quelleia.com/modeles/mistral-medium-3-5.md) | Mistral AI | non précisée | 1 263,1 Elo | 67,9 | https://arena.ai/leaderboard |
| 100 | [Gemini 3.1 Flash-Lite](https://quelleia.com/modeles/gemini-3-1-flash-lite.md) | Google DeepMind | non précisée | 1 255,9 Elo | 67,4 | https://arena.ai/leaderboard |
| 101 | [Qwen3.5-35B-A3B](https://quelleia.com/modeles/qwen3-5-35b-a3b.md) | Alibaba | non précisée | 1 253,5 Elo | 67,2 | https://arena.ai/leaderboard |
| 102 | [GPT-5.1-Codex-mini](https://quelleia.com/modeles/gpt-5-1-codex-mini.md) | OpenAI | non précisée | 1 243,6 Elo | 66,6 | https://arena.ai/leaderboard |
| 103 | [Qwen 3.5 Flash (hosted 35B-A3B)](https://quelleia.com/modeles/qwen-3-5-flash-hosted-35b-a3b.md) | Alibaba | non précisée | 1 243,2 Elo | 66,5 | https://arena.ai/leaderboard |
| 104 | [Grok 4.1 Fast](https://quelleia.com/modeles/grok-4-1-fast.md) | xAI | Élevée | 1 241,4 Elo | 66,4 | https://arena.ai/leaderboard |
| 105 | [Trinity Large Thinking](https://quelleia.com/modeles/trinity-large-thinking.md) | Arcee AI | Élevée | 1 237,6 Elo | 66,2 | https://arena.ai/leaderboard |
| 106 | [Mistral Large 3](https://quelleia.com/modeles/mistral-large-3.md) | Mistral AI | non précisée | 1 229,8 Elo | 65,6 | https://arena.ai/leaderboard |
| 107 | [Gemini 2.5 Pro (Jun 2025)](https://quelleia.com/modeles/gemini-2-5-pro-jun-2025.md) | Google DeepMind | non précisée | 1 226,8 Elo | 65,4 | https://arena.ai/leaderboard |
| 108 | [Grok 4.1](https://quelleia.com/modeles/grok-4-1.md) | xAI | Élevée | 1 213,8 Elo | 64,5 | https://arena.ai/leaderboard |
| 109 | [Devstral 2](https://quelleia.com/modeles/devstral-2.md) | Mistral AI | non précisée | 1 196,1 Elo | 63,3 | https://arena.ai/leaderboard |
| 110 | [Granite 4.1 8B](https://quelleia.com/modeles/granite-4-1-8b.md) | IBM | non précisée | 1 190,8 Elo | 63,0 | https://arena.ai/leaderboard |
| 111 | [Mercury 2](https://quelleia.com/modeles/mercury-2.md) | Inception Labs | non précisée | 1 170,0 Elo | 61,5 | https://arena.ai/leaderboard |
| 112 | [grok-code-fast-1](https://quelleia.com/modeles/grok-code-fast-1.md) | xAI | non précisée | 1 167,0 Elo | 61,3 | https://arena.ai/leaderboard |
| 113 | [Grok 4 Fast](https://quelleia.com/modeles/grok-4-fast.md) | xAI | Élevée | 1 159,5 Elo | 60,8 | https://arena.ai/leaderboard |
| 114 | [Devstral Medium 1.0](https://quelleia.com/modeles/devstral-medium-1-0.md) | Mistral AI | Moyenne | 1 075,9 Elo | 55,1 | https://arena.ai/leaderboard |

## En bref

**Que mesure Code Arena, WebDev ?** Deux modèles construisent le même site ou la même application web, l'internaute vote pour le meilleur résultat. Sur Quelle IA, il est rangé dans la tâche Web et interfaces.

**Comment Code Arena, WebDev est-il noté ?** Un score Elo calculé sur des duels où le résultat s'affiche et s'utilise. Un modèle qui obtient 1 440 Elo a un score IA d'environ 80.

**Qui est en tête sur Code Arena, WebDev ?** Claude Opus 5.5 (Anthropic) est en tête de Code Arena, WebDev avec 1 817,8 Elo, dans l'édition du 28 septembre 2026. Suivent GPT-6 Astra (1 789,1 Elo) et GPT-6.1 Sol (1 758,7 Elo). 114 modèles y sont mesurés.

**Quelles sont les limites de Code Arena, WebDev ?** Juge le rendu et l'usage immédiat. La qualité du code et sa maintenance ne sont pas évaluées. Au 28 septembre 2026, le benchmark est actif.

**Combien pèse Code Arena, WebDev dans le score IA ?** Code Arena, WebDev compte pour 5 % du score général, dans l'édition du 28 septembre 2026. Il est le seul benchmark de la tâche Web et interfaces (5 % du score général) : il en porte tout le poids.

**Qui maintient Code Arena, WebDev ?** Arena (ex LMArena). Sa page de référence : arena.ai/leaderboard/code/webdev.

Source : Quelle IA, édition du 28 septembre 2026. https://quelleia.com
