# Arena, questions de code

> Fiche du benchmark Arena, questions de code sur Quelle IA, édition du 28 septembre 2026. Les duels à l'aveugle d'Arena sur des questions de programmation. En tête au 28 septembre 2026 : Gemini 4 Argon (1 559,1 Elo). Notation, limites et classement des 275 modèles mesurés.

Page : https://quelleia.com/benchmarks/arena_code/
Source du benchmark : https://arena.ai/leaderboard
Mainteneur : Arena (ex LMArena)
Tâche : Code
État : actif

## À quoi il sert

Sur Quelle IA, Arena, questions de code sert à noter la tâche Code : c'est l'un de ses 13 benchmarks. Il départage surtout les modèles dont le score IA approche 70.

## Comment c'est noté

Un score Elo calculé sur les seuls duels portant sur du code.

Pour le calcul, un Elo devient une probabilité de victoire face à un niveau de référence, ici 1 447 Elo. Un écart de 100 points donne environ 64 % de chances de l'emporter.

## Ce qu'il ne dit pas

Le votant juge une réponse à l'œil, sans exécuter le code.

## Qui le tient

Arena (ex LMArena).

## Comment lire le score

Chaque trait est un modèle, placé à son meilleur score. Un modèle qui obtient 1 447 Elo a un score IA d'environ 70. Le meilleur, Gemini 4 Argon, atteint 1 559,1 Elo.

Ce que le benchmark attend à chaque niveau, d'après sa courbe d'étalonnage :

- Score IA 51 (niveau de GPT-4o (Nov 2024)) : 1 361 Elo
- Score IA 76 (niveau de Claude Sonnet 4.5) : 1 476 Elo
- Score IA 100 (niveau de Claude Opus 5.5) : 1 584 Elo

## Son poids dans le score IA

1,15 % du score général. Arena, questions de code porte 8 % de la tâche Code (15 % du score général), que se partagent 13 benchmarks.

## Classement (275 modèles mesurés · 316 mesures, édition du 28 septembre 2026)

Un modèle par ligne, à sa meilleure configuration. « Suggère » : le score IA que cette seule mesure indique.

| Rang | Modèle | Éditeur | Réflexion | Score publié | Suggère | Source |
| --- | --- | --- | --- | --- | --- | --- |
| 1 | [Gemini 4 Argon](https://quelleia.com/modeles/gemini-4-argon.md) | Google DeepMind | Élevée | 1 559,1 Elo | 94,5 | https://arena.ai/leaderboard |
| 2 | [Claude Fable 5](https://quelleia.com/modeles/claude-fable-5.md) | Anthropic | Élevée | 1 551,7 Elo | 92,9 | https://arena.ai/leaderboard |
| 3 | [Claude Opus 4.6](https://quelleia.com/modeles/claude-opus-4-6.md) | Anthropic | Élevée | 1 551,4 Elo | 92,8 | https://arena.ai/leaderboard |
| 4 | [Claude Opus 4.7](https://quelleia.com/modeles/claude-opus-4-7.md) | Anthropic | Élevée | 1 550,6 Elo | 92,6 | https://arena.ai/leaderboard |
| 5 | [Kimi K3](https://quelleia.com/modeles/kimi-k3.md) | Moonshot | Maximale | 1 540,8 Elo | 90,5 | https://arena.ai/leaderboard |
| 6 | [MiMo-V2.6-Pro](https://quelleia.com/modeles/mimo-v2-6-pro.md) | Xiaomi | non précisée | 1 540,3 Elo | 90,4 | https://arena.ai/leaderboard |
| 7 | [GPT-6 Astra](https://quelleia.com/modeles/gpt-6-astra.md) | OpenAI | Maximale | 1 539,0 Elo | 90,1 | https://arena.ai/leaderboard |
| 7 | [Muse Spark 1.3](https://quelleia.com/modeles/muse-spark-1-3.md) | Meta AI | Maximale | 1 539,0 Elo | 90,1 | https://arena.ai/leaderboard |
| 9 | [Claude Opus 5.5](https://quelleia.com/modeles/claude-opus-5-5.md) | Anthropic | Élevée | 1 538,0 Elo | 89,9 | https://arena.ai/leaderboard |
| 10 | [Muse Spark 1.2](https://quelleia.com/modeles/muse-spark-1-2.md) | Meta AI | non précisée | 1 534,9 Elo | 89,2 | https://arena.ai/leaderboard |
| 11 | [Muse Spark 1.1](https://quelleia.com/modeles/muse-spark-1-1.md) | Meta AI | non précisée | 1 534,0 Elo | 89,0 | https://arena.ai/leaderboard |
| 12 | [Claude Opus 5](https://quelleia.com/modeles/claude-opus-5.md) | Anthropic | Élevée | 1 533,7 Elo | 88,9 | https://arena.ai/leaderboard |
| 12 | [GPT-5.6 Sol](https://quelleia.com/modeles/gpt-5-6-sol.md) | OpenAI | Maximale | 1 533,7 Elo | 88,9 | https://arena.ai/leaderboard |
| 14 | [Claude Opus 4.8](https://quelleia.com/modeles/claude-opus-4-8.md) | Anthropic | Élevée | 1 533,3 Elo | 88,9 | https://arena.ai/leaderboard |
| 15 | [Claude Fable 5.1](https://quelleia.com/modeles/claude-fable-5-1.md) | Anthropic | Maximale | 1 532,5 Elo | 88,7 | https://arena.ai/leaderboard |
| 16 | [Gemini 3.8 Flash](https://quelleia.com/modeles/gemini-3-8-flash.md) | Google DeepMind | Élevée | 1 530,8 Elo | 88,3 | https://arena.ai/leaderboard |
| 17 | [Claude Opus 4.5](https://quelleia.com/modeles/claude-opus-4-5.md) | Anthropic | Élevée | 1 530,6 Elo | 88,3 | https://arena.ai/leaderboard |
| 18 | [Muse Spark](https://quelleia.com/modeles/muse-spark.md) | Meta AI | non précisée | 1 529,6 Elo | 88,0 | https://arena.ai/leaderboard |
| 19 | [DeepSeek V4.1 Flash](https://quelleia.com/modeles/deepseek-v4-1-flash.md) | DeepSeek | Maximale | 1 529,1 Elo | 87,9 | https://arena.ai/leaderboard |
| 20 | [Claude Sonnet 4.6](https://quelleia.com/modeles/claude-sonnet-4-6.md) | Anthropic | non précisée | 1 528,7 Elo | 87,9 | https://arena.ai/leaderboard |
| 21 | [Qwen3.7-Max](https://quelleia.com/modeles/qwen3-7-max.md) | Alibaba | Maximale | 1 523,9 Elo | 86,8 | https://arena.ai/leaderboard |
| 22 | [GLM-5.3-Flash](https://quelleia.com/modeles/glm-5-3-flash.md) | Z.ai (Zhipu AI) | non précisée | 1 523,4 Elo | 86,7 | https://arena.ai/leaderboard |
| 23 | [GPT-6 Sol](https://quelleia.com/modeles/gpt-6-sol.md) | OpenAI | Maximale | 1 522,6 Elo | 86,5 | https://arena.ai/leaderboard |
| 24 | [Qwen3.8 Max (0902)](https://quelleia.com/modeles/qwen3-8-max-0902.md) | Alibaba | Maximale | 1 521,8 Elo | 86,3 | https://arena.ai/leaderboard |
| 25 | [MiMo-V2.6-Flash](https://quelleia.com/modeles/mimo-v2-6-flash.md) | Xiaomi | non précisée | 1 521,4 Elo | 86,3 | https://arena.ai/leaderboard |
| 26 | [GLM-5.3](https://quelleia.com/modeles/glm-5-3.md) | Z.ai (Zhipu AI) | Maximale | 1 521,3 Elo | 86,2 | https://arena.ai/leaderboard |
| 26 | [Gemini 3.1 Pro](https://quelleia.com/modeles/gemini-3-1-pro.md) | Google DeepMind | non précisée | 1 521,3 Elo | 86,2 | https://arena.ai/leaderboard |
| 26 | [MiMo-V2.5-Pro](https://quelleia.com/modeles/mimo-v2-5-pro.md) | Xiaomi | non précisée | 1 521,3 Elo | 86,2 | https://arena.ai/leaderboard |
| 29 | [GPT-5.4](https://quelleia.com/modeles/gpt-5-4.md) | OpenAI | Élevée | 1 520,5 Elo | 86,1 | https://arena.ai/leaderboard |
| 30 | [Claude Sonnet 4.5](https://quelleia.com/modeles/claude-sonnet-4-5.md) | Anthropic | Élevée | 1 519,1 Elo | 85,7 | https://arena.ai/leaderboard |
| 31 | [Claude Sonnet 5](https://quelleia.com/modeles/claude-sonnet-5.md) | Anthropic | Élevée | 1 518,9 Elo | 85,7 | https://arena.ai/leaderboard |
| 32 | [GPT-5.5](https://quelleia.com/modeles/gpt-5-5.md) | OpenAI | Élevée | 1 518,6 Elo | 85,6 | https://arena.ai/leaderboard |
| 33 | [Gemini 3.6 Flash](https://quelleia.com/modeles/gemini-3-6-flash.md) | Google DeepMind | Élevée | 1 518,2 Elo | 85,6 | https://arena.ai/leaderboard |
| 34 | [Gemini 3.7 Flash](https://quelleia.com/modeles/gemini-3-7-flash.md) | Google DeepMind | Élevée | 1 518,1 Elo | 85,5 | https://arena.ai/leaderboard |
| 35 | [Gemini 3 Pro](https://quelleia.com/modeles/gemini-3-pro.md) | Google DeepMind | non précisée | 1 517,8 Elo | 85,5 | https://arena.ai/leaderboard |
| 36 | [Kimi K2.6](https://quelleia.com/modeles/kimi-k2-6.md) | Moonshot | non précisée | 1 516,1 Elo | 85,1 | https://arena.ai/leaderboard |
| 37 | [GPT-5.6 Terra](https://quelleia.com/modeles/gpt-5-6-terra.md) | OpenAI | Maximale | 1 515,3 Elo | 84,9 | https://arena.ai/leaderboard |
| 38 | [GPT-5.2 Chat](https://quelleia.com/modeles/gpt-5-2-chat.md) | OpenAI | non précisée | 1 514,9 Elo | 84,8 | https://arena.ai/leaderboard |
| 39 | [Seed 2.0 Pro](https://quelleia.com/modeles/seed-2-0-pro.md) | ByteDance | non précisée | 1 513,9 Elo | 84,6 | https://arena.ai/leaderboard |
| 40 | [Qwen3.5 Max Preview](https://quelleia.com/modeles/qwen3-5-max-preview.md) | Alibaba | Maximale | 1 513,7 Elo | 84,6 | https://arena.ai/leaderboard |
| 41 | [Grok 4.5](https://quelleia.com/modeles/grok-4-5.md) | xAI | non précisée | 1 513,6 Elo | 84,5 | https://arena.ai/leaderboard |
| 42 | [GPT-5.5 Instant](https://quelleia.com/modeles/gpt-5-5-instant.md) | OpenAI | non précisée | 1 513,1 Elo | 84,4 | https://arena.ai/leaderboard |
| 43 | [GLM-5.1](https://quelleia.com/modeles/glm-5-1.md) | Z.ai (Zhipu AI) | non précisée | 1 512,7 Elo | 84,3 | https://arena.ai/leaderboard |
| 44 | [ERNIE 5.1](https://quelleia.com/modeles/ernie-5-1.md) | Baidu | non précisée | 1 512,4 Elo | 84,3 | https://arena.ai/leaderboard |
| 45 | [GLM-5.2](https://quelleia.com/modeles/glm-5-2.md) | Z.ai (Zhipu AI) | Maximale | 1 512,1 Elo | 84,2 | https://arena.ai/leaderboard |
| 46 | [Qwen 3.6 Max (Preview)](https://quelleia.com/modeles/qwen-3-6-max-preview.md) | Alibaba | Maximale | 1 511,9 Elo | 84,2 | https://arena.ai/leaderboard |
| 47 | [GPT-6 Luna](https://quelleia.com/modeles/gpt-6-luna.md) | OpenAI | Maximale | 1 511,5 Elo | 84,1 | https://arena.ai/leaderboard |
| 48 | [Claude Opus 4.1](https://quelleia.com/modeles/claude-opus-4-1.md) | Anthropic | Élevée | 1 511,4 Elo | 84,1 | https://arena.ai/leaderboard |
| 49 | [Grok 4.20 Beta (0309)](https://quelleia.com/modeles/grok-4-20-beta-0309.md) | xAI | Élevée | 1 510,7 Elo | 83,9 | https://arena.ai/leaderboard |
| 50 | [Grok 4.20 Multi Agent Beta](https://quelleia.com/modeles/grok-4-20-multi-agent-beta.md) | xAI | non précisée | 1 508,7 Elo | 83,5 | https://arena.ai/leaderboard |
| 51 | [Grok 4.20 Beta 1](https://quelleia.com/modeles/grok-4-20-beta-1.md) | xAI | non précisée | 1 508,2 Elo | 83,4 | https://arena.ai/leaderboard |
| 52 | [Gemini 3.5 Flash](https://quelleia.com/modeles/gemini-3-5-flash.md) | Google DeepMind | Élevée | 1 506,9 Elo | 83,1 | https://arena.ai/leaderboard |
| 53 | [Grok 4.6](https://quelleia.com/modeles/grok-4-6.md) | xAI | Élevée | 1 506,8 Elo | 83,1 | https://arena.ai/leaderboard |
| 54 | [DeepSeek-V4-Pro](https://quelleia.com/modeles/deepseek-v4-pro.md) | DeepSeek | Élevée | 1 505,6 Elo | 82,8 | https://arena.ai/leaderboard |
| 55 | [Gemini 3 Flash](https://quelleia.com/modeles/gemini-3-flash.md) | Google DeepMind | non précisée | 1 505,4 Elo | 82,7 | https://arena.ai/leaderboard |
| 56 | [Qwen 3.8 27B](https://quelleia.com/modeles/qwen-3-8-27b.md) | Alibaba | non précisée | 1 504,9 Elo | 82,6 | https://arena.ai/leaderboard |
| 57 | [MiMo-V2-Pro](https://quelleia.com/modeles/mimo-v2-pro.md) | Xiaomi | non précisée | 1 503,2 Elo | 82,3 | https://arena.ai/leaderboard |
| 58 | [Kimi K2.5 Instant](https://quelleia.com/modeles/kimi-k2-5-instant.md) | Moonshot | non précisée | 1 502,9 Elo | 82,2 | https://arena.ai/leaderboard |
| 59 | [Kimi K2.5](https://quelleia.com/modeles/kimi-k2-5.md) | Moonshot | Élevée | 1 502,0 Elo | 82,0 | https://arena.ai/leaderboard |
| 59 | [Gemma 4 31B IT](https://quelleia.com/modeles/gemma-4-31b-it.md) | Google DeepMind | non précisée | 1 502,0 Elo | 82,0 | https://arena.ai/leaderboard |
| 61 | [GPT-5.6 Luna](https://quelleia.com/modeles/gpt-5-6-luna.md) | OpenAI | Maximale | 1 501,6 Elo | 81,9 | https://arena.ai/leaderboard |
| 62 | [Hy3](https://quelleia.com/modeles/hy3.md) | Tencent | non précisée | 1 501,2 Elo | 81,8 | https://arena.ai/leaderboard |
| 63 | [Gemini 3.5 Flash-Lite](https://quelleia.com/modeles/gemini-3-5-flash-lite.md) | Google DeepMind | non précisée | 1 501,0 Elo | 81,8 | https://arena.ai/leaderboard |
| 64 | [Qwen3.7-Plus](https://quelleia.com/modeles/qwen3-7-plus.md) | Alibaba | non précisée | 1 500,5 Elo | 81,7 | https://arena.ai/leaderboard |
| 65 | [Grok 4.1](https://quelleia.com/modeles/grok-4-1.md) | xAI | Élevée | 1 499,6 Elo | 81,5 | https://arena.ai/leaderboard |
| 66 | [GLM-5](https://quelleia.com/modeles/glm-5.md) | Z.ai (Zhipu AI) | non précisée | 1 497,9 Elo | 81,1 | https://arena.ai/leaderboard |
| 66 | [Claude Opus 4](https://quelleia.com/modeles/claude-opus-4.md) | Anthropic | Élevée | 1 497,9 Elo | 81,1 | https://arena.ai/leaderboard |
| 68 | [GPT-5.3 Chat](https://quelleia.com/modeles/gpt-5-3-chat.md) | OpenAI | non précisée | 1 497,8 Elo | 81,1 | https://arena.ai/leaderboard |
| 69 | [Qwen 3.6 Plus](https://quelleia.com/modeles/qwen-3-6-plus.md) | Alibaba | non précisée | 1 496,0 Elo | 80,7 | https://arena.ai/leaderboard |
| 70 | [MiniMax-M3](https://quelleia.com/modeles/minimax-m3.md) | MiniMax | non précisée | 1 494,8 Elo | 80,4 | https://arena.ai/leaderboard |
| 71 | [GPT-5.4 Mini](https://quelleia.com/modeles/gpt-5-4-mini.md) | OpenAI | Élevée | 1 494,7 Elo | 80,4 | https://arena.ai/leaderboard |
| 72 | [Grok 4.7](https://quelleia.com/modeles/grok-4-7.md) | xAI | Maximale | 1 492,1 Elo | 79,8 | https://arena.ai/leaderboard |
| 73 | [GPT-5.1](https://quelleia.com/modeles/gpt-5-1.md) | OpenAI | Élevée | 1 492,0 Elo | 79,8 | https://arena.ai/leaderboard |
| 73 | [Inkling](https://quelleia.com/modeles/inkling.md) | Thinking Machines | non précisée | 1 492,0 Elo | 79,8 | https://arena.ai/leaderboard |
| 75 | [Qwen3.5 397B-A17B](https://quelleia.com/modeles/qwen3-5-397b-a17b.md) | Alibaba | non précisée | 1 491,0 Elo | 79,6 | https://arena.ai/leaderboard |
| 76 | [MiMo-V2.5](https://quelleia.com/modeles/mimo-v2-5.md) | Xiaomi | non précisée | 1 490,7 Elo | 79,5 | https://arena.ai/leaderboard |
| 77 | [ERNIE 5.0](https://quelleia.com/modeles/ernie-5-0.md) | Baidu | non précisée | 1 489,8 Elo | 79,3 | https://arena.ai/leaderboard |
| 78 | [GPT-5.2](https://quelleia.com/modeles/gpt-5-2.md) | OpenAI | Élevée | 1 489,0 Elo | 79,2 | https://arena.ai/leaderboard |
| 79 | [MiMo V2 Omni](https://quelleia.com/modeles/mimo-v2-omni.md) | Xiaomi | non précisée | 1 488,8 Elo | 79,1 | https://arena.ai/leaderboard |
| 80 | [GLM-5V-Turbo](https://quelleia.com/modeles/glm-5v-turbo.md) | Z.ai (Zhipu AI) | non précisée | 1 487,9 Elo | 78,9 | https://arena.ai/leaderboard |
| 81 | [Grok 4.3 Beta](https://quelleia.com/modeles/grok-4-3-beta.md) | xAI | non précisée | 1 487,8 Elo | 78,9 | https://arena.ai/leaderboard |
| 82 | [Kimi K2 Thinking](https://quelleia.com/modeles/kimi-k2-thinking.md) | Moonshot | non précisée | 1 486,5 Elo | 78,6 | https://arena.ai/leaderboard |
| 83 | [GLM-4.7](https://quelleia.com/modeles/glm-4-7.md) | Z.ai (Zhipu AI) | non précisée | 1 484,0 Elo | 78,1 | https://arena.ai/leaderboard |
| 84 | [DeepSeek-V4-Flash](https://quelleia.com/modeles/deepseek-v4-flash.md) | DeepSeek | non précisée | 1 483,9 Elo | 78,0 | https://arena.ai/leaderboard |
| 85 | [Gemma 4 26B A4B](https://quelleia.com/modeles/gemma-4-26b-a4b.md) | Google DeepMind | non précisée | 1 482,6 Elo | 77,8 | https://arena.ai/leaderboard |
| 86 | [Claude Haiku 4.5](https://quelleia.com/modeles/claude-haiku-4-5.md) | Anthropic | non précisée | 1 480,8 Elo | 77,4 | https://arena.ai/leaderboard |
| 87 | [Qwen3-Max](https://quelleia.com/modeles/qwen3-max.md) | Alibaba | Maximale | 1 480,4 Elo | 77,3 | https://arena.ai/leaderboard |
| 88 | [MiniMax-M2.7](https://quelleia.com/modeles/minimax-m2-7.md) | MiniMax | non précisée | 1 479,6 Elo | 77,1 | https://arena.ai/leaderboard |
| 88 | [Muse Glimmer 30B](https://quelleia.com/modeles/muse-glimmer-30b.md) | Meta AI | non précisée | 1 479,6 Elo | 77,1 | https://arena.ai/leaderboard |
| 90 | [Mistral Medium 3.5](https://quelleia.com/modeles/mistral-medium-3-5.md) | Mistral AI | non précisée | 1 478,6 Elo | 76,9 | https://arena.ai/leaderboard |
| 91 | [DeepSeek-V3.2](https://quelleia.com/modeles/deepseek-v3-2.md) | DeepSeek | Élevée | 1 475,6 Elo | 76,2 | https://arena.ai/leaderboard |
| 92 | [DeepSeek-V3.2-Exp](https://quelleia.com/modeles/deepseek-v3-2-exp.md) | DeepSeek | Élevée | 1 474,8 Elo | 76,1 | https://arena.ai/leaderboard |
| 93 | [Nemotron 3 Ultra](https://quelleia.com/modeles/nemotron-3-ultra.md) | NVIDIA | non précisée | 1 474,3 Elo | 75,9 | https://arena.ai/leaderboard |
| 94 | [Inkling-Small](https://quelleia.com/modeles/inkling-small.md) | Thinking Machines | non précisée | 1 474,0 Elo | 75,9 | https://arena.ai/leaderboard |
| 94 | [Claude Sonnet 4](https://quelleia.com/modeles/claude-sonnet-4.md) | Anthropic | Élevée | 1 474,0 Elo | 75,9 | https://arena.ai/leaderboard |
| 96 | [Qwen3-235B-A22B-Instruct (Jul 2025)](https://quelleia.com/modeles/qwen3-235b-a22b-instruct-jul-2025.md) | Alibaba | non précisée | 1 471,9 Elo | 75,4 | https://arena.ai/leaderboard |
| 97 | [LongCat Flash Chat](https://quelleia.com/modeles/longcat-flash-chat.md) | Meituan | non précisée | 1 471,6 Elo | 75,4 | https://arena.ai/leaderboard |
| 98 | [GPT-5](https://quelleia.com/modeles/gpt-5.md) | OpenAI | Élevée | 1 470,2 Elo | 75,0 | https://arena.ai/leaderboard |
| 99 | [Mistral Large 3](https://quelleia.com/modeles/mistral-large-3.md) | Mistral AI | non précisée | 1 469,3 Elo | 74,8 | https://arena.ai/leaderboard |
| 100 | [Kimi K2 (Sep 2025)](https://quelleia.com/modeles/kimi-k2-sep-2025.md) | Moonshot | non précisée | 1 467,4 Elo | 74,4 | https://arena.ai/leaderboard |
| 101 | [ChatGPT-4o Latest](https://quelleia.com/modeles/chatgpt-4o-latest.md) | OpenAI | non précisée | 1 467,2 Elo | 74,4 | https://arena.ai/leaderboard |
| 102 | [Gemini 2.5 Pro (Jun 2025)](https://quelleia.com/modeles/gemini-2-5-pro-jun-2025.md) | Google DeepMind | non précisée | 1 464,3 Elo | 73,8 | https://arena.ai/leaderboard |
| 102 | [DeepSeek-R1 (May 2025)](https://quelleia.com/modeles/deepseek-r1-may-2025.md) | DeepSeek | non précisée | 1 464,3 Elo | 73,8 | https://arena.ai/leaderboard |
| 104 | [Solar Pro 4](https://quelleia.com/modeles/solar-pro-4.md) | Upstage | non précisée | 1 462,7 Elo | 73,4 | https://arena.ai/leaderboard |
| 105 | [Qwen3 VL 235B A22B Instruct](https://quelleia.com/modeles/qwen3-vl-235b-a22b-instruct.md) | Alibaba | non précisée | 1 462,5 Elo | 73,4 | https://arena.ai/leaderboard |
| 106 | [Grok 4.1 Fast](https://quelleia.com/modeles/grok-4-1-fast.md) | xAI | Élevée | 1 461,3 Elo | 73,1 | https://arena.ai/leaderboard |
| 107 | [DeepSeek-V3.1-Terminus](https://quelleia.com/modeles/deepseek-v3-1-terminus.md) | DeepSeek | Élevée | 1 460,3 Elo | 72,9 | https://arena.ai/leaderboard |
| 108 | [o3](https://quelleia.com/modeles/o3.md) | OpenAI | non précisée | 1 460,2 Elo | 72,9 | https://arena.ai/leaderboard |
| 109 | [GPT-5.4 Nano](https://quelleia.com/modeles/gpt-5-4-nano.md) | OpenAI | Élevée | 1 460,1 Elo | 72,8 | https://arena.ai/leaderboard |
| 110 | [Kimi K2 (Jul 2025)](https://quelleia.com/modeles/kimi-k2-jul-2025.md) | Moonshot | non précisée | 1 459,9 Elo | 72,8 | https://arena.ai/leaderboard |
| 111 | [Qwen3.5-122B-A10B](https://quelleia.com/modeles/qwen3-5-122b-a10b.md) | Alibaba | non précisée | 1 458,3 Elo | 72,4 | https://arena.ai/leaderboard |
| 111 | [GPT-4.5](https://quelleia.com/modeles/gpt-4-5.md) | OpenAI | non précisée | 1 458,3 Elo | 72,4 | https://arena.ai/leaderboard |
| 113 | [Grok 4 Fast Chat](https://quelleia.com/modeles/grok-4-fast-chat.md) | xAI | non précisée | 1 457,8 Elo | 72,3 | https://arena.ai/leaderboard |
| 114 | [GLM-4.6](https://quelleia.com/modeles/glm-4-6.md) | Z.ai (Zhipu AI) | non précisée | 1 457,7 Elo | 72,3 | https://arena.ai/leaderboard |
| 115 | [Gemini 3.1 Flash-Lite](https://quelleia.com/modeles/gemini-3-1-flash-lite.md) | Google DeepMind | non précisée | 1 457,6 Elo | 72,3 | https://arena.ai/leaderboard |
| 116 | [Qwen3-Coder-480B-A35B](https://quelleia.com/modeles/qwen3-coder-480b-a35b.md) | Alibaba | non précisée | 1 457,1 Elo | 72,2 | https://arena.ai/leaderboard |
| 117 | [GPT-4.1](https://quelleia.com/modeles/gpt-4-1.md) | OpenAI | non précisée | 1 456,1 Elo | 72,0 | https://arena.ai/leaderboard |
| 118 | [DeepSeek-V3.1](https://quelleia.com/modeles/deepseek-v3-1.md) | DeepSeek | Élevée | 1 455,5 Elo | 71,8 | https://arena.ai/leaderboard |
| 119 | [GLM-4.5](https://quelleia.com/modeles/glm-4-5.md) | Z.ai (Zhipu AI) | non précisée | 1 454,5 Elo | 71,6 | https://arena.ai/leaderboard |
| 120 | [Mistral Medium 3.1](https://quelleia.com/modeles/mistral-medium-3-1.md) | Mistral AI | Moyenne | 1 453,9 Elo | 71,5 | https://arena.ai/leaderboard |
| 121 | [Hunyuan Hy3 Preview](https://quelleia.com/modeles/hunyuan-hy3-preview.md) | Tencent | non précisée | 1 452,9 Elo | 71,3 | https://arena.ai/leaderboard |
| 122 | [Claude 3.7 Sonnet](https://quelleia.com/modeles/claude-3-7-sonnet.md) | Anthropic | Élevée | 1 452,7 Elo | 71,2 | https://arena.ai/leaderboard |
| 123 | [Qwen3.5-27B](https://quelleia.com/modeles/qwen3-5-27b.md) | Alibaba | non précisée | 1 451,7 Elo | 71,0 | https://arena.ai/leaderboard |
| 124 | [Qwen3 VL 235B A22B Thinking](https://quelleia.com/modeles/qwen3-vl-235b-a22b-thinking.md) | Alibaba | Élevée | 1 451,4 Elo | 70,9 | https://arena.ai/leaderboard |
| 125 | [Step 3.5 Flash](https://quelleia.com/modeles/step-3-5-flash.md) | StepFun | non précisée | 1 449,4 Elo | 70,5 | https://arena.ai/leaderboard |
| 126 | [MiMo-V2-Flash](https://quelleia.com/modeles/mimo-v2-flash.md) | Xiaomi | non précisée | 1 447,1 Elo | 70,0 | https://arena.ai/leaderboard |
| 127 | [MiniMax-M2.5](https://quelleia.com/modeles/minimax-m2-5.md) | MiniMax | non précisée | 1 446,3 Elo | 69,8 | https://arena.ai/leaderboard |
| 128 | [Qwen3-235B-A22B](https://quelleia.com/modeles/qwen3-235b-a22b.md) | Alibaba | Sans | 1 444,7 Elo | 69,5 | https://arena.ai/leaderboard |
| 129 | [chutes/Qwen3-Next-80B-A3B-Instruct](https://quelleia.com/modeles/chutes-qwen3-next-80b-a3b-instruct.md) | Alibaba | non précisée | 1 444,1 Elo | 69,3 | https://arena.ai/leaderboard |
| 130 | [Trinity Large Thinking](https://quelleia.com/modeles/trinity-large-thinking.md) | Arcee AI | non précisée | 1 443,2 Elo | 69,1 | https://arena.ai/leaderboard |
| 131 | [Grok 3](https://quelleia.com/modeles/grok-3.md) | xAI | non précisée | 1 442,0 Elo | 68,9 | https://arena.ai/leaderboard |
| 132 | [Qwen3-235B-A22B-Thinking (Jul 2025)](https://quelleia.com/modeles/qwen3-235b-a22b-thinking-jul-2025.md) | Alibaba | Élevée | 1 441,6 Elo | 68,8 | https://arena.ai/leaderboard |
| 133 | [MiniMax-M2.1](https://quelleia.com/modeles/minimax-m2-1.md) | MiniMax | non précisée | 1 438,1 Elo | 68,0 | https://arena.ai/leaderboard |
| 134 | [Grok 4 Fast](https://quelleia.com/modeles/grok-4-fast.md) | xAI | Élevée | 1 437,9 Elo | 68,0 | https://arena.ai/leaderboard |
| 135 | [Qwen3-30B-A3B-Instruct (Jul 2025)](https://quelleia.com/modeles/qwen3-30b-a3b-instruct-jul-2025.md) | Alibaba | non précisée | 1 437,7 Elo | 67,9 | https://arena.ai/leaderboard |
| 136 | [Hunyuan Vision 1.5](https://quelleia.com/modeles/hunyuan-vision-1-5.md) | Tencent | Élevée | 1 436,1 Elo | 67,6 | https://arena.ai/leaderboard |
| 137 | [Claude 3.5 Sonnet](https://quelleia.com/modeles/claude-3-5-sonnet.md) | Anthropic | non précisée | 1 435,8 Elo | 67,5 | https://arena.ai/leaderboard |
| 138 | [Qwen 3.5 Flash (hosted 35B-A3B)](https://quelleia.com/modeles/qwen-3-5-flash-hosted-35b-a3b.md) | Alibaba | non précisée | 1 435,7 Elo | 67,5 | https://arena.ai/leaderboard |
| 139 | [Qwen3.5-35B-A3B](https://quelleia.com/modeles/qwen3-5-35b-a3b.md) | Alibaba | non précisée | 1 434,9 Elo | 67,3 | https://arena.ai/leaderboard |
| 140 | [Grok 4](https://quelleia.com/modeles/grok-4.md) | xAI | non précisée | 1 434,8 Elo | 67,3 | https://arena.ai/leaderboard |
| 141 | [o3-mini](https://quelleia.com/modeles/o3-mini.md) | OpenAI | Élevée | 1 434,5 Elo | 67,2 | https://arena.ai/leaderboard |
| 142 | [o4-mini](https://quelleia.com/modeles/o4-mini.md) | OpenAI | non précisée | 1 433,2 Elo | 66,9 | https://arena.ai/leaderboard |
| 143 | [GPT-4.1 mini](https://quelleia.com/modeles/gpt-4-1-mini.md) | OpenAI | non précisée | 1 433,0 Elo | 66,9 | https://arena.ai/leaderboard |
| 144 | [o1](https://quelleia.com/modeles/o1.md) | OpenAI | non précisée | 1 432,9 Elo | 66,9 | https://arena.ai/leaderboard |
| 145 | [Mistral Medium 3](https://quelleia.com/modeles/mistral-medium-3.md) | Mistral AI | Moyenne | 1 432,6 Elo | 66,8 | https://arena.ai/leaderboard |
| 146 | [GPT-5 mini](https://quelleia.com/modeles/gpt-5-mini.md) | OpenAI | Élevée | 1 431,2 Elo | 66,5 | https://arena.ai/leaderboard |
| 147 | [DeepSeek-V3 (Mar 2025)](https://quelleia.com/modeles/deepseek-v3-mar-2025.md) | DeepSeek | non précisée | 1 428,2 Elo | 65,9 | https://arena.ai/leaderboard |
| 148 | [Gemini 2.5 Flash (Sep 2025)](https://quelleia.com/modeles/gemini-2-5-flash-sep-2025.md) | Google DeepMind | non précisée | 1 427,2 Elo | 65,6 | https://arena.ai/leaderboard |
| 149 | [GLM-4.5-Air](https://quelleia.com/modeles/glm-4-5-air.md) | Z.ai (Zhipu AI) | non précisée | 1 426,6 Elo | 65,5 | https://arena.ai/leaderboard |
| 150 | [Gemini 2.5 Flash (Jun 2025)](https://quelleia.com/modeles/gemini-2-5-flash-jun-2025.md) | Google DeepMind | non précisée | 1 423,7 Elo | 64,9 | https://arena.ai/leaderboard |
| 151 | [glm-4.7-flash](https://quelleia.com/modeles/glm-4-7-flash.md) | Z.ai (Zhipu AI) | non précisée | 1 423,1 Elo | 64,7 | https://arena.ai/leaderboard |
| 152 | [Qwen3-Next-80B-A3B Thinking](https://quelleia.com/modeles/qwen3-next-80b-a3b-thinking.md) | Alibaba | Élevée | 1 421,3 Elo | 64,3 | https://arena.ai/leaderboard |
| 153 | [Nemotron 3.5 Lightning](https://quelleia.com/modeles/nemotron-3-5-lightning.md) | NVIDIA | non précisée | 1 420,3 Elo | 64,1 | https://arena.ai/leaderboard |
| 154 | [MiniMax-M1-80k](https://quelleia.com/modeles/minimax-m1-80k.md) | MiniMax | non précisée | 1 416,1 Elo | 63,2 | https://arena.ai/leaderboard |
| 155 | [GLM-4.6V](https://quelleia.com/modeles/glm-4-6v.md) | Z.ai (Zhipu AI) | non précisée | 1 415,8 Elo | 63,1 | https://arena.ai/leaderboard |
| 155 | [INTELLECT-3](https://quelleia.com/modeles/intellect-3.md) | Prime Intellect | non précisée | 1 415,8 Elo | 63,1 | https://arena.ai/leaderboard |
| 157 | [o1-preview](https://quelleia.com/modeles/o1-preview.md) | OpenAI | non précisée | 1 415,6 Elo | 63,1 | https://arena.ai/leaderboard |
| 158 | [Mistral Small 3.2](https://quelleia.com/modeles/mistral-small-3-2.md) | Mistral AI | non précisée | 1 412,1 Elo | 62,3 | https://arena.ai/leaderboard |
| 159 | [Ling-flash-2.0](https://quelleia.com/modeles/ling-flash-2-0.md) | Ant Group | non précisée | 1 409,6 Elo | 61,8 | https://arena.ai/leaderboard |
| 160 | [Step 3](https://quelleia.com/modeles/step-3.md) | StepFun | non précisée | 1 409,3 Elo | 61,7 | https://arena.ai/leaderboard |
| 161 | [Nemotron 3 Super 120B](https://quelleia.com/modeles/nemotron-3-super-120b.md) | NVIDIA | non précisée | 1 406,7 Elo | 61,1 | https://arena.ai/leaderboard |
| 162 | [Qwen3-32B](https://quelleia.com/modeles/qwen3-32b.md) | Alibaba | non précisée | 1 406,4 Elo | 61,1 | https://arena.ai/leaderboard |
| 163 | [GLM-4.5V](https://quelleia.com/modeles/glm-4-5v.md) | Z.ai (Zhipu AI) | non précisée | 1 402,6 Elo | 60,2 | https://arena.ai/leaderboard |
| 164 | [Llama 3.3 Nemotron Super 49B v1.5](https://quelleia.com/modeles/llama-3-3-nemotron-super-49b-v1-5.md) | NVIDIA | non précisée | 1 402,0 Elo | 60,1 | https://arena.ai/leaderboard |
| 165 | [Qwen2.5-Max](https://quelleia.com/modeles/qwen2-5-max.md) | Alibaba | Maximale | 1 401,6 Elo | 60,0 | https://arena.ai/leaderboard |
| 166 | [Hunyuan-T1](https://quelleia.com/modeles/hunyuan-t1.md) | Tencent | non précisée | 1 400,9 Elo | 59,9 | https://arena.ai/leaderboard |
| 167 | [Hunyuan-TurboS](https://quelleia.com/modeles/hunyuan-turbos.md) | Tencent | non précisée | 1 399,0 Elo | 59,5 | https://arena.ai/leaderboard |
| 168 | [Granite 4.2 30B](https://quelleia.com/modeles/granite-4-2-30b.md) | IBM | non précisée | 1 398,8 Elo | 59,4 | https://arena.ai/leaderboard |
| 169 | [Gemini 2.5 Flash-Lite (Sep 2025)](https://quelleia.com/modeles/gemini-2-5-flash-lite-sep-2025.md) | Google DeepMind | Sans | 1 397,3 Elo | 59,1 | https://arena.ai/leaderboard |
| 170 | [Grok-3 mini](https://quelleia.com/modeles/grok-3-mini.md) | xAI | Élevée | 1 392,5 Elo | 58,0 | https://arena.ai/leaderboard |
| 171 | [Mercury 2](https://quelleia.com/modeles/mercury-2.md) | Inception Labs | non précisée | 1 392,2 Elo | 58,0 | https://arena.ai/leaderboard |
| 172 | [Llama 3.1 Nemotron Ultra 253B](https://quelleia.com/modeles/llama-3-1-nemotron-ultra-253b.md) | NVIDIA | non précisée | 1 391,0 Elo | 57,7 | https://arena.ai/leaderboard |
| 173 | [Ring-flash-2.0](https://quelleia.com/modeles/ring-flash-2-0.md) | Ant Group | non précisée | 1 390,1 Elo | 57,5 | https://arena.ai/leaderboard |
| 174 | [gpt-oss-120b](https://quelleia.com/modeles/gpt-oss-120b.md) | OpenAI | non précisée | 1 389,7 Elo | 57,4 | https://arena.ai/leaderboard |
| 175 | [Cohere Command A](https://quelleia.com/modeles/cohere-command-a.md) | Cohere | non précisée | 1 389,1 Elo | 57,3 | https://arena.ai/leaderboard |
| 176 | [Magistral Medium 1.1](https://quelleia.com/modeles/magistral-medium-1-1.md) | Mistral AI | Moyenne | 1 387,2 Elo | 56,9 | https://arena.ai/leaderboard |
| 177 | [o1-mini](https://quelleia.com/modeles/o1-mini.md) | OpenAI | non précisée | 1 386,0 Elo | 56,6 | https://arena.ai/leaderboard |
| 178 | [Claude 3.5 Haiku](https://quelleia.com/modeles/claude-3-5-haiku.md) | Anthropic | non précisée | 1 385,8 Elo | 56,6 | https://arena.ai/leaderboard |
| 179 | [Qwen3-30B-A3B](https://quelleia.com/modeles/qwen3-30b-a3b.md) | Alibaba | non précisée | 1 385,2 Elo | 56,4 | https://arena.ai/leaderboard |
| 180 | [GPT-5 nano](https://quelleia.com/modeles/gpt-5-nano.md) | OpenAI | Élevée | 1 384,3 Elo | 56,2 | https://arena.ai/leaderboard |
| 181 | [QwQ-32B](https://quelleia.com/modeles/qwq-32b.md) | Alibaba | non précisée | 1 383,1 Elo | 56,0 | https://arena.ai/leaderboard |
| 182 | [Gemini 2.5 Flash-Lite (Jun 2025)](https://quelleia.com/modeles/gemini-2-5-flash-lite-jun-2025.md) | Google DeepMind | Élevée | 1 382,4 Elo | 55,8 | https://arena.ai/leaderboard |
| 183 | [MiniMax-M2](https://quelleia.com/modeles/minimax-m2.md) | MiniMax | non précisée | 1 381,1 Elo | 55,5 | https://arena.ai/leaderboard |
| 184 | [OLMo 3.1 32B Instruct](https://quelleia.com/modeles/olmo-3-1-32b-instruct.md) | Allen Institute for AI | non précisée | 1 381,0 Elo | 55,5 | https://arena.ai/leaderboard |
| 185 | [Qwen Plus (Jan 2025)](https://quelleia.com/modeles/qwen-plus-jan-2025.md) | Alibaba | non précisée | 1 378,9 Elo | 55,1 | https://arena.ai/leaderboard |
| 186 | [Llama 3.1-405B](https://quelleia.com/modeles/llama-3-1-405b.md) | Meta AI | non précisée | 1 376,3 Elo | 54,5 | https://arena.ai/leaderboard |
| 187 | [DeepSeek-V2.5 (Dec 2024)](https://quelleia.com/modeles/deepseek-v2-5-dec-2024.md) | DeepSeek | non précisée | 1 374,0 Elo | 54,0 | https://arena.ai/leaderboard |
| 188 | [GPT-4.1 nano](https://quelleia.com/modeles/gpt-4-1-nano.md) | OpenAI | non précisée | 1 373,3 Elo | 53,8 | https://arena.ai/leaderboard |
| 189 | [Llama 4 Maverick](https://quelleia.com/modeles/llama-4-maverick.md) | Meta AI | non précisée | 1 372,7 Elo | 53,7 | https://arena.ai/leaderboard |
| 190 | [Granite 4.2 8B](https://quelleia.com/modeles/granite-4-2-8b.md) | IBM | non précisée | 1 369,4 Elo | 53,0 | https://arena.ai/leaderboard |
| 191 | [GPT-4o (May 2024)](https://quelleia.com/modeles/gpt-4o-may-2024.md) | OpenAI | non précisée | 1 369,1 Elo | 52,9 | https://arena.ai/leaderboard |
| 192 | [gpt-oss-20b](https://quelleia.com/modeles/gpt-oss-20b.md) | OpenAI | non précisée | 1 368,7 Elo | 52,8 | https://arena.ai/leaderboard |
| 192 | [Yi-Lightning](https://quelleia.com/modeles/yi-lightning.md) | 01.AI | non précisée | 1 368,7 Elo | 52,8 | https://arena.ai/leaderboard |
| 194 | [DeepSeek-V2.5 (Sep 2024)](https://quelleia.com/modeles/deepseek-v2-5-sep-2024.md) | DeepSeek | non précisée | 1 367,9 Elo | 52,7 | https://arena.ai/leaderboard |
| 195 | [Gemini 2.0 Flash (Feb 2025)](https://quelleia.com/modeles/gemini-2-0-flash-feb-2025.md) | Google DeepMind | non précisée | 1 363,6 Elo | 51,7 | https://arena.ai/leaderboard |
| 196 | [Llama 4 Scout](https://quelleia.com/modeles/llama-4-scout.md) | Meta AI | non précisée | 1 362,5 Elo | 51,5 | https://arena.ai/leaderboard |
| 197 | [Mistral Small 3.1](https://quelleia.com/modeles/mistral-small-3-1.md) | Mistral AI | non précisée | 1 360,9 Elo | 51,1 | https://arena.ai/leaderboard |
| 198 | [Nemotron 3 Nano 30B](https://quelleia.com/modeles/nemotron-3-nano-30b.md) | NVIDIA | non précisée | 1 360,7 Elo | 51,1 | https://arena.ai/leaderboard |
| 199 | [OLMo 3 32B Think](https://quelleia.com/modeles/olmo-3-32b-think.md) | Ai2 | non précisée | 1 360,2 Elo | 51,0 | https://arena.ai/leaderboard |
| 200 | [GPT-4o (Aug 2024)](https://quelleia.com/modeles/gpt-4o-aug-2024.md) | OpenAI | non précisée | 1 360,0 Elo | 50,9 | https://arena.ai/leaderboard |
| 201 | [Grok-2 (Aug 2024)](https://quelleia.com/modeles/grok-2-aug-2024.md) | xAI | non précisée | 1 358,0 Elo | 50,5 | https://arena.ai/leaderboard |
| 202 | [Gemma 3 27B](https://quelleia.com/modeles/gemma-3-27b.md) | Google DeepMind | non précisée | 1 357,6 Elo | 50,4 | https://arena.ai/leaderboard |
| 203 | [Gemini 1.5 Pro (Sept 2024)](https://quelleia.com/modeles/gemini-1-5-pro-sept-2024.md) | Google DeepMind | non précisée | 1 356,2 Elo | 50,1 | https://arena.ai/leaderboard |
| 204 | [Claude 3 Opus](https://quelleia.com/modeles/claude-3-opus.md) | Anthropic | non précisée | 1 355,2 Elo | 49,9 | https://arena.ai/leaderboard |
| 205 | [Qwen2.5-72B](https://quelleia.com/modeles/qwen2-5-72b.md) | Alibaba | non précisée | 1 355,1 Elo | 49,8 | https://arena.ai/leaderboard |
| 206 | [Mistral Large 2 (Jul 2024)](https://quelleia.com/modeles/mistral-large-2-jul-2024.md) | Mistral AI | non précisée | 1 353,8 Elo | 49,6 | https://arena.ai/leaderboard |
| 207 | [Granite 4.1 8B](https://quelleia.com/modeles/granite-4-1-8b.md) | IBM | non précisée | 1 353,5 Elo | 49,5 | https://arena.ai/leaderboard |
| 208 | [GPT-4o mini](https://quelleia.com/modeles/gpt-4o-mini.md) | OpenAI | non précisée | 1 348,0 Elo | 48,3 | https://arena.ai/leaderboard |
| 209 | [GPT-4 Turbo (Apr 2024)](https://quelleia.com/modeles/gpt-4-turbo-apr-2024.md) | OpenAI | non précisée | 1 347,1 Elo | 48,1 | https://arena.ai/leaderboard |
| 210 | [Gemini 1.5 Pro (May 2024)](https://quelleia.com/modeles/gemini-1-5-pro-may-2024.md) | Google DeepMind | non précisée | 1 346,4 Elo | 47,9 | https://arena.ai/leaderboard |
| 211 | [Mistral Large 2 (Nov 2024)](https://quelleia.com/modeles/mistral-large-2-nov-2024.md) | Mistral AI | non précisée | 1 346,0 Elo | 47,9 | https://arena.ai/leaderboard |
| 212 | [Llama 3.3 70B](https://quelleia.com/modeles/llama-3-3-70b.md) | Meta AI | non précisée | 1 345,7 Elo | 47,8 | https://arena.ai/leaderboard |
| 213 | [Amazon Nova Pro](https://quelleia.com/modeles/amazon-nova-pro.md) | Amazon | non précisée | 1 342,8 Elo | 47,2 | https://arena.ai/leaderboard |
| 214 | [Gemini 2.0 Flash-Lite](https://quelleia.com/modeles/gemini-2-0-flash-lite.md) | Google DeepMind | non précisée | 1 342,3 Elo | 47,0 | https://arena.ai/leaderboard |
| 215 | [Qwen2.5-Coder-32B-Instruct](https://quelleia.com/modeles/qwen2-5-coder-32b-instruct.md) | Alibaba | non précisée | 1 342,1 Elo | 47,0 | https://arena.ai/leaderboard |
| 216 | [GPT-4 Turbo (Nov 2023)](https://quelleia.com/modeles/gpt-4-turbo-nov-2023.md) | OpenAI | non précisée | 1 340,3 Elo | 46,6 | https://arena.ai/leaderboard |
| 217 | [Grok-2 mini](https://quelleia.com/modeles/grok-2-mini.md) | xAI | non précisée | 1 334,5 Elo | 45,3 | https://arena.ai/leaderboard |
| 218 | [Llama 3.1-70B](https://quelleia.com/modeles/llama-3-1-70b.md) | Meta AI | non précisée | 1 333,3 Elo | 45,1 | https://arena.ai/leaderboard |
| 219 | [GPT-4 (Mar 2023)](https://quelleia.com/modeles/gpt-4-mar-2023.md) | OpenAI | non précisée | 1 330,0 Elo | 44,4 | https://arena.ai/leaderboard |
| 220 | [Llama-3.1-Nemotron-70B-Instruct](https://quelleia.com/modeles/llama-3-1-nemotron-70b-instruct.md) | NVIDIA | non précisée | 1 328,0 Elo | 43,9 | https://arena.ai/leaderboard |
| 221 | [Claude 3 Sonnet](https://quelleia.com/modeles/claude-3-sonnet.md) | Anthropic | non précisée | 1 318,2 Elo | 41,8 | https://arena.ai/leaderboard |
| 222 | [Gemini 1.5 Flash (Sep 2024)](https://quelleia.com/modeles/gemini-1-5-flash-sep-2024.md) | Google DeepMind | non précisée | 1 316,1 Elo | 41,3 | https://arena.ai/leaderboard |
| 223 | [Gemma 3 12B](https://quelleia.com/modeles/gemma-3-12b.md) | Google DeepMind | non précisée | 1 315,8 Elo | 41,2 | https://arena.ai/leaderboard |
| 224 | [GPT-4 (Jun 2023)](https://quelleia.com/modeles/gpt-4-jun-2023.md) | OpenAI | non précisée | 1 314,7 Elo | 41,0 | https://arena.ai/leaderboard |
| 225 | [Mistral Small 3](https://quelleia.com/modeles/mistral-small-3.md) | Mistral AI | non précisée | 1 312,2 Elo | 40,5 | https://arena.ai/leaderboard |
| 226 | [GLM-4 (0520)](https://quelleia.com/modeles/glm-4-0520.md) | Z.ai (Zhipu AI) | non précisée | 1 309,1 Elo | 39,8 | https://arena.ai/leaderboard |
| 227 | [Gemini 1.5 Flash (May 2024)](https://quelleia.com/modeles/gemini-1-5-flash-may-2024.md) | Google DeepMind | non précisée | 1 309,0 Elo | 39,8 | https://arena.ai/leaderboard |
| 228 | [Nemotron-4 340B](https://quelleia.com/modeles/nemotron-4-340b.md) | NVIDIA | non précisée | 1 308,8 Elo | 39,7 | https://arena.ai/leaderboard |
| 229 | [Gemma 3n E4B](https://quelleia.com/modeles/gemma-3n-e4b.md) | Google DeepMind | non précisée | 1 306,9 Elo | 39,3 | https://arena.ai/leaderboard |
| 230 | [Llama 3-70B](https://quelleia.com/modeles/llama-3-70b.md) | Meta AI | non précisée | 1 306,3 Elo | 39,2 | https://arena.ai/leaderboard |
| 231 | [Phi-4](https://quelleia.com/modeles/phi-4.md) | Microsoft | non précisée | 1 306,1 Elo | 39,1 | https://arena.ai/leaderboard |
| 232 | [Amazon Nova Lite](https://quelleia.com/modeles/amazon-nova-lite.md) | Amazon | non précisée | 1 305,7 Elo | 39,0 | https://arena.ai/leaderboard |
| 233 | [Gemma 2 27B](https://quelleia.com/modeles/gemma-2-27b.md) | Google DeepMind | non précisée | 1 304,3 Elo | 38,7 | https://arena.ai/leaderboard |
| 234 | [Claude 3 Haiku](https://quelleia.com/modeles/claude-3-haiku.md) | Anthropic | non précisée | 1 301,3 Elo | 38,1 | https://arena.ai/leaderboard |
| 235 | [Qwen2-72B](https://quelleia.com/modeles/qwen2-72b.md) | Alibaba | non précisée | 1 297,4 Elo | 37,2 | https://arena.ai/leaderboard |
| 236 | [Mistral Large](https://quelleia.com/modeles/mistral-large.md) | Mistral AI | non précisée | 1 295,8 Elo | 36,9 | https://arena.ai/leaderboard |
| 237 | [Amazon Nova Micro](https://quelleia.com/modeles/amazon-nova-micro.md) | Amazon | non précisée | 1 288,5 Elo | 35,3 | https://arena.ai/leaderboard |
| 238 | [Qwen1.5-110B](https://quelleia.com/modeles/qwen1-5-110b.md) | Alibaba | non précisée | 1 279,9 Elo | 33,4 | https://arena.ai/leaderboard |
| 239 | [Mixtral 8x22B](https://quelleia.com/modeles/mixtral-8x22b.md) | Mistral AI | non précisée | 1 277,8 Elo | 32,9 | https://arena.ai/leaderboard |
| 240 | [Qwen1.5-72B](https://quelleia.com/modeles/qwen1-5-72b.md) | Alibaba | non précisée | 1 275,4 Elo | 32,4 | https://arena.ai/leaderboard |
| 241 | [GPT-3.5 Turbo (Jan 2024)](https://quelleia.com/modeles/gpt-3-5-turbo-jan-2024.md) | OpenAI | non précisée | 1 275,2 Elo | 32,4 | https://arena.ai/leaderboard |
| 242 | [Ministral 8B](https://quelleia.com/modeles/ministral-8b.md) | Mistral AI | non précisée | 1 274,4 Elo | 32,2 | https://arena.ai/leaderboard |
| 243 | [Gemma 3 4B](https://quelleia.com/modeles/gemma-3-4b.md) | Google DeepMind | non précisée | 1 273,5 Elo | 32,0 | https://arena.ai/leaderboard |
| 244 | [Gemini 1.5 Flash 8B](https://quelleia.com/modeles/gemini-1-5-flash-8b.md) | Google DeepMind | non précisée | 1 271,4 Elo | 31,5 | https://arena.ai/leaderboard |
| 245 | [Gemma 2 9B](https://quelleia.com/modeles/gemma-2-9b.md) | Google DeepMind | non précisée | 1 270,1 Elo | 31,2 | https://arena.ai/leaderboard |
| 246 | [Mistral Medium](https://quelleia.com/modeles/mistral-medium.md) | Mistral AI | Moyenne | 1 262,8 Elo | 29,6 | https://arena.ai/leaderboard |
| 247 | [GPT-3.5 Turbo (Nov 2023)](https://quelleia.com/modeles/gpt-3-5-turbo-nov-2023.md) | OpenAI | non précisée | 1 262,7 Elo | 29,6 | https://arena.ai/leaderboard |
| 248 | [Qwen1.5-32B](https://quelleia.com/modeles/qwen1-5-32b.md) | Alibaba | non précisée | 1 262,4 Elo | 29,6 | https://arena.ai/leaderboard |
| 249 | [Llama 3.1-8B](https://quelleia.com/modeles/llama-3-1-8b.md) | Meta AI | non précisée | 1 259,7 Elo | 29,0 | https://arena.ai/leaderboard |
| 250 | [Llama 3-8B](https://quelleia.com/modeles/llama-3-8b.md) | Meta AI | non précisée | 1 253,3 Elo | 27,6 | https://arena.ai/leaderboard |
| 251 | [DBRX](https://quelleia.com/modeles/dbrx.md) | Databricks | non précisée | 1 251,5 Elo | 27,2 | https://arena.ai/leaderboard |
| 252 | [Yi-1.5-34B](https://quelleia.com/modeles/yi-1-5-34b.md) | 01.AI | non précisée | 1 248,5 Elo | 26,5 | https://arena.ai/leaderboard |
| 253 | [Mixtral 8x7B](https://quelleia.com/modeles/mixtral-8x7b.md) | Mistral AI | non précisée | 1 239,9 Elo | 24,6 | https://arena.ai/leaderboard |
| 253 | [Qwen1.5-14B](https://quelleia.com/modeles/qwen1-5-14b.md) | Alibaba | non précisée | 1 239,9 Elo | 24,6 | https://arena.ai/leaderboard |
| 255 | [DeepSeek LLM 67B](https://quelleia.com/modeles/deepseek-llm-67b.md) | DeepSeek | non précisée | 1 218,5 Elo | 19,9 | https://arena.ai/leaderboard |
| 256 | [Qwen1.5-7B](https://quelleia.com/modeles/qwen1-5-7b.md) | Alibaba | non précisée | 1 209,8 Elo | 18,0 | https://arena.ai/leaderboard |
| 257 | [Yi-34B](https://quelleia.com/modeles/yi-34b.md) | 01.AI | non précisée | 1 205,8 Elo | 17,2 | https://arena.ai/leaderboard |
| 258 | [phi-3-small 7.4B](https://quelleia.com/modeles/phi-3-small-7-4b.md) | Microsoft | non précisée | 1 205,2 Elo | 17,0 | https://arena.ai/leaderboard |
| 259 | [Qwen-14B](https://quelleia.com/modeles/qwen-14b.md) | Alibaba | non précisée | 1 198,0 Elo | 15,5 | https://arena.ai/leaderboard |
| 260 | [phi-3-mini 3.8B](https://quelleia.com/modeles/phi-3-mini-3-8b.md) | Microsoft | non précisée | 1 187,7 Elo | 13,2 | https://arena.ai/leaderboard |
| 261 | [Mistral 7B v0.2](https://quelleia.com/modeles/mistral-7b-v0-2.md) | Mistral AI | non précisée | 1 186,1 Elo | 12,9 | https://arena.ai/leaderboard |
| 262 | [Llama 2-70B](https://quelleia.com/modeles/llama-2-70b.md) | Meta AI | non précisée | 1 179,3 Elo | 11,4 | https://arena.ai/leaderboard |
| 263 | [Llama 3.2 3B](https://quelleia.com/modeles/llama-3-2-3b.md) | Meta AI | non précisée | 1 176,6 Elo | 10,8 | https://arena.ai/leaderboard |
| 264 | [QwQ-32B-Preview](https://quelleia.com/modeles/qwq-32b-preview.md) | Alibaba | non précisée | 1 173,6 Elo | 10,1 | https://arena.ai/leaderboard |
| 265 | [MPT-30B](https://quelleia.com/modeles/mpt-30b.md) | MosaicML | non précisée | 1 168,3 Elo | 9,0 | https://arena.ai/leaderboard |
| 266 | [Gemma 7B](https://quelleia.com/modeles/gemma-7b.md) | Google DeepMind | non précisée | 1 167,1 Elo | 8,7 | https://arena.ai/leaderboard |
| 267 | [Llama 2-13B](https://quelleia.com/modeles/llama-2-13b.md) | Meta AI | non précisée | 1 162,8 Elo | 7,8 | https://arena.ai/leaderboard |
| 268 | [Llama 3.2 1B](https://quelleia.com/modeles/llama-3-2-1b.md) | Meta AI | non précisée | 1 149,4 Elo | 4,8 | https://arena.ai/leaderboard |
| 269 | [Gemma 2B](https://quelleia.com/modeles/gemma-2b.md) | Google DeepMind | non précisée | 1 136,2 Elo | 1,9 | https://arena.ai/leaderboard |
| 270 | [Llama 2-7B](https://quelleia.com/modeles/llama-2-7b.md) | Meta AI | non précisée | 1 103,3 Elo | -5,3 | https://arena.ai/leaderboard |
| 271 | [MPT-7B](https://quelleia.com/modeles/mpt-7b.md) | MosaicML | non précisée | 1 066,5 Elo | -13,3 | https://arena.ai/leaderboard |
| 272 | [chatglm2-6b](https://quelleia.com/modeles/chatglm2-6b.md) | Z.ai (Zhipu AI) | non précisée | 1 031,0 Elo | -21,1 | https://arena.ai/leaderboard |
| 273 | [stablelm-tuned-alpha-7b](https://quelleia.com/modeles/stablelm-tuned-alpha-7b.md) | Stability AI | non précisée | 1 005,1 Elo | -26,8 | https://arena.ai/leaderboard |
| 274 | [Dolly 2.0-12b](https://quelleia.com/modeles/dolly-2-0-12b.md) | Databricks | non précisée | 962,8 Elo | -36,0 | https://arena.ai/leaderboard |
| 275 | [LLaMA-13B](https://quelleia.com/modeles/llama-13b.md) | Meta AI | non précisée | 883,2 Elo | -53,5 | https://arena.ai/leaderboard |

## En bref

**Que mesure Arena, questions de code ?** Les duels à l'aveugle d'Arena sur des questions de programmation. Sur Quelle IA, il est rangé dans la tâche Code.

**Comment Arena, questions de code est-il noté ?** Un score Elo calculé sur les seuls duels portant sur du code. Un modèle qui obtient 1 447 Elo a un score IA d'environ 70.

**Qui est en tête sur Arena, questions de code ?** Gemini 4 Argon (Google DeepMind) est en tête d'Arena, questions de code avec 1 559,1 Elo, dans l'édition du 28 septembre 2026. Suivent Claude Fable 5 (1 551,7 Elo) et Claude Opus 4.6 (1 551,4 Elo). 275 modèles y sont mesurés.

**Quelles sont les limites d'Arena, questions de code ?** Le votant juge une réponse à l'œil, sans exécuter le code. Au 28 septembre 2026, le benchmark est actif.

**Combien pèse Arena, questions de code dans le score IA ?** Arena, questions de code compte pour 1,15 % du score général, dans l'édition du 28 septembre 2026. Il porte 8 % de la tâche Code (15 % du score général), que se partagent 13 benchmarks.

**Qui maintient Arena, questions de code ?** Arena (ex LMArena). Sa page de référence : arena.ai/leaderboard.

## Les autres benchmarks de la tâche Code

- [WeirdML (v2)](https://quelleia.com/benchmarks/weirdml.md) : 129 modèles · 1,15 % du score
- [SciCode](https://quelleia.com/benchmarks/scicode.md) : 120 modèles · 1,15 % du score
- [Terminal-Bench 2.0](https://quelleia.com/benchmarks/terminal_bench.md) : 45 modèles · 1,15 % du score
- [FrontierCode](https://quelleia.com/benchmarks/frontiercode.md) : 37 modèles · 1,15 % du score
- [SWE-bench Verified](https://quelleia.com/benchmarks/swe_bench_verified.md) : 32 modèles · 1,15 % du score
- [DeepSWE](https://quelleia.com/benchmarks/deepswe.md) : 26 modèles · 1,15 % du score
- [GSO](https://quelleia.com/benchmarks/gso_bench.md) : 26 modèles · 1,15 % du score
- [GBAEval](https://quelleia.com/benchmarks/gbaeval.md) : 23 modèles · 1,15 % du score
- [FrontierSWE](https://quelleia.com/benchmarks/frontierswe.md) : 16 modèles · 1,15 % du score
- [CursorBench](https://quelleia.com/benchmarks/cursorbench.md) : 13 modèles · 1,15 % du score
- [WeirdML v3](https://quelleia.com/benchmarks/weirdml_v3.md) : 11 modèles · 1,15 % du score
- [MirrorCode](https://quelleia.com/benchmarks/mirrorcode.md) : 9 modèles · 1,15 % du score
- [Aider Polyglot](https://quelleia.com/benchmarks/aider_polyglot.md) : 54 modèles · hors score, archivé
- [LiveBench, code](https://quelleia.com/benchmarks/livebench_code.md) : 48 modèles · hors score, archivé

Source : Quelle IA, édition du 28 septembre 2026. https://quelleia.com
