# Arena, vision

> Fiche du benchmark Arena, vision sur Quelle IA, édition du 28 septembre 2026. Des duels à l'aveugle où la question porte sur une image fournie par l'internaute. En tête au 28 septembre 2026 : Claude Fable 5 (1 310,1 Elo). Notation, limites et classement des 121 modèles mesurés.

Page : https://quelleia.com/benchmarks/arena_vision/
Source du benchmark : https://arena.ai/leaderboard
Mainteneur : Arena (ex LMArena)
Tâche : Vision et multimodal
État : actif

## À quoi il sert

Sur Quelle IA, Arena, vision sert à noter la tâche Vision et multimodal : c'est l'un de ses 3 benchmarks. Il départage surtout les modèles dont le score IA approche 75.

## Comment c'est noté

Un score Elo calculé sur les duels avec image.

Pour le calcul, un Elo devient une probabilité de victoire face à un niveau de référence, ici 1 226 Elo. Un écart de 100 points donne environ 64 % de chances de l'emporter.

## Ce qu'il ne dit pas

Porte sur des images du quotidien. La précision sur des documents techniques n'est pas mesurée.

## Qui le tient

Arena (ex LMArena).

## Comment lire le score

Chaque trait est un modèle, placé à son meilleur score. Un modèle qui obtient 1 226 Elo a un score IA d'environ 75. Le meilleur, Claude Fable 5, atteint 1 310,1 Elo.

Ce que le benchmark attend à chaque niveau, d'après sa courbe d'étalonnage :

- Score IA 51 (niveau de GPT-4o (Nov 2024)) : 1 123 Elo
- Score IA 76 (niveau de Claude Sonnet 4.5) : 1 230 Elo
- Score IA 100 (niveau de Claude Opus 5.5) : 1 330 Elo

## Son poids dans le score IA

1,67 % du score général. Arena, vision porte 33 % de la tâche Vision et multimodal (5 % du score général), que se partagent 3 benchmarks.

## Classement (121 modèles mesurés · 136 mesures, édition du 28 septembre 2026)

Un modèle par ligne, à sa meilleure configuration. « Suggère » : le score IA que cette seule mesure indique.

| Rang | Modèle | Éditeur | Réflexion | Score publié | Suggère | Source |
| --- | --- | --- | --- | --- | --- | --- |
| 1 | [Claude Fable 5](https://quelleia.com/modeles/claude-fable-5.md) | Anthropic | Élevée | 1 310,1 Elo | 95,2 | https://arena.ai/leaderboard |
| 2 | [Qwen3.8 Max (0902)](https://quelleia.com/modeles/qwen3-8-max-0902.md) | Alibaba | Maximale | 1 300,9 Elo | 93,0 | https://arena.ai/leaderboard |
| 3 | [Claude Opus 4.6](https://quelleia.com/modeles/claude-opus-4-6.md) | Anthropic | Élevée | 1 299,4 Elo | 92,7 | https://arena.ai/leaderboard |
| 4 | [Claude Opus 4.7](https://quelleia.com/modeles/claude-opus-4-7.md) | Anthropic | non précisée | 1 298,7 Elo | 92,5 | https://arena.ai/leaderboard |
| 5 | [Gemini 3.7 Flash](https://quelleia.com/modeles/gemini-3-7-flash.md) | Google DeepMind | Élevée | 1 295,0 Elo | 91,6 | https://arena.ai/leaderboard |
| 6 | [Muse Spark](https://quelleia.com/modeles/muse-spark.md) | Meta AI | non précisée | 1 293,9 Elo | 91,4 | https://arena.ai/leaderboard |
| 7 | [Muse Spark 1.2](https://quelleia.com/modeles/muse-spark-1-2.md) | Meta AI | non précisée | 1 292,4 Elo | 91,0 | https://arena.ai/leaderboard |
| 8 | [Muse Spark 1.3](https://quelleia.com/modeles/muse-spark-1-3.md) | Meta AI | Maximale | 1 289,6 Elo | 90,4 | https://arena.ai/leaderboard |
| 9 | [Gemini 3 Pro](https://quelleia.com/modeles/gemini-3-pro.md) | Google DeepMind | non précisée | 1 289,1 Elo | 90,3 | https://arena.ai/leaderboard |
| 10 | [Claude Opus 5](https://quelleia.com/modeles/claude-opus-5.md) | Anthropic | Élevée | 1 288,8 Elo | 90,2 | https://arena.ai/leaderboard |
| 11 | [GPT-5.6 Sol](https://quelleia.com/modeles/gpt-5-6-sol.md) | OpenAI | Maximale | 1 286,8 Elo | 89,7 | https://arena.ai/leaderboard |
| 12 | [Claude Fable 5.1](https://quelleia.com/modeles/claude-fable-5-1.md) | Anthropic | Maximale | 1 286,6 Elo | 89,7 | https://arena.ai/leaderboard |
| 13 | [GPT-5.5](https://quelleia.com/modeles/gpt-5-5.md) | OpenAI | non précisée | 1 286,5 Elo | 89,6 | https://arena.ai/leaderboard |
| 13 | [Claude Opus 4.8](https://quelleia.com/modeles/claude-opus-4-8.md) | Anthropic | Élevée | 1 286,5 Elo | 89,6 | https://arena.ai/leaderboard |
| 15 | [Gemini 3.8 Flash](https://quelleia.com/modeles/gemini-3-8-flash.md) | Google DeepMind | Élevée | 1 286,3 Elo | 89,6 | https://arena.ai/leaderboard |
| 16 | [GPT-6 Astra](https://quelleia.com/modeles/gpt-6-astra.md) | OpenAI | Maximale | 1 285,1 Elo | 89,3 | https://arena.ai/leaderboard |
| 17 | [Gemini 3.5 Flash](https://quelleia.com/modeles/gemini-3-5-flash.md) | Google DeepMind | Élevée | 1 284,5 Elo | 89,2 | https://arena.ai/leaderboard |
| 18 | [GPT-5.4](https://quelleia.com/modeles/gpt-5-4.md) | OpenAI | Élevée | 1 284,1 Elo | 89,1 | https://arena.ai/leaderboard |
| 19 | [GLM-5.3-Flash](https://quelleia.com/modeles/glm-5-3-flash.md) | Z.ai (Zhipu AI) | non précisée | 1 281,2 Elo | 88,4 | https://arena.ai/leaderboard |
| 20 | [Gemini 3.6 Flash](https://quelleia.com/modeles/gemini-3-6-flash.md) | Google DeepMind | Élevée | 1 280,1 Elo | 88,1 | https://arena.ai/leaderboard |
| 21 | [Gemini 3.1 Pro](https://quelleia.com/modeles/gemini-3-1-pro.md) | Google DeepMind | non précisée | 1 279,6 Elo | 88,0 | https://arena.ai/leaderboard |
| 22 | [Muse Spark 1.1](https://quelleia.com/modeles/muse-spark-1-1.md) | Meta AI | non précisée | 1 279,5 Elo | 88,0 | https://arena.ai/leaderboard |
| 23 | [Grok 4.5](https://quelleia.com/modeles/grok-4-5.md) | xAI | non précisée | 1 278,7 Elo | 87,8 | https://arena.ai/leaderboard |
| 24 | [GPT-5.2 Chat](https://quelleia.com/modeles/gpt-5-2-chat.md) | OpenAI | non précisée | 1 278,3 Elo | 87,7 | https://arena.ai/leaderboard |
| 25 | [GPT-5.5 Instant](https://quelleia.com/modeles/gpt-5-5-instant.md) | OpenAI | non précisée | 1 276,1 Elo | 87,2 | https://arena.ai/leaderboard |
| 26 | [Claude Sonnet 4.6](https://quelleia.com/modeles/claude-sonnet-4-6.md) | Anthropic | non précisée | 1 275,4 Elo | 87,0 | https://arena.ai/leaderboard |
| 27 | [Gemini 3 Flash](https://quelleia.com/modeles/gemini-3-flash.md) | Google DeepMind | non précisée | 1 273,0 Elo | 86,5 | https://arena.ai/leaderboard |
| 28 | [GPT-5.6 Terra](https://quelleia.com/modeles/gpt-5-6-terra.md) | OpenAI | Maximale | 1 267,9 Elo | 85,3 | https://arena.ai/leaderboard |
| 29 | [Qwen3.7-Plus](https://quelleia.com/modeles/qwen3-7-plus.md) | Alibaba | non précisée | 1 265,8 Elo | 84,8 | https://arena.ai/leaderboard |
| 30 | [Kimi K2.6](https://quelleia.com/modeles/kimi-k2-6.md) | Moonshot | non précisée | 1 264,8 Elo | 84,5 | https://arena.ai/leaderboard |
| 31 | [Claude Sonnet 5](https://quelleia.com/modeles/claude-sonnet-5.md) | Anthropic | Élevée | 1 264,6 Elo | 84,5 | https://arena.ai/leaderboard |
| 32 | [Gemini 3.5 Flash-Lite](https://quelleia.com/modeles/gemini-3-5-flash-lite.md) | Google DeepMind | non précisée | 1 264,1 Elo | 84,4 | https://arena.ai/leaderboard |
| 33 | [Grok 4.6](https://quelleia.com/modeles/grok-4-6.md) | xAI | Élevée | 1 263,2 Elo | 84,2 | https://arena.ai/leaderboard |
| 34 | [Gemma 4 31B IT](https://quelleia.com/modeles/gemma-4-31b-it.md) | Google DeepMind | non précisée | 1 263,1 Elo | 84,1 | https://arena.ai/leaderboard |
| 35 | [GPT-5.6 Luna](https://quelleia.com/modeles/gpt-5-6-luna.md) | OpenAI | Maximale | 1 259,1 Elo | 83,2 | https://arena.ai/leaderboard |
| 36 | [Seed 2.0 Pro](https://quelleia.com/modeles/seed-2-0-pro.md) | ByteDance | non précisée | 1 256,5 Elo | 82,6 | https://arena.ai/leaderboard |
| 37 | [Grok 4.20 Beta (0309)](https://quelleia.com/modeles/grok-4-20-beta-0309.md) | xAI | Élevée | 1 255,6 Elo | 82,4 | https://arena.ai/leaderboard |
| 38 | [MiMo-V2.6-Flash](https://quelleia.com/modeles/mimo-v2-6-flash.md) | Xiaomi | non précisée | 1 252,9 Elo | 81,7 | https://arena.ai/leaderboard |
| 39 | [Kimi K2.5](https://quelleia.com/modeles/kimi-k2-5.md) | Moonshot | Élevée | 1 252,1 Elo | 81,6 | https://arena.ai/leaderboard |
| 40 | [GPT-5.1](https://quelleia.com/modeles/gpt-5-1.md) | OpenAI | Élevée | 1 251,3 Elo | 81,4 | https://arena.ai/leaderboard |
| 41 | [GPT-5.4 Mini](https://quelleia.com/modeles/gpt-5-4-mini.md) | OpenAI | Élevée | 1 250,9 Elo | 81,3 | https://arena.ai/leaderboard |
| 42 | [Grok 4.20 Multi Agent Beta](https://quelleia.com/modeles/grok-4-20-multi-agent-beta.md) | xAI | non précisée | 1 249,9 Elo | 81,0 | https://arena.ai/leaderboard |
| 43 | [Gemini 2.5 Pro (Jun 2025)](https://quelleia.com/modeles/gemini-2-5-pro-jun-2025.md) | Google DeepMind | non précisée | 1 247,4 Elo | 80,4 | https://arena.ai/leaderboard |
| 44 | [MiMo-V2.6-Pro](https://quelleia.com/modeles/mimo-v2-6-pro.md) | Xiaomi | non précisée | 1 246,4 Elo | 80,2 | https://arena.ai/leaderboard |
| 45 | [Qwen3.5 397B-A17B](https://quelleia.com/modeles/qwen3-5-397b-a17b.md) | Alibaba | non précisée | 1 245,3 Elo | 80,0 | https://arena.ai/leaderboard |
| 46 | [Grok 4.3 Beta](https://quelleia.com/modeles/grok-4-3-beta.md) | xAI | non précisée | 1 244,3 Elo | 79,7 | https://arena.ai/leaderboard |
| 47 | [GPT-5.2](https://quelleia.com/modeles/gpt-5-2.md) | OpenAI | Élevée | 1 242,8 Elo | 79,4 | https://arena.ai/leaderboard |
| 48 | [Qwen 3.8 27B](https://quelleia.com/modeles/qwen-3-8-27b.md) | Alibaba | non précisée | 1 242,3 Elo | 79,2 | https://arena.ai/leaderboard |
| 49 | [Gemma 4 26B A4B](https://quelleia.com/modeles/gemma-4-26b-a4b.md) | Google DeepMind | non précisée | 1 241,9 Elo | 79,2 | https://arena.ai/leaderboard |
| 50 | [ChatGPT-4o Latest](https://quelleia.com/modeles/chatgpt-4o-latest.md) | OpenAI | non précisée | 1 238,8 Elo | 78,4 | https://arena.ai/leaderboard |
| 51 | [Kimi K2.5 Instant](https://quelleia.com/modeles/kimi-k2-5-instant.md) | Moonshot | non précisée | 1 236,7 Elo | 77,9 | https://arena.ai/leaderboard |
| 52 | [MiniMax-M3](https://quelleia.com/modeles/minimax-m3.md) | MiniMax | non précisée | 1 236,5 Elo | 77,9 | https://arena.ai/leaderboard |
| 53 | [Gemini 3.1 Flash-Lite](https://quelleia.com/modeles/gemini-3-1-flash-lite.md) | Google DeepMind | non précisée | 1 234,6 Elo | 77,4 | https://arena.ai/leaderboard |
| 54 | [MiMo-V2.5](https://quelleia.com/modeles/mimo-v2-5.md) | Xiaomi | non précisée | 1 231,6 Elo | 76,7 | https://arena.ai/leaderboard |
| 55 | [Gemini 2.5 Flash (Sep 2025)](https://quelleia.com/modeles/gemini-2-5-flash-sep-2025.md) | Google DeepMind | non précisée | 1 230,3 Elo | 76,4 | https://arena.ai/leaderboard |
| 56 | [GLM-5V-Turbo](https://quelleia.com/modeles/glm-5v-turbo.md) | Z.ai (Zhipu AI) | non précisée | 1 229,9 Elo | 76,3 | https://arena.ai/leaderboard |
| 57 | [Qwen3.5-122B-A10B](https://quelleia.com/modeles/qwen3-5-122b-a10b.md) | Alibaba | non précisée | 1 226,4 Elo | 75,5 | https://arena.ai/leaderboard |
| 58 | [GPT-5](https://quelleia.com/modeles/gpt-5.md) | OpenAI | non précisée | 1 225,5 Elo | 75,3 | https://arena.ai/leaderboard |
| 59 | [GPT-4.5](https://quelleia.com/modeles/gpt-4-5.md) | OpenAI | non précisée | 1 225,1 Elo | 75,2 | https://arena.ai/leaderboard |
| 60 | [ERNIE 5.0](https://quelleia.com/modeles/ernie-5-0.md) | Baidu | non précisée | 1 218,7 Elo | 73,7 | https://arena.ai/leaderboard |
| 61 | [Qwen3.5-27B](https://quelleia.com/modeles/qwen3-5-27b.md) | Alibaba | non précisée | 1 216,7 Elo | 73,2 | https://arena.ai/leaderboard |
| 62 | [MiMo V2 Omni](https://quelleia.com/modeles/mimo-v2-omni.md) | Xiaomi | non précisée | 1 216,2 Elo | 73,1 | https://arena.ai/leaderboard |
| 63 | [o3](https://quelleia.com/modeles/o3.md) | OpenAI | non précisée | 1 215,5 Elo | 72,9 | https://arena.ai/leaderboard |
| 64 | [Qwen3 VL 235B A22B Instruct](https://quelleia.com/modeles/qwen3-vl-235b-a22b-instruct.md) | Alibaba | non précisée | 1 215,0 Elo | 72,8 | https://arena.ai/leaderboard |
| 64 | [Gemini 2.5 Flash (Jun 2025)](https://quelleia.com/modeles/gemini-2-5-flash-jun-2025.md) | Google DeepMind | non précisée | 1 215,0 Elo | 72,8 | https://arena.ai/leaderboard |
| 66 | [GPT-4.1](https://quelleia.com/modeles/gpt-4-1.md) | OpenAI | non précisée | 1 214,0 Elo | 72,6 | https://arena.ai/leaderboard |
| 67 | [Claude Opus 4](https://quelleia.com/modeles/claude-opus-4.md) | Anthropic | Élevée | 1 207,3 Elo | 71,0 | https://arena.ai/leaderboard |
| 68 | [Inkling-Small](https://quelleia.com/modeles/inkling-small.md) | Thinking Machines | non précisée | 1 206,8 Elo | 70,9 | https://arena.ai/leaderboard |
| 69 | [Claude Sonnet 4](https://quelleia.com/modeles/claude-sonnet-4.md) | Anthropic | Élevée | 1 206,2 Elo | 70,8 | https://arena.ai/leaderboard |
| 70 | [GPT-4.1 mini](https://quelleia.com/modeles/gpt-4-1-mini.md) | OpenAI | non précisée | 1 200,9 Elo | 69,5 | https://arena.ai/leaderboard |
| 71 | [o4-mini](https://quelleia.com/modeles/o4-mini.md) | OpenAI | non précisée | 1 200,7 Elo | 69,5 | https://arena.ai/leaderboard |
| 72 | [Mistral Large 3](https://quelleia.com/modeles/mistral-large-3.md) | Mistral AI | non précisée | 1 200,3 Elo | 69,4 | https://arena.ai/leaderboard |
| 73 | [GPT-5.4 Nano](https://quelleia.com/modeles/gpt-5-4-nano.md) | OpenAI | Élevée | 1 199,6 Elo | 69,2 | https://arena.ai/leaderboard |
| 73 | [Mistral Medium 3.5](https://quelleia.com/modeles/mistral-medium-3-5.md) | Mistral AI | non précisée | 1 199,6 Elo | 69,2 | https://arena.ai/leaderboard |
| 75 | [Grok 4.1 Fast](https://quelleia.com/modeles/grok-4-1-fast.md) | xAI | Élevée | 1 196,2 Elo | 68,4 | https://arena.ai/leaderboard |
| 76 | [Claude 3.7 Sonnet](https://quelleia.com/modeles/claude-3-7-sonnet.md) | Anthropic | Élevée | 1 192,8 Elo | 67,6 | https://arena.ai/leaderboard |
| 77 | [o1](https://quelleia.com/modeles/o1.md) | OpenAI | non précisée | 1 192,7 Elo | 67,6 | https://arena.ai/leaderboard |
| 78 | [Gemini 2.5 Flash-Lite (Jun 2025)](https://quelleia.com/modeles/gemini-2-5-flash-lite-jun-2025.md) | Google DeepMind | Élevée | 1 188,2 Elo | 66,5 | https://arena.ai/leaderboard |
| 79 | [Qwen3 VL 235B A22B Thinking](https://quelleia.com/modeles/qwen3-vl-235b-a22b-thinking.md) | Alibaba | Élevée | 1 188,0 Elo | 66,5 | https://arena.ai/leaderboard |
| 80 | [Qwen-VL-Max](https://quelleia.com/modeles/qwen-vl-max.md) | Alibaba | Maximale | 1 184,8 Elo | 65,7 | https://arena.ai/leaderboard |
| 81 | [Grok 4](https://quelleia.com/modeles/grok-4.md) | xAI | non précisée | 1 184,2 Elo | 65,6 | https://arena.ai/leaderboard |
| 82 | [GPT-5 mini](https://quelleia.com/modeles/gpt-5-mini.md) | OpenAI | Élevée | 1 183,0 Elo | 65,3 | https://arena.ai/leaderboard |
| 83 | [Gemini 1.5 Pro (Sept 2024)](https://quelleia.com/modeles/gemini-1-5-pro-sept-2024.md) | Google DeepMind | non précisée | 1 179,3 Elo | 64,4 | https://arena.ai/leaderboard |
| 84 | [Gemini 2.5 Flash-Lite (Sep 2025)](https://quelleia.com/modeles/gemini-2-5-flash-lite-sep-2025.md) | Google DeepMind | Sans | 1 174,4 Elo | 63,3 | https://arena.ai/leaderboard |
| 85 | [Gemini 2.0 Flash (Feb 2025)](https://quelleia.com/modeles/gemini-2-0-flash-feb-2025.md) | Google DeepMind | non précisée | 1 171,8 Elo | 62,7 | https://arena.ai/leaderboard |
| 86 | [GPT-4o (May 2024)](https://quelleia.com/modeles/gpt-4o-may-2024.md) | OpenAI | non précisée | 1 161,8 Elo | 60,3 | https://arena.ai/leaderboard |
| 87 | [GLM-4.6V](https://quelleia.com/modeles/glm-4-6v.md) | Z.ai (Zhipu AI) | non précisée | 1 161,4 Elo | 60,2 | https://arena.ai/leaderboard |
| 88 | [Claude 3.5 Sonnet](https://quelleia.com/modeles/claude-3-5-sonnet.md) | Anthropic | non précisée | 1 160,7 Elo | 60,1 | https://arena.ai/leaderboard |
| 89 | [Gemma 3 27B](https://quelleia.com/modeles/gemma-3-27b.md) | Google DeepMind | non précisée | 1 159,5 Elo | 59,8 | https://arena.ai/leaderboard |
| 90 | [Mistral Medium 3.1](https://quelleia.com/modeles/mistral-medium-3-1.md) | Mistral AI | Moyenne | 1 159,4 Elo | 59,7 | https://arena.ai/leaderboard |
| 91 | [Hunyuan Vision 1.5](https://quelleia.com/modeles/hunyuan-vision-1-5.md) | Tencent | Élevée | 1 155,5 Elo | 58,8 | https://arena.ai/leaderboard |
| 92 | [Mistral Medium 3](https://quelleia.com/modeles/mistral-medium-3.md) | Mistral AI | Moyenne | 1 155,3 Elo | 58,8 | https://arena.ai/leaderboard |
| 93 | [GLM-4.5V](https://quelleia.com/modeles/glm-4-5v.md) | Z.ai (Zhipu AI) | non précisée | 1 152,8 Elo | 58,2 | https://arena.ai/leaderboard |
| 94 | [GPT-5 nano](https://quelleia.com/modeles/gpt-5-nano.md) | OpenAI | Élevée | 1 146,0 Elo | 56,6 | https://arena.ai/leaderboard |
| 95 | [Llama 4 Maverick](https://quelleia.com/modeles/llama-4-maverick.md) | Meta AI | non précisée | 1 145,1 Elo | 56,4 | https://arena.ai/leaderboard |
| 96 | [Step 3](https://quelleia.com/modeles/step-3.md) | StepFun | non précisée | 1 144,7 Elo | 56,3 | https://arena.ai/leaderboard |
| 97 | [Gemini 1.5 Flash (Sep 2024)](https://quelleia.com/modeles/gemini-1-5-flash-sep-2024.md) | Google DeepMind | non précisée | 1 141,3 Elo | 55,5 | https://arena.ai/leaderboard |
| 98 | [Mistral Small 3.2](https://quelleia.com/modeles/mistral-small-3-2.md) | Mistral AI | non précisée | 1 139,8 Elo | 55,1 | https://arena.ai/leaderboard |
| 99 | [Gemini 2.0 Flash-Lite](https://quelleia.com/modeles/gemini-2-0-flash-lite.md) | Google DeepMind | non précisée | 1 135,9 Elo | 54,2 | https://arena.ai/leaderboard |
| 100 | [Llama 4 Scout](https://quelleia.com/modeles/llama-4-scout.md) | Meta AI | non précisée | 1 127,5 Elo | 52,2 | https://arena.ai/leaderboard |
| 101 | [Mistral Small 3.1](https://quelleia.com/modeles/mistral-small-3-1.md) | Mistral AI | non précisée | 1 127,0 Elo | 52,1 | https://arena.ai/leaderboard |
| 102 | [Claude 3.5 Haiku](https://quelleia.com/modeles/claude-3-5-haiku.md) | Anthropic | non précisée | 1 126,8 Elo | 52,1 | https://arena.ai/leaderboard |
| 103 | [Qwen2.5-72B](https://quelleia.com/modeles/qwen2-5-72b.md) | Alibaba | non précisée | 1 121,2 Elo | 50,8 | https://arena.ai/leaderboard |
| 104 | [Gemini 1.5 Pro (May 2024)](https://quelleia.com/modeles/gemini-1-5-pro-may-2024.md) | Google DeepMind | non précisée | 1 119,6 Elo | 50,4 | https://arena.ai/leaderboard |
| 105 | [GPT-4o (Aug 2024)](https://quelleia.com/modeles/gpt-4o-aug-2024.md) | OpenAI | non précisée | 1 118,4 Elo | 50,1 | https://arena.ai/leaderboard |
| 106 | [GPT-4 Turbo (Apr 2024)](https://quelleia.com/modeles/gpt-4-turbo-apr-2024.md) | OpenAI | non précisée | 1 111,9 Elo | 48,6 | https://arena.ai/leaderboard |
| 107 | [Molmo 2 8B](https://quelleia.com/modeles/molmo-2-8b.md) | Allen Institute for AI | non précisée | 1 111,7 Elo | 48,5 | https://arena.ai/leaderboard |
| 108 | [GPT-4o mini](https://quelleia.com/modeles/gpt-4o-mini.md) | OpenAI | non précisée | 1 097,2 Elo | 45,1 | https://arena.ai/leaderboard |
| 109 | [Pixtral Large](https://quelleia.com/modeles/pixtral-large.md) | Mistral AI | non précisée | 1 095,2 Elo | 44,7 | https://arena.ai/leaderboard |
| 110 | [GPT-4.1 nano](https://quelleia.com/modeles/gpt-4-1-nano.md) | OpenAI | non précisée | 1 088,7 Elo | 43,1 | https://arena.ai/leaderboard |
| 111 | [Gemini 1.5 Flash 8B](https://quelleia.com/modeles/gemini-1-5-flash-8b.md) | Google DeepMind | non précisée | 1 071,3 Elo | 39,0 | https://arena.ai/leaderboard |
| 112 | [Claude 3 Opus](https://quelleia.com/modeles/claude-3-opus.md) | Anthropic | non précisée | 1 061,6 Elo | 36,7 | https://arena.ai/leaderboard |
| 113 | [Gemini 1.5 Flash (May 2024)](https://quelleia.com/modeles/gemini-1-5-flash-may-2024.md) | Google DeepMind | non précisée | 1 059,5 Elo | 36,3 | https://arena.ai/leaderboard |
| 114 | [Qwen2-VL-7B-Instruct](https://quelleia.com/modeles/qwen2-vl-7b-instruct.md) | Alibaba | non précisée | 1 030,8 Elo | 29,5 | https://arena.ai/leaderboard |
| 115 | [Pixtral 12B](https://quelleia.com/modeles/pixtral-12b.md) | Mistral AI | non précisée | 1 025,2 Elo | 28,2 | https://arena.ai/leaderboard |
| 116 | [Amazon Nova Pro](https://quelleia.com/modeles/amazon-nova-pro.md) | Amazon | non précisée | 1 018,7 Elo | 26,7 | https://arena.ai/leaderboard |
| 116 | [Amazon Nova Lite](https://quelleia.com/modeles/amazon-nova-lite.md) | Amazon | non précisée | 1 018,7 Elo | 26,7 | https://arena.ai/leaderboard |
| 118 | [Claude 3 Sonnet](https://quelleia.com/modeles/claude-3-sonnet.md) | Anthropic | non précisée | 1 016,4 Elo | 26,1 | https://arena.ai/leaderboard |
| 119 | [Claude 3 Haiku](https://quelleia.com/modeles/claude-3-haiku.md) | Anthropic | non précisée | 1 000,0 Elo | 22,3 | https://arena.ai/leaderboard |
| 120 | [MiniCPM-V-2_6](https://quelleia.com/modeles/minicpm-v-2-6.md) | OpenBMB | non précisée | 962,7 Elo | 13,5 | https://arena.ai/leaderboard |
| 121 | [Phi-3.5-vision-instruct](https://quelleia.com/modeles/phi-3-5-vision-instruct.md) | Microsoft | non précisée | 919,6 Elo | 3,4 | https://arena.ai/leaderboard |

## En bref

**Que mesure Arena, vision ?** Des duels à l'aveugle où la question porte sur une image fournie par l'internaute. Sur Quelle IA, il est rangé dans la tâche Vision et multimodal.

**Comment Arena, vision est-il noté ?** Un score Elo calculé sur les duels avec image. Un modèle qui obtient 1 226 Elo a un score IA d'environ 75.

**Qui est en tête sur Arena, vision ?** Claude Fable 5 (Anthropic) est en tête d'Arena, vision avec 1 310,1 Elo, dans l'édition du 28 septembre 2026. Suivent Qwen3.8 Max (0902) (1 300,9 Elo) et Claude Opus 4.6 (1 299,4 Elo). 121 modèles y sont mesurés.

**Quelles sont les limites d'Arena, vision ?** Porte sur des images du quotidien. La précision sur des documents techniques n'est pas mesurée. Au 28 septembre 2026, le benchmark est actif.

**Combien pèse Arena, vision dans le score IA ?** Arena, vision compte pour 1,67 % du score général, dans l'édition du 28 septembre 2026. Il porte 33 % de la tâche Vision et multimodal (5 % du score général), que se partagent 3 benchmarks.

**Qui maintient Arena, vision ?** Arena (ex LMArena). Sa page de référence : arena.ai/leaderboard.

## Les autres benchmarks de la tâche Vision et multimodal

- [Furniture Assembly](https://quelleia.com/benchmarks/furniture_assembly.md) : 28 modèles · 1,67 % du score
- [Blueprint-Bench 2](https://quelleia.com/benchmarks/blueprint_bench_2.md) : 26 modèles · 1,67 % du score
- [Video-MME](https://quelleia.com/benchmarks/videomme.md) : 50 modèles · hors score, archivé
- [VPCT (Visual Physics Comprehension Test)](https://quelleia.com/benchmarks/vpct.md) : 28 modèles · hors score, archivé
- [GeoBench](https://quelleia.com/benchmarks/geobench.md) : 27 modèles · hors score, archivé
- [CadEval](https://quelleia.com/benchmarks/cadeval.md) : 15 modèles · hors score, archivé
- [SpatialViz-Bench](https://quelleia.com/benchmarks/spatialviz_bench.md) : 8 modèles · hors score, archivé
- [MindCube](https://quelleia.com/benchmarks/mindcube.md) : 5 modèles · hors score, archivé

Source : Quelle IA, édition du 28 septembre 2026. https://quelleia.com
