# Claude Sonnet 4

> Fiche du modèle de langage Claude Sonnet 4 sur Quelle IA, édition du 28 septembre 2026. Claude Sonnet 4 (Anthropic) : score IA de 70,6, 107e sur 246. Scores par tâche, prix, exécution locale et liens pour le télécharger ou l'essayer.

Page : https://quelleia.com/modeles/claude-sonnet-4/
Origine : Anthropic · États-Unis · sorti le 22 mai 2025

## Score général

- Score IA : 70,6 (marge à 90 % : de 68,4 à 72,8)
- Rang : 107 (Groupe 9, ex æquo)
- Couverture : 95 % du poids des tâches, 26 mesures
- Échelle : 100 pour le meilleur modèle au lancement du site, 50 pour GPT-4o de novembre 2024.

## Scores par tâche

| Tâche | Score | Détail |
| --- | --- | --- |
| Raisonnement | 71,4 | Rang 74 · 78 % |
| Code | 72,2 | Rang 54 · 31 % |
| Agents | 72,7 | Provisoire · 22 % |
| Usage | 70,4 | Rang 120 · 100 % |
| Maths | 68,0 | Rang 74 · 50 % |
| Sciences | 70,6 | Rang 67 · 80 % |
| Français | 73,0 | Rang 55 · 50 % |
| Vision | 70,6 | Provisoire · 33 % |
| Écriture | 73,0 | Rang 102 · 100 % |
| Web | non mesuré | Non mesuré |

## Artificial Analysis (hors du score)

Artificial Analysis évalue les modèles de son côté et publie son propre indice, l'Artificial Analysis Intelligence Index v4.3. C'est un autre indice, qui ne compte pas dans le score IA de Quelle IA et ne se compare pas directement à lui.

| Version évaluée | Indice v4.3 | Rang chez eux | Vitesse | Premier jeton | Prix par million de jetons (entrée / sortie) |
| --- | --- | --- | --- | --- | --- |
| [Claude 4 Sonnet (Reasoning)](https://artificialanalysis.ai/models/claude-4-sonnet-thinking) | 18,9 (estimé) | hors classement | non publié | non publié | non publié |
| [Claude 4 Sonnet (Non-reasoning)](https://artificialanalysis.ai/models/claude-4-sonnet) | 16,6 (estimé) | hors classement | non publié | non publié | non publié |

Médianes de leurs mesures : vitesse en jetons produits par seconde, délai avant le premier jeton en secondes. Prix en dollars par million de jetons, en entrée puis en sortie. Rang parmi les 193 modèles que leur indice classe ; un indice qu'ils estiment reste hors de ce classement. Relevé le 1er octobre 2026 sur leur site, reproduit avec leur accord.

Source : Artificial Analysis, https://artificialanalysis.ai/models/claude-4-sonnet-thinking

## Exécution locale

Non. Claude Sonnet 4 est un modèle fermé : il s'utilise en ligne, par l'application de son éditeur ou par API.

## Fiche technique

- Prix : 2,60 € / 13,0 € (entrée / sortie, par million de jetons)
- Fenêtre de contexte : 1 000 000 jetons (environ 750 000 mots)
- Entrées : Texte, image, PDF
- Réflexion : Non communiqué
- Paramètres : Non communiqué
- Licence : Propriétaire (poids fermés, accès par l'éditeur)
- Classe énergétique : E (sur une échelle de A à G)
- Hébergement en Europe : Possible
- Connaissances jusqu'à : Mars 2025

## Où le trouver

- Par API : [OpenRouter](https://openrouter.ai/anthropic/claude-sonnet-4)
- Par API : [API Anthropic](https://docs.anthropic.com)
- L'essayer : [Claude](https://claude.ai)

## Dans les outils de code

- Disponible dans : [Cursor](https://quelleia.com/outils/#cursor) (inclus), [Kiro](https://quelleia.com/outils/#kiro) (inclus)
- Relevé du 30 septembre 2026 sur la page publique de chaque outil. Un modèle proposé par un outil figure dans la liste que son éditeur publie. Rien n'y est mesuré.

## Mesures

| Benchmark | Tâche | Publié | Niveau suggéré | État | Source |
| --- | --- | --- | --- | --- | --- |
| MATH Level 5 | Maths | 84,4 % | 62,5 | archivé | https://epoch.ai/benchmarks |
| Lech Mazur Writing | Écriture | 8,14 | 74,9 | archivé | https://epoch.ai/benchmarks |
| Lech Mazur Writing | Écriture | 8,09 | 73,7 | archivé | https://epoch.ai/benchmarks |
| GPQA Diamond | Sciences | 79,2 % | 72,0 | actif | https://epoch.ai/benchmarks |
| OTIS Mock AIME 2024-2025 | Maths | 71,1 % | 68,5 | saturé | https://epoch.ai/benchmarks |
| GPQA Diamond | Sciences | 78,3 % | 71,3 | actif | https://epoch.ai/benchmarks |
| OTIS Mock AIME 2024-2025 | Maths | 68,9 % | 67,8 | saturé | https://epoch.ai/benchmarks |
| GPQA Diamond | Sciences | 75,8 % | 69,5 | actif | https://epoch.ai/benchmarks |
| METR Time Horizons (taux de réussite) | Agents | 62 % | 72,9 | actif | https://epoch.ai/benchmarks |
| DTBench | Raisonnement | 77,1 % | 68,9 | saturé | https://conceptualreasoning.ai/dtbench |
| Aider Polyglot | Code | 61,3 % | 68,7 | archivé | https://aider.chat/docs/leaderboards/ |
| Aider Polyglot | Code | 56,4 % | 67,0 | archivé | https://aider.chat/docs/leaderboards/ |
| GPQA Diamond | Sciences | 66,7 % | 63,4 | actif | https://epoch.ai/benchmarks |
| compar:IA | Français | 1 063,0 Elo | 90,1 | actif | https://arene.comparia.beta.gouv.fr/ranking |
| Arena, questions de code | Code | 1 474,0 Elo | 75,9 | actif | https://arena.ai/leaderboard |
| Arena, écriture créative | Écriture | 1 395,7 Elo | 75,6 | actif | https://arena.ai/leaderboard |
| OTIS Mock AIME 2024-2025 | Maths | 53,3 % | 63,3 | saturé | https://epoch.ai/benchmarks |
| Arena, écriture créative | Écriture | 1 388,0 Elo | 73,9 | actif | https://arena.ai/leaderboard |
| Arena, questions d'experts | Sciences | 1 432,7 Elo | 72,5 | actif | https://arena.ai/leaderboard |
| Arena, questions de code | Code | 1 449,2 Elo | 70,4 | actif | https://arena.ai/leaderboard |
| Arena, questions en français | Français | 1 427,2 Elo | 71,2 | actif | https://arena.ai/leaderboard |
| Arena, questions de maths | Maths | 1 403,5 Elo | 70,2 | actif | https://arena.ai/leaderboard |
| Arena, texte | Usage | 1 401,6 Elo | 69,8 | actif | https://arena.ai/leaderboard |
| Arena, questions en français | Français | 1 418,0 Elo | 69,2 | actif | https://arena.ai/leaderboard |
| Arena, texte | Usage | 1 390,7 Elo | 67,3 | actif | https://arena.ai/leaderboard |
| Arena, questions de maths | Maths | 1 390,7 Elo | 67,5 | actif | https://arena.ai/leaderboard |
| Arena, vision | Vision | 1 206,2 Elo | 70,8 | actif | https://arena.ai/leaderboard |
| Arena, questions d'experts | Sciences | 1 401,9 Elo | 66,6 | actif | https://arena.ai/leaderboard |
| Fiction.LiveBench | Données | 46,9 % | 57,5 | archivé | https://epoch.ai/benchmarks |
| DeepResearch Bench | Agents | 46,6 % | 80,5 | actif | https://evals.futuresearch.ai/#drb |
| WeirdML (v2) | Code | 46,1 % | 71,9 | actif | https://htihle.github.io/weirdml.html |
| MindCube | Vision | 44,8 % | 55,0 | archivé | https://mind-cube.github.io/ |
| Arena, vision | Vision | 1 188,0 Elo | 66,5 | actif | https://arena.ai/leaderboard |
| OSWorld | Agents | 43,9 % | 72,9 | archivé | https://epoch.ai/benchmarks |
| WeirdML (v2) | Code | 43,9 % | 70,4 | actif | https://htihle.github.io/weirdml.html |
| OSWorld | Agents | 41,4 % | 71,9 | archivé | https://epoch.ai/benchmarks |
| SciCode | Code | 40 % | 71,4 | actif | https://artificialanalysis.ai/evaluations/scicode |
| ARC-AGI-1 | Raisonnement | 40 % | 71,6 | saturé | https://epoch.ai/benchmarks |
| GeoBench | Vision | 37 % | 17,6 | archivé | https://epoch.ai/benchmarks |
| Cybench | Sécurité | 35 % | 70,8 | archivé | https://epoch.ai/benchmarks |
| SimpleBench | Raisonnement | 45,5 % | 73,3 | actif | https://epoch.ai/benchmarks |
| SimpleBench | Raisonnement | 45,5 % | 73,3 | actif | https://epoch.ai/benchmarks |
| LMCA | Raisonnement | 29 | 71,2 | actif | https://conceptualreasoning.ai/lmca |
| TheAgentCompany | Agents | 33,1 % | 69,4 | archivé | https://epoch.ai/benchmarks |
| GeoBench | Vision | 32 % | 9,2 | archivé | https://epoch.ai/benchmarks |
| OSWorld | Agents | 31,2 % | 67,4 | archivé | https://epoch.ai/benchmarks |
| ARC-AGI-1 | Raisonnement | 29 % | 68,7 | saturé | https://epoch.ai/benchmarks |
| OTIS Mock AIME 2024-2025 | Maths | 28,9 % | 56,2 | saturé | https://epoch.ai/benchmarks |
| ARC-AGI-1 | Raisonnement | 28 % | 68,4 | saturé | https://epoch.ai/benchmarks |
| ARC-AGI-1 | Raisonnement | 23,8 % | 67,1 | saturé | https://arcprize.org/leaderboard |
| ForecastBench | Raisonnement | 60,2 % | 78,4 | actif | https://epoch.ai/benchmarks |
| FrontierMath, paliers 1 à 3 (version 2025) | Maths | 4,1 % | 64,8 | actif | https://epoch.ai/benchmarks |
| ARC-AGI-2 | Raisonnement | 5,9 % | 72,8 | saturé | https://epoch.ai/benchmarks |
| GSO | Code | 4,9 % | 71,7 | actif | https://epoch.ai/benchmarks |
| GSO | Code | 4,9 % | 71,7 | actif | https://epoch.ai/benchmarks |
| EnigmaEval | Raisonnement | 3,1 % | 66,2 | actif | https://labs.scale.com/leaderboard/enigma_eval |
| Humanity's Last Exam | Sciences | 7,8 % | 57,4 | actif | https://epoch.ai/benchmarks |
| ARC-AGI-2 | Raisonnement | 2,1 % | 68,1 | saturé | https://epoch.ai/benchmarks |
| ARC-AGI-2 | Raisonnement | 1,3 % | 65,8 | saturé | https://epoch.ai/benchmarks |
| VPCT (Visual Physics Comprehension Test) | Vision | 34 % | 62,4 | archivé | https://epoch.ai/benchmarks |
| ARC-AGI-2 | Raisonnement | 0,9 % | 64,7 | saturé | https://epoch.ai/benchmarks |
| Humanity's Last Exam | Sciences | 5,5 % | 44,5 | actif | https://epoch.ai/benchmarks |
| CritPt | Sciences | 0,3 % | 61,2 | actif | https://epoch.ai/benchmarks |
| FrontierMath, palier 4 (version 2025) | Maths | 0 % | 66,0 | actif | https://epoch.ai/benchmarks |
| VPCT (Visual Physics Comprehension Test) | Vision | 30 % | 62,4 | archivé | https://epoch.ai/benchmarks |

## En bref

**Quel est le score de Claude Sonnet 4 ?** Claude Sonnet 4 obtient un score IA de 70,6, avec une marge de 68,4 à 72,8, dans l'édition du 28 septembre 2026. Il est classé 107e sur 246 modèles, à partir de 26 mesures.

**Dans quelles tâches Claude Sonnet 4 est-il le plus fort ?** Ses deux meilleures tâches sont français (73,0) et écriture (73,0). Sa tâche la plus faible est maths (68,0).

**Claude Sonnet 4 peut-il tourner en local ?** Non. Claude Sonnet 4 est un modèle fermé : il s'utilise en ligne, par l'application de son éditeur ou par API.

**Combien coûte Claude Sonnet 4 ?** 2,60 € par million de jetons en entrée et 13,0 € en sortie, au tarif affiché par les fournisseurs. Le coût réel d'une tâche dépend du nombre de jetons que le modèle consomme.

**Qui édite Claude Sonnet 4 ?** Claude Sonnet 4 est édité par Anthropic (États-Unis), et il est sorti le 22 mai 2025. C'est un modèle fermé.

Source : Quelle IA, édition du 28 septembre 2026. https://quelleia.com
