Aller au contenu
EN 4 QUESTIONSTrouver mon modèle
Fiche modèle · édition du

Claude Opus 4.8

Anthropic · États-Unis · sorti le Anthropic · États-Unis · 28 mai 2026

  • Réflexion réglable
  • Poids fermés
  • En ligne seulement
90,7de 89,7 à 91,8Rang 12 · 100 %
Empreinte
Raisonnement89,2Code92,3Agents90,2Usage89,7Maths91,0Sciences92,8Français89,7Vision89,7Écriture91,3Web88,1

Score général

90,7de 89,7 à 91,8

Rang12Groupe 4, ex æquoCouverture100 %41 mesures
Pourquoi ce score ? →

Les dix tâches

  • Raisonnement
    89,2Rang 16 · 100 %
  • Code
    92,3Rang 7 · 54 %
  • Agents
    90,2Rang 7 · 78 %
  • Usage
    89,7Rang 15 · 100 %
  • Maths
    91,0Rang 12 · 88 %
  • Sciences
    92,8Rang 11 · 80 %
  • Français
    89,7Provisoire · 25 %
  • Vision
    89,7Rang 13 · 100 %
  • Écriture
    91,3Rang 12 · 100 %
  • Web
    88,1Rang 31 · 100 %

Artificial Analysis

Hors du score

Artificial Analysis évalue les modèles de son côté et publie son propre indice, l'Artificial Analysis Intelligence Index v4.3. C'est un autre indice, qui ne compte pas dans le score IA de Quelle IA et ne se compare pas directement à lui.

Version évaluéeIndice v4.3Rang chez euxVitessePremier jetonPrix par million de jetonsentrée / sortie
Claude Opus 4.8 (Adaptive Reasoning, Max Effort)41,850e sur 19358,7 jetons/s63,1 s5 $ / 25 $

Médianes de leurs mesures : vitesse en jetons produits par seconde, délai avant le premier jeton en secondes. Prix en dollars par million de jetons, en entrée puis en sortie. Rang parmi les 193 modèles que leur indice classe. Relevé le 1er octobre 2026 sur leur site, reproduit avec leur accord.

Source : Artificial Analysis

Peut-il tourner chez vous ?

Non. Claude Opus 4.8 est un modèle fermé : il s'utilise en ligne, par l'application de son éditeur ou par API.

Ces trois modèles ouverts ont le score le plus proche. Eux peuvent se télécharger et tourner sur une machine ou un serveur à vous.

Fiche technique

Prix
4,39 € / 22,0 €entrée / sortie, par million de jetons
Fenêtre de contexte
1 000 000 jetonsenviron 750 000 mots
Entrées
Texte, image, PDF
Réflexion
Faible, moyenne, élevée, très élevée, maximalecinq niveaux réglables
Paramètres
Non communiqué
Licence
Propriétairepoids fermés, accès par l'éditeur
Classe énergétique
Non communiquée
Hébergement en Europe
Non communiqué
Connaissances jusqu'à
Janvier 2026

Où le trouver

Liens directs, sans affiliation

Dans les outils de code

Relevé du
Disponible dans
Mesuré dans

Un modèle proposé par un outil figure dans la liste que son éditeur publie. Rien n'y est mesuré. Tous les outils et leurs modèles →

Toutes les mesures

76 mesures · la matière du score
BenchmarkPubliéSuggèreRéflexionÉtatSource
OTIS Mock AIME 2024-202598,3 %90,3MaximaleSATURÉepoch.ai
OTIS Mock AIME 2024-202597,8 %88,2FaibleSATURÉepoch.ai
ARC-AGI-192,5 %88,8MaximaleSATURÉarcprize.org
ARC-AGI-192 %88,4ÉlevéeSATURÉarcprize.org
DTBench94,9 %95,9MaximaleSATURÉconceptualreasoning.ai
ARC-AGI-191,5 %88,0MoyenneSATURÉarcprize.org
GPQA Diamond91 %84,2MaximaleACTIFepoch.ai
ARC-AGI-188 %85,7FaibleSATURÉarcprize.org
Surface Evolver Bench87,5 %97,5ÉlevéeSATURÉyhenon.github.io
GPQA Diamond88,4 %80,7FaibleACTIFepoch.ai
OTIS Mock AIME 2024-202584,4 %73,9SansSATURÉepoch.ai
WeirdML (v2)82,9 %101,3MaximaleACTIFhtihle.github.io
Voir les 64 autres mesures
GPQA Diamond85,4 %77,4SansACTIFepoch.ai
WeirdML (v2)76 %94,1MoyenneACTIFhtihle.github.io
ARC-AGI-272,1 %89,2ÉlevéeSATURÉepoch.ai
ARC-AGI-271,7 %89,1MoyenneSATURÉepoch.ai
GBAEval70,9 %92,9InconnueACTIFgbaeval.com
WeirdML (v2)70,5 %89,3SansACTIFhtihle.github.io
ProofBench69 %91,0MaximaleSATURÉvals.ai
LMCA57,5194,3MaximaleACTIFconceptualreasoning.ai
Code Arena, WebDev1 556,0 Elo87,9ÉlevéeACTIFarena.ai
Arena, questions d'experts1 525,3 Elo90,1ÉlevéeACTIFarena.ai
Arena, écriture créative1 469,4 Elo92,2ÉlevéeACTIFarena.ai
Code Arena, WebDev1 534,1 Elo86,4InconnueACTIFarena.ai
Arena, questions d'experts1 516,6 Elo88,4InconnueACTIFarena.ai
Arena, écriture créative1 463,5 Elo90,9InconnueACTIFarena.ai
Arena, questions de maths1 493,9 Elo88,7ÉlevéeACTIFarena.ai
ARC-AGI-262,2 %87,2FaibleSATURÉepoch.ai
Arena, questions de code1 533,3 Elo88,9ÉlevéeACTIFarena.ai
Arena, questions de code1 530,2 Elo88,2InconnueACTIFarena.ai
Arena, questions en français1 508,5 Elo88,6ÉlevéeACTIFarena.ai
Arena, texte1 481,3 Elo88,2ÉlevéeACTIFarena.ai
Arena, questions en français1 505,1 Elo87,9InconnueACTIFarena.ai
Arena, questions de maths1 476,2 Elo85,1InconnueACTIFarena.ai
Arena, texte1 474,5 Elo86,7InconnueACTIFarena.ai
DeepSWE59 %89,3Maximale · mini-SWE-agentACTIFdeepswe.datacurve.ai
Arena, vision1 286,5 Elo89,6ÉlevéeACTIFarena.ai
SimpleBench64,8 %86,6InconnueACTIFlmcouncil.ai
Arena, vision1 278,6 Elo87,8InconnueACTIFarena.ai
FrontierMath, palier 4 (v2)56,1 %91,3MaximaleSATURÉepoch.ai
DeepSWE54,4 %87,8Maximale · mini-SWE-agentACTIFdeepswe.datacurve.ai
SciCode53,5 %87,3MaximaleACTIFartificialanalysis.ai
SimpleQA Verified53 %89,4MaximaleACTIFepoch.ai
DeepSWE51,8 %87,0Élevée · mini-SWE-agentACTIFdeepswe.datacurve.ai
Vending-Bench 25 787 $88,4InconnueACTIFepoch.ai
APEX-Agents48,9 %87,4MaximaleACTIFepoch.ai
DeepSWE48,7 %86,1Moyenne · mini-SWE-agentACTIFdeepswe.datacurve.ai
Vending-Bench 22 992 $86,1MaximaleACTIFepoch.ai
GSO47,1 %92,0Inconnue · OpenHandsACTIFgso-bench.github.io
FrontierCode46,5 %93,1Inconnue · Claude CodeACTIFcognition.com
DeepSWE40,8 %83,7Faible · mini-SWE-agentACTIFdeepswe.datacurve.ai
PostTrainBench33,8 %93,2Élevée · Claude CodeACTIFepoch.ai
PostTrainBench32,9 %92,5Maximale · Claude CodeACTIFepoch.ai
Chess Puzzles34 %86,1MaximaleACTIFepoch.ai
Mystery Game Puzzles36 %89,4MaximaleACTIFepoch.ai
Chess Puzzles29 %83,5FaibleACTIFepoch.ai
GDP.pdf24 %92,3MaximaleACTIFsurgehq.ai
Mystery Game Puzzles31 %87,6MaximaleACTIFepoch.ai
EnigmaEval23,5 %89,1MaximaleACTIFlabs.scale.com
CritPt20,9 %90,9MaximaleACTIFepoch.ai
OSWorld 2.020,6 %91,7MaximaleACTIFosworld-v2.xlang.ai
ForecastBench59,9 %75,3BudgetACTIFepoch.ai
OSWorld 2.018,5 %90,8MaximaleACTIFosworld-v2.xlang.ai
ForecastBench59,1 %66,5InconnueACTIFepoch.ai
Furniture Assembly42,5 %91,8MaximaleACTIFepoch.ai
Blueprint-Bench 214,5 %83,5InconnueACTIFandonlabs.com
Chess Puzzles13 %70,2SansACTIFepoch.ai
Remote Labor Index8,3 %91,7InconnueACTIFepoch.ai

En bref

Quel est le score de Claude Opus 4.8 ?
Claude Opus 4.8 obtient un score IA de 90,7, avec une marge de 89,7 à 91,8, dans l'édition du 28 septembre 2026. Il est classé 12e sur 246 modèles, à partir de 41 mesures.
Dans quelles tâches Claude Opus 4.8 est-il le plus fort ?
Ses deux meilleures tâches sont sciences (92,8) et code (92,3). Sa tâche la plus faible est web (88,1).
Claude Opus 4.8 peut-il tourner en local ?
Non. Claude Opus 4.8 est un modèle fermé : il s'utilise en ligne, par l'application de son éditeur ou par API.
Combien coûte Claude Opus 4.8 ?
4,39 € par million de jetons en entrée et 22,0 € en sortie, au tarif affiché par les fournisseurs. Le coût réel d'une tâche dépend du nombre de jetons que le modèle consomme.
Qui édite Claude Opus 4.8 ?
Claude Opus 4.8 est édité par Anthropic (États-Unis), et il est sorti le 28 mai 2026. C'est un modèle fermé.

Ses voisins