Aller au contenu
EN 4 QUESTIONSTrouver mon modèle
Fiche modèle · édition du

Claude 3.7 Sonnet

Anthropic · États-Unis · sorti le Anthropic · États-Unis · 24 février 2025

  • Avec réflexion
  • Poids fermés
  • En ligne seulement
68,3de 65,5 à 71,1Rang 122 · 95 %
Empreinte
Raisonnement69,3Code70,1Agents70,1Usage67,5Maths64,6Sciences70,4Français63,8Vision68,0Écriture71,4Web

Score général

68,3de 65,5 à 71,1

Rang122Groupe 10, ex æquoCouverture95 %25 mesures
Pourquoi ce score ? →

Les dix tâches

  • Raisonnement
    69,3Rang 80 · 56 %
  • Code
    70,1Provisoire · 23 %
  • Agents
    70,1Provisoire · 22 %
  • Usage
    67,5Rang 139 · 100 %
  • Maths
    64,6Provisoire · 38 %
  • Sciences
    70,4Rang 68 · 60 %
  • Français
    63,8Rang 83 · 56 %
  • Vision
    68,0Provisoire · 33 %
  • Écriture
    71,4Rang 109 · 100 %
  • Web
    Non mesuré

Artificial Analysis

Hors du score

Artificial Analysis évalue les modèles de son côté et publie son propre indice, l'Artificial Analysis Intelligence Index v4.3. C'est un autre indice, qui ne compte pas dans le score IA de Quelle IA et ne se compare pas directement à lui.

Version évaluéeIndice v4.3Rang chez euxVitessePremier jetonPrix par million de jetonsentrée / sortie
Claude 3.7 Sonnet (Reasoning)17,7estiméhors classementnon publiénon publiénon publié
Claude 3.7 Sonnet (Non-reasoning)15,3estiméhors classementnon publiénon publié3 $ / 15 $

Médianes de leurs mesures : vitesse en jetons produits par seconde, délai avant le premier jeton en secondes. Prix en dollars par million de jetons, en entrée puis en sortie. Rang parmi les 193 modèles que leur indice classe ; un indice qu'ils estiment reste hors de ce classement. Relevé le 1er octobre 2026 sur leur site, reproduit avec leur accord.

Source : Artificial Analysis

Peut-il tourner chez vous ?

Non. Claude 3.7 Sonnet est un modèle fermé : il s'utilise en ligne, par l'application de son éditeur ou par API.

Ces trois modèles ouverts ont le score le plus proche. Eux peuvent se télécharger et tourner sur une machine ou un serveur à vous.

Fiche technique

Prix
2,63 € / 13,2 €entrée / sortie, par million de jetons
Fenêtre de contexte
200 000 jetonsenviron 150 000 mots
Entrées
Texte, image, PDF
Réflexion
Non communiqué
Paramètres
Non communiqué
Licence
Propriétairepoids fermés, accès par l'éditeur
Classe énergétique
Non communiquée
Hébergement en Europe
Non communiqué
Connaissances jusqu'à
Octobre 2024

Où le trouver

Liens directs, sans affiliation

Toutes les mesures

87 mesures · la matière du score
BenchmarkPubliéSuggèreRéflexionÉtatSource
MATH Level 591,2 %67,6BudgetARCHIVÉepoch.ai
MATH Level 590 %66,6BudgetARCHIVÉepoch.ai
LiveBench, raisonnement87,8 %74,6InconnueARCHIVÉepoch.ai
MATH Level 586,3 %63,7BudgetARCHIVÉepoch.ai
Fiction.LiveBench83,3 %78,0BudgetARCHIVÉepoch.ai
Lech Mazur Writing8,1174,2BudgetARCHIVÉepoch.ai
Lech Mazur Writing7,9470,2InconnueARCHIVÉepoch.ai
LiveBench, mathématiques79 %67,4InconnueARCHIVÉepoch.ai
LiveBench76,1 %70,5InconnueARCHIVÉepoch.ai
LiveBench, code74,5 %69,0InconnueARCHIVÉepoch.ai
Voir les 75 autres mesures
GPQA Diamond79,7 %72,5BudgetACTIFepoch.ai
GPQA Diamond76,8 %70,2BudgetACTIFepoch.ai
GPQA Diamond76,8 %70,2BudgetACTIFepoch.ai
MATH Level 568,2 %55,1InconnueARCHIVÉepoch.ai
GeoBench68 %66,9InconnueARCHIVÉepoch.ai
LiveBench, code67,5 %64,1InconnueARCHIVÉepoch.ai
LiveBench, raisonnement66 %59,5InconnueARCHIVÉepoch.ai
LiveBench65,6 %61,9InconnueARCHIVÉepoch.ai
GeoBench65 %61,7BudgetARCHIVÉepoch.ai
Aider Polyglot64,9 %69,9BudgetARCHIVÉaider.chat
LiveBench, mathématiques63,3 %58,0InconnueARCHIVÉepoch.ai
SWE-bench Verified61 %70,5InconnueACTIFepoch.ai
Aider Polyglot60,4 %68,4InconnueARCHIVÉaider.chat
OTIS Mock AIME 2024-202557,8 %64,5BudgetSATURÉepoch.ai
GPQA Diamond66 %63,0InconnueACTIFepoch.ai
CadEval54 %68,9InconnueARCHIVÉepoch.ai
OTIS Mock AIME 2024-202553,3 %63,3BudgetSATURÉepoch.ai
Arena, écriture créative1 393,2 Elo75,1ÉlevéeACTIFarena.ai
Arena, écriture créative1 377,5 Elo71,5InconnueACTIFarena.ai
Arena, questions de code1 452,7 Elo71,2ÉlevéeACTIFarena.ai
Fiction.LiveBench50 %59,0InconnueARCHIVÉepoch.ai
Arena, questions d'experts1 411,7 Elo68,5ÉlevéeACTIFarena.ai
Arena, texte1 388,3 Elo66,7ÉlevéeACTIFarena.ai
Arena, questions de code1 431,4 Elo66,6InconnueACTIFarena.ai
Arena, questions de maths1 385,5 Elo66,5ÉlevéeACTIFarena.ai
OTIS Mock AIME 2024-202546,7 %61,4BudgetSATURÉepoch.ai
Arena, texte1 372,5 Elo63,1InconnueACTIFarena.ai
Arena, questions d'experts1 390,3 Elo64,4InconnueACTIFarena.ai
Arena, vision1 192,8 Elo67,6ÉlevéeACTIFarena.ai
Arena, questions en français1 386,9 Elo62,5InconnueACTIFarena.ai
Arena, questions de maths1 363,1 Elo61,9InconnueACTIFarena.ai
DeepResearch Bench43,6 %69,8BudgetACTIFepoch.ai
Arena, questions en français1 376,5 Elo60,3ÉlevéeACTIFarena.ai
Arena, vision1 175,2 Elo63,5InconnueACTIFarena.ai
OSWorld35,8 %69,5Inconnue · claude-3-7-sonnet-20250219 (50 steps)ARCHIVÉepoch.ai
SimpleBench46,4 %74,0BudgetACTIFepoch.ai
SimpleBench46,4 %74,0InconnueACTIFepoch.ai
OSWorld35,6 %69,4Inconnue · claude-3-7-sonnet-20250219 (100 steps)ARCHIVÉepoch.ai
SpatialViz-Bench33,9 %51,9InconnueARCHIVÉarxiv.org
SimpleBench44,9 %72,8InconnueACTIFepoch.ai
TheAgentCompany30,9 %68,4InconnueARCHIVÉepoch.ai
ARC-AGI-128,6 %68,6BudgetSATURÉepoch.ai
OSWorld27,1 %65,4Inconnue · claude-3-7-sonnet-20250219 (15 steps)ARCHIVÉepoch.ai
TheAgentCompany26,3 %66,2InconnueARCHIVÉepoch.ai
ForecastBench61,8 %94,2InconnueACTIFepoch.ai
OTIS Mock AIME 2024-202521,9 %53,7InconnueSATURÉepoch.ai
ARC-AGI-121,2 %66,2BudgetSATURÉepoch.ai
Cybench20 %65,9InconnueARCHIVÉepoch.ai
ARC-AGI-113,6 %63,1InconnueSATURÉepoch.ai
ARC-AGI-111,6 %62,0BudgetSATURÉepoch.ai
EnigmaEval4,2 %69,4InconnueACTIFlabs.scale.com
GSO3,8 %69,8Inconnue · OpenHandsACTIFepoch.ai
GSO3,8 %69,8Inconnue · OpenHandsACTIFepoch.ai
Humanity's Last Exam8 %58,4InconnueACTIFepoch.ai
EnigmaEval2,3 %62,8InconnueACTIFlabs.scale.com
ARC-AGI-20,9 %64,7BudgetSATURÉepoch.ai
ARC-AGI-20,7 %64,7BudgetSATURÉepoch.ai
ARC-AGI-20,4 %64,7BudgetSATURÉepoch.ai
ARC-AGI-20 %64,7InconnueSATURÉepoch.ai

En bref

Quel est le score de Claude 3.7 Sonnet ?
Claude 3.7 Sonnet obtient un score IA de 68,3, avec une marge de 65,5 à 71,1, dans l'édition du 28 septembre 2026. Il est classé 122e sur 246 modèles, à partir de 25 mesures.
Dans quelles tâches Claude 3.7 Sonnet est-il le plus fort ?
Ses deux meilleures tâches sont écriture (71,4) et sciences (70,4). Sa tâche la plus faible est français (63,8).
Claude 3.7 Sonnet peut-il tourner en local ?
Non. Claude 3.7 Sonnet est un modèle fermé : il s'utilise en ligne, par l'application de son éditeur ou par API.
Combien coûte Claude 3.7 Sonnet ?
2,63 € par million de jetons en entrée et 13,2 € en sortie, au tarif affiché par les fournisseurs. Le coût réel d'une tâche dépend du nombre de jetons que le modèle consomme.
Qui édite Claude 3.7 Sonnet ?
Claude 3.7 Sonnet est édité par Anthropic (États-Unis), et il est sorti le 24 février 2025. C'est un modèle fermé.

Ses voisins