Aller au contenu
EN 4 QUESTIONSTrouver mon modèle
Fiche modèle · édition du

o1

OpenAI · États-Unis · sorti le OpenAI · États-Unis · 17 décembre 2024

  • Réflexion réglable
  • Poids fermés
  • En ligne seulement
68,8de 66,8 à 70,9Rang 119 · 95 %
Empreinte
Raisonnement68,5Code70,6Agents64,6Usage69,3Maths69,3Sciences68,8Français65,7Vision68,3Écriture70,4Web

Score général

68,8de 66,8 à 70,9

Rang119Groupe 10, ex æquoCouverture95 %20 mesures
Pourquoi ce score ? →

Les dix tâches

  • Raisonnement
    68,5Rang 82 · 67 %
  • Code
    70,6Provisoire · 15 %
  • Agents
    64,6Provisoire · 11 %
  • Usage
    69,3Rang 128 · 100 %
  • Maths
    69,3Rang 72 · 50 %
  • Sciences
    68,8Rang 74 · 60 %
  • Français
    65,7Provisoire · 25 %
  • Vision
    68,3Provisoire · 33 %
  • Écriture
    70,4Rang 117 · 100 %
  • Web
    Non mesuré

Artificial Analysis

Hors du score

Artificial Analysis évalue les modèles de son côté et publie son propre indice, l'Artificial Analysis Intelligence Index v4.3. C'est un autre indice, qui ne compte pas dans le score IA de Quelle IA et ne se compare pas directement à lui.

Version évaluéeIndice v4.3Rang chez euxVitessePremier jetonPrix par million de jetonsentrée / sortie
o115,2estiméhors classementnon publiénon publié15 $ / 60 $

Médianes de leurs mesures : vitesse en jetons produits par seconde, délai avant le premier jeton en secondes. Prix en dollars par million de jetons, en entrée puis en sortie. Rang parmi les 193 modèles que leur indice classe ; un indice qu'ils estiment reste hors de ce classement. Relevé le 1er octobre 2026 sur leur site, reproduit avec leur accord.

Source : Artificial Analysis

Peut-il tourner chez vous ?

Non. o1 est un modèle fermé : il s'utilise en ligne, par l'application de son éditeur ou par API.

Ces trois modèles ouverts ont le score le plus proche. Eux peuvent se télécharger et tourner sur une machine ou un serveur à vous.

Fiche technique

Prix
13,2 € / 52,7 €entrée / sortie, par million de jetons
Fenêtre de contexte
200 000 jetonsenviron 150 000 mots
Entrées
Texte, image, PDF
Réflexion
Faible, moyenne, élevéetrois niveaux réglables
Paramètres
Non communiqué
Licence
Propriétairepoids fermés, accès par l'éditeur
Classe énergétique
Non communiquée
Hébergement en Europe
Non communiqué
Connaissances jusqu'à
Septembre 2023

Où le trouver

Liens directs, sans affiliation

Toutes les mesures

44 mesures · la matière du score
BenchmarkPubliéSuggèreRéflexionÉtatSource
MATH Level 594,7 %72,0ÉlevéeARCHIVÉepoch.ai
MATH Level 594,4 %71,6MoyenneARCHIVÉepoch.ai
LiveBench, raisonnement91,6 %79,4ÉlevéeARCHIVÉepoch.ai
Fiction.LiveBench83,3 %78,0MoyenneARCHIVÉepoch.ai
LiveBench, mathématiques80,3 %68,3ÉlevéeARCHIVÉepoch.ai
GeoBench80 %91,1MoyenneARCHIVÉepoch.ai
LiveBench75,7 %70,1ÉlevéeARCHIVÉepoch.ai
OTIS Mock AIME 2024-202573,3 %69,3MoyenneSATURÉepoch.ai
OTIS Mock AIME 2024-202573,3 %69,3ÉlevéeSATURÉepoch.ai
Lech Mazur Writing7,0251,8MoyenneARCHIVÉepoch.ai
LiveBench, code69,7 %65,6ÉlevéeARCHIVÉepoch.ai
GPQA Diamond76,8 %70,2ÉlevéeACTIFepoch.ai
Voir les 32 autres mesures
GPQA Diamond75,8 %69,5MoyenneACTIFepoch.ai
GPQA Diamond74,2 %68,4FaibleACTIFepoch.ai
Aider Polyglot61,7 %68,8ÉlevéeARCHIVÉaider.chat
DTBench74,7 %66,6ÉlevéeSATURÉconceptualreasoning.ai
CadEval56 %70,1MoyenneARCHIVÉepoch.ai
OTIS Mock AIME 2024-202553,3 %63,3FaibleSATURÉepoch.ai
Arena, écriture créative1 381,4 Elo72,4InconnueACTIFarena.ai
Arena, questions de maths1 408,9 Elo71,3InconnueACTIFarena.ai
Arena, texte1 402,3 Elo69,9InconnueACTIFarena.ai
Arena, questions de code1 432,9 Elo66,9InconnueACTIFarena.ai
Arena, questions d'experts1 401,8 Elo66,6InconnueACTIFarena.ai
WeirdML (v2)46,1 %71,9ÉlevéeACTIFhtihle.github.io
Arena, vision1 192,7 Elo67,6InconnueACTIFarena.ai
Arena, questions en français1 385,1 Elo62,1InconnueACTIFarena.ai
SpatialViz-Bench41,4 %78,7InconnueARCHIVÉarxiv.org
SimpleQA Verified41,1 %81,6ÉlevéeACTIFepoch.ai
ARC-AGI-130,7 %69,2MoyenneSATURÉepoch.ai
SimpleBench40,1 %69,1ÉlevéeACTIFepoch.ai
ARC-AGI-127,2 %68,2FaibleSATURÉepoch.ai
LMCA22,2764,9ÉlevéeACTIFconceptualreasoning.ai
SimpleBench36,7 %66,1MoyenneACTIFepoch.ai
Chess Puzzles15 %72,7ÉlevéeACTIFepoch.ai
Chess Puzzles12 %68,7MoyenneACTIFepoch.ai
EnigmaEval5,7 %72,5InconnueACTIFlabs.scale.com
Humanity's Last Exam8 %58,1InconnueACTIFepoch.ai
Chess Puzzles7 %55,5FaibleACTIFepoch.ai

En bref

Quel est le score de o1 ?
o1 obtient un score IA de 68,8, avec une marge de 66,8 à 70,9, dans l'édition du 28 septembre 2026. Il est classé 119e sur 246 modèles, à partir de 20 mesures.
Dans quelles tâches o1 est-il le plus fort ?
Ses deux meilleures tâches sont code (70,6) et écriture (70,4). Sa tâche la plus faible est agents (64,6).
o1 peut-il tourner en local ?
Non. o1 est un modèle fermé : il s'utilise en ligne, par l'application de son éditeur ou par API.
Combien coûte o1 ?
13,2 € par million de jetons en entrée et 52,7 € en sortie, au tarif affiché par les fournisseurs. Le coût réel d'une tâche dépend du nombre de jetons que le modèle consomme.
Qui édite o1 ?
o1 est édité par OpenAI (États-Unis), et il est sorti le 17 décembre 2024. C'est un modèle fermé.

Ses voisins