Aller au contenu
EN 4 QUESTIONSTrouver mon modèle
Fiche modèle · édition du

DeepSeek-V3

DeepSeek · Chine · sorti le DeepSeek · Chine · 26 décembre 2024

  • Poids ouverts
54,4de 49,0 à 59,9Rang 168 · 65 %
Empreinte
Raisonnement48,7Code60,5Agents58,1UsageMaths51,3Sciences56,8FrançaisVisionÉcritureWeb

Score général

54,4de 49,0 à 59,9

Rang168Groupe 12, ex æquoCouverture65 %8 mesures
Pourquoi ce score ? →

Les dix tâches

  • Raisonnement
    48,7Provisoire · 22 %
  • Code
    60,5Provisoire · 8 %
  • Agents
    58,1Provisoire · 11 %
  • Usage
    Non mesuré
  • Maths
    51,3Provisoire · 25 %
  • Sciences
    56,8Provisoire · 40 %
  • Français
    Non mesuré
  • Vision
    Non mesuré
  • Écriture
    Non mesuré
  • Web
    Non mesuré

Peut-il tourner chez vous ?

Ses poids sont ouverts, mais sa taille n'est pas communiquée. Aucune estimation de mémoire n'est possible.

Fiche technique

Prix
Non communiqué
Fenêtre de contexte
Non communiqué
Entrées
Non communiqué
Réflexion
Non communiqué
Paramètres
Non communiqué
Licence
Poids ouvertspoids ouverts, téléchargeables
Classe énergétique
Non communiquée
Hébergement en Europe
Non communiqué
Connaissances jusqu'à
Non communiqué

Où le trouver

Liens directs, sans affiliation

Toutes les mesures

23 mesures · la matière du score
BenchmarkPubliéSuggèreRéflexionÉtatSource
ARC (AI2 Reasoning Challenge)95,3 %72,2InconnueARCHIVÉepoch.ai
HellaSwag88,9 %57,2InconnueARCHIVÉepoch.ai
BIG-Bench Hard (BBH)87,5 %58,1InconnueARCHIVÉepoch.ai
MMLU87,2 %63,3InconnueARCHIVÉepoch.ai
TriviaQA82,9 %56,3InconnueARCHIVÉepoch.ai
MMLU87,1 %63,0InconnueARCHIVÉepoch.ai
BIG-Bench Hard (BBH)82,9 %48,5InconnueARCHIVÉepoch.ai
WinoGrande85,2 %52,9InconnueARCHIVÉepoch.ai
PIQA84,7 %41,2InconnueARCHIVÉepoch.ai
MATH Level 564,9 %53,9InconnueARCHIVÉepoch.ai
LiveBench, code61,8 %60,6InconnueARCHIVÉepoch.ai
LiveBench, mathématiques60,5 %56,6InconnueARCHIVÉepoch.ai
Voir les 11 autres mesures
LiveBench60,5 %58,2InconnueARCHIVÉepoch.ai
LiveBench, raisonnement56,8 %54,9InconnueARCHIVÉepoch.ai
Aider Polyglot48,4 %64,4InconnueARCHIVÉepoch.ai
GPQA Diamond56,5 %57,0InconnueACTIFepoch.ai
SciCode35,4 %65,6InconnueACTIFartificialanalysis.ai
ForecastBench59,1 %66,5InconnueACTIFepoch.ai
OTIS Mock AIME 2024-202515,8 %50,9InconnueSATURÉepoch.ai
SimpleBench18,9 %31,9InconnueACTIFepoch.ai
CritPt0 %61,2InconnueACTIFepoch.ai

En bref

Quel est le score de DeepSeek-V3 ?
DeepSeek-V3 obtient un score IA de 54,4, avec une marge de 49,0 à 59,9, dans l'édition du 28 septembre 2026. Il est classé 168e sur 246 modèles, à partir de 8 mesures.
Dans quelles tâches DeepSeek-V3 est-il le plus fort ?
Ses deux meilleures tâches sont code (60,5) et agents (58,1). Sa tâche la plus faible est raisonnement (48,7).
DeepSeek-V3 peut-il tourner en local ?
Ses poids sont ouverts, mais sa taille n'est pas communiquée. Aucune estimation de mémoire n'est possible.
Qui édite DeepSeek-V3 ?
DeepSeek-V3 est édité par DeepSeek (Chine), et il est sorti le 26 décembre 2024. Ses poids sont ouverts.

Ses voisins