Fiche modèle · édition du
Llama-3.1-Nemotron-70B-Instruct
NVIDIA · États-Unis · sorti le NVIDIA · États-Unis · 18 décembre 2024
- Poids ouverts · Llama 3.1
- Mac 96 Go
- Classe énergétique C
48,2de 37,9 à 58,4Rang 197 · 60 %
Empreinte
RaisonnementCode46,4AgentsUsage47,4Maths46,6Sciences47,4Français56,0VisionÉcriture48,4Web
Score général
Les dix tâches
- RaisonnementNon mesuré
- Code46,4Provisoire · 8 %
- AgentsNon mesuré
- Usage47,4Rang 218 · 100 %
- Maths46,6Provisoire · 12 %
- Sciences47,4Provisoire · 20 %
- Français56,0Rang 108 · 56 %
- VisionNon mesuré
- Écriture48,4Rang 213 · 100 %
- WebNon mesuré
Peut-il tourner chez vous ?ESTIMATION
Tient à partir d'un Mac de 96 Go (71 Go utiles), en version allégée à 4 bits, par exemple un Mac Studio M5 Ultra de 96 Go. Mémoire estimée : 48,3 Go.
- Carte graphique 96 Gopar exemple RTX PRO 6000 BlackwellOui, jusqu'à 8 bits
- PC portables GeForce RTXTrop juste
- PC portables Intel Core UltraTrop juste
- PC portables Snapdragon X2Trop juste
- Mac 96 Gopar exemple Mac Studio M5 Ultra, 96 GoOui, allégé 4 bits
- Ryzen AI Max 128 Gopar exemple Ryzen AI Max+ 395, 128 Go, et une autre machineOui, jusqu'à 8 bits
- DGX Spark 128 Gopar exemple Nvidia DGX SparkOui, jusqu'à 8 bits
- Sans carte graphiqueTrop juste
- ServeurOui
Mémoire selon la versionAllégée, 4 bits48,3 GoAllégée, 8 bits84,5 GoComplète, 16 bits161,0 GoLe pointillé marque 71 Go, la mémoire utile d'un Mac de 96 Go. Au-delà, le modèle ne tient plus sur cette machine.
Les benchmarks mesurent la version complète du modèle. La version allégée fait un peu moins bien. À télécharger avec Ollama, LM Studio ou llama.cpp. Comment on compte la mémoire.
Fiche technique
- Prix
- 0,52 € / 0,52 €entrée / sortie, par million de jetons
- Fenêtre de contexte
- 131 072 jetonsenviron 98 000 mots
- Entrées
- Texte
- Réflexion
- Non communiqué
- Paramètres
- 70 milliards
- Licence
- Llama 3.1poids ouverts, téléchargeables
- Classe énergétique
- Csur une échelle de A à G
- Hébergement en Europe
- Possible
- Connaissances jusqu'à
- Non communiqué
Où le trouver
Liens directs, sans affiliationToutes les mesures
11 mesures · la matière du scoreBenchmarkPubliéSuggèreRéflexionÉtatSource
En bref
- Quel est le score de Llama-3.1-Nemotron-70B-Instruct ?
- Llama-3.1-Nemotron-70B-Instruct obtient un score IA de 48,2, avec une marge de 37,9 à 58,4, dans l'édition du 28 septembre 2026. Il est classé 197e sur 246 modèles, à partir de 11 mesures.
- Dans quelles tâches Llama-3.1-Nemotron-70B-Instruct est-il le plus fort ?
- Ses deux meilleures tâches sont français (56,0) et écriture (48,4). Sa tâche la plus faible est code (46,4).
- Llama-3.1-Nemotron-70B-Instruct peut-il tourner en local ?
- Tient à partir d'un Mac de 96 Go (71 Go utiles), en version allégée à 4 bits, par exemple un Mac Studio M5 Ultra de 96 Go. Mémoire estimée : 48,3 Go.
- Combien coûte Llama-3.1-Nemotron-70B-Instruct ?
- 0,52 € par million de jetons en entrée et 0,52 € en sortie, au tarif affiché par les fournisseurs. Le coût réel d'une tâche dépend du nombre de jetons que le modèle consomme.
- Qui édite Llama-3.1-Nemotron-70B-Instruct ?
- Llama-3.1-Nemotron-70B-Instruct est édité par NVIDIA (États-Unis), et il est sorti le 18 décembre 2024. Ses poids sont ouverts, sous licence Llama 3.1.