# Llama 3.1 Nemotron Ultra 253B

> Fiche du modèle de langage Llama 3.1 Nemotron Ultra 253B sur Quelle IA, édition du 28 septembre 2026. Llama 3.1 Nemotron Ultra 253B (NVIDIA) : score IA de 59,1, provisoire. Scores par tâche, prix, exécution locale et liens pour le télécharger ou l'essayer.

Page : https://quelleia.com/modeles/llama-3-1-nemotron-ultra-253b/
Origine : NVIDIA · États-Unis · sorti le 7 avril 2025

## Score général

- Score IA : 59,1 (marge à 90 % : de 47,5 à 70,8)
- Rang : non classé, score provisoire
- Couverture : 40 % du poids des tâches, 4 mesures
- Échelle : 100 pour le meilleur modèle au lancement du site, 50 pour GPT-4o de novembre 2024.

## Scores par tâche

| Tâche | Score | Détail |
| --- | --- | --- |
| Raisonnement | non mesuré | Non mesuré |
| Code | 58,4 | Provisoire · 8 % |
| Agents | non mesuré | Non mesuré |
| Usage | 58,4 | Rang 170 · 100 % |
| Maths | 62,3 | Provisoire · 12 % |
| Sciences | non mesuré | Non mesuré |
| Français | non mesuré | Non mesuré |
| Vision | non mesuré | Non mesuré |
| Écriture | 60,2 | Rang 162 · 100 % |
| Web | non mesuré | Non mesuré |

## Artificial Analysis (hors du score)

Artificial Analysis évalue les modèles de son côté et publie son propre indice, l'Artificial Analysis Intelligence Index v4.3. C'est un autre indice, qui ne compte pas dans le score IA de Quelle IA et ne se compare pas directement à lui.

| Version évaluée | Indice v4.3 | Rang chez eux | Vitesse | Premier jeton | Prix par million de jetons (entrée / sortie) |
| --- | --- | --- | --- | --- | --- |
| [Llama 3.1 Nemotron Ultra 253B v1 (Reasoning)](https://artificialanalysis.ai/models/llama-3-1-nemotron-ultra-253b-v1-reasoning) | 7,5 (estimé) | hors classement | non publié | non publié | non publié |

Médianes de leurs mesures : vitesse en jetons produits par seconde, délai avant le premier jeton en secondes. Prix en dollars par million de jetons, en entrée puis en sortie. Rang parmi les 193 modèles que leur indice classe ; un indice qu'ils estiment reste hors de ce classement. Relevé le 1er octobre 2026 sur leur site, reproduit avec leur accord.

Source : Artificial Analysis, https://artificialanalysis.ai/models/llama-3-1-nemotron-ultra-253b-v1-reasoning

## Exécution locale

Tient à partir d'un Mac de 256 Go (189,4 Go utiles), en version allégée à 4 bits, par exemple un Mac Studio M5 Ultra de 256 Go. Mémoire estimée : 174,8 Go.

- Allégée, 4 bits : 174,8 Go
- Allégée, 8 bits : 306,0 Go
- Complète, 16 bits : 582,8 Go

- Plus petite machine : [Mac 256 Go](https://quelleia.com/local/#mac_256_go), version allégée à 4 bits
- Carte graphique : Trop juste
- PC portable RTX : Trop juste
- PC portable Intel : Trop juste
- PC portable Snapdragon : Trop juste
- Mac : [Mac 256 Go](https://quelleia.com/local/#mac_256_go), version allégée à 4 bits ; par exemple [Mac Studio M5 Ultra, 256 Go](https://quelleia.com/local/mac-studio-m5-ultra-256go/)
- Ryzen AI Max : Trop juste
- Nvidia DGX : [2 DGX Spark, 256 Go](https://quelleia.com/local/#dgx_spark_x2), version allégée à 4 bits ; par exemple [Deux DGX Spark en grappe](https://quelleia.com/local/dgx-spark-x2/)
- Sans carte graphique : Trop juste
- Serveur : Oui

## Fiche technique

- Prix : Non communiqué
- Fenêtre de contexte : Non communiqué
- Entrées : Non communiqué
- Réflexion : Non communiqué
- Paramètres : 253,4 milliards
- Licence : NVIDIA Open Model License (poids ouverts, téléchargeables)
- Classe énergétique : Non communiquée
- Hébergement en Europe : Non communiqué
- Connaissances jusqu'à : Non communiqué

## Où le trouver

- Télécharger : [Hugging Face](https://huggingface.co/models?library=gguf&search=Llama+3.1+Nemotron+Ultra+253B)
- Sur votre machine : [Ollama](https://ollama.com/search?q=Llama+3.1+Nemotron+Ultra+253B)
- Sur votre machine : [LM Studio](https://lmstudio.ai)
- Par API : [API NVIDIA](https://docs.api.nvidia.com)
- L'essayer : [NVIDIA Build](https://build.nvidia.com)

## Mesures

| Benchmark | Tâche | Publié | Niveau suggéré | État | Source |
| --- | --- | --- | --- | --- | --- |
| Arena, questions de maths | Maths | 1 380,8 Elo | 65,5 | actif | https://arena.ai/leaderboard |
| Arena, écriture créative | Écriture | 1 331,6 Elo | 61,2 | actif | https://arena.ai/leaderboard |
| Arena, texte | Usage | 1 347,6 Elo | 57,3 | actif | https://arena.ai/leaderboard |
| Arena, questions de code | Code | 1 391,0 Elo | 57,7 | actif | https://arena.ai/leaderboard |

## En bref

**Quel est le score de Llama 3.1 Nemotron Ultra 253B ?** Llama 3.1 Nemotron Ultra 253B obtient un score IA de 59,1, avec une marge de 47,5 à 70,8. Ce score est provisoire : il repose sur 4 mesures, et le modèle n'a pas de rang.

**Dans quelles tâches Llama 3.1 Nemotron Ultra 253B est-il le plus fort ?** Ses deux meilleures tâches sont maths (62,3) et écriture (60,2). Sa tâche la plus faible est usage (58,4).

**Llama 3.1 Nemotron Ultra 253B peut-il tourner en local ?** Tient à partir d'un Mac de 256 Go (189,4 Go utiles), en version allégée à 4 bits, par exemple un Mac Studio M5 Ultra de 256 Go. Mémoire estimée : 174,8 Go.

**Qui édite Llama 3.1 Nemotron Ultra 253B ?** Llama 3.1 Nemotron Ultra 253B est édité par NVIDIA (États-Unis), et il est sorti le 7 avril 2025. Ses poids sont ouverts, sous licence NVIDIA Open Model License.

Source : Quelle IA, édition du 28 septembre 2026. https://quelleia.com
