Gemini 4 Argon
Google DeepMind · États-Unis · sorti le Google DeepMind · États-Unis · 30 septembre 2026
- Avec réflexion
- Poids fermés
- En ligne seulement
Score général
Les dix tâches
- RaisonnementNon mesuré
- Code96,0Provisoire · 8 %
- AgentsNon mesuré
- Usage97,5Rang 1 · 100 %
- Maths96,5Provisoire · 12 %
- Sciences94,9Provisoire · 20 %
- FrançaisNon mesuré
- VisionNon mesuré
- Écriture99,9Rang 2 · 100 %
- Web96,5Rang 8 · 100 %
Annoncé par Google DeepMind
Hors du scoreCe que l'éditeur dit lui-même de ce modèle, sur sa page du . Ces chiffres ne sont pas vérifiés par une source indépendante et ne comptent pas dans le score IA.
- Disponibilité
- D'abord réservé à des testeurs choisis et à des spécialistes de la cybersécurité ; ouverture annoncée aux clients payants de l'API et aux abonnés Google AI Ultra, puis aux développeurs, aux entreprises et au grand public.
- Prix de lancement
- 2 $ par million de jetons en entrée, 10 $ en sortie ; entrée en cache à 95 % de moins.
- Prix ensuite
- 4 $ par million de jetons en entrée, 20 $ en sortie, à la fin de la période de lancement.
- Longueur de réponse
- Jusqu'à 1 million de jetons en sortie, contre 64 000 auparavant.
- Poids
- Fermés : le modèle ne se télécharge pas.
| Benchmark | Résultat annoncé | D'où vient le chiffre |
|---|---|---|
| Travail de bureau | ||
| Vals Index | 68,9 % | repris de Vals AI |
| AutomationBenchscore | 51,3 % | repris du classement public de Zapier (jeu privé) |
| Vals Finance Agent v2 | 65,4 % | repris de Vals AI |
| Harvey's Legal Agent Benchmark | 19,6 % | repris de Vals AI |
| Code agentique | ||
| DeepSWE v1.1 | 77,9 % | calculé par Google (harnais mini-swe-agent) |
| FrontierSWE v2 | 55,0 % | repris du classement public de Proximal |
| Vibe Code Bench | 91,9 % | repris du classement public de Vals AI |
| Terminal-Bench 4.0 | 57,4 % | calculé par Google |
| Ingénierie de l'apprentissage | ||
| PostTrainBench v1.1 | 45,3 % | calculé par Google (harnais OpenCode, 10 heures sur un H100) |
| Sciences et maths | ||
| Terminal-Bench Science 0.1 | 57,6 % | calculé par Google, délai du vérificateur multiplié par six |
| LABBench 2 | 88,8 % | calculé par Google |
| RiemannBench | 76,0 % | repris du classement public de Surge |
| Long contexte | ||
| GraphWalksjusqu'à 128 000 jetons, BFS (F1) | 99,7 % | calculé par Google |
| GraphWalksde 256 000 à 1 million de jetons, BFS (F1) | 84,2 % | calculé par Google |
| Utilisation d'un ordinateur | ||
| Agent's Last Examtaux de réussite | 39,5 % | calculé par Google (harnais ALE-Claw, 5 heures) |
| OSWorld-2.0sous-ensemble hors ligne, score partiel | 69,2 % | calculé par Google, meilleur de trois passages |
| Compréhension multimodale | ||
| Chartography | 71,6 % | repris du classement public de Surge, sans outils |
| LVBench | 91,7 % | calculé par Google, sans outils |
| Cybersécurité | ||
| CWE-bench v1 | 68,0 % | repris du classement public |
Google compare Argon à GPT-6 Astra, Claude Fable 5.1 et Claude Opus 5.5 sur la même page. Relu le sur la page de Google DeepMind, avec sa note de méthode et son annonce.
Artificial Analysis
Hors du scoreArtificial Analysis évalue les modèles de son côté et publie son propre indice, l'Artificial Analysis Intelligence Index v4.3. C'est un autre indice, qui ne compte pas dans le score IA de Quelle IA et ne se compare pas directement à lui.
| Version évaluée | Indice v4.3 | Rang chez eux | Vitesse | Premier jeton | Prix par million de jetonsentrée / sortie |
|---|---|---|---|---|---|
| Gemini 4 Argon (High)pas publiquement disponible | 52,6 | 8e sur 193 | non publié | non publié | 2 $ / 10 $ |
Médianes de leurs mesures : vitesse en jetons produits par seconde, délai avant le premier jeton en secondes. Prix en dollars par million de jetons, en entrée puis en sortie. Rang parmi les 193 modèles que leur indice classe. Artificial Analysis signale que Gemini 4 Argon (High) n'est pas publiquement disponible. Relevé le 1er octobre 2026 sur leur site, reproduit avec leur accord.
Source : Artificial Analysis
Peut-il tourner chez vous ?
Non. Gemini 4 Argon est un modèle fermé : il s'utilise en ligne, par l'application de son éditeur ou par API.
- MiMo-V2.6-Pro · Serveur90,5
- Kimi K3 · Serveur90,2
- GLM-5.3 · Serveur88,4
Ces trois modèles ouverts ont le score le plus proche. Eux peuvent se télécharger et tourner sur une machine ou un serveur à vous.
Fiche technique
- Prix
- Non communiqué
- Fenêtre de contexte
- Non communiqué
- Entrées
- Non communiqué
- Réflexion
- Non communiqué
- Paramètres
- Non communiqué
- Licence
- Propriétairepoids fermés, accès par l'éditeur
- Classe énergétique
- Non communiquée
- Hébergement en Europe
- Non communiqué
- Connaissances jusqu'à
- Non communiqué
Où le trouver
Liens directs, sans affiliationToutes les mesures
6 mesures · la matière du scoreEn bref
- Quel est le score de Gemini 4 Argon ?
- Gemini 4 Argon obtient un score IA de 97,0, avec une marge de 89,7 à 104,3. Ce score est provisoire : il repose sur 6 mesures, et le modèle n'a pas de rang.
- Dans quelles tâches Gemini 4 Argon est-il le plus fort ?
- Ses deux meilleures tâches sont écriture (99,9) et usage (97,5). Sa tâche la plus faible est sciences (94,9).
- Gemini 4 Argon peut-il tourner en local ?
- Non. Gemini 4 Argon est un modèle fermé : il s'utilise en ligne, par l'application de son éditeur ou par API.
- Qui édite Gemini 4 Argon ?
- Gemini 4 Argon est édité par Google DeepMind (États-Unis), et il est sorti le 30 septembre 2026. C'est un modèle fermé.