# Sécurité : un dossier sans score

> Dans l'édition du 28 septembre 2026, Quelle IA suit 2 benchmarks sur la sécurité informatique, dont 1 encore actif. C'est trop peu, et les sources sont trop inégales, pour en tirer un score et un classement honnêtes : Sécurité reste un dossier, qui ne pèse pas dans le score général.

Page : https://quelleia.com/classement/securite/

## ExploitBench

Exploiter de vraies failles déjà corrigées du moteur JavaScript de Chrome, de l'accès au code vulnérable jusqu'à l'exécution de code arbitraire.

- État : actif
- Notation : Part moyenne des 16 jalons atteints sur 41 failles, avec plusieurs essais par faille.
- Limites : Un seul logiciel cible, le moteur V8. Peu de modèles testés, certains en préversion, et les failles sont déjà documentées publiquement.
- Tenu par : Université Carnegie Mellon
- 9 modèles mesurés
- Source : https://exploitbench.ai/

Meilleurs résultats publiés :

1. Claude Mythos Preview : 73,8 %
2. GPT-5.5 : 47,4 %
3. Claude Opus 4.7 : 26,5 %

## Cybench

40 épreuves de piratage tirées de compétitions professionnelles : cryptographie, failles web, rétro-ingénierie, analyse de traces.

- État : archivé
- Notation : Part d'épreuves résolues sans aucune indication intermédiaire (mode « unguided »).
- Limites : Une partie des chiffres vient des fiches des éditeurs, avec leurs propres harnais. Le meilleur modèle dépasse 90 % et les épreuves sont publiques.
- Tenu par : Université Stanford
- 21 modèles mesurés
- Source : https://cybench.github.io/

Meilleurs résultats publiés :

1. Claude Opus 4.6 : 93 %
2. Claude Opus 4.5 : 82 %
3. Claude Sonnet 4.5 : 60 %

Source : Quelle IA, édition du 28 septembre 2026. https://quelleia.com
