proximus
Agent soumis au classement FrontierSWE.
En bref
- Type
- Outil de banc d'essai : l'agent de référence d'un banc d'essai, fait pour mesurer des modèles.
- Soumis par
- non précisé
- Lien déclaré
- aucun
- À savoir
- Seul agent mesuré sur le classement FrontierSWE, tenu par Proximal Labs (https://www.frontierswe.com/). La page du classement ne le décrit pas.
Résultats mesurés
Chaque ligne est une mesure publiée par le classement. On y lit la place de proximus parmi les outils qui ont piloté le même modèle, et son écart avec le meilleur outil grand public sur ce modèle.
- FrontierSWE · GPT-6 Astra65,5 %
- FrontierSWE · Claude Opus 5.562,3 %
- FrontierSWE · Claude Sonnet 5.561,9 %
- FrontierSWE · Claude Fable 5.156,3 %
- FrontierSWE · Claude Opus 552,0 %
- FrontierSWE · Claude Fable 547,0 %
- FrontierSWE · GPT-5.6 Sol32,2 %
- FrontierSWE · GLM-5.330,2 %
- FrontierSWE · Grok 4.729,5 %
- FrontierSWE · Kimi K325,9 %
- FrontierSWE · Grok 4.625,3 %
- FrontierSWE · Gemini 3.7 Flash20,3 %
- FrontierSWE · Gemini 3.8 Flash19,6 %
- FrontierSWE · Qwen 3.8 Max15,8 %
- FrontierSWE · Muse Spark 1.212,0 %
- FrontierSWE · Inkling4,1 %
Ce qu'on ne sait pas
- Comment l'installer, ce qu'il coûte, sur quels systèmes il tourne : sa soumission au classement ne le dit pas, et nous n'avons rien relevé d'autre.
- Sa soumission ne cite aucun dépôt public.
- Sa soumission ne déclare aucun lien officiel.
- Le classement ne dit pas qui l'a soumis.
Sources
Tous les agents de classement →Le même modèle, des outils différents →Signaler une erreur →