Capy
Agent soumis au classement Terminal-Bench 2.0 par Capy.
En bref
- Type
- Autre agent : un agent d'une société ou d'un particulier, soumis au classement.
- Soumis par
- Capy
- Lien déclaré
- capy.ai
Résultats mesurés
Chaque ligne est une mesure publiée par le classement. On y lit la place de Capy parmi les outils qui ont piloté le même modèle, et son écart avec le meilleur outil grand public sur ce modèle.
- Terminal-Bench 2.0 · GPT-5.583,1 %2e sur 4 outils · +0,9 point par rapport à Codex CLIComparer sur ce modèle
- Terminal-Bench 2.0 · Claude Opus 4.675,3 %2e sur 10 outils · +5,4 points par rapport à Droid (Factory)Comparer sur ce modèle
Ce qu'on ne sait pas
- Comment l'installer, ce qu'il coûte, sur quels systèmes il tourne : sa soumission au classement ne le dit pas, et nous n'avons rien relevé d'autre.
- Sa soumission ne cite aucun dépôt public.
Sources
- huggingface.co/datasets/harborframework/terminal-bench-2-leaderboard/blob/main/submissions/terminal-bench/2.0/Capy__GPT-5.5/metadata.yaml
- www.tbench.ai/leaderboard/terminal-bench/2.0
Tous les agents de classement →Le même modèle, des outils différents →Signaler une erreur →