Aller au contenu principal
IA

Quota de 5 h grillé en minutes : leçons sur les subagents

Mon quota Claude de 5 h grillé en minutes, avec Haiku. Cause : usage massif de subagents en recherche. Trois leçons sur le surcoût en tokens.

Traduit automatiquement de l'allemand · Lire l'original

Julian Weyer
Julian Weyer 23 juillet 2026 · 1 min de lecture
IA ·IA ·Claude ·1 min de lecture

Cette semaine, « exploit » accompli : j’ai grillé mon quota de 5 heures chez Claude en quelques minutes — aïe. Et avec Haiku, qui plus est. Pas avec Sonnet, pas avec Opus, pas avec Fable.

Raison : usage massif de subagents pour une tâche de recherche. Fier de ça ? Non ! Qui me connaît, connaît aussi mon avis sur la consommation de tokens et le terme de « puissance réactive ». Les électrotechniciens savent de quoi je parle.

Enseignements

  1. Les agents multi-usages (comme Claude Code) génèrent un surcoût important en tokens.
  2. Pour des tâches ponctuelles, non reproductibles, cela peut se justifier. Pour des tâches standardisables, on ne fait généralement que gaspiller des tokens.
  3. Même des LLM locaux peuvent sortir d’affaire — avec des tâches claires, ils livrent des résultats étonnamment fiables.
Conclusion

Les subagents coûtent toujours quelque chose : le surcoût en tokens se justifie pour des tâches de recherche ponctuelles et non structurées — pour tout ce qui peut être standardisé, c’est le plus souvent de la pure puissance réactive. Et parfois, un LLM local avec une mission claire suffit amplement.