Cette semaine, « exploit » accompli : j’ai grillé mon quota de 5 heures chez Claude en quelques minutes — aïe. Et avec Haiku, qui plus est. Pas avec Sonnet, pas avec Opus, pas avec Fable.
Raison : usage massif de subagents pour une tâche de recherche. Fier de ça ? Non ! Qui me connaît, connaît aussi mon avis sur la consommation de tokens et le terme de « puissance réactive ». Les électrotechniciens savent de quoi je parle.
Enseignements
- Les agents multi-usages (comme Claude Code) génèrent un surcoût important en tokens.
- Pour des tâches ponctuelles, non reproductibles, cela peut se justifier. Pour des tâches standardisables, on ne fait généralement que gaspiller des tokens.
- Même des LLM locaux peuvent sortir d’affaire — avec des tâches claires, ils livrent des résultats étonnamment fiables.
Les subagents coûtent toujours quelque chose : le surcoût en tokens se justifie pour des tâches de recherche ponctuelles et non structurées — pour tout ce qui peut être standardisé, c’est le plus souvent de la pure puissance réactive. Et parfois, un LLM local avec une mission claire suffit amplement.