Au-delà de deux sous-agents, des jetons brûlés sans gain de qualité
D'après Eric Provencher (@pvncher) sur X, 15 septembre 2026 et The Decoder – 17 septembre 2026, relayé par The Decoder
Image : générée (Gemini)
Rédigé à partir de la source originale; chaque fait est vérifié contre le texte source.
Message personnel : publication d'un compte individuel, pas un document officiel.
À retenir
- Le mécanisme porte un nom chez lui : la « taxe de coordination ». Il est très difficile, dit-il, de garder autant de voies parallèles en marche sans dériver et sans brûler des jetons en vérifications excessives.
- Ce qu'il propose à la place : confier les tâches à des fils distincts qui préviennent l'agent principal une fois terminés, au lieu d'un agent principal qui interroge sans cesse leur état.
- Deux sources de gaspillage s'additionnent : l'invite système, soit les consignes permanentes données au modèle, se répète dans chaque sous-agent ; et un sous-agent qui manque de contexte refait des appels d'outils déjà faits.
- L'exemple qui a déclenché le débat le contredit. Nous Research annonce le 15 septembre 1393 sous-agents, un million de lignes de Python nettoyées, une base réduite de 34,4 % en dix-neuf heures, et près de 2 M$ d'heures d'ingénierie économisées.
- Et le relais en réduit l'ampleur : The Decoder écrit que ces 1393 agents ont refactorisé « un seul fichier Python ». Le message d'origine parle d'un million de lignes. Provencher reconnaît par ailleurs qu'OpenAI doit encore livrer de meilleures solutions.
Pourquoi ça compte
laveille.ai rapportait la veille, le 17 septembre 2026, qu'Anthropic pousse dans l'autre sens : décrire un objectif et laisser un coordinateur le découper entre des fils parallèles. Rien ne tranche aujourd'hui entre les deux positions : d'un côté l'observation d'un développeur, de l'autre l'annonce d'une entreprise, aucune mesure indépendante. Ce qui est sûr, c'est que la facture de jetons, elle, est payée dans les deux cas par celui qui lance les agents.
Chiffre-clé
Deux : le nombre de sous-agents en parallèle au-delà duquel Eric Provencher, développeur de Codex chez OpenAI, estime le 15 septembre 2026 qu'on brûle des jetons sans gain de qualité. Son message affichait 280 400 vues au 18 septembre 2026.
Citation
« I hate to say it, but if you’re running more than 2 sub agents at time, you’re almost certainly burning tokens for 0 quality gain. Agents don’t trust each other enough to avoid double-checking everyone’s homework. » Eric Provencher, développeur de Codex chez OpenAI, sur X le 15 septembre 2026
Action concrète
Avant de lancer un essaim d'agents, compter ce qui se répète : chaque sous-agent recharge l'invite système, et ceux qui manquent de contexte refont des appels déjà faits. La piste de Provencher est de laisser les fils prévenir une fois terminés plutôt que de les interroger sans arrêt.
Repères datés
- 17 septembre 2026 - Anthropic met en bêta un coordinateur qui découpe un objectif entre des fils parallèles, chacun dans sa propre session infonuagique.
« I hate to say it, but if you’re running more than 2 sub agents at time, you’re almost certainly burning tokens for 0 quality gain. Agents don’t trust each other enough to avoid double-checking everyone’s homework. »
Fondée sur la source originale