Veille IA Veille IA sans buzz : pour stratèges québécois.
La veille

Au-delà de deux sous-agents, des jetons brûlés sans gain de qualité

3 min de lecture · The Decoder · 17 sept. 2026

D'après Eric Provencher (@pvncher) sur X, 15 septembre 2026 et The Decoder – 17 septembre 2026, relayé par The Decoder

Au-delà de deux sous-agents, des jetons brûlés sans gain de qualité

Image : générée (Gemini)

Rédigé à partir de la source originale; chaque fait est vérifié contre le texte source.

Message personnel : publication d'un compte individuel, pas un document officiel.

À retenir

  • Le mécanisme porte un nom chez lui : la « taxe de coordination ». Il est très difficile, dit-il, de garder autant de voies parallèles en marche sans dériver et sans brûler des jetons en vérifications excessives.
  • Ce qu'il propose à la place : confier les tâches à des fils distincts qui préviennent l'agent principal une fois terminés, au lieu d'un agent principal qui interroge sans cesse leur état.
  • Deux sources de gaspillage s'additionnent : l'invite système, soit les consignes permanentes données au modèle, se répète dans chaque sous-agent ; et un sous-agent qui manque de contexte refait des appels d'outils déjà faits.
  • L'exemple qui a déclenché le débat le contredit. Nous Research annonce le 15 septembre 1393 sous-agents, un million de lignes de Python nettoyées, une base réduite de 34,4 % en dix-neuf heures, et près de 2 M$ d'heures d'ingénierie économisées.
  • Et le relais en réduit l'ampleur : The Decoder écrit que ces 1393 agents ont refactorisé « un seul fichier Python ». Le message d'origine parle d'un million de lignes. Provencher reconnaît par ailleurs qu'OpenAI doit encore livrer de meilleures solutions.

Pourquoi ça compte

laveille.ai rapportait la veille, le 17 septembre 2026, qu'Anthropic pousse dans l'autre sens : décrire un objectif et laisser un coordinateur le découper entre des fils parallèles. Rien ne tranche aujourd'hui entre les deux positions : d'un côté l'observation d'un développeur, de l'autre l'annonce d'une entreprise, aucune mesure indépendante. Ce qui est sûr, c'est que la facture de jetons, elle, est payée dans les deux cas par celui qui lance les agents.

Chiffre-clé

Deux : le nombre de sous-agents en parallèle au-delà duquel Eric Provencher, développeur de Codex chez OpenAI, estime le 15 septembre 2026 qu'on brûle des jetons sans gain de qualité. Son message affichait 280 400 vues au 18 septembre 2026.

Citation

« I hate to say it, but if you’re running more than 2 sub agents at time, you’re almost certainly burning tokens for 0 quality gain. Agents don’t trust each other enough to avoid double-checking everyone’s homework. » Eric Provencher, développeur de Codex chez OpenAI, sur X le 15 septembre 2026

Action concrète

Avant de lancer un essaim d'agents, compter ce qui se répète : chaque sous-agent recharge l'invite système, et ceux qui manquent de contexte refont des appels déjà faits. La piste de Provencher est de laisser les fils prévenir une fois terminés plutôt que de les interroger sans arrêt.

Repères datés

« I hate to say it, but if you’re running more than 2 sub agents at time, you’re almost certainly burning tokens for 0 quality gain. Agents don’t trust each other enough to avoid double-checking everyone’s homework. »

Fondée sur la source originale

Sources

🔐 Connexion rapide

Entrez votre courriel pour recevoir un code à 6 chiffres.

Pas besoin de mot de passe ni d'inscription. Entrez votre courriel, recevez un code par courriel, et c'est tout !