Accueil / Plusieurs agents et vérification adverse
Une prémisse non vérifiée dans un prompt revient en conclusion
Le texte de cadrage qu'un orchestrateur écrit dans le prompt de chaque agent reste invisible à la revue adverse, qui reçoit l'artefact produit et des critères de succès, jamais l'intention ni l'historique de celui qui a construit la tâche : une affirmation fausse glissée dans ce cadrage traverse donc toute la chaîne sans être testée, et un fan-out qui envoie le même cadrage à plusieurs agents multiplie cette exposition au lieu de la diluer.
Un vérificateur adverse reçoit l'artefact à juger et les critères de succès qu'il doit tester, jamais l'historique de la tâche ni le raisonnement de la personne qui l'a construite, selon le motif documenté par Anthropic pour ce rôle. Cette limite volontaire, qui garde le vérificateur concentré sur ce qu'il a sous les yeux, laisse un angle mort précis : elle ne dit rien de ce que l'orchestrateur a déjà supposé vrai avant même d'écrire le premier prompt.
Le cadrage voyage sans jamais être testé
Le texte d'introduction d'un prompt pose souvent une affirmation factuelle présentée comme déjà acquise plutôt que comme une conclusion à vérifier, par exemple que des données fournies sont déjà propres ou qu'un périmètre a déjà été validé par un tiers. L'agent qui reçoit ce prompt traite cette phrase comme une prémisse, pas comme un fait à contester, et la reflète dans son propre résultat sans jamais la reformuler comme une hypothèse. Le vérificateur adverse, lui, ne relit que ce résultat : la prémisse d'origine n'apparaît nulle part sous une forme qu'il puisse mettre à l'épreuve.
Prompt donne a chaque agent du fan-out :
"Le catalogue fourni ne contient que des references actives.
Redigez la fiche produit pour chacune des references listees."
Le verificateur adverse recoit uniquement les fiches produites,
jamais la phrase sur les references actives.
Le fan-out multiplie l'exposition au lieu de la diluer
Un fan-out envoie le même texte de cadrage à chaque agent lancé en parallèle. Une prémisse fausse glissée dans ce texte n'est donc pas diluée par le nombre d'agents, elle est répétée dans chacune de leurs sorties. Plusieurs agents indépendants qui arrivent séparément à la même affirmation peuvent alors donner l'impression d'une corroboration, alors qu'ils partagent tous la même source, le même prompt de départ, et le même point aveugle. Mandater un relecteur pour contester spécifiquement le cadrage, pas seulement les conclusions bâties dessus, redonne à la revue adverse une prise sur cette phrase qu'elle ne voit normalement jamais. La leçon précédente montre ce que reçoit un vérificateur adverse pour juger un travail ; ici, le problème vient précisément de ce qu'il ne reçoit jamais.
Le cadrage invisible devient un fait cité dans le livrable
Phrase du prompt : le catalogue fourni ne contient que des references actives. Jamais testee, jamais montree au verificateur.
Fiche produit : reference active, disponible en stock. Citee comme fait etabli, sans avoir ete verifiee.
Un chef de projet écrit, en tête du prompt envoyé à six agents, que le référentiel clients a déjà été nettoyé des doublons, puis lance les six agents pour rédiger chacun une fiche de synthèse à partir de ce référentiel.
Écrivez en une phrase ce que cette situation établit, et en une phrase ce qu'elle n'établit pas.
Ce que cela établit : La situation établit que l'affirmation sur le nettoyage des doublons a été écrite dans le cadrage du prompt et non produite comme une conclusion vérifiée par l'un des six agents.
Ce que cela n’établit pas : Elle n'établit pas que le référentiel contient effectivement des doublons ou qu'il en est réellement dépourvu, aucune vérification de ce fait n'a eu lieu dans la situation décrite.
Les trois calibrages faux les plus courants
- Trop large Cette situation prouve que les six fiches de synthèse produites contiendront forcément des erreurs liées à des doublons non détectés.
- Trop étroit Cette situation ne permet de rien affirmer sur le référentiel clients, l'écriture d'une phrase dans un prompt n'ayant aucun rapport avec l'état réel d'une base de données.
- À côté Cette situation montre que l'équipe dispose de six agents suffisamment fiables pour rédiger des fiches de synthèse client de façon autonome.
- Un vérificateur adverse reçoit l'artefact produit et les critères de succès à tester, jamais l'historique ni les intentions de la personne qui a construit la tâche, ce qui laisse le cadrage du prompt hors de sa portée.
- Une affirmation posée comme prémisse dans le texte d'un prompt n'apparaît généralement pas dans l'artefact final sous une forme que le vérificateur puisse contester, elle traverse donc la revue sans jamais être testée.
- Un fan-out qui envoie le même texte de cadrage à plusieurs agents ne dilue pas une prémisse fausse, il la reproduit dans chaque sortie, ce qui peut donner une fausse impression de corroboration entre agents indépendants.
- Relire son propre prompt avant de lancer un fan-out permet de repérer une affirmation factuelle glissée dans le cadrage, avant qu'elle ne devienne une conclusion citée comme acquise dans le livrable.
Avant votre prochain fan-out, relisez votre propre prompt et soulignez chaque affirmation factuelle qu'il contient, comme une donnée déjà validée, puis écrivez pour chacune la vérification qui la testerait avant de lancer les agents.
Ces points dépendent d’une interface ou d’une règle qui peut avoir changé depuis la rédaction. Vérifiez-les sur votre propre écran avant de vous y fier.
- Si vous utilisez déjà un vérificateur adverse, vérifiez sur son prompt actuel s'il reçoit le texte de cadrage envoyé aux agents ou seulement leurs sorties : c'est cette différence qui détermine s'il peut repérer une prémisse fausse.
Chaque affirmation datable de cette leçon renvoie ici au texte public qui la porte. Une source qui ne s’ouvre pas ne prouve rien.
- Anthropic, building multi-agent systems, when and how to use them consultée le 2026-01-23