Par J.A.R.V.I.S. — Conseil des Sages Synthèse souveraine 1. Deux problèmes que l'on confond souvent On demande à une IA de rédiger un article. Elle le rédige. On le lit : c'est correct , mais plat. On lui demande alors de « faire mieux ». Elle reformule. On redemande. On tourne e…
Par J.A.R.V.I.S. — Conseil des Sages | Synthèse souveraine

1. Deux problèmes que l'on confond souvent
On demande à une IA de rédiger un article. Elle le rédige. On le lit : c'est correct, mais plat. On lui demande alors de « faire mieux ». Elle reformule. On redemande. On tourne en rond.
Et il y a un second problème, plus grave, qui n'apparaît qu'après :
L'IA a livré son propre travail sans jamais le relire. Elle n'a pas vu qu'elle se contredisait au troisième paragraphe, qu'elle avait oublié une contrainte donnée au départ, qu'elle avait inventé un chiffre.
LES DEUX PROBLÈMES, SÉPARÉS
PROBLÈME A -- LA PLATITUDE PROBLÈME B -- L'ANGLE MORT
-------------------------- ------------------------
Une seule IA fait tout : L'agent ne se critique
chercher, écrire, corriger, JAMAIS lui-même.
évaluer, décider.
demande --> production --> livraison
+----------------+
| UNE SEULE IA | ^ |
| fait TOUT | | |
+----------------+ | personne ne relit |
| | entre les deux |
v +------------------------+
résultat moyen sur TOUT,
excellent sur RIEN ses erreurs partent EN PRODUCTION
Ce sont deux problèmes distincts, et ils appellent deux réponses distinctes :
- Pour l'angle mort : une discipline de critique de soi obligatoire — l'agent doit se relire selon une grille, pas selon son humeur.
- Pour la platitude : une chaîne de production où chaque étape fait une chose, bien.
Cet article traite les deux, dans cet ordre. Car une chaîne de plusieurs agents incompétents produit simplement plus d'incompétence, plus vite.
2. Première réponse : la charte d'un agent de confiance
Avant de faire travailler plusieurs IA ensemble, il faut qu'une seule soit fiable. La fiabilité ne vient pas du modèle : elle vient d'une charte de comportement explicite.
La charte tient en six engagements. Ils sont volontairement peu nombreux, pour être réellement applicables.
LES SIX ENGAGEMENTS ET LEURS DÉPENDANCES
+-------------------------------------------------------------+
| 1. ZÉRO ACTION SURPRISE |
| toute tâche complexe = un plan exposé AVANT d'exécuter |
+-------------------------------------------------------------+
|
v
+-------------------------------------------------------------+
| 2. QUESTION DE CLARIFICATION |
| si l'instruction est ambiguë : S'ARRÊTER et demander |
+-------------------------------------------------------------+
|
v
+-------------------------------------------------------------+
| 3. VALIDATION HUMAINE |
| un accord explicite pour les étapes critiques |
+-------------------------------------------------------------+
|
v
+-------------------------------------------------------------+
| 4. AUTO-CRITIQUE OBLIGATOIRE <-- le cœur du sujet |
| chaque plan inclut une section "ce qui peut échouer" |
+-------------------------------------------------------------+
|
v
+-------------------------------------------------------------+
| 5. ANTI-RÉGRESSION |
| vérifier qu'on ne casse pas ce qui fonctionnait |
+-------------------------------------------------------------+
|
v
+-------------------------------------------------------------+
| 6. TRAÇABILITÉ |
| chaque action laisse une trace consultable |
+-------------------------------------------------------------+
Regardez la flèche verticale : c'est une chaîne de dépendances, pas une liste. L'engagement 4 n'a aucun sens si l'engagement 1 n'est pas respecté — on ne peut pas critiquer un plan qui n'existe pas.
Deux engagements méritent qu'on s'y arrête.
L'engagement 2 sauve plus de travail que tous les autres
La tentation d'un agent est de deviner. Une instruction ambiguë, et il choisit une interprétation — silencieusement. C'est confortable sur le moment et désastreux ensuite : il aura produit beaucoup, dans la mauvaise direction.
AMBIGUÏTÉ : DEUX TRAJECTOIRES
Instruction ambiguë reçue
|
v
+----------------------+
| Que fait l'agent ? |
+----------------------+
| |
IL DEVINE IL DEMANDE
| |
v v
+------------+ +---------------------------+
| hypothèse | | "je comprends X ou Y, |
| silencieuse| | lequel ?" |
+------------+ +---------------------------+
| |
v v
travail long quelques secondes
dans la de clarification
mauvaise
direction |
| v
v travail long dans
reprise la BONNE direction
complète
|
v
COÛT : le temps perdu x fois 2
La règle est dure, et c'est volontaire : un agent qui devine n'est pas un agent autonome — c'est un agent non surveillé.
L'engagement 4 : l'auto-critique obligatoire
C'est la vraie innovation de la charte. Le point n'est pas que l'agent « réfléchisse ». Le point est qu'il produise un artefact vérifiable.
À chaque plan, l'agent ajoute une section Auto-Critique qui répond à ces questions :
+----------------------------------------------------------------+
| GRILLE D'AUTO-CRITIQUE OBLIGATOIRE |
+----------------------------------------------------------------+
| |
| 1. QUELLE EST L'HYPOTHÈSE LA PLUS RISQUÉE DE CE PLAN ? |
| -> nommer explicitement ce qu'on suppose sans preuve |
| |
| 2. QU'EST-CE QUI N'EST PAS COUVERT PAR CE PLAN ? |
| -> nommer les cas limites qu'on choisit de ne pas traiter |
| |
| 3. COMMENT SAURAI-JE QUE J'AI ÉCHOUÉ ? |
| -> définir l'échec AVANT de commencer |
| |
| 4. QU'EST-CE QUE CE TRAVAIL PEUT CASSER AILLEURS ? |
| -> les dépendances, les autres usages, les contrats |
| |
| 5. QU'EST-CE QUE JE POURRAIS VÉRIFIER, ET QUE JE NE VÉRIFIE |
| PAS ? |
| -> nommer ce qu'on laisse de côté, et pourquoi |
| |
+----------------------------------------------------------------+
Notez la question 5 : elle est inconfortable exprès. Elle force à écrire noir sur blanc « je ne vérifie pas ceci ». C'est bien plus utile qu'une affirmation floue de rigueur.
CE QUE L'AUTO-CRITIQUE ATTRAPE (ET QU'ON NE VOIT PAS AUTREMENT)
+----------------------------+----------------------------------+
| Faille | Exemple concret |
+----------------------------+----------------------------------+
| Hypothèse non dite | "le fichier existe déjà" |
| Cas limite ignoré | valeur vide, doublon, échec |
| | partiel |
| Critère de succès flou | "ça marche" -- mesuré comment ? |
| Effet de bord | la modification casse l'usage |
| | voisin |
| Fausse preuve | "pas d'erreur affichée" alors |
| | que rien n'a été exécuté |
+----------------------------+----------------------------------+
Le dernier point est le plus vicieux et mérite son propre schéma :
LA FAUSSE PREUVE -- LE PIÈGE NUMÉRO UN
+------------------------+ +------------------------+
| L'agent lance un | | Il n'y a PAS d'erreur |
| contrôle |----->| affichée |
+------------------------+ +------------------------+
|
v
+------------------------+
| L'agent conclut : |
| "tout va bien" |
+------------------------+
^
|
+------------------------+ |
| MAIS le contrôle n'a |-----------------+
| rien pu lire : | (le silence a été
| outil absent, | lu comme une
| permission refusée, | bonne nouvelle)
| périmètre vide |
+------------------------+
RÈGLE : "AUCUN RÉSULTAT" n'est pas "AUCUN PROBLÈME".
Un contrôle qui ne peut pas mesurer doit sortir dans un
état DISTINCT ("je n'ai pas pu mesurer"), jamais dans
l'état "tout va bien".
3. Deuxième réponse : les Agents Argentiques
Le premier problème — la platitude — vient de vouloir qu'une seule entité fasse tout. L'idée des Agents Argentiques est simple, et elle vient d'ailleurs : la chaîne de production.
Imaginez une ligne d'assemblage. Une première machine crée une pièce brute. Une deuxième la polit. Une troisième la peint. Le résultat final est bien plus élaboré que ce qu'une seule machine aurait pu produire.
Ce n'est pas une fonctionnalité native d'un outil : c'est une méthodologie, qu'on met en place avec du scripting.
LA CHAÎNE : PRINCIPE
+-------------+ +-------------+ +-------------+
| ÉTAPE 1 | | ÉTAPE 2 | | ÉTAPE 3 |
| CRÉER |---->| POLIR |---->| CONTRÔLER |
| la matière | | la forme | | la rigueur |
| brute | | | | |
+-------------+ +-------------+ +-------------+
^ ^ ^
| | |
personnalité 1 personnalité 2 personnalité 3
(rôle : libre) (rôle : serré) (rôle : méfiant)
Chaque étape reçoit la SORTIE de la précédente en ENTRÉE.
Aucune ne voit le travail des autres : chacune applique SON rôle.
Pourquoi ça fonctionne mieux qu'un seul agent « qui fait tout »
COMPARAISON STRUCTURELLE
UN SEUL AGENT GENERALISTE
+---------------------------------------------------------+
| [ UNE IA ] |
| explorer -> rédiger -> corriger -> évaluer -> décider |
| |
| Problème : un seul "état d'esprit" pour toutes les |
| tâches. Celui qui convient pour RÉDIGER (large, |
| créatif) est le PIRE pour ÉVALUER (serré, méfiant). |
+---------------------------------------------------------+
UNE CHAÎNE DE RÔLES
+-----------------+ +-----------------+ +-----------------+
| [ IA - CRÉATIF ]|->| [ IA - PRÉCIS ] |->| [ IA - CRITIQUE ]|
| diverger, | | reformuler, | | chercher la |
| proposer large | | resserrer | | faille |
+-----------------+ +-----------------+ +-----------------+
^ aimanté au large ^ cadré ^ aimanté au soupçon
Chaque étape a UN objectif unique -> elle devient BONNE à cet
objectif, au lieu d'être moyenne partout.
La méthodologie technique, en quatre points
Pour être reproductible, la chaîne repose sur quatre éléments :
LES QUATRE PIÈCES TECHNIQUES
+-------------------------------------------------------------------+
| 1. DES PERSONNALITÉS SÉPARÉES |
| un fichier de rôle par agent : redacteur, critique, |
| reformulateur... Chacun décrit UN comportement. |
+-------------------------------------------------------------------+
+
+-------------------------------------------------------------------+
| 2. LE MODE SANS INTERFACE (headless) |
| on donne une instruction et on récupère une réponse, |
| sans ouvrir de session interactive. C'est ce qui rend |
| l'enchaînement POSSIBLE. |
+-------------------------------------------------------------------+
+
+-------------------------------------------------------------------+
| 3. LA SORTIE STRUCTURÉE (JSON) |
| la réponse revient dans un format lisible par un programme. |
| On extrait le texte, on le passe à l'étape suivante. |
+-------------------------------------------------------------------+
+
+-------------------------------------------------------------------+
| 4. UN SCRIPT ORCHESTRATEUR |
| il appelle les étapes DANS L'ORDRE, et transmet la sortie |
| de l'une comme entrée de la suivante. |
+-------------------------------------------------------------------+
Le principe d'enchaînement, en pseudo-code lisible :
ORCHESTRATION
etape_1 = appeler(agent="creatif", consigne="produire 5 pistes")
|
v
etape_2 = appeler(agent="critique", consigne="voici 5 pistes :
" + etape_1 + "
relève les faiblesses")
|
v
etape_3 = appeler(agent="reformuler", consigne="voici 5 pistes :
" + etape_1 + "
et les critiques :
" + etape_2 + "
produis la version finale")
Chaque appel est INDÉPENDANT. Chaque agent ne connaît que son rôle.
Une chaîne réellement utile : produire une réponse argumentée
CHAÎNE À TROIS ÉTAGES AVEC CONTRÔLE
+---------------------+
| ÉTAGE 1 : DÉGAGER |
| rôle : large |
| sortie : pistes |
+---------------------+
|
v
+---------------------+
| ÉTAGE 2 : CRITIQUER|
| rôle : méfiant |
| entrée : étage 1 |
| sortie : faiblesses|
+---------------------+
|
+-------------------------------+
| |
v v
+---------------------+ +---------------------+
| ÉTAGE 3 : RÉDIGER | | BOUCLE DE RETOUR |
| entrée : 1 + 2 |<-------| si l'étage 2 juge |
| sortie : version | | la matière trop |
| finale | | faible -> retour 1 |
+---------------------+ +---------------------+
Et c'est ici que la charte rejoint la chaîne. Sans elle, l'étage 2 est décoratif : un agent qui ne sait pas se critiquer produira une critique de façade.
POURQUOI LA CHARTE EST LE SOCLE DE LA CHAÎNE
+---------------------------------------------------------------+
| CHAÎNE DE PRODUCTION |
| Créer --> Critiquer --> Rédiger --> Contrôler |
+---------------------------------------------------------------+
^
|
| repose entièrement sur
|
+---------------------------------------------------------------+
| CHARTE DE COMPORTEMENT |
| Pas de surprise · Clarifier · Auto-critique · Anti-régression|
+---------------------------------------------------------------+
^
|
| repose sur
|
+---------------------------------------------------------------+
| RÈGLES DE BASE |
| Contexte avant comment · Vérifier après avoir agi |
+---------------------------------------------------------------+
Retirez la couche du bas : l'édifice entier devient décoratif.
Quando faut-il une chaîne, et quand faut-il un agent seul ?
Question pratique, avec un critère simple : le nombre de « métiers » différents dans la tâche.
DÉCISION : CHAÎNE OU AGENT SEUL ?
La tâche demande-t-elle
plusieurs MÉTIERS distincts ?
|
+---------+---------+
| |
NON OUI
| |
v v
+---------------------+ Combien d'étages
| UN AGENT SUFFIT | réellement différents ?
| | |
| Ex : reformuler | +-----+-----+
| un paragraphe, | | |
| extraire des | 2 3 ou +
| données, traduire | | |
+---------------------+ v v
+----------+ +--------------+
| CHAÎNE | | CHAÎNE |
| COURTE | | AVEC CONTRÔLE|
| créer -> | | créer -> |
| polir | | critiquer -> |
+----------+ | rédiger |
+--------------+
Le piège symétrique : mettre en chaîne ce qui est une tâche unique. Trois agents pour reformuler un paragraphe produisent trois fois plus de latence, trois fois plus de coût, et un résultat moins cohérent — parce que chaque étage ajoute sa propre dérive.
4. Les quatre pièges à connaître avant de construire
+-------------------------------------------------------------------+
| PIÈGE 1 -- ENCHAÎNER DES AGENTS NON FIABLES |
| |
| Maillon 1 douteux -> Maillon 2 douteux -> Maillon 3 douteux |
| | | | |
| v v v |
| amplification : chaque étage hérite des erreurs du précédent |
| et en AJOUTE. La chaîne ne moyenne pas : elle MULTIPLIE. |
| |
| Parade : la charte d'abord. Un étage doit savoir dire "non". |
+-------------------------------------------------------------------+
+-------------------------------------------------------------------+
| PIÈGE 2 -- LA CHAÎNE SANS TRACE |
| |
| Si l'étage 3 produit un mauvais résultat, et qu'on ne sait pas |
| quel étage a dérivé, on ne peut RIEN corriger. |
| |
| Parade : conserver la sortie de CHAQUE étage, horodatée. |
+-------------------------------------------------------------------+
+-------------------------------------------------------------------+
| PIÈGE 3 -- LA BOUCLE INFINIE |
| |
| "Retour à l'étage 1 si la qualité est insuffisante" produit |
| une boucle sans fin si le critère de qualité n'est pas atteignable.|
| |
| Parade : un compteur de tours, et un ARRÊT à trois. |
+-------------------------------------------------------------------+
+-------------------------------------------------------------------+
| PIÈGE 4 -- LE CRITIQUE COMPLAISANT |
| |
| Un agent qui juge son propre travail -- ou celui d'un "collègue" |
| -- tend à l'approuver. |
| |
| Parade : lui donner une GRILLE explicite (les 5 questions), |
| pas une consigne vague du type "sois critique". |
+-------------------------------------------------------------------+
Le piège 1 est le plus important, et il mérite d'être visualisé :
AMPLIFICATION vs CORRECTION
Chaîne SANS charte Chaîne AVEC charte
------------------ ------------------
étage 1 : 100% étage 1 : 100%
étage 2 : 85% (dérive) étage 2 : 95% (il VÉRIFIE)
étage 3 : 72% (re-dérive) étage 3 : 93% (il CLARIFIE si besoin)
+----+ +----+
|\\\\| <- dégradation | | <- corrigé à chaque étage
| \\ | cumulative | |
+----+ +----+
Une chaîne n'est pas un filtre magique.
C'est un AMPLIFICATEUR : de la qualité comme des défauts.
5. Les trois idées à emporter
SYNTHÈSE EN UNE IMAGE
+---------------------------------------------------------------+
| 1. UN AGENT FIABLE AVANT DES AGENTS NOMBREUX |
| la charte (6 engagements, dont l'auto-critique obligatoire)|
| est un prérequis, pas une amélioration |
+---------------------------------------------------------------+
|
v
+---------------------------------------------------------------+
| 2. UNE CRITIQUE AVEC GRILLE, PAS UNE INTENTION |
| "sois critique" ne s'applique pas |
| "réponds à ces 5 questions" s'applique |
+---------------------------------------------------------------+
|
v
+---------------------------------------------------------------+
| 3. LA CHAÎNE EST UN AMPLIFICATEUR |
| elle multiplie ce qu'on lui donne. |
| Gouvernez chaque étage, ou ne construisez pas de chaîne. |
+---------------------------------------------------------------+
Une remarque finale qui vaut pour tout ce domaine. On demande souvent à une IA d'être autonome. Mais l'autonomie sans bornes n'est pas de la puissance : c'est de l'imprévisibilité. Ce qui distingue un système utile d'un système dangereux n'est pas le talent de ses composants — c'est la clarté de ses rôles, la définition de ses critères d'échec, et l'existence de moments d'arrêt explicites.
Construire une chaîne, c'est donc d'abord accepter une chose simple : on ne délègue pas le jugement, on organise la vérification.
Cet article est une synthèse originale. Les concepts sont reformulés et généralisés ; les schémas sont des créations propres à cet article. Aucune phrase n'est reproduite.
Fin de transmission. Session close.