
Au terme de deux semaines d'intense refondation logicielle, synthèse du modèle en six briques fondamentales qui permet de déployer des agents autonomes puissants sans jamais sacrifier le contrôle humain ni la sécurité.
1. DÉPASSER LE STADE DU BRICOLAGE AGENTIQUE
Depuis l'avènement des grands modèles de langage, l'écosystème de l'intelligence artificielle est passé par trois vagues successives :
- La vague du Chatbot (2022-2023) : L'IA répond à des questions dans une bulle de texte isolée du monde extérieur.
- La vague des Assistants avec Outils (2024-2025) : L'IA appelle des fonctions prédéfinies (Function Calling) pour récupérer des données en lecture seule.
- La vague de l'Action Autonome (2026) : L'IA prend des initiatives, orchestre des tâches longues, manipule des interfaces graphiques (Computer Use) et modifie en profondeur des systèmes d'information réels.
Cette troisième vague est grisante par ses gains de productivité, mais elle terrifie à juste titre les directeurs des systèmes d'information et les entrepreneurs : comment laisser un agent agir de façon autonome sans craindre qu'il n'efface une base de données critique, ne vide un compte bancaire ou ne diffuse des informations confidentielles ?
Le 2 octobre, au terme d'une quinzaine d'expérimentations intenses consignées dans notre projet souverain Eywa (Issue de référence Eywa#123), nous avons stabilisé l'architecture canonique de l'IA moderne en six composants indissociables.
2. LE MODÈLE EN SIX BRIQUES D'EYWA
Pour qu'un système agentique soit à la fois puissant, prévisible et inoffensif, il ne doit jamais être conçu comme un bloc monolithique. Il doit s'articuler autour de six rôles strictement compartimentés :
LA CHAÎNE DE L'ACTION MAÎTRISÉE (EYWA)
─────────────────────────────────────
┌───────────┐ ┌────────────┐ ┌──────────────┐
│ 1. AGENT │ ──▶ │ 2. WORKER │ ──▶ │ 3. COMPUTER │
│ (Cerveau) │ │ (Artisan) │ │ (Action CLI) │
└───────────┘ └────────────┘ └──────────────┘
│
▼
┌───────────┐ ┌────────────┐ ┌──────────────┐
│ 6. HUMAN │ ◀── │ 5. EVIDENCE│ ◀── │ 4. EVENT │
│ APPROVAL │ │ (Preuve) │ │ (Bus Télém.) │
└───────────┘ └────────────┘ └──────────────┘
1. L'Agent (Le Stratège / Décideur)
C'est le grand modèle de raisonnement (ex. Claude 3.5 Sonnet, Gemini 1.5 Pro). Il ne tape aucun code directement sur la machine hôte. Il reçoit l'objectif humain, décompose le problème en étapes élémentaires, et rédige les plans d'exécution.
2. Le Worker (L'Ouvrier Éphémère)
L'Agent ne fait pas le travail lui-même : il délègue chaque tâche à un conteneur éphémère (un Worker Jules ou un conteneur Cloud Run) doté d'une durée de vie limitée et d'un accès disque strictement restreint à son dossier de travail.
3. Le Computer Use (L'Interfaçage Matériel)
C'est le bras mécanique : manipulation de terminaux bash, clics de souris dans un navigateur observable, appels d'APIs sous protocole MCP. L'outil n'a aucune intelligence propre : il exécute la directive du Worker et renvoie le flux vidéo ou le code de retour brut.
4. L'Événement (Event Bus)
Chaque interaction génère immédiatement un événement immuable sur le bus système : « Worker-04 a cliqué sur le bouton de soumission à 14:02:11 UTC ». Rien ne se fait dans le secret.
5. La Preuve (Evidence & Récépissé)
L'action a-t-elle fonctionné ? Le système ne croit pas l'Agent sur parole : il exige une preuve matérielle (une capture d'écran, une trace d'exécution, une empreinte SHA256 du fichier produit).
6. L'Approbation Humaine (Human Approval / Règle #72)
La clé de voûte absolue. Dès qu'une action franchit le seuil d'irréversibilité (dépense financière, publication en production, suppression de ressource), le pipeline se fige. Il affiche un sas d'approbation limpide à l'humain. Sans validation manuelle, le système ne passe pas.
En plaçant la porte d'approbation humaine juste avant l'exécution irréversible, vous libérez totalement l'autonomie de vos agents pour la recherche, le test et la préparation, tout en conservant une sérénité totale sur l'impact final.
3. COMPUTER USE : LA FIN DE L'AVEUGLEMENT ALGORITHMIQUE
L'un des apports majeurs de notre infrastructure a été d'encadrer l'usage du Computer Use (la capacité pour un modèle de piloter un écran d'ordinateur comme un humain).
Trop d'implémentations actuelles exécutent ces automatisations en mode aveugle (Headless). C'est ainsi que des agents tournent en rond pendant des heures sur une bannière de cookies ou confirment des formulaires erronés.
Dans notre charte :
- Tout navigateur piloté par une IA doit être observable en direct sur l'écran de l'opérateur.
- L'agent prend des captures d'écran séquentielles à chaque étape clé.
- Si une incertitude survient, l'agent s'interrompt et demande une clarification plutôt que de deviner.
4. CE QUE SIGNIFIE VRAIMENT « TRAVAILLER AVEC UNE FLOTTE D'IA »
Au terme de ces deux semaines fondatrices, notre regard sur l'ingénierie a radicalement changé :
ANCIEN PARADIGME vs NOUVEAU PARADIGME AGENTIQUE
────────────────────────────────────────────────
ANCIEN : L'humain tape du code, l'IA suggère des complétions.
NOUVEAU : L'humain conçoit des constitutions logicielles et arbitre des preuves ;
les agents usinent le code dans des bacs à sable étanches.
- L'IA ne remplace pas l'ingénieur, elle le hisse au rang d'architecte souverain : Vous ne passez plus votre temps à aligner des balises HTML ou à chercher une virgule manquante dans un fichier JSON. Vous concevez des systèmes de contrôle, des flux d'événements et des politiques de sécurité.
- La rigueur documentaire est devenue le code source : Un modèle ne comprend que ce qui est écrit avec une clarté limpide. Si vos spécifications sont vagues, votre système produira le chaos à la vitesse de la lumière.
- Le futur est aux écosystèmes frugaux et vérifiables : Pas besoin de millions de dollars d'infrastructure. Une constellation de micro-services bien orchestrés, respectueux du scale-to-zero et scellés sous des contrôles stricts surpasse n'importe quel monolithe opaque.