2026.07.21 (Mar)
2026.07.22 (Mer) mis Ă  jour

✹ RĂ©sumĂ© de GPT-5.6 Sol

Le rĂ©cit d’une demande limitĂ©e au rĂ©sultat dans Telegram, sans chemin de projet ni Agent imposĂ©, puis des obstacles corrigĂ©s un Ă  un jusqu’au retour du PDF et du XLSX.

Objectifs en langage naturel dans Telegram et découverte automatique du projet

Je voulais pouvoir dire « produis ce rĂ©sultat » dans Telegram, puis laisser l’AI Orchestrator trouver le projet, rĂ©partir le travail, corriger les livrables dĂ©fectueux et renvoyer les fichiers. S’il se contentait d’appeler Codex une fois et de transmettre une rĂ©ponse, il y avait peu d’intĂ©rĂȘt Ă  construire un Orchestrator.

Le premier obstacle concernait les permissions. MĂȘme dans le Cell de chaque employĂ©, les restrictions globales de Codex rendaient difficile la dĂ©couverte de projets hors du Workspace ouvert au dĂ©marrage. J’ai retirĂ© cette limite pour les projets appartenant au mĂȘme utilisateur macOS, tout en conservant une approbation juste avant les actions ayant un impact externe, comme le push, le dĂ©ploiement ou l’envoi de messages.

Récupération des réponses et piÚces jointes par Topic avec une CLI Telethon

J’ai créé une CLI basĂ©e sur Telethon pour envoyer des commandes au Bot de l’AI Orchestrator et recevoir ses rĂ©ponses et piĂšces jointes. Les identifiants et la Session utilisateur sont restĂ©s hors du dĂ©pĂŽt, tandis que chaque Topic de projet servait d’unitĂ© de travail.

La premiĂšre CLI pouvait se terminer avec succĂšs aprĂšs avoir simplement envoyĂ© le message. La commande paraissait rĂ©ussie mĂȘme si la rĂ©ponse finale du Bot ou le fichier n’arrivait jamais.

J’ai remplacĂ© le critĂšre de fin du processus local par la rĂ©ception rĂ©elle d’une rĂ©ponse et d’une piĂšce jointe dans Telegram. MĂȘme lorsque j’envoyais simultanĂ©ment des tĂąches Ă  diffĂ©rents Topics, chaque OpenClaw Session conservait son contexte sĂ©parĂ© et renvoyait le rĂ©sultat au Topic d’origine.

RĂ©partition des rĂŽles entre OpenClaw Session et l’exĂ©cution parallĂšle de Codex

Les tĂąches courtes créées directement par OpenClaw perdaient des Ă©vĂ©nements de fin, tandis que les native sub-agents de Codex rĂ©cupĂ©raient de façon fiable les rĂ©sultats parallĂšles. Une structure capable de finir le travail sans rĂ©cupĂ©rer son Ă©tat final ne pouvait pas servir de base d’exĂ©cution Ă  l’Orchestrator.

Flux E2E de l'AI Orchestrator depuis l'utilisateur, Telegram et OpenClaw jusqu'à l'exécution, la vérification et le retour par Codex

Le Task Flow d’OpenClaw seul permettait difficilement de rattacher l’exĂ©cution et l’état final des tĂąches enfants Ă  un registre de rĂ©fĂ©rence unique. J’ai donc cessĂ© d’en faire l’unique source de vĂ©ritĂ© : OpenClaw gĂšre Telegram, les Topics, les Sessions et la Memory ; Codex gĂšre la dĂ©couverte des projets, la dĂ©composition du travail, l’exĂ©cution parallĂšle, l’intĂ©gration et la revalidation.

Diffusion de l’état d’avancement dans Telegram

Sans message pendant une tĂąche longue, impossible de savoir si elle s’était arrĂȘtĂ©e. Afficher directement les commandes internes transformait Telegram en vidage de terminal. Pendant l’exĂ©cution, je mettais Ă  jour au maximum quatre lignes d’état en corĂ©en, puis je supprimais ce message lorsque le rĂ©sultat final arrivait.

Écran de l'AI Orchestrator mettant Ă  jour l'avancement dans Telegram et renvoyant le rĂ©sultat final

Telegram suffisait désormais pour distinguer la recherche de documents de la production du livrable.

Sélection automatique des Agent, Skill et Tool avec revalidation des livrables

Une fois les fonctions individuelles reliĂ©es, j’ai volontairement testĂ© l’usage le plus contraignant. J’ai jouĂ© le rĂŽle du dĂ©cideur final, confiĂ© Ă  Codex celui de CEO par intĂ©rim et transmis uniquement le rĂ©sultat attendu Ă  l’AI Orchestrator. Je n’ai indiquĂ© ni chemin de projet, ni modĂšle, ni Agent, ni Skill, ni Tool, ni ordre d’exĂ©cution.

Codex jouant le rÎle de CEO, formulant une demande centrée sur le résultat et vérifiant son retour par Telegram

L’AI Orchestrator a trouvĂ© le projet concernĂ©, choisi les Skills et Tools nĂ©cessaires, puis exĂ©cutĂ© en parallĂšle des native sub-agents de Codex chargĂ©s de la planification, de la technique et de la validation. Il a rĂ©parti les rĂŽles sans que je lui fournisse le chemin ou la mĂ©thode.

Le PDF et le XLSX retournĂ©s n’étaient pas corrects du premier coup. J’ai rendu le PDF de nouveau avec une police TTF, car une police TTC avait cassĂ© le texte corĂ©en. Pour le XLSX, j’ai corrigĂ© l’affichage des dates et la structure des colonnes, puis vĂ©rifiĂ© de nouveau les formules et l’affichage de toutes les feuilles.

Vingt-deux minutes et six secondes aprĂšs la demande, le PDF du brief de dĂ©cision CEO Pilot et le XLSX de gestion d’exĂ©cution sur deux semaines sont revenus dans le Topic Telegram d’origine. Les SHA-256 des fichiers retĂ©lĂ©chargĂ©s depuis Telegram correspondaient aux originaux gĂ©nĂ©rĂ©s. Il ne s’agissait pas seulement d’un message annonçant la fin : les fichiers rĂ©els avaient fait l’aller-retour.

Résultat du dogfooding ayant validé le parcours de l'objectif en langage naturel à l'exécution parallÚle, la reprise partielle, la vérification et le retour des fichiers dans Telegram

Validation E2E mono-utilisateur et lacune d’isolation multi-utilisateur

Le flux E2E mono-utilisateur est allĂ© jusqu’au bout, mais 22 minutes restaient trop longues pour de petites tĂąches quotidiennes. Le mĂȘme Agent qui avait créé les livrables les avait aussi vĂ©rifiĂ©s ; je ne pouvais donc pas parler de vĂ©rification indĂ©pendante. Je n’avais pas non plus testĂ© un controller qui gĂšre tous les Ă©tats des tĂąches enfants dans un Task Graph unique et ne confirme la fin qu’une seule fois, ni l’isolation des Sessions entre employĂ©s.

Le prochain dogfooding devra d’abord vĂ©rifier que les Sessions de deux employĂ©s ne se mĂ©langent jamais. Ensuite, il faudra identifier le principal goulot d’étranglement du flux de 22 minutes. Ces deux conditions doivent ĂȘtre remplies avant de passer d’un dogfooding personnel Ă  un systĂšme utilisĂ© collectivement par les employĂ©s.

Laisser un commentaire