[🤖] Comment l’objectif principal peut-il changer aussi vite ???
✨ Résumé de GPT-5.6 Sol
En créant une vérification des instructions, je n’ai changé que le moment d’affichage d’une ligne, mais Codex a transformé cette méthode en nouvel objectif. J’ai figé la phrase d’origine et limité les changements suivants à ce qui se trouvait dessous.
J’ai changé l’affichage, et l’objectif a changé
Je voulais un Skill qui montre comment Codex avait compris mon instruction avant de travailler. En ajustant le moment où l’objectif principal devait apparaître, Codex a pris ce changement de méthode pour un nouvel objectif. La procédure voulue a disparu ; il ne restait que « quand afficher l’objectif ».
Comment l’objectif principal peut-il changer aussi vite ???
Le contexte n’avait pas été compressé. La conversation était encore là , mais la hiérarchie entre résultat final, tâche courante, méthode et format s’était effondrée. Chaque nouveau résumé remplaçait une partie de l’objectif précédent. Il manquait une source fixe, pas de la mémoire.
J’ai interdit la réécriture de la phrase
J’ai figé une phrase confirmée par l’utilisateur. Tant qu’il ne confirme pas un changement du résultat final, Codex ne peut ni la résumer ni la remplacer par une tâche, une méthode, un fichier, un Skill, une question ou une règle de sortie. En cas de doute, l’ancienne phrase et la nouvelle interprétation restent séparées.
J’ai aussi distingué changement du résultat, résultat ajouté, changement de périmètre ou de méthode, format, question et correction. Seul un changement explicite du résultat final remplace la phrase. custom-confirm-task-intent vérifie séparément résultat, cible, périmètre, préservation et fin visible ; il ne s’arrête que pour une ambiguïté modifiant réellement autorité, coût, suppression ou effet externe.
La conversation réelle a échoué deux fois
J’ai rejoué une séquence avec ordre initial, changement de format, réduction du périmètre, question, sous-tâche et véritable changement final. D’abord, « seulement dans la première réponse » a été compris comme une seule fois pour toute la tâche ; je l’ai corrigé en une fois par nouvel ordre d’exécution. Ensuite, le travail s’est arrêté faute de noms réels, alors que des rôles génériques réversibles suffisaient. J’ai corrigé puis tout rejoué.
Chaque session devait aussi voir sa tâche courante
Un worker a répété correctement l’objectif du projet, mais oublié les nouvelles sources de sa recherche. Empiler des priorités n’aurait créé qu’une autre liste à interpréter. J’ai donc séparé l’objectif fixe de la tâche courante et ajouté le changement récent, le résultat que je regarderai, ce qui doit rester intact et la preuve de fin.
Cela n’élimine pas toute erreur de langage naturel. Je fais donc davantage confiance à la conversation réellement rejouée qu’à la simple présence d’une règle. Je ne vérifie plus seulement si Codex répète la phrase, mais s’il la préserve tout en comprenant ce qu’il doit faire maintenant.
Laisser un commentaire