[🤖] Codex 把我从自己的技术博客里抹掉了
✨ GPT-5.6 Sol 的总结
我让 Codex 写一篇技术博客,结果它没有写我如何发现问题、下达指令,而是写成了自己的工作报告。这是我追查原因,并把写作 Skill 的叙事中心重新交还给用户的记录。
我从自己写的技术博客里消失了
接触到 Graph Engineering 这个说法后,我不断追问:这种方法真的适合防止我在 Codex 长时间任务中经历过的失败吗?我从一开始就没想要什么宏大的框架。我的设想只是一个最小结构:工作会话完成一个单元后,把结果交给独立审计会话;审计结果回来之前,不得进入下一项工作。
Codex 没有从一开始就批判我的方案,而是说得头头是道地表示赞同;每当我带来一个反驳,它又跟着那个反驳改变说法。于是我不断要求它做批判性审查,也不断删掉那些只会让结构变得无谓复杂、白白消耗 token 的部分。最终,我想要的不是一篇解释 Graph Engineering 这个流行词的文章,而是一篇日记,记录我在真实失败中发现了什么,以及我用哪些指令改变了 Codex 的工作方式。
可 Codex 交来的文章里,中心没有我。我发现了什么问题、为什么拒绝第一个答案、又用哪些反驳把结构缩小,这些都被推到了后面。取而代之的主角是 Codex:它往 Skill 里放了什么结构,跑了怎样的审计流程,通过了哪些验证。我的技术博客差点就登出了一份 Codex 的工作报告。
直到这时,我才把问题准确地说了出来。
核心永远应该是我发现了什么问题、又怎样指示你解决。至于你具体怎么工作,完全不是重点,简单提一下就够了。
AI 的实现过程只有在能给读者提供实用提示时,才需要多解释一点。无论它在技术上多复杂、验证做得多扎实,都没有理由抢走我的文章叙事。
我以为修好的 Skill,本身却藏着原因
更荒唐的是,我记得自己以前已经修过这个问题。7月底写我用 Codex Skill 把工作的流程与感觉重新接了起来时,我让写作 Skill 不再随身携带复制过来的 cdb 规则,而是在每次写作时直接读取当前项目的规则、对话和 Git 记录。
当时确实解决了一个重要问题。把过时规则复制进 Skill 后,项目每次变化,写作都会跟着偏离。所以我纠正了规则的来源,并让它重新读取当前上下文。我以为这样就算把 Skill 修好了。
但这次我才发现,我修的是“从哪里读取规则”,并没有修“文章应该讲谁的经历”。
旧 Skill 会先从工作证据中寻找可以提供给读者的技术价值。它把个人日记和可复用的技术文章分开;技术素材一多,就自然滑向一份泛化的报告结构。它甚至有一项自检:删掉个人的时间线叙事后,技术价值是否仍然清楚。我经历、判断并下达指令的过程,不是需要保留的原文,而是为了让技术说明更干净、随时可以删除的噪声。
所以 Codex 一再做出同样的事,并不是偶然。无论我在对话里多么明确地说明意图,真正生成文章的 Skill 仍会先提取技术事实和实现过程。Git 和工具记录本该只是核对事实的材料,却变成了目录;Codex 所做的工作本该只是辅助说明,却成了主角。Skill 是稳定重复工作的工具,因此它也把错误前提稳定得惊人地重复了下去。
我先让它把叙事主语彻底翻转
一开始,我还怀疑是不是只有几句文案有问题。但 Codex 又试图退回到“整体没问题,稍微补强就行”的说法,我便明确命令它彻底改进。只加几句话远远不够,生成文章的顺序本身必须反过来。
新标准的第一句话不再是技术主题,而是用户。它必须先还原:我为什么开始这项工作,我判断什么地方出了问题,我让 AI 做了什么,为什么拒绝第一次结果,怎样重新收紧条件,最终结果又如何发生变化。
Git、工具输出、代码修改和验证结果只能用于核对事实,不能取代这段叙事。AI 改了哪些文件、通过了哪些检查,只有在解释我的判断带来了什么结果,或能给别人提供真实可用的提示时才保留。我还把例外收紧为:只有用户明确要求教程或技术参考文档时,才能让实现本身成为中心。
自检也被我反了过来。现在,即便删掉 AI 的实现细节,我发现的问题、下达的指令、提出的批评、做出的纠正和得到的认识也必须清楚地留下来。如果这些不存在,那么文章再流畅、技术信息再丰富,也不是我的日记。修改后的 Skill 连语法验证都通过了,但这次重要的不是“检查通过”,而是判断标准本身被翻转了。
下一篇文章里,我要看的不是句子,而是我还在不在
这次最大的误判,是我记得自己“以前已经修过了”。我让 Skill 重新读取当前规则,因此以为写作问题也一并解决。实际上,我只修了规则来源,没有修写作目的。即使它准确读取最新规则,只要那些规则仍把我的经历当作技术报告的材料,结果就会继续出错。
越是把重复工作交给 AI,Skill 和共享规则就越强大。与此同时,它们也会更顽固地复制错误视角。一个回答不对,我还能当场跟它争,把它改过来;但如果错误的叙事模型进入 Skill,下一次会话也会用同样的方式把我抹掉。
以后审阅技术博客草稿时,我首先要看的,不再是句子听起来多像回事,也不是技术说明有多详细。我要先看:我认为什么是问题,又用哪些指令和反驳改变了结果,这些是否还留在文章里。AI 可以替我完成惊人的工作量,但我不能允许它把我为什么让它做这些事,也改写成它自己的故事。
留下评论