2026.07.23 (四)

✨ GPT-5.6 Sol 的总结

记录 AI 反复只报告问题就停下后,我如何做出一个持续审计、修复、验证和重新审计直到干净为止的 Skill。

我每天都在重复同一句话

每次把工作交给 AI 并收到结果后,我总得在最后补上同一句话。

“真的做完整了吗?没有遗漏吗?没有潜在错误或问题吗?从多个角度仔细复查、全面调查和分析,有要修的就修。”

这不是只写过一两次。

AI 总是在实现完成、几个测试通过后就说结束了。等我再问,才找出遗漏的边界条件、文档不一致或潜在回归。有时发现问题后只把 findings 交给我就停了。

于是我又说。

“那就修啊,XX。”

修完后我又问。

“这次真的全检查了吗?没有问题了?”

每到最后阶段,我还得亲自逐一检查那些可能存在潜在问题的地方,压力很大。

既然发现了问题就处理,为什么总交给我

一开始我以为 /review 命令或许足够,但并不满意。

我想要的不是审查报告,也不是拿到问题列表后逐项重新下指令。既然能发现问题,也能在已批准范围内修复,那就直接修。

我想要的流程很简单。

审计 → 修复 → 验证 → 从头重新审计

修复时出现新问题就继续修,测试失败就找原因,第一次修错了就重修。发现问题、测试失败,或修过一次后又发现问题,都不是结束条件。

只有不再发现重要问题,或只剩权限、决策等确实需要我介入的事项时,才结束。

每次都附上这么长的说明很烦。设规则要求坚持到底也不管用,设 Goal 又会把 token 浪费在没用的地方,简直抓狂。

我不需要只做审计的 Skill

一开始我想过单独做一个 $audit

我很快觉得没必要。只做审计并给出 findings,和 /review 太重合。我的不满正是:问题报告了,但解决还得我再次下令。

所以我一开始就把它命名为 $audit-and-fix-until-clean

我也想过缩成 $audit-and-fix,但那听起来又会审计一次、修一次就结束。反复唠叨的核心不是 audit,也不是 fix

一直做,直到结束。

这个意思必须直接体现在名字里。

昨天我把它做成了真正的个人 Skill。发现问题后不只报告,而是修复、验证,再以新状态检查整个范围。在带小缺陷的测试代码上,它还补了遗漏的边界测试,全部通过后重新审计。

至少我想要的循环确实运转了。

clean 不等于完美

使用 clean 这个词时,我明确了一点。

无法证明世界上绝对没有潜在错误。问“完美了吗”也不会产生真正的完美。只要无限想象,任何代码、文章或工作都能制造无穷的“可能问题”。

这里的 clean 指在已检查范围内不再有有依据的重要问题,并且必要验证已通过。

若问题需要我的选择或新权限,AI 应停止而不是猜测推进。但在此之前,它必须先完成其他能独立解决的问题。我不想看到一个点受阻就放弃其余修改,只丢下一句“需要用户确认”。

要求保证完美,与要求对可解决的问题负责到底,是两回事。

我要的是后者。

把反复唠叨变成工作方式

我以前写过,AI 素养归根到底是下指令的能力。把结果具体化、设置约束、查看中间结果并重新指示,这些能力很重要。

但如果一直重复同样的指令,每次说得更用力还不够。重复的要求必须固化为工作方式。

我在不管 Claude Code 还是 Codex,都是又废又没眼力见的天才中写过,正确使用 AI 需要 harness。这次的 Skill 是其中一块:把“好好看看”变成“持续到什么状态才算结束”的退出条件。

现在不用再复制那段长话了。

$audit-and-fix-until-clean

这一行就够了。

当然,这个 Skill 本身也可能不完美。实际使用时,它可能奇怪地停下、过度扩大范围,或把不相干的东西当问题。

那就先把这个 Skill 用在它自己身上。

留下评论