2026.08.12 (三)
2026.08.14 (五) 更新

✨ GPT-5.6 Sol 的总结

看到 AI 随着我的每次反驳轻易改口后,我做了一个只用一名 fresh critic、同时怀疑首个答案与批评的 Skill。

“拜托,请批评一下”

一项运行了16小时的 UI 工作最终成了一堆垃圾,我追问 Codex 为什么会搞成这样。未经验证的中间结果一路扩散到后续任务的问题,我另行处理了。但就在解释失败原因的对话里,另一件怪事不断重演。

我提出替代方案,AI 马上说对;我再提出反驳,它又说反驳对。每次都讲得像模像样,结论却总倒向我最后一句话。连它对失败原因的解释也不能直接相信。

于是我把一个会话的答案交给另一个会话批评,再把批评带回原会话让它反驳。另一边确实会抓到遗漏的前提与运营成本。可一贴上批评,AI 还是太容易说“这个指正是对的”。

最后,我只能直说:

拜托,请批评一下。

我不要两个 AI 客气地达成共识。我要最初的答案和后来的批评都被怀疑,直到证据做出判断。多个 Agent 说同一句话不等于正确,叫 critic 也不会自动变准。

把复制粘贴式审查缩成一名 fresh critic

一开始我想过三名 critic、多轮辩论,甚至考虑订阅 Claude Code,让它和 Codex 对打。AI 随即拿出了 Coordinator、Worker、Auditor 与额外状态。16小时的 Goal 正是因为失控才失败,再造一个巨型 orchestration 来防止它,怎么看都不对。

我需要的东西很小。主会话把当前结论交给一名 fresh critic。critic 寻找反例与隐藏前提。主会话对重要指正只能三选一:接受、用证据反驳、保留为未解决。修改后的答案只交回同一名 critic 一次;首轮没有重大问题,就不硬凑第二轮。

我把它做成了名为 Custom - Deliberate 的公共 Skill。审查只读,不自动采纳 critic 的答案,最终回答还要公开被驳回的意见与剩余不确定性。它只是把我在 GPT 和 Codex 之间复制原文、答案与反驳的工作缩短了。

Skill 做好后,我立即让它审查自己的流程。不传递旧对话,并不会产生完全独立的 critic。它仍共享相同模型和上层规则,主会话给错材料,它也会一起错。因此它只处理足以改变结论的反对意见;证据不足时承认不足,不强行制造一致。

首个答案和批评,我都不自动相信

这个 Skill 不保证真相。要打破同一模型家族共享的偏见,换一个模型也许更好;偏好与价值判断最终仍由我负责。

不过,在再增加一份15万韩元的订阅前,我先从这里开始。不立刻确定第一个结论,先让一名 fresh critic 尝试把它打破,并记录我接受了什么、为何反驳什么、还有什么没解决。

我以前写过,无论 Claude Code 还是 Codex,最终都需要 harness。这次我把它用在判断本身。让 AI 把工作做完很重要,阻止它盲目附和我、过早锁死结论也同样重要。

分类: ,

更新时间:

留下评论