「为什么我的 Codex 没推特上那么神」:从一句配置自伤,到让两个 AI 分工审我的代码
X 上人人都夸 Codex 强,我自己用却总觉得它畏手畏脚、动不动停下来问我。这篇复盘一次完整的排查:先发现「Codex 过度请示」根本不是模型能力问题,而是我自己在 AGENTS.md 里写的一句规则把它教停了(这个结论后来在 OpenAI 官方 prompting guide 里得到印证);再顺着「codex exec 是一次性的吗」摸到会话续接;最后换了个思路——不再让一个 AI 埋头干到底,而是把 Codex 通过 MCP 接进 Claude Code,定下「Claude 实现、Codex 只做去相关对抗式审查」的分工,解决版本漂移、上下文污染两个工程坑,并拉通一次真实的「实现 → 自审 → 隔离审查 → 对账」。全程用中性示例,不需要你了解任何具体项目。