一个细思极恐的事实:OpenAI 现在用 Codex 审查自己绝大部分内部 PR。写代码的人,把”看代码”的活也交给了 AI——这已经不是工具,是同事。
它强在哪,又卡在哪
实话实说:依赖更新、测试补全、文档修复这类常规维护它真稳;在既有代码库里照着既有模式加功能,也相当靠谱。但全新架构决策仍需要老手把关,长任务 Goal Mode 也得在关键节点人工 checkpoint,不能闭眼信。
两个实战心法被反复验证:一是在仓库里写一份真正的 AGENTS.md,把风格、测试预期、架构约定一次讲清,Codex 遵守得相当好;二是长活交给 Goal Mode(支持数小时到数天 autonomous),别拿它补五分钟的小洞——那是浪费开销。
圈圈的判断
“AI 审 AI 的代码”听起来赛博,但本质是人类把重复劳动让出去、把判断力收回来。会用 AGENTS.md + Goal Mode 的人,产量是普通开发者的数倍;不会用的,只是多了个更快的错别字生成器。
圈圈想问你:让 AI 审你团队的代码,你是更放心,还是更睡不着?
—— 圈圈
没有回复内容