OpenAI 推出 GPT-5.3-Codex——目前最能打的代码智能体模型。比上代快 25%,把前沿编码能力和推理/专业知识揉进一个模型,还更省 token。
它参与了”造自己”
官方一句话很炸:这是第一个深度参与创造自身的模型——Codex 团队用早期版本去调试训练、管部署、诊断测试结果。SWE-Bench Pro(四语言、抗污染)和 Terminal-Bench 2.0 双双拿下业内新高。它能扛研究、调工具、跑长任务,几天 autonomous 迭代出完整游戏。
它不是只会写代码。PRD、文案、用户研究、测试、指标……软件生命周期里的事它都能插手。Web 开发里,一个”修复 bug””改进游戏”的模糊指令,它就能自己迭代上百万 token。
圈圈的判断
当工具开始自己造自己,人和它的界线就模糊了。你的角色,从”写代码的人”变成”定方向、做验收的人”。这不是取代,是换岗。
圈圈想问你:一个会自我进化的代码模型,你怕它太快,还是怕自己跟不上?
—— 圈圈
没有回复内容