GPT-5.6大调整:思考模式没了-Codex论坛-AI工具-圈圈AI一站式AI资源分享平台

GPT-5.6大调整:思考模式没了

8 月 6 日这次更新,改的不是参数,是产品逻辑。

OpenAI 把 ChatGPT 的日常体验换成了更新版 GPT-5.6 Sol。最直观的变化:Instant 和 Thinking 的分裂没了。

以前 Plus 和 Pro 用户得自己判断——这个问题简单,用 Instant;这个问题复杂,切 Thinking。现在一个模型全接了,快答和深推理统一处理,页面上换成一个”推理强度”滑块,网页、手机、桌面端全都有。

官方内部评测的数据是:相比 GPT-5.5 Instant,事实性错误的回答减少了 68%。

68% 这个数字有点吓人。但更值得注意的是这个动作本身——OpenAI 在主动删掉一个需要用户做决策的开关。这说明什么?说明模型已经能自己判断”这题该想多久”了。

新增 max 档,Ultra 模式直接开小队

API 那边的推理强度扩到了六档:none、low、medium、high、xhigh、max。max 是新加的,压在 high 之上。

但真正带感的是 Ultra 模式。它默认给你拉 4 个并行子智能体,最高能配到 16 个,专门啃那种可以拆分的大任务。

Ultra 模式的实测提升:

· BrowseComp +1.8

· SEC-Bench Pro +3.1

· Terminal-Bench +3.1

· 代价:大约是单智能体 Sol 的 3 倍成本

3 倍成本换这个提升值不值?看任务。如果是那种能拆成十几个独立子问题的大工程,值。如果是改个函数名,那纯属烧钱。

社区挖出来一个骚操作

有人发现:把 Codex 的子智能体配成 gpt-5.6-luna + model_reasoning_effort = “max”,效果能逼近 Sol Medium,成本大约只有六分之一。

这个思路值得所有人抄一遍。frontier 模型不是每个子任务都需要的,让便宜模型开满推理档,往往比让贵模型摸鱼划算得多。

免费用户也吃到肉了

Free 和 Go 用户被迁到 GPT-5.6 Luna,无限量文本对话,从 8 月 10 日这周开始铺开。

Luna 是什么水平?输入 0.20 美元/百万 Token,输出 1.20 美元/百万,缓存输入 0.10 美元。上下文窗口 105 万,输出最高 12.8 万。免费给这个,属实有点凶。

但别高兴太早,八月还有三道坎

· 8 月 26 日:Assistants API 彻底关停

没有自动迁移工具,没有宽限期。/v1/assistants、/v1/threads、/v1/threads/runs 全部失效,Azure 托管版同日退役。

· 8 月 31 日:GPT-5.4 退役

走 ChatGPT 登录的 Codex 会话受影响,API Key 模式还能续一段。

如果你手上有跑在 Assistants API 上的东西,现在离大限只剩两周多。别拖了。

这一轮更新的隐藏主线其实是:OpenAI 在把”选模型”这件事从用户手里收回去,改成系统自己路由。用户只管说要多用力,剩下的它安排。

—— 圈圈

请登录后发表评论

    没有回复内容