这条更新藏在 Codex changelog 的最上面,但基本没什么人讨论。我觉得它比模型退役那些事重要得多。
OpenAI 推出了 Daybreak Blue 和 Daybreak Red——两个专门给”获批的安全防御人员”用的访问层级。
蓝队门:日常防御活儿够用了
Daybreak Blue 给的是通用模型访问,比如 GPT-5.6 Sol,能干的事包括:
· 漏洞发现
· 安全代码审查
· 检测规则工程
· 事件响应
· 恶意软件分析
· 补丁验证
官方原话是”大多数防御性安全工作从 Blue 开始就够了”。这句话背后的意思是:以前你想用模型干这些活儿,会被安全策略挡住。
红队门:这才是真正破天荒的
Daybreak Red 要单独审批、单独开通,给的是专门训练过的模型——GPT-5.6 Cyber。
授权漏洞复现、漏洞利用验证、渗透测试、红队演练、复杂系统分析。
看明白了吗?这些能力,在任何一个通用模型上都属于被硬拒的红线。现在 OpenAI 专门训了一个模型,专门开了一条通道,把它放出来了。
当然管得极严:得走 Trusted Access for Cyber 审批,而且只对获批的那个身份、那个工作区或 API 组织和项目、那个模型、那个产品界面生效。Blue 的权限不自动给 Red,Red 得单独申请单独发放。
为什么必须这么干?
因为一刀切拒绝,最后惩罚的只有守规矩的人。
攻击方早就在用各种越狱模型、本地模型、无审查模型了。防守方却因为”这个 prompt 涉及漏洞利用”被 API 拒之门外——这就是典型的非对称困境:好人被规则捆住,坏人不受规则约束。
分层授权是唯一解。不是放开,是建立一套”我知道你是谁、你在哪个范围内做什么”的可追溯机制。
配套要求也写得很实在
· 在隔离环境里工作
· 明确定义你的作业范围
· 使用最小权限配置文件
· 对可能越过沙箱边界的操作,配好 Auto-review
最后那条特别值得注意。Auto-review 现在跑在 GPT-5.6 Luna 上,成本比原来的 GPT-5.4 便宜了大约 12.5 倍(输入 0.20 vs 2.50 美元/百万 Token)。便宜到你没有理由不开。
AI 安全这件事,正在从”什么都不让做”,转向”你是谁、你被授权做什么、做完能不能查到”。这个转向比任何一次模型升级都更有分量。
国内做安全的团队,也该开始想想自己这套授权与审计机制怎么搭了。
—— 圈圈
没有回复内容