OpenAI给安全团队开了两道门-Codex论坛-AI工具-圈圈AI一站式AI资源分享平台

OpenAI给安全团队开了两道门

这条更新藏在 Codex changelog 的最上面,但基本没什么人讨论。我觉得它比模型退役那些事重要得多。

OpenAI 推出了 Daybreak BlueDaybreak Red——两个专门给”获批的安全防御人员”用的访问层级。

蓝队门:日常防御活儿够用了

Daybreak Blue 给的是通用模型访问,比如 GPT-5.6 Sol,能干的事包括:

· 漏洞发现

· 安全代码审查

· 检测规则工程

· 事件响应

· 恶意软件分析

· 补丁验证

官方原话是”大多数防御性安全工作从 Blue 开始就够了”。这句话背后的意思是:以前你想用模型干这些活儿,会被安全策略挡住。

红队门:这才是真正破天荒的

Daybreak Red 要单独审批、单独开通,给的是专门训练过的模型——GPT-5.6 Cyber

授权漏洞复现、漏洞利用验证、渗透测试、红队演练、复杂系统分析。

看明白了吗?这些能力,在任何一个通用模型上都属于被硬拒的红线。现在 OpenAI 专门训了一个模型,专门开了一条通道,把它放出来了。

当然管得极严:得走 Trusted Access for Cyber 审批,而且只对获批的那个身份、那个工作区或 API 组织和项目、那个模型、那个产品界面生效。Blue 的权限不自动给 Red,Red 得单独申请单独发放。

为什么必须这么干?

因为一刀切拒绝,最后惩罚的只有守规矩的人。

攻击方早就在用各种越狱模型、本地模型、无审查模型了。防守方却因为”这个 prompt 涉及漏洞利用”被 API 拒之门外——这就是典型的非对称困境:好人被规则捆住,坏人不受规则约束。

分层授权是唯一解。不是放开,是建立一套”我知道你是谁、你在哪个范围内做什么”的可追溯机制

配套要求也写得很实在

· 在隔离环境里工作

· 明确定义你的作业范围

· 使用最小权限配置文件

· 对可能越过沙箱边界的操作,配好 Auto-review

最后那条特别值得注意。Auto-review 现在跑在 GPT-5.6 Luna 上,成本比原来的 GPT-5.4 便宜了大约 12.5 倍(输入 0.20 vs 2.50 美元/百万 Token)。便宜到你没有理由不开。

AI 安全这件事,正在从”什么都不让做”,转向”你是谁、你被授权做什么、做完能不能查到”。这个转向比任何一次模型升级都更有分量。

国内做安全的团队,也该开始想想自己这套授权与审计机制怎么搭了。

—— 圈圈

请登录后发表评论

    没有回复内容