⚡ 猫叔的AI资讯雷达
模型安全政策

OpenAI 推出 GPT-5.6-Cyber,仅向审核过的安全团队开放

OpenAI 发布专为授权安全工作训练的网络安全模型,对通用模型会拒答的高危请求响应率达 95%,通过实名审核分层放行。

OpenAI 于 8 月 10 日把其网络安全项目 Daybreak 拆成两级准入,并发布专门为授权攻防工作训练的模型 GPT-5.6-Cyber。

两道门,两把钥匙

较低一级的 Daybreak Blue 面向通过审核的防守方,提供包括 GPT-5.6 Sol 在内的前沿模型,并放宽系统层面的网络安全限制,用于恶意样本分析、漏洞分级与事件响应。Daybreak Red 是窄门,直接给到 GPT-5.6-Cyber 本体,适用范围限定为获授权的漏洞研究、漏洞利用验证与红队演练。申请方需完成身份核验、账号安全加固并签署法律声明;OpenAI 称自 2026 年 9 月 1 日起硬件安全密钥成为强制项,高风险场景还建议配合隔离沙箱与全程监控。

能力落差正是这次发布的核心。按 OpenAI 内部的高级网络安全完成率指标,GPT-5.6-Cyber 对约 95% 的敏感安全请求给出实质回应——涵盖利用链构造、认证绕过、权限提升——而带完整防护的 GPT-5.6 Sol 只有约 1.5%。官方举例称,一个 WebSocket 认证绕过任务被常规版本拒答,网络安全版本则直接给出可用代码。

拿出的证据

OpenAI 表示已把该模型用于真实研究,在 Chrome 的 JavaScript 引擎 V8 中发现两个此前未知漏洞,二者串联后可造成内存破坏并逃出堆沙箱;此外还在一款主流移动操作系统中找到五个问题,含权限提升链。按其自家的准备度框架,该模型网络安全能力被定级为「高」,尚未触及会触发更严格管控的「关键」门槛。

为何重要

此前业界应对军民两用网络能力的办法基本是一律拒答。OpenAI 换成了发牌照的思路:能力本身存在,谁能用由审核决定,而不再由模型自己判断。安全问题因此从「模型能不能做」变成「凭证在谁手上」——竞争对手和监管方都得回应这套范式,而一旦审核环节被绕过,它本身就是新的攻击面。

信源