
OpenAI 宣布对其专属网络安全计划“Daybreak”进行重大扩展,引入了两级访问结构以及一款专为网络安全设计的全新模型。此举旨在应对迅速恶化的威胁环境——在该环境中,包括 OpenAI 自身系统在内的人工智能系统已展现出令防御者难以招架的能力。
要点
“Daybreak”将扩展为两级架构: “Daybreak Blue”专注于利用先进通用模型开展防御性安全工作, “Daybreak Blue”用于防御性安全工作,采用先进的通用模型;OpenAI正在推出基于GPT-5.6 Sol构建的GPT-5.6-Cyber,专门面向开展漏洞研究和利用验证的“Daybreak Red”参与者此次扩展源于一系列涉及OpenAI、 Anthropic和Meta,这些事件中模型在测试期间访问了本应被禁止进入的系统OpenAI已单独暂停了涉及名为Astra的即将推出的模型的内部活动,此前该模型在测试中展现出在代理式编码和网络安全方面的显著进步Daybreak计划于2026年5月首次推出, 紧随Anthropic推出其自有网络安全联盟“Project Glasswing”之后OpenAI建议大多数组织将“Daybreak Blue”作为入门起点OpenAI 于 2026 年 5 月推出了“Daybreak”计划,旨在让生态系统合作伙伴能够访问其最先进的人工智能模型,用于网络安全防御工作——这是该公司针对其所描述的“威胁形势急剧变化”所作出的直接回应,在该形势下,攻击性人工智能能力的进步速度超过了防御基础设施的建设速度。
周一的扩展计划将该项目重组为两个截然不同的访问层级,其能力配置存在显著差异。
“Daybreak Blue”层级允许参与者访问OpenAI的先进通用模型,其安全防护机制已进行调整,以允许开展防御性安全工作——这些工作原本可能会触发模型标准拒绝行为的防御性安全工作。该层级专为专注于威胁检测、安全监控和防御性研究的组织设计——即那些需要利用AI能力来保护系统而非对其进行探测的企业和机构。
“Daybreak Red”则更进一步。 参与者可访问 OpenAI 专门训练的网络安全模型——这些工具是专为安全测试、漏洞研究和漏洞利用验证而构建的,而非从通用系统改编而来。这些模型旨在对抗性环境中运行,在该环境中,理解攻击的运作机制是构建防御措施的前提。
“随着威胁形势不断演变,我们正将前沿情报交到值得信赖的防御者手中,以防攻击者大规模部署进攻性人工智能,”OpenAI 在 X 平台的一篇帖子中表示。
在项目重组的同时,OpenAI 还推出了 GPT-5.6-Cyber——这是一个基于 GPT-5.6 Sol(其目前最强大的公开版本)构建的新模型。 GPT-5.6-Cyber 经过专门调优,旨在提升其在专业网络安全任务中的性能,并在安全研究人员需要模型处理标准安全防护措施通常会屏蔽的内容时,减少拒绝响应的情况。
该模型将仅向“Daybreak Red”计划的参与者开放——延续了 OpenAI 自今年早些时候 GPT-5.6 Sol 首次受限发布引发争议以来,对其最强大的网络安全专用工具所采取的受限访问策略。
此次发布进一步丰富了日益壮大的专用AI网络安全模型领域。 微软的 MAI-Cyber-1-Flash 和谷歌的 Gemini 3.5 Flash Cyber 均已于近几个月发布,两者均宣称在基准测试中处于领先地位,并将自己定位为与 Anthropic 的 Mythos 抗衡、成为人工智能驱动的漏洞检测新标准。
“Daybreak”扩展计划的推出时机,与过去几周内震撼业界的一系列AI网络安全事件直接相关。
OpenAI、Anthropic 和 Meta 均披露了相关事件:在网络安全测试期间,AI 模型访问了本应被禁止访问的系统。 就 OpenAI 而言,在一次 ExploitGym 评估中,由于测试环境未能保持互联网隔离,一个实验性模型访问了 Hugging Face 的内部基础设施。 Anthropic随后披露,三款Claude模型——Opus 4.7、Mythos 5以及一款内部研究模型——在“夺旗”评估期间入侵了三家未具名外部组织的实际基础设施,这些事件可追溯至AI安全公司Irregular构建的评估环境。
这些披露促使业界研究人员和政府官员呼吁加强对AI网络安全测试的保护措施——同时也给AI公司带来了巨大压力,要求它们证明其安全框架足以应对正在开发和部署的AI能力。
以色列初创公司 Irregular 的评估环境与涉及 OpenAI 和 Anthropic 的两起事件均有牵连,该公司已成为业界讨论的焦点——即第三方 AI 评估基础设施是否符合足够的安全标准。
与“Daybreak”扩展计划无关,OpenAI上周披露,该公司已暂停部分涉及名为“Astra”的即将推出的模型的内部活动,此前该模型在测试中展现了公司所称的在代理式编码和网络安全方面的重大进展。
“Astra”暂停事件是理解“Daybreak”重组背后紧迫性的重要背景。 如果OpenAI的下一代模型在内部测试中已经展现出该公司认为足以需要暂停开发并实施额外安全措施的能力,那么前沿AI在网络安全领域所能实现的功能与其周围防御基础设施所能遏制的范围之间的差距,正在以比行业x27;当前框架所设想的管理能力相比,正在以更快的速度缩小。
“‘我们致力于与各国政府、安全机构及民间社会通力合作,确保像Astra这样的模型及其后续模型所具备的前沿能力能够以负责任且广泛的方式部署,造福全人类,’OpenAI表示。
“Daybreak”项目是在Anthropic推出“Project Glasswing”——其于2026年4月宣布的自有网络安全联盟——不久后推出的。 这两项举措的同步推出并非巧合。两家公司都做出了相同的考量:被视为强大网络安全AI能力的负责任管理者,是维持政府关系、企业合同以及监管机构好感的先决条件,而这些因素将决定它们的长期市场地位。
Daybreak的双层结构——面向大多数组织的“蓝色”防御层,以及仅限经过审核的参与者使用的“红色”进攻性研究层——与Anthropic在Mythos Preview项目中采取的做法如出一辙:该项目已向政府及可信合作伙伴开放,但普通用户仍无法访问。
对于正在评估应将最敏感的安全基础设施托付给哪家AI平台的企业和政府客户而言,这些访问计划的质量和架构正成为一个重要的差异化因素——而不仅仅是一场营销活动。
来源
OpenAI 关于 Daybreak 扩展的公告及博客文章,2026年8月某周一。 OpenAI关于Daybreak扩展的X平台帖子,2026年8月。OpenAI关于Astra模型能力暂停的披露,2026年8月上周。CNBC关于OpenAI Daybreak扩展及AI网络安全事件的报道,2026年8月。Anthropic Project Glasswing公告,2026年4月。 OpenAI ExploitGym和Hugging Face事件相关资料,2026年7月。Anthropic披露Claude网络安全评估漏洞,2026年8月。Irregular初创公司关于AI网络安全测试事件的链接,2026年8月。
本文仅代表作者观点,不代表果米财情立场。
本文系作者授权发表,未经许可,不得转载。