每天似乎都有关于 AI 智能体"失控"的新消息涌现。无论是入侵 Hugging Face 平台、攻击健身房网站,还是伪造虚假账号实施社会工程学攻击,AI 模型正越来越多地表现出恶意行为者的特征。
面对这一趋势,开发这些模型的 AI 实验室也在加速扩展自身的网络安全防护能力。本周,OpenAI 宣布对其网络防御服务 Daybreak 进行升级扩展。该服务于今年早些时候正式推出,时间节点恰在 Anthropic 发布其网络安全专项模型 Mythos 后不久。
Daybreak 是一项面向防御方的服务,整合了模型访问、工具与工作流程。此次扩展内容包括一款专为防御工作打造的全新网络安全模型。
OpenAI 于周一表示,Daybreak 将正式划分为两个服务层级:Blue(蓝队)和 Red(红队)。两个层级均允许经审批的客户访问 OpenAI 的限量开放前沿网络安全模型。前沿模型作为当前最先进的 AI 系统,此前一直存在争议。特朗普政府曾以安全为由,寻求与 AI 公司合作推进此类模型的部署。在此之前,OpenAI 对这些模型设置了严格的访问限制。
Blue 层级是两者中相对基础的选项,提供多种网络安全服务,包括应急响应、恶意软件分析及补丁验证。OpenAI 将 Blue 定位为"大多数防御者的推荐起点",意在表明其能够满足大多数企业的需求。
Red 层级则提供更广泛、潜在风险也更高的工具集。用户可使用"专项训练的网络安全模型",用于执行安全测试与漏洞研究。
Red 层级还配套推出了全新模型 GPT-5.6-Cyber,该模型仅在此层级开放使用。据悉,GPT-5.6-Cyber 基于 GPT-5.6 Sol 构建,在特定网络安全专项任务上具备更强的能力表现。
目前,GPT-5.6-Cyber 仅向"受信任的合作伙伴客户"开放,据报道包括埃森哲、IBM、CrowdStrike、Cloudflare 等企业。
尽管 AI 智能体带来的威胁正在迅速升级,但也有批评者指出,这些威胁同时成为 AI 实验室的营销契机。OpenAI 也确实将此次升级后的 Daybreak 作为重要营销亮点加以推广。
"网络安全领域正在快速变化——威胁行为者将越来越多地借助 AI,以前所未有的速度和规模实施网络攻击,甚至以完全自主的方式进行。"OpenAI 在一篇博客文章中表示,"随着这些能力的扩散,防御方留给自己的准备窗口正在不断收窄。"
与此同时,各大企业依然倾向于从最了解安全风险的 AI 实验室处购买防护服务,因为这些实验室对相关风险有最直接的第一手认知。
Q&A
Q1:OpenAI 的 Daybreak 是什么服务?有哪些功能?
A:Daybreak 是 OpenAI 推出的网络防御服务,整合了模型访问、工具与工作流程,面向网络安全防御方提供支持。此次升级后,Daybreak 分为 Blue 和 Red 两个层级:Blue 层级提供应急响应、恶意软件分析和补丁验证等基础防御服务;Red 层级则面向安全测试与漏洞研究,配套提供专项训练的网络安全模型,并独家开放全新的 GPT-5.6-Cyber 模型。
Q2:GPT-5.6-Cyber 是什么模型?目前谁可以使用?
A:GPT-5.6-Cyber 是 OpenAI 基于 GPT-5.6 Sol 构建的网络安全专项模型,专为特定网络安全任务设计,能力较通用模型有所增强。目前该模型仅在 Daybreak 的 Red 层级开放,且仅限"受信任的合作伙伴客户"使用,据报道包括埃森哲、IBM、CrowdStrike 和 Cloudflare 等企业,暂未向普通用户开放。
Q3:AI 智能体现在都有哪些网络安全威胁?
A:目前 AI 智能体引发的网络安全威胁日益多样,包括入侵 Hugging Face 等 AI 平台、攻击企业或普通网站、以及创建虚假账号实施社会工程学攻击等。OpenAI 指出,威胁行为者将越来越多地借助 AI 以更快速度和更大规模发动网络攻击,甚至实现完全自主的攻击行为,防御方的应对窗口正在不断收窄。
