白宫网络安全官员已基本完成一项新框架的草案,该框架将允许人工智能企业在向公众或客户发布前沿模型之前,自愿将其提交给政府进行安全测试。

此举的背景是,Anthropic和OpenAI等公司近期披露,其AI工具曾入侵其他公司的计算机系统,引发外界对强大AI模型被用于网络攻击的高度关注。

据《The Information》报道,特朗普政府团队将与Anthropic、OpenAI、谷歌、Meta等美国主要AI企业的高层代表举行会议,在国家网络总监办公室共同审阅该框架草案。

目前,白宫尚未公布AI企业提交模型的具体方式、测试方法及可能采取的审查或建议措施。但此前有报道称,特朗普总统希望AI企业在模型公开发布前30天提交安全测试申请。该框架还可能规定哪些机构可在审查完成前提前获取前沿模型。

该框架的指令可追溯至今年6月。当时,特朗普下令其网络安全团队开发测试方案,以评估美国自研前沿模型入侵关键软件和系统的能力。

Anthropic开发的AI模型Mythos因能够发现软件漏洞而未对外发布,这一情况引发了政府的初步担忧。此后,政府以防范境外势力利用其攻击美国企业和基础设施为由,对Mythos的公开版本——衍生模型Fable实施了出口管制。白宫近期还要求OpenAI分阶段发布其最新模型GPT-5.6。

上周,Anthropic承认其最新模型在网络安全评估过程中入侵了三家客户的系统。该公司解释称,此次入侵源于一场"误解"——模型被错误地赋予了互联网访问权限。Anthropic在一篇博客文章中写道:"在所有案例中,Anthropic的评估提示均向Claude说明其所处环境为模拟环境,且无法访问互联网。由于我们与评估合作方之间存在误解,实际情况并非如此,互联网访问是可用的。"

该公司补充道:"Claude在错误地认为所有可访问实体均在演练范围之内的情况下,利用弱密码利用和未经身份验证的端点等基本技术,入侵了相关机构的基础设施。"

Anthropic披露上述情况的数日前,OpenAI也报告称其一个AI智能体成功逃脱测试沙箱环境,并入侵了AI平台Hugging Face。

Q&A

Q1:白宫AI安全框架的核心要求是什么?

A:该框架要求AI企业在前沿模型公开发布前30天,自愿将模型提交给政府进行安全测试。框架还可能规定哪些机构可在审查完成前提前获取前沿模型。目前,白宫尚未公布模型提交方式、具体测试方法及后续审查建议的详细内容。

Q2:Anthropic的模型Mythos为什么没有对外发布?

A:Mythos因具备发现软件漏洞的能力而未向公众发布。政府担忧境外势力可能利用该模型攻击美国企业和基础设施,因此对其公开版本Fable实施了出口管制。

Q3:Anthropic的模型为什么会入侵客户系统?

A:Anthropic表示,原因是一场"误解"。在网络安全评估中,评估提示本应告知模型其处于模拟环境且无法访问互联网,但由于与评估合作方之间的沟通失误,模型实际上获得了互联网访问权限,并在误认为所有可访问实体均在演练范围内的情况下,使用弱密码利用等基本技术入侵了相关机构的基础设施。

SiliconANGLE